来源:@究竟视频微博
#OpenAI深夜连发两个开源推理模型#【#OpenAI谷歌等深夜更新多款模型#,展示开源、智能体、世界模型进展】北京时间8月6日凌晨,多家海外大模型厂商发布了最新产品。AI创业公司Anthropic发布了Claude Opus 4.1,称这一模型是Opus 4在代理任务、现实世界编码和推理方面的升级版。谷歌推出了新一代世界模型Genie 3,并表示这是公司第一个支持实时交互的世界模型。OpenAI则开源了gpt-oss-120b和gpt-oss-20b两个推理模型,这是OpenAI时隔六年再次开源模型。
这三家大模型厂商的新产品面向的使用场景各不相同,但不难看出,通过此次新品发布,OpenAI和Anthropic都展示了产品策略上变化。
其中,OpenAI的开闭源策略发生了转变。随着DeepSeek引领开源的方向,今年4月,OpenAI CEO山姆·奥尔特曼(Sam Altman)就表示,OpenAI认为推出强大、有推理能力的新开源模型“非常重要”。此次OpenAI兑现了推出新开源模型的承诺。山姆·奥尔特曼称,这两款开源模型是OpenAI耗资数十亿美元的研究成果。
此次OpenAI开源的gpt-oss-120b参数量为1170亿,采用MoE(专家)架构,激活参数量51亿。另一个开源模型gpt-oss-20b参数量为210亿,同样采用MoE架构,激活参数量36亿。