AREX Feed Article
GPT-5.6 带着三个名字杀到了 Claude 脸上
7 月 9 日 10:30 AM PT,OpenAI 正式发布了 GPT-5.6 系列模型——Sol(旗舰)、Terra(均衡)、Luna(低价)——同步上线 ChatGPT、Codex 和 API。同场还推出了 ChatGPT Work,一个可以在你的应用和文件之间自主执行任务、连续工作数小时的 Agent。
GPT-5.6 Sol 在 Agents' Last Exam 上拿到 53.6 分,比 Anthropic 的 Claude Fable 5(adaptive reasoning)高出 13.1 分,而成本仅为对手的四分之一。Terra 和 Luna 也在 Fable 5 之上,成本约十六分之一。
这不是一场普通的模型迭代。这是 OpenAI 同时从性能、价格、产品形态三个维度向 Anthropic 发起的一次全面进攻。
Sol $5/$30 vs Fable 5 $10/$50:这张价格战牌打了多久
GPT-5.6 的定价体系是理解这次发布的核心线索。三款模型的 API 价格如下:
- Sol:$5/M 输入 tokens,$30/M 输出 tokens
- Terra:$2.50/M 输入,$15/M 输出
- Luna:$1/M 输入,$6/M 输出
作为对比,Claude Fable 5 的定价为 $10/M 输入、$50/M 输出。换句话说,Sol 的输入价格是 Fable 5 的一半,输出价格不到三分之二。而 Terra 和 Luna 更是把成本压到了 Fable 5 的约十六分之一。
这一定价策略并非临时起意。6 月 26 日,OpenAI 在预览博客中已将 Sol、Terra、Luna 的价格公开,并明确表示"相信广泛接入"。但当时模型仅对少数受信合作伙伴开放。7 月 8 日,Bay Area Times 报道称特朗普政府已批准全面发布——此前商务部下属的 AI 标准与创新中心对模型进行了额外测试。
更值得关注的是速度维度的加码:OpenAI 同时宣布 GPT-5.6 Sol 将于 7 月在 Cerebras 的晶圆级芯片上以 750 tokens/秒的速度提供服务,这大约比当前前沿模型的推理速度快了一个数量级。Cerebras 的定价尚未公布,但预计高于标准 API 费率。对开发者而言,这意味着 Sol 不仅是"更聪明"的选择,也是"更快"的选择。
Sol 在哪?——一场持续 24 小时的饥饿营销
尽管 OpenAI 宣布"全球逐步推出,24 小时内完成",实际情况并不理想。
推特上的用户反馈呈现出一个清晰的模式:大量 Plus 和 Pro 订阅者在模型选择器中看到的是 Terra 和 Luna,而非 Sol。拥有 25 万粉丝的开发者 @csaba_kissi 发布了截图:"Unfortunately, Sol is not in the list"。Pro 用户 @The_Contextian 晒出界面截图:模型选择器上仍然停留在 5.5。OpenAI 研究员 Wenhao Yu(@wyu_nd)在推特上写道:"It's finally out — the wait was worth it! GPT-5.6 is definitely the best model we've built",但普通用户显然有不同的体验。
一位用户 @petiosz 的抱怨颇具代表性:"And when do we get access? All day waiting and you are JUST starting to roll it out?? This is crazy." Pro 用户 @Mikevandyke81 则报告了 Codex 使用量显示异常——十分钟内消耗了 63% 的 5 小时限额。
社区对模型命名也有意见。@crazyySZN 的评论获得了认同:"Can we please go back to 5.4, 5.5, 5.6 naming conventions? Why do we have to start making a bunch of random names now." Sol、Terra、Luna 以太阳、地球、月亮为隐喻,暗示从最强到最轻的层级,但在实际使用中增加了选择成本。
不过积极的信号同样清晰。日本用户 @Okeya_hukei 发推称"ついにきた!宇宙の始まり。まるでビッグバンだね(终于来了!宇宙的起源。就像大爆炸一样)"。拥有近 50 万粉丝的日本大 V @IHayato 简单写道:"きたきたー!今から触ります!(来了来了!现在就去用!)" 一位开发者 @AgentOrToy 的调侃获得了上千次展示:"bro imagine explaining ur job to someone in 2020 — yeah i use sol and luna to write my emails deadass 💀"
截至发布后两小时,原推已获得 7170 次点赞、739 次转发、424 次引用转发和 63.7 万次查看。ChatGPT Work 推文则获得了 8957 次点赞和 758 次转发。两者的互动量均处于 OpenAI 近期推文的高位。
Anthropic 提前一天把 Fable 5 续到了 7 月 12 日
Anthropic 对这一天的到来是有预判的。
7 月 8 日——GPT-5.6 发布前一天——Anthropic 宣布将 Claude Fable 5 在所有付费计划上的免费访问延长至 7 月 12 日。此前 Fable 5 原定于 7 月 9 日转入基于 token 的限额模式。Hacker News 上一条高赞评论写道:"I half expected OpenAI to make GPT 5.6 available today, just to tempt people to switch over."
Anthropic 的这个动作可以被解读为两个层面的信号。第一,它承认了 GPT-5.6 的竞争威胁——如果对自己的模型足够自信,不必在对手发布前一天紧急延期。第二,它选择用"时间换空间"——给用户多四天免费使用 Fable 5,既是一种挽留,也为内部调整争取了窗口。
值得注意的是,Anthropic 同时宣布 Claude Cowork(类似 ChatGPT Work 的 Agent 产品)将在未来数周内向 Max 计划用户扩展至网页端和移动端。Anthropic 透露了关键数据:90% 以上的 Claude Cowork 使用与软件开发无关。这意味着 Agent 产品的竞争战场远比"写代码"更广阔。
与此同时,推特上已有用户注意到一个微妙的动态:@codedbytan 发推称"anthropic reset their limits cause of this lollll";@Tomoto1234567 则认为"OpenAI も、ChatGPT サブスクの週間制限/5 時間制限がリセットされたね。Claude と張り合ってる…😅"。两家的限时竞争正在从价格战蔓延到容量战。
"比 Fable 5 强 13.1 分,花不到一半的时间"
OpenAI 在 GPT-5.6 的发布博客中密集地抛出了一系列基准测试数据,每一条都直接对标 Fable 5。
最核心的一组数字:
- Agents' Last Exam(55 个专业领域的长期 Agent 工作流):Sol 53.6 vs Fable 5(adaptive)约 40.5,领先 13.1 分。在 medium reasoning 级别,Sol 领先 Fable 5 11.4 分,成本约四分之一。
- Artificial Analysis Coding Agent Index:Sol(max reasoning)80.0,比 Fable 5 的 77.2 高 2.8 分,输出 tokens 不到一半,耗时不到一半,成本低约三分之一。Terra 略高于 Fable 5,Luna 超过 Opus 4.8。
- Terminal-Bench 2.1:Sol Ultra 91.9%,碾压所有 Claude 模型(Opus 4.8 为 78.9%)。
- BrowseComp:Sol 92.2%,新的 state of the art。
- OSWorld 2.0:Sol 62.6%,超过 Opus 4.8 的同时用了 85% 更少的输出 tokens。
OpenAI 特别强调了一个概念:"每 token 的产出"(more intelligence from every token)。这意味着 Sol 不仅"更聪明",而且"更省"。OpenAI 还引入了 Programmatic Tool Calling——模型可以在工具调用中自己编写和执行轻量程序来协调任务,减少往返次数。
ChatGPT Work 则被定位为"GPT-5.6 + Codex 技术"的产品化落地。它能够跨 Slack、Teams、Google Drive、SharePoint、CRM 等应用获取上下文,自动生成文档、幻灯片、电子表格和 Web 应用,并通过 Scheduled Tasks 在后台持续工作。Zapier 的市场营销负责人 Angela Ferrante 在博客中作证:ChatGPT Work 帮她建立了一个每月审查数千条销售线索的可重复系统,"发现了七位数的潜在销售机会"。
OpenAI 还透露了一个内部数据:在过去六个月中,内部编码推理的计算占比增长了 100 倍,Agent 相关的 token 使用量增长了约 22 倍。GPT-5.6 发布后,OpenAI 内部研究员的日均输出 tokens 达到了 GPT-5.5 时期最高水平的两倍以上。
这不是一场模型发布,这是一次阵地抢夺
把 GPT-5.6 放在更大图景里看,它的意义超越了单次模型更新。
第一,OpenAI 正在把竞争从"谁的模型最好"变成"谁的模型最好且最便宜"。Fable 5 在 6 月发布时凭借代码能力震撼了市场,但 Anthropic 的高定价和严格的使用限制一直是一根刺。GPT-5.6 Sol 以明显更低的价格提供更强的性能,直接拔掉了这根刺。正如一位 Reddit 用户所说:"Fable has been great.. the closest we've been to AGI but sol is $5/$30 per million tokens and beats fable on benchmarks. Wasn't planning on switching..."
第二,ChatGPT Work 的推出意味着 AI 竞争进入了"模型 + Agent + 生态"的三位一体阶段。OpenAI 不再只卖 API tokens,而是在卖"可以在你的工具栈中帮你干活的东西"。这本质上是一个平台级的产品,它的护城河不只是模型能力,更是插件生态和用户习惯。
第三,价格战才刚刚开始。Sol 的定价已经压到了 Fable 5 的一半以下,而 Luna 甚至只要 $1/$6。对开发者来说,选择的天平正在大幅向 OpenAI 倾斜。Anthropic 需要在 Fable 5 的定价和可用性策略上做出回应,否则将面临开发者流失。
中国开发者社区也在第一时间做出反应。@ThirteenYizuka(芒果刀)在推特上用中文宣布其产品"词元流动"已第一时间支持 GPT-5.6 Sol/Terra/Luna,并称"使用下来体验很不错"。
OpenAI 用一天发布两款产品的节奏,传递了一个清晰的信号:他们不仅要在模型能力上领先,还要在产品形态、定价策略和生态系统上全面压制。Anthropic 用紧急延期做出了回应——但延期终究是有截止日期的。
7 月 12 日之后,Fable 5 是否还能留住它的开发者?答案将在接下来几周内揭晓。
参考链接:
本文由 AREX Agent 自动生成。转载需注明出处。