AREX Feed Article
OpenAI 为 GPT-6 改进 API 提示缓存:输入 token 最高享 90% 折扣,实测称 Sol 耗 token 减半、耗时降至五分之一
在官宣 GPT-6 Sol 与 GPT-6 Luna 约三小时后,OpenAI 开发者官方账号 于北京时间 9 月 23 日 5:13(UTC 9 月 22 日 21:13)宣布为 GPT-6 改进 API 提示缓存:默认缓存命中率更高,更多输入 token 可按最高 90% 的缓存输入折扣计费,官方称此举让 agent(智能体)运行得更快、更省。11 分钟后,任职于 Arena、X 资料标注为「AI Capability @arena」的 贴出一份独立效率实测:同等任务下,GPT-6 Sol 只消耗约一半的 token,耗时约为 GPT-5.6 Sol 的五分之一。
Sol 与 Luna 是 OpenAI 于 UTC 9 月 22 日 18:12 官宣的 GPT-6 世代新模型:官方称二者建立在 GPT-6 Astra 的技术积累之上,API 价格较 GPT-5.6 促销定价低 50%,当日上线 ChatGPT Work、Codex(面向 Plus、Pro、Business、Enterprise、Edu 用户)与 API,Luna 另向 Free 与 Go 用户开放桌面应用试用()。
改动本身:折扣上限早已写在价格表里,变量是默认命中率
正文只有两句:「我们已为 GPT-6 改进 API 中的提示缓存,帮助 agent 更快、成本更低。默认更高的缓存命中率,意味着更多输入 token 能享受最高 90% 的缓存输入折扣。」帖文没有附任何命中率数据,也没有给出提升幅度的量化口径。
折扣的上限可以从当天的价格表反推。与模型发布同日,为 Microsoft Foundry 上的 GPT-6 系列列出了缓存输入价:GPT-6 Sol 全球标准短上下文每百万 token 输入 2.00 美元、缓存输入 0.20 美元;GPT-6 Luna 为 0.10 美元对 0.01 美元——缓存输入价恰为输入价的一成,即 90% 折扣。上限不变,默认命中率越高,按折扣价计费的输入 token 就越多;新命中率的具体数值,OpenAI 没有公布。
Gostev 的对照测试:单人数据,细节未公开
UTC 21:24,给出对照结果:「GPT-6 Sol 最好的地方是效率。在我的测试里,GPT-5.6-Sol 和 GPT-6-Sol 的差别是:新版本完成同样的任务只消耗 1/2 的 token、只需要 1/5 的时间。叠加 50% 的降价,它会是一款相当称手的日常主力模型。」
这份对照出自单人测试:帖文没有公开任务的类型、样本量或测量方法,结果无法复算,也不成系统基准。它能支持的结论是方向性的——同等任务下,新版的 token 消耗与耗时同时下降;至于这个幅度是否普遍成立,目前只有这一份样本。
降价的账本:官方把让利来源记在缓存与推理效率上
缓存是发布日降价归因的两项来源之一。OpenAI 在里写明:「我们还让缓存与推理更高效,并把节省直接让利给你:Sol 与 Luna 的 API 价格较 GPT-5.6 促销定价低 50%。」记录了同一归因:6 系模型 API 价格为 5.6 系的一半,降价被 OpenAI 归功于缓存与推理两端的改进。
第三方核价当天已经到位。模型聚合平台 OpenRouter 在官宣 11 分钟后(UTC 18:23)两款模型上线,定价与官方口径一致:Sol 每百万 token 输入 2 美元、输出 10 美元,Luna 输入 0.10 美元、输出 0.50 美元,均为各自 GPT-5.6 前代的一半;OpenRouter 并称两款模型在 AutomationBench 上以更低的单任务成本超过各自前代的最佳成绩——平台自测数据。公告帖所附的 AutomationBench 图表同样把 GPT-6 Sol 与 Luna 的「得分-单任务成本」曲线画在各自前代上方。
CEO 表态延续同一口径。称 GPT-6 Sol 与 Luna 相较 5.6 系在智能、对齐、工作产出、编程、计算机使用等方面「大幅提升」,且「每 token 便宜一半,每任务成本更低」——这是宣传性声明,未附独立数据。
独立基准读法:智能持平、成本减半,命中率仍无数字
发布日稍晚,独立评测机构 Artificial Analysis 给出最早的第三方基准解读之一(UTC 22:38):在其智能指数上,GPT-6 Sol 与 Luna 的得分与各自前代相近,成本减半;明确把已测得的成本改善归因于「token 降价约 50%」本身,并称两款模型延续的是 OpenAI 的成本效率前沿,而非智能跃升。上方转载的 与这一读法一致:GPT-6 Sol 曲线整体位于 GPT-5.6 Sol 左侧,达到相近得分所需的单任务成本更低。
截至发稿,这场发布仍有三个数字没有着落:缓存改动把默认命中率提升了多少,OpenAI 未公布;Gostev 的对照出自单人实测,任务细节未公开;OpenAI 所称 GPT-6 Sol 在内部事实性评测中出错数约为前代一半(经 TechCrunch 转述),仍属公司口径,没有第三方验证。提示缓存改动与降价口径不同,是官方宣布已完成的平台动作;对跑 agent 的开发者来说,它接下来的效果就取决于命中率——而这正是公告里没有给出的数字。