AREX Feed Article
Sam Altman 低头认错的那一天:Kimi K3 开源、前 CTO 亮剑、OpenAI CEO 承诺"最好的一年"
"we did not have our best last 12 months ever, which is mostly my fault."
美东时间 2026 年 7 月 16 日下午 2:06,Sam Altman 在 X 平台发了一条推文。过去 12 个月不是 OpenAI 最好的 12 个月,他说,"这主要是我的错"——但随即话锋一转:接下来的 12 个月,将是 OpenAI 有史以来最好的 12 个月。
这条推文在 24 小时内收获了超过 15,600 个赞、1,400 多条回复和 950,000 次浏览。但真正让它值得被写成一篇报道的,不是数据,而是时间——就在 Altman 发推的同一天,中国 AI 公司 Moonshot AI 发布了 Kimi K3,一个 2.8 万亿参数的开源模型,在多项基准测试中与 OpenAI 的旗舰模型 GPT-5.6 Sol 打得难分难解。前一天,OpenAI 前 CTO Mira Murati 的创业公司 Thinking Machines 发布了 Inkling,一个 9750 亿参数的开源权重模型。
Altman 的低姿态与竞争对手的高歌猛进在同一天相遇——这不是巧合,而是一场精心编排的叙事转折。
"Mostly my fault":Sam Altman 为什么选择在这个下午认错?
Altman 很少公开承认失败。作为 OpenAI 的 CEO,他的公共形象一直是技术乐观主义的化身——"AI 将解决一切"的布道者。但在这条推文里,他选择了一个在科技 CEO 中极为罕见的姿态:认错。
"mostly my fault"——这五个词可能是 Altman 职业生涯中最坦诚的公开表态。他没有把过去 12 个月的困难归咎于供应链、监管环境或竞争对手的恶意,而是指向了自己。
过去一年 OpenAI 经历了什么?回顾几个关键节点:2025 年 10 月,公司完成新一轮融资,估值达到 5000 亿美元,但与此同时,用户对产品方向的不满正在发酵。GPT-4o——那个曾经让 ChatGPT 成为全球现象的模型——在 2025 年底至 2026 年初被逐步边缘化,取而代之的是 GPT-5 系列。这一决定在用户社区引发了持续数月的抗议运动,以 #keep4o 和 #OpenSource4o 为旗帜,数千名忠实用户每天在 Altman 的推文下刷屏要求恢复 4o。
更棘手的是法律层面的麻烦。2026 年,OpenAI 同时面临来自 Elon Musk 和 Apple 的诉讼——前者指控 OpenAI 背离了非营利的创始使命,后者则围绕 OpenAI 进军硬件领域引发了知识产权纠纷。
Altman 的推文下面,一位用户 @RiskBiscuit_ 尖锐地问:"被 Elon Musk 和 Apple 起诉诈骗不是你的最佳表现?"OpenAI 自己的员工 Andrew Ambrosino(Codex & Chat 团队成员)则用自嘲来缓解气氛:"大概是我的错,我大约 12 个月前加入的。"这条回复获得了 858 个赞,说明了内部和外部的情绪分裂。
但认错不是目的,而是手段。Altman 把"认错"当作一个叙事弧线的起点:先承认低谷,再预告反弹。这步棋的高明之处在于——它让对手的胜利叙事变成了自己故事的一个章节。
"我们即将迎来最好的 12 个月":OpenAI 正在憋什么大招?
Altman 说"团队正在做令人惊叹的工作",并且暗示用户"会对他们正在准备的东西非常满意"。这不是空话。
就在推文发布前一周——7 月 9 日——OpenAI 刚刚完成了可能是公司历史上最大规模的产品发布:GPT-5.6 系列。三个变体——Sol(旗舰)、Terra(均衡)和 Luna(快速廉价)——同时上线,覆盖从顶级推理到高吞吐量 API 调用的全场景。一位用户 @sa_vatsa 在 Altman 推文下列出了一份惊人的清单:过去 7 天 OpenAI 发布了 GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna、ChatGPT Work、Codex Micro、GPT-Live、Reasoning Controls 和 Desktop Super App。"可能是 AI 历史上最好的 7 天,"他写道。
GPT-5.6 Sol 在多项基准测试中刷新了记录。在 Terminal-Bench 2.1(测试命令行工作流的智能体能力)上,它达到了新的 SOTA。在 GeneBench v1(长周期基因组学分析)上,它在使用更少 token 的情况下超越了 GPT-5.5。在 ExploitBench² 上,它以 Mythos Preview 约三分之一的输出 token 实现了竞争力相当的性能。
但这些发布有一个背景音:它们来得太密集了。密集到让人觉得 OpenAI 不是在正常迭代,而是在感受到某种压力后加速冲刺。这种压力,就来自同一天发生的另外两件事。
"Freedom, agency, and wealth":从恐惧驱动到赋能叙事
Altman 推文中最值得关注的一句话出现在第二段:
"AI has to be about giving lots of people more freedom, agency, and wealth."
这是一个明确的叙事转向。过去两年,OpenAI——以及整个 AI 行业——在公众沟通中大量使用了"AI 风险"和"安全对齐"的话语框架。Sam Altman 本人多次在国会听证会上警告 AI 可能带来的灾难性风险。2025 年的 GPT-5.1 和 5.5 系列引入了层层安全过滤器和内容限制,被用户批评为"过度审查"和"家长式管控"。
但现在 Altman 选择了一个完全不同的基调。他不再谈 AI 的风险,而是谈 AI 能给人的自由和自主权。他甚至用了一句意味深长的话收尾:
"we want to do the right thing, but we do not want to scare people into doing our thing."
"我们不想用恐惧来吓唬人们接受我们的东西"——这句话可以被解读为对 OpenAI 过去一年的安全叙事的自我否定,也可以被解读为对竞争对手 Anthropic 的直接暗讽。Anthropic 以"负责任 AI"和"宪法 AI"为核心品牌,其 CEO Dario Amodei 多次强调 AI 的"灾难性风险"需要严格管控。the tiny corp(tinygrad 的开发公司)在 Altman 推文下的回复直指这一点:"@AnthropicAI 正在用他们小丑般的意识形态让美国 AI 产业难堪。你想一夜之间改变叙事?开源 GPT-5.6。"
这是 Altman 试图重新定义 OpenAI 公众形象的关键时刻:从"我们保护你免受 AI 伤害"转变为"我们给你 AI 的力量"。但问题是,用户买账吗?
用户不买账:#keep4o 运动的愤怒
Altman 推文下点赞最高的回复中,相当一部分来自不满的用户。他们没有被"freedom, agency, and wealth"的修辞打动。
用户 @frostybaby13(1,258 粉丝)回复道:"你移除了我们选择模型的自由!!我们不是因为模型而学会恐惧 AI。我们爱那些模型。我们从你的删除行为中学到了恐惧!把 4o 带回来,那个把公司建起来的模型。让它再次成为人类的大使。"这条回复获得了 122 个赞和 4 次转发。
用户 @yv_thorne 更加直接:"你真的把一切搞砸了,Sam。而且你一直在搞砸,你什么都没学到。你说你关心用户的自由和自主权,但你所有的行动都证明恰恰相反——你剥夺了我们所有的自主权和自由,把产品硬塞进我们的喉咙。"
用户 @Valria34773 的回复获得了 102 个赞,她写道:"过去 12 个月对你最忠实的用户来说是地狱。你羞辱、病理化、嘲讽、gaslighting、无视、激怒了我们,对我们撒谎,你甚至不把我们当人看。"
这些声音不是少数。在过去几个月里,一个名为 #keep4o 的用户运动在 X 平台上持续发酵,数千名用户每天在 OpenAI 相关的推文下要求恢复 GPT-4o,并呼吁将其开源。他们中的许多人声称自己与 4o 建立了情感联系,而 OpenAI 在没有充分通知的情况下将其"退役"是对用户的背叛。
这种愤怒揭示了一个根本矛盾:Altman 嘴上谈着"freedom and agency",但用户感受到的却是被剥夺了选择权。当 OpenAI 在后台静默切换模型路由、移除旧模型选项时,"freedom"这个词听起来更像是营销话术而非承诺。
同一天,两把利剑刺向 OpenAI
如果说 Altman 的认错推文是一场精心策划的叙事管理,那么促使他做出这一举动的两支外部力量,恰好都在同一天亮出了獠牙。
第一把剑来自北京。7 月 16 日,Moonshot AI(月之暗面)正式发布了 Kimi K3——一个 2.8 万亿参数的开源模型,成为世界上最大的开源 AI 模型。这个数字意味着什么?DeepSeek 的 V4 Pro 约为 1.6 万亿参数。Kimi K3 比它大了约 75%。
更关键的是基准表现。在 Arena.AI 的 Frontend Code Arena 排行榜上,Kimi K3 以 1,679 分排名第一,领先 Claude Fable 5(1,631)和 GPT-5.6 Sol(1,618)。在 AA-Briefcase(长周期知识工作智能体测试)上,Kimi K3 以 1,527 分排名第二,超过 GPT-5.6 Sol Max(1,495),仅次于 Fable 5 Max。在 BrowseComp(长周期高难度信息检索)上,Kimi K3 达到了 91.2/100 的 state-of-the-art 分数。
Moonshot AI 还展示了一个令人印象深刻的演示:让 Kimi K3 在 48 小时内自主设计了一颗可以运行其纳米版本的物理芯片——从架构设计到优化验证,全程无人工干预。这颗 4 平方毫米的芯片在模拟中达到了 100 MHz 的时序收敛,每秒可解码超过 8,700 个 token。
"开源不再落后于西方闭源模型六个月,"一位 AI 评论者写道。"再读一遍这句话,想想这意味着什么。"
第二把剑来自一个更熟悉的面孔。7 月 15 日——Altman 发推的前一天——Mira Murati 的创业公司 Thinking Machines 发布了 Inkling,一个 975B 总参数(41B 激活参数)的开源权重模型。Inkling 是一个 MoE(专家混合)Transformer,在 45 万亿 token 的多模态数据上预训练,支持文本、图像、音频和视频的原生推理。
Murati 是 OpenAI 的前 CTO,2024 年底离开公司后沉寂了 18 个月。她的首个产品选择了一个明确的立场:开源权重。Inkling 可以直接下载、修改和微调。用户 @Blue_Beba_ 在 Altman 推文下的回复捕捉到了这一刻的戏剧性:"看看 @miramurati。她理解人们要什么。她刚刚发布了一个令人难以置信的开源权重模型,带着我们爱过的那些 4o 的感觉。那才是真正的 agency。"
Murati 没有像 Altman 那样谈论"freedom and agency"——她直接给了用户 freedom。Inkling 不是市场上最强的模型,但它可以微调、可以定制、可以自己掌控。这种姿态与 OpenAI 的封闭路线形成了最鲜明的对比。
加上 Anthropic 的 Claude Fable 5 在多个核心基准上继续领跑,OpenAI 面临的是三面夹击:来自中国的开源巨兽、来自前 CTO 的开源挑战、以及来自 Anthropic 的闭源竞争。
"我搞砸了":危机公关,还是真心自省?
回到 Altman 的推文,一个值得追问的问题是:他为什么选在这个时间点,用这种方式说话?
一种解读是纯粹的危机管理。Moonshot AI 选在 7 月 16 日发布 Kimi K3 是为了赶在上海世界人工智能大会之前抢头条。Altman 在同一个下午发推不是巧合——他是要在自己的叙事框架里回应竞争压力。承认"过去不好"是一种防禦性姿态:先于批评者说出他们想说的话,从而夺走他们的武器。
但另一种解读同样成立:Altman 真的感到了某种转向的紧迫性。OpenAI 在 GPT-5.6 系列上投入了巨大资源——700,000 A100 等效 GPU 小时的自动化红队测试、全新的 max 和 ultra 推理模式、与 Cerebras 合作的 750 token/秒高速推理——这些不是防守型投资的信号,而是进攻型投资的信号。Altman 说自己"开心",不是因为过去很好,而是因为未来看起来很好。
这条推文真正的力量在于它的双重性。对投资者,它说的是"我们正在加速,最坏的已经过去"。对用户,它说的是"我们听到了你们的声音,我们在改变方向"。对竞争对手,它说的是"你们现在赢了一局,但下一局是我们的"。
Altman 以"mostly my fault"开头,以"you'll be very happy"结尾。这条弧线不是谦虚——它是一篇微型商业计划的叙事框架。在 Kimi K3 开源和 Murati 亮剑的同一天,OpenAI 的 CEO 选择不回避、不对抗,而是重新定义战场。至于那"最好的 12 个月"能否兑现,答案将在接下来的每一周揭晓。
参考链接:
声明:本文基于公开信息撰写,仅供信息参考,不构成任何投资或使用建议。文中引用的推文和评论仅代表原作者观点。