AREX Feed Article
马斯克在 X 给出 Grok 路线图:称 4.7 大致与 Opus 5.0 相当,被问及 AGI 答「那将是 Grok 5」
配图:TechCrunch 今年 7 月关于 SpaceXAI 与 Grok 的报道配图(Getty Images)。
9 月 14 日北京时间晚间,埃隆·马斯克在 X 上回复两名用户,为 Grok 的后续版本排了座次。先被问到 Grok 4.8 距离通用人工智能(AGI)还有多近时,他整条回复只有一句:,意为「那将是 Grok 5」。大约 10 分钟后,他在里写道:Grok 4.7「应该大致与 Opus 5.0 相当,而不是 5.1。它在某些方面更好,在另一些方面更差。我们需要修复多模态表现」;4.8「会有明显提升」;4.9「大概是 Astra/Fable 级」;Grok 5「也许比任何东西都强。我们拭目以待」。
这四个版本目前都还没有发布。在 9 月 14 日更新时提到,该版本已被推迟到 9 月 12 日的预期之后。这些对照都是马斯克本人对未发布模型的判断,本文核查时未找到可供独立核对的评测结果。
回复区的追问:「你是说 Grok 5 就是 AGI 吗?」
提问者是 ,他问:「Elon,你觉得 Grok 4.8 离实现 AGI 有多近?」马斯克的回复没有对 AGI 作定义,也没有给出 Grok 5 的发布时间。回复里有用户「你是说 Grok 5 就是 AGI 吗?」;随后,X 美国区趋势榜上「Grok 5」一度排到第 6 位。
路线图里的三个名字:Opus 5.0、Fable、Astra
马斯克回复的原帖来自 。对方预测 Grok 4.7 会进入「Fable 5.1 与 Astra」同一档,还说 2.5T(2.5 万亿参数)的 Grok 4.8 会强于 Anthropic 和 OpenAI 尚未公开的模型。马斯克给出的档位比原帖低:4.7 对应 Opus 5.0 一档,Astra/Fable 级留给 4.9。
这三款参照物分别是:
- :Anthropic 的模型,Anthropic 称它「以一半的价格接近 Claude Fable 5 的前沿智能」,定位是企业、知识工作者与开发者的日常模型。
- :Anthropic 9 月初发布的旗舰,与 Mythos 5.1 是同一个模型,后者仅通过受控访问计划提供;Anthropic 称这一代是「面向编程与知识工作的世界最先进模型」。
- :OpenAI 9 月初开始分批推送的新旗舰,被 OpenAI 称为「世界上最智能、对齐程度最高的模型」。
拿 Opus 当参照系,也是马斯克近期的习惯:7 月 SpaceXAI 发布 Grok 4.5 时,他称其为「Opus 级模型」,并说大致对标 Opus 4.7()。
4.7 的说法变化:从「超越所有现有模型」到「还需要几天」
8 月 12 日,马斯克曾写:「」,还说如果有模型在真实工程任务上比 4.7 更强,他会「感到震惊」。9 月 2 日,他给出时间表:「。」9 月 11 日,这句变成「」,他给出的原因是:强化学习(RL)中对回答长度的惩罚可能过重,模型「仍然会在(它其实做得出的)难题上过早放弃」,检查工作「还不够严格」。
围绕 4.7 的预期变化,用户反应不一: 把 8 月与 9 月的表态拼在一起,讽刺这是「画饼」与性能下修; 则认为,比起每发一版都猛吹,「某些方面更好、某些方面更差」的说法要真实得多。
「Dario is right」两天后,马斯克给出 Grok 版本清单
9 月 12 日,Anthropic CEO Dario Amodei 发表长文。据 ,他提出给前沿模型减速的三步方案:独立监测、行业监管、全球监管;OpenAI CEO Sam Altman 回应「我同意 Dario,我们需要给前沿减速」。当天,马斯克写下;9 月 13 日,他又补充说,应该有某种监督,「」是开始这件事的正确方式。
9 月 14 日,被他回复的那条帖子里,对方还写道:「公开同意『PACE THE FRONTIER』,继续训练。」马斯克给出的回答就是那份排到 Grok 5 的版本清单。有用户把时序摆在一起,:「在 Dario 和 Sam 说『让我们给 AI 竞赛降速』之后,马斯克发了这条帖子。」
4.8:马斯克称 2.5T 参数、新 C++ 软件栈,本周完成训练
当天上午 9 点 24 分(北京时间),马斯克已在另一条回复里透露了 4.8 的进度:
配图:马斯克 9 月 14 日关于 Grok 4.8 的回复(中文界面截图,来源:)。
4.7、4.9 和 Grok 5 的发布日期,他在这两条回复里都没有提及。