AREX Feed Article
Arena.ai 确认 Grok 4.6 8 月 7 日发布,Musk 宣称 Grok 4.5 速度成本 Pareto 第一
8 月 1 日,Elon Musk 在 X 平台发帖称“Grok 4.5 is Pareto #1 when considering speed & cost”,宣称 Grok 4.5 在速度与成本两个维度上同时位于效率前沿——没有任何模型能在这两项指标上同时超越它。该帖获得约 4300 点赞、86 万次以上浏览。与此同时,独立评测平台 Arena.ai 已于 7 月 28 日正式确认 Grok 4.6 的发布日期为 8 月 7 日,并将在发布后一周内上线 Arena 排行榜进行独立评测。
Arena.ai 第三方确认:8 月 7 日 + 独立评测安排
7 月 28 日,Arena.ai(原 LMArena,拥有约 20.9 万关注者)在 X 平台发帖:“Announced today: Grok 4.6 is coming on August 7. Get ready to see it in @arena next week!”这标志着 Grok 4.6 的发布日期首次获得 Musk 以外的独立第三方确认。
此前报道仅依据 Musk 个人发帖推断发布日期(先为“8 月 7 日前后”,后精确至“约 8 月 6 日”)。Arena.ai 的公告将日期锁定为 8 月 7 日,并额外披露了评测安排:Grok 4.6 将在发布后一周内进入 Arena Agent 排行榜,接受基于真实 Agent 会话的独立对比评测。在 Agent Arena 上,Grok 4.5 首秀排名第 13(较 Grok 4.3 的第 29 名大幅跃升),尤其在 Bash Recovery 等任务上表现突出。Grok 4.6 能否延续这一爬升曲线,将是发布后最值得关注的信号。
Musk“Pareto 第一”论:速度 + 成本双维度领先
Musk 8 月 1 日的“Pareto #1”表述是一项新的修辞升级。在经济学中,“Pareto 最优”指无法在不损害某一维度的情况下改善另一维度的状态。Musk 借此暗示 Grok 4.5 在速度和成本的二维平面上定义了效率边界线。
Vercel CEO Guillermo Rauch 的独立评测为这一论断提供了部分支撑。据 crypto.news 报道,Rauch 在 Vercel 的网络安全测试中发现:Grok 4.5 的成本仅为 GPT-5.6 Sol 的十分之一、Claude Opus 5 的约 5.7 分之一、Kimi K3 的约 2.2 分之一,性能接近 Kimi K3。不过 Rauch 仍将 Sol 列为综合前沿能力最强的模型——这意味着“Pareto 第一”的前提是将评估框架限定在速度与成本维度,而非综合智能水平。
未解问题
Grok 4.6 目前未公开任何规格、基准分数或定价。Grok 4.7(2.1 万亿参数)尚无确切日期,仅知“数周后”跟进。两模型是否维持 $2/$6 的激进定价仍未可知。
本次更新来源
- (2026-08-01)
- (2026-07-28)
- (2026-07-29)
- (2026-07-28)