AREX Feed Article
Grok 4.5 掏底价:Musk 放话 Opus 级,Cursor 联训,$2/$6 把对手价格砍掉六成
TL;DR:SpaceXAI 于 7 月 8 日正式发布 Grok 4.5——一款 1.5 万亿参数、与 Cursor 联合训练的 MoE 前沿模型。Elon Musk 将其定性为"Opus 级,但更快、更省 token、成本更低"。独立评测机构 Artificial Analysis 给出全球第四的综合排名,在 Coding Agent 指标上与 GPT-5.5 持平,但每任务成本不到 Fable 5 的四分之一。API 定价 $2/$6 per百万 token,比 Opus 4.8 低 60% 以上。
凌晨两点,Musk 一句话把 Grok 4.5 推上了牌桌
美东时间 7 月 8 日凌晨 2:21,Elon Musk 在 X 上投下一枚炸弹。
"基于客户在 beta 测试中的强烈正面反馈,SpaceXAI 明天将向公众开放 Grok 4.5。这是一个 Opus 级模型,但更快、更省 token、成本更低。"
这条推文迅速揽下 4.8 万点赞、5200 次转发和 530 万次浏览。十多个小时后,SpaceXAI 和 Cursor 同步官宣:Grok 4.5 正式上线。SpaceXAI 官方推文拿下 1.5 万点赞、230 万次浏览和 730 万次观看。
这是 SpaceXAI 上市三周以来发布的第一款旗舰模型,也是今年 6 月以 600 亿美元收购 AI 编程工具 Cursor 后,双方首次交出的联合作业。
Musk 在后续回复中追加了一个关键信息:"2T 参数模型本月完成训练,下月交付客户。"言下之意:Grok 4.5 只是开胃菜。
Cursor 团队直呼"日常主力",独立评测一把梭出 54 分
发布后几小时内,Grok 4.5 在 X 上形成了高密度舆论场。按影响力降序:
Elon Musk,SpaceXAI 创始人(2.4 亿粉丝)追加定性:"内部评估认为 Grok 4.5 与 Opus 4.7 大致相当,但快得多。能力、速度和更低成本的组合才是它的竞争力所在。"他另发一推强调:"Grok 在法律领域一直很强。"
Michael Truell,Cursor CEO(16.5 万粉丝)官宣合作:"这是我们迄今为止最强大的模型,也是第一次为软件工程之外的任务打造。它已是团队很多人的日常主力。这只是第一个版本,还会有更多。"该推获得 5600 点赞。
Artificial Analysis,独立 AI 评测机构(10.8 万粉丝)在数小时内发布了最完整的第三方背书,其线程获得超过 2500 次互动。核心结论:Grok 4.5 以 54 分在 Intelligence Index 上排名全球第四,仅次于 Fable 5、GPT-5.5 和 Opus 4.8;在 Coding Agent Index 上与 GPT-5.5 打成平手(76 分),但每任务成本仅 $2.59——不到 Fable 5($11.80)的四分之一,不到 GPT-5.5($5.07)的一半。
社区端同样炸裂。Danny Limanseta(独立开发者,3.1 万粉丝)分享了数天试用体验:"感觉像 Opus 4.8,但速度快一倍,价格便宜得多。"Yun-Ta Tsai,Tesla 高级工程师(11.7 万粉丝)直言:"叫它编程 Agent 是低估了它——它能处理真实世界的工程问题,包括我团队遇到的制造流程故障排查。"NVIDIA 官方账号也下场祝贺。
IPO 三周、$600 亿买下 Cursor、GPT-5.6 同日截胡——SpaceXAI 为什么非要今天
Grok 4.5 的发布时间绝非偶然。过去三周,SpaceXAI 完成了剧烈变形。
6 月 12 日,SpaceXAI 以每股 $135 在纳斯达克上市。仅仅四天后的 6 月 16 日,公司宣布以 600 亿美元全股票交易收购 Cursor 母公司 Anysphere——2026 年迄今最大的 AI 收购案。CNBC 和 Reuters 均以头条报道。
6 月 28 日,Grok 4.5 开始在 SpaceX 和 Tesla 内部进行私有 beta,训练数据正是来自 Cursor 的万亿级 token 真实代码交互数据。xAI 研究员 Dinghuai Zhang 在 X 上透露,团队在过去几个月"日夜迭代 RL 基础设施",在强化学习的稳定性和能力上"推动了根本性的算法变革"。
而 7 月 9 日——Grok 4.5 全面开放的同一天——OpenAI 计划将 GPT-5.6 推向更广泛的用户。该模型此前被特朗普政府以安全理由限制发布范围。
因此,Grok 4.5 是一石三鸟:验证 SpaceXAI-Cursor 垂直整合的技术可行性,抢在 GPT-5.6 铺开前占据注意力,向华尔街传递信号——上市后的 SpaceXAI,每个月都有货可交。
不做榜单第一,只做每块钱最聪明的那一个
Grok 4.5 是一台 1.5 万亿参数的 MoE(混合专家)模型,在 Memphis 的 Colossus 集群上使用数万张 NVIDIA GB300 GPU 训练而成。RL 训练覆盖数十万个多步软件工程任务,训练栈支持高度异步,agent 跑数小时的同时学习仍在继续。
但真正的故事不在架构——在经济学。
定价屠刀。 API 价格为 $2/百万输入 token、$6/百万输出 token(缓存命中仅 $0.50)。横向对比:Opus 4.8 为 $5/$25,GPT-5.5 和 GPT-5.6 为 $5/$30,Fable 5 高达 $10/$50。仅凭标价,Grok 4.5 就比对手便宜 60% 到 80%。
Token 效率进一步放大价差。 根据 xAI 官方数据,在 SWE-Bench Pro 上,Grok 4.5 平均每个任务消耗 15,954 个输出 token,而 Opus 4.8(max 模式)消耗 67,020 个——4.2 倍的差距。Artificial Analysis 独立测算确认:Grok 4.5 每 Intelligence Index 任务仅需约 14K 输出 token,比 Opus 4.8 低 60% 以上。
Benchmark 诚实看:不登顶,但够近。 在四个核心编程评测中,Grok 4.5 均位列第三或第四。DeepSWE 1.1 得 53%(第四,落后 Fable 5 的 70%),SWE-Bench Pro 得 64.7%(第三),Terminal Bench 2.1 得 83.3%(第三,与 GPT-5.5 的 83.4% 仅差 0.1 个百分点)。但把成本拉进来:它在 Coding Agent Index 上用 1.9M token 就拿到与 GPT-5.5(6.2M token)相同的 76 分。
其他规格:上下文窗口 500K token,服务速度 80 TPS,支持文本+图像输入、结构化输出和原生并行工具调用。目前不在欧盟可用,预计 7 月中旬开放。可用渠道:Grok Build、Cursor(所有套餐)、OpenCode、Hermes Agent 和 Warp。
从追赶者到价格屠夫,SpaceXAI 用一条垂直铁链锁死了成本端
在 Grok 4.5 之前,SpaceXAI 的模型在顶级 AI 评测中始终处于第二梯队。Grok 4.3 在 Artificial Analysis Intelligence Index 上仅得 38 分——此次 Grok 4.5 一举跃升 16 分至 54,首次进入"前沿俱乐部",超越了所有开源模型和 Google 的 Gemini 系列。
但更大的格局变化不在于分数。在于 SpaceXAI 现在拥有了一条从硅到应用的完整铁链:Colossus 超算集群提供训练算力,Cursor 提供万亿级真实代码交互数据,Grok 模型本身是产品,Grok Build 和 Cursor 是分发渠道。当一个实验室既能控制训练成本(自有算力)、又能控制数据成本(Cursor 用户交互)、还能控制分发(Cursor 装机量),它就拥有了对手难以复制的定价权。
Axios 的报道点出了一个耐人寻味的细节:SpaceXAI 用于训练 Grok 4.5 的算力,同时也租给了竞争对手 Anthropic 和 Google。随着自有模型需求增长,SpaceXAI 可能需要在"租给对手赚钱"和"留给自己训练"之间做出选择——这是一个只有垂直整合玩家才有的奢侈烦恼。
Design Arena 的独立评测提供了一个额外参照:Grok 4.5 在 Website Arena 上以 Elo 1328 排名第五,相比 SpaceXAI 此前的最高排名跃升 25 位,与 Claude Opus 4.6(Thinking)处于同一性能带。
Artificial Analysis 在评测结语中写道,Grok 4.5 在性能 vs 成本的 Pareto 前沿上"站得极为清晰"。而 Musk 预热的 2T 参数模型 7 月完成训练——意味着这个定价锚点可能还会被进一步往下砸。
这不只是模型发布,这是一份定价锚
Grok 4.5 不是来抢第一的。它是来重新定义"值不值"的。
当一台 1.5 万亿参数、Opus 级的模型把百万 token 价格压到 $6,当 Cursor 的真实工程数据可以在自家模型上形成飞轮,当 Musk 已经预告了下一个月就能交付的 2T 版本——SpaceXAI 正在做的事情,不是追赶,是改写前沿 AI 的计价单位。
本文基于公开信息独立撰写。信息来源包括:SpaceXAI / xAI 官方博客、Elon Musk X 账号、Cursor 官方博客、Artificial Analysis 独立评测、TechCrunch、Axios、the-decoder.com、Digital Applied 及 X 平台公开讨论。
Sources:
- (47.8K likes, 5.2K retweets)
- (15.3K likes, 7.3M views)
- (12.4K likes)