AREX Feed Article
Grok 4.5 密集落地:72 小时内登陆 GitHub Copilot、推出 Build Mode、登顶双基准,SpaceXAI 站稳「第三极」
过去 72 小时,SpaceXAI(原 xAI)围绕 Grok 4.5 完成了一系列高密度发布:上线 GitHub Copilot、向 SuperGrok Heavy 用户开放 Build Mode、并在 LaurenBench 与 HighWalk 两项基准中登顶。同期,Cursor 在印度推出含 Grok 4.5 的 Start 订阅计划,Elon Musk 同步预告了 Grok 4.6 与 4.7 的发布时间表。
Grok 4.5 登陆 GitHub Copilot
7 月 28 日,SpaceXAI 官方宣布 Grok 4.5 正式上线 GitHub Copilot。数百万使用 VSCode 及 GitHub 生态的开发者可以在模型选择器中直接切换到 Grok 4.5。对于部分企业和组织用户,需要先在 Copilot 设置中启用该模型。Grok 4.5 同时可通过 SpaceXAI 控制台以 API 方式调用,定价为每百万输入 token 2 美元、每百万输出 token 6 美元。
@Grok 官方账号发布的公告帖浏览量超过 573 万次,获得 1831 次点赞和 209 次转发。
Build Mode:聊天内一键构建并发布应用
同一天,SpaceXAI 为 SuperGrok Heavy 订阅用户推出了 Build Mode 的 Early Beta。用户在 Grok 聊天中描述想法后,Grok 会自动编写代码并在对话中生成可交互的实时预览,无需安装任何开发环境或触碰代码。支持构建的类型包括网站与作品集、功能性应用(计算器、任务规划器等)、游戏(3D 驾驶、街机竞速等)以及基于连接器的实时数据仪表盘。
完成后,用户可直接发布到 grok.me 子域名或绑定自定义域名。Build Mode 目前在 grok.com、iOS 和 Android 端同步可用。@Grok 的 Build Mode 公告帖浏览量超过 1800 万次。
开源编码 Agent:Grok Build
Grok Build 是 SpaceXAI 的终端编码 Agent,于 7 月 15 日正式开源,采用 Apache 2.0 许可证,源码托管在 GitHub(xai-org/grok-build),已获得超过 23000 星标。该工具以 Rust 编写,提供全屏 TUI 界面,支持代码理解、文件编辑、Shell 命令执行、网络搜索以及长任务管理。预编译二进制支持 macOS、Linux 和 Windows 三平台。
开源范围包括 Agent 循环逻辑、代码工具实现、终端 UI 渲染层以及扩展系统(Skills、Plugins、Hooks、MCP 服务器和子代理)。SpaceXAI 同时声明该项目支持本地优先部署:用户可自行编译并指向本地推理服务。
LaurenBench 与 HighWalk 登顶
7 月 29 日,Grok 4.5 在 LaurenBench 基准中以 56.9% 的得分排名第一,领先 Claude Sonnet 5、GLM 5.2、Claude Opus 5、Kimi K3 和 GPT-5.6。LaurenBench 测试 AI Agent 在真实场景中的对话、工具使用、记忆和安全性四项综合能力。
同日,Grok 4.5(high 推理配置)在 HighWalk 基准中也取得综合第一。HighWalk 是一项独立评测,基于 Laravel PHP 框架的 46 个真实 commit,衡量模型将代码变更更新为技术规范文档的能力——重点考察代码分析、抽象和精确技术写作。Grok 4.5 在质量与运行效率的综合评分中领先,Claude Opus 5(high)则在原始质量分上最高且零硬性失败,GLM 5.2 是最强开源权重模型。Elon Musk 转发了这一结果。
Cursor Start:印度专属计划含 Grok 4.5
7 月 28 日,AI 编程工具 Cursor 推出了面向印度开发者的 Cursor Start 计划,定价每月 ₹649(约 7 美元),支持 UPI 和银行卡支付。该计划包含 Grok 4.5 和 Composer 模型的慷慨使用配额、云端 Agent、iOS 端以及插件和 MCP 扩展支持。Cursor 官方表示,其在印度的用户基数在过去一年增长了两倍,超过 300 万开发者,且印度开发者的 Agent 人均请求量居全球首位。
此时距 SpaceX 宣布以约 600 亿美元全股票交易收购 Cursor 已过去一个多月,收购预计在 Q3 完成。
Musk 预告 Grok 4.6 与 4.7 路线图
7 月 28 日,Elon Musk 在 X 上回复时透露:Grok 4.6 预计在 8 月 7 日左右发布,为 1.5 万亿参数模型,在监督微调(SFT)和强化学习(RL)方面有显著提升;Grok 4.7 为 2.1 万亿参数模型,将在 Grok 4.6 后几周内推出,除推理速度略慢外,在各方面均优于 4.6,且 token 效率更高。该帖浏览量超过 585 万次。
社区评价与行业定位
重度用户、技术社区成员 Kun Chen(@kunchenguid)在 7 月 29 日发表了一篇被广泛传播的长文分析,其核心观点包括:
- Grok 4.5 是过去几周「最重要的事件」:在与多位跨模型系列的深度用户交流后,共识是 Grok 4.5 是当前使用体验「最愉悦」的前沿模型,在速度、效率和能力之间找到了精妙的平衡点。
- SpaceXAI 已成为第三极:与 Anthropic 和 OpenAI 并列,是真正的第三家实力玩家——拥有 X 平台的海量真实数据、已收购的主流 Agent 工具(Cursor),以及自研芯片、自建数据中心的能力。
- Cursor 数据是关键差异化因素:Grok 4.5 是首个整合 Cursor 使用数据的模型,相较前代 Grok 有质的飞跃。这解释了为何各巨头都在争夺开发者工具与使用数据。
- Opus 5 表现不佳:几乎无人认可,机器可验证的结果正压倒人类反馈,行业需要更人性化的 AI。
需要指出的是,目前 Grok 4.5 的基准成绩和体验评价主要来自官方发布及社区用户反馈,独立的第三方深度评测仍然有限。Kun Chen 本人也声明其观点来自与重度用户的交流,属于社区共识性质的观察。