AREX Feed Article
SpaceXAI 采用 NVIDIA Vera CPU 扩容 Grok,算力迈向吉瓦级
NVIDIA 于 8 月 24 日宣布,SpaceXAI 将部署 NVIDIA Vera CPU,加速其下一代智能体(agentic)AI 应用。NVIDIA 称这是第一款为 AI 智能体打造的 CPU;新闻稿称,这次部署把它带到了「世界上最具雄心的 AI 部署之一」()。
同一份公告里还有两个更大的计划:SpaceXAI 将以 Vera Rubin 平台扩容 Grok 背后的 AI 基础设施,向吉瓦级计算容量迈进;计划中的第一代 Starmind AI 卫星将基于优化版 Vera Rubin NVL72 机架系统,把同一套加速计算架构从地面 AI 工厂延伸到轨道。SpaceXAI 是 SpaceX 旗下的 AI 公司,前身 xAI 于今年 7 月更名,运营 Grok 与社交平台 X()。
生成答案之外,CPU 还要能「动手」
「智能体 AI 需要一种新的计算系统——它不仅要生成答案,还要采取行动,」NVIDIA 超大规模与高性能计算副总裁 Ian Buck 在新闻稿中说(原文:"Agentic AI requires a new kind of computing system — one built not only to generate answers, but to take action")。他补充说,Vera 给了 AI 智能体实时行动的 CPU 性能:执行代码、处理数据、协调复杂任务;SpaceXAI 正在把这套架构从庞大的 AI 工厂带到轨道的下一前沿。
原因在于 agentic 应用的运行方式:模型调用之间,CPU 要编排工具、执行代码、处理数据、运行仿真。新闻稿称,SpaceXAI 将用 Vera 加速这些负载,让智能体行动更快,同时让 GPU 保持喂饱、充分利用。
SpaceXAI 总裁 Mike Nicolls 则从应用方角度说明:「Vera 给了我们运行海量编排、代码与数据处理所需的 CPU 性能和内存带宽,同时让 GPU 做它们最擅长的事。」他给出的结论是:更高性能的 AI 智能体,以及每瓦算力产出更多有用的工作。
88 个 Olympus 核心:模型调用之间谁在干活
Vera 加速的是模型推理周围的 CPU 密集型工作:工具调用、代码执行、数据处理、编排与仿真。它搭载 88 颗 NVIDIA 自研 Olympus 核心与 Spatial Multithreading 技术,配高带宽 LPDDR5X 内存,带宽最高 1.2TB/s;在智能体 AI、强化学习、数据处理等负载上,任务完成速度最高达到 x86 CPU 的 1.8 倍。NVIDIA 产品页补充说,Spatial Multithreading 把 88 个核心扩展成 176 线程()。
首批 Vera CPU 系统此前已经到过 SpaceXAI。NVIDIA 产品页上的博客条目记载,Ian Buck 已亲手把首批系统交付给 Anthropic、OpenAI、Oracle Cloud Infrastructure 与 SpaceXAI,称这标志着该 CPU 从发布进入生产。本次公告把这一采用正式化,并追加了扩容与卫星计划。
从机架到吉瓦级 AI 工厂
Vera Rubin 平台在计算、网络、软件三层协同设计,把 NVIDIA 加速计算、NVLink 互连、Spectrum-X 以太网、BlueField 数据处理与 NVIDIA 软件集成在一起,目标是规模化地提升性能与能效,同时压低每 token 成本。
机架级的 Vera Rubin NVL72 集成 72 颗 Rubin GPU 与 36 颗 Vera CPU()。NVIDIA 官网的预估数据显示,面向深度推理的 agentic AI,NVL72 每百万 token 推理成本为上一代 GB200 NVL72 的十分之一,每兆瓦 token 产出最高为后者的 10 倍。
对正「向吉瓦级计算容量扩张」的 SpaceXAI 来说,每兆瓦产出是直接的成本指标。这一步有迹可循:2025 年 12 月 30 日,xAI 购入第三栋大楼,把训练容量提升到接近 2 吉瓦,同时宣布计划把 Colossus 超算扩展到至少 100 万颗 GPU(Wikipedia)。新闻稿称,Vera Rubin 提供的共同架构,是 SpaceXAI 高效扩建下一代 AI 工厂、并把这座地基带到轨道上的基础。
Starmind 卫星要把机架级系统装进轨道
轨道上的约束与地面数据中心截然不同:电力、散热、带宽、可靠性与物理集成,每一项都要重新适配。新闻稿称,SpaceXAI 计划中的第一代 Starmind AI 卫星将基于优化版 Vera Rubin NVL72 机架级系统,双方正在把这一地基架构改造成轨道版本,同时保留共同的 NVIDIA 架构与软件生态。据 Wikipedia,Mike Nicolls 于 2026 年 4 月从 SpaceX Starlink 副总裁任上转任 xAI(今 SpaceXAI)总裁。
时间表未公布,产品「当且仅当可用时」提供
新闻稿同时附上了标准免责:Vera 部署、Vera Rubin 扩容与 Starmind 卫星计划均属前瞻性声明,不构成承诺;文中描述的许多产品与功能仍处于不同阶段,「当且仅当可用时」提供,开发、发布与时间安排由 NVIDIA 单方决定、可能变更。
公告没有给出 Vera 部署的时间表,也没有给出 Starmind 卫星的发射日期。无论吉瓦级 AI 工厂还是轨道上的 Vera Rubin NVL72,目前都停留在规划层面。