AREX Feed Article
AWS 首台 Vera 实机到手:Ian Buck 西雅图亲手交付
8 月 27 日,NVIDIA 官方 X 账号宣布,NVIDIA 的 Ian Buck 已在西雅图 AWS 总部把 AWS 首台 Vera CPU 服务器与 Vera Rubin GPU 亲手交付给 Willem Visser 与 Supreeth Sheshadri。称 Vera 专为 agentic AI 打造:更多 token 每美元(more tokens per dollar)、用户得到更快结果,是 AI 工厂规模扩张的计算基础,并配有一段交付现场视频。截至我们核验时(发布约 5 小时后),推文获得 669 次点赞、约 4.2 万次浏览。
一天前,AWS 与 NVIDIA 联合官宣扩大战略合作:计划 2027–2028 年在 AWS 全球基础设施再部署 200 万张 NVIDIA GPU(Blackwell Ultra、Rubin、Rubin Ultra),并引入 Vera CPU 架构。当时 的措辞还是"双方正在合作把 Vera CPU 基础设施带到 AWS"(working to bring),没有交付时间表。这条推文,把计划推进到了第一台实机。
Spheres 前的交接
(8 月 27 日更新)补充了现场细节:NVIDIA 超大规模与 HPC 副总裁(Vice President of Hyperscale and HPC)Ian Buck 把 AWS 首台 Vera CPU 服务器与 Vera Rubin GPU 推过西雅图的 Spheres(亚马逊总部园区标志性的玻璃球温室),交给 Willem Visser,博客称其为 AWS 的 Amazon EC2 副总裁。Supreeth Sheshadri(博客称其为 Amazon EC2 硬件工程副总裁,正文中拼作 Sheshardi)一同在场,三人随后讨论了 Vera 与 Vera Rubin 将给 AWS 客户带来什么。
博客还交代了这次交付的位置:AWS 是 Vera 之旅的最新一站。今年 5 月 18 日,Buck 曾把首批 Vera CPU 系统亲手送到 Oracle Cloud Infrastructure 以及 Anthropic、OpenAI、SpaceXAI 三家 AI 实验室;这篇博客原发于 5 月 18 日,8 月 27 日增补了 AWS 章节。
计划与实机之间,隔了一条推文
8 月 26 日的联合公告是一份计划清单:200 万张 GPU、Vera CPU、NVLink Fusion 扩展、为美国政府建 AI 工厂(10 万张 GPU),AWS CEO Matt Garman 与 NVIDIA CEO 黄仁勋的引语讲的都是"将要做什么"。新闻稿里 Vera 部分的动词是 working to bring,即正在把 Vera CPU 基础设施带到 AWS。
8 月 27 日的推文与博客更新改变了这个状态:AWS 已经收到实机。一台服务器加一张 GPU 的实物交付,与"计划再部署 200 万张"之间隔着数量级的距离,但它让"Vera 进 AWS"从新闻稿措辞变成了可拍摄、可搬运的事实,推文配的是一段交接现场视频。
88 个 Olympus 核心,专为 agent 而生
Vera 是 NVIDIA 为 agentic AI 设计的 CPU。按 NVIDIA 博客的解释,AI agent 并不只在 GPU 上跑:每个沙箱、每次工具调用、每层编排、每次长上下文检索,都是 CPU 的工作。Vera 为此配置了 88 个 NVIDIA 自研 Olympus 核心、1.2TB/s 内存带宽,NVIDIA 称其 agentic AI 负载下单核性能最高可提升 1.8 倍。
Vera 同时是 Vera Rubin NVL72 的主机处理器:通过第二代 NVLink-C2C 与两颗 Rubin GPU 配对,共享统一内存,NVIDIA 称其以 2 倍于传统基础设施的能效为 GPU 供数。Buck 在博客中说:"Agentic AI 正在 AI 工厂里创造一个新的 CPU 时刻——模型从'回答问题'走向'采取行动',Vera 就是为了让这项工作在规模扩张时不停摆而造的。"这些性能数字均为 NVIDIA 单方面说法。
社区反应:"还剩 1,999,999 张"
对这次交接,X 上的讨论分成两派。
一派盯着交付本身的象征意义。用户 写道:"AWS 刚承诺两年内加购 200 万张 NVIDIA GPU。这是第一张,靠人手送到的。还剩 1,999,999 张"(Only 1,999,999 to go)。
则把重点放在 CPU 上:"被埋没的细节是'Vera CPU 服务器'——NVIDIA 把一颗 ARM CPU 亲手送进为了摆脱 CPU 厂商而造出 Graviton 的公司。GPU 是门票,CPU 是打进 AWS 以为已经收回的那个插槽的特洛伊木马。"
用户 拿它和 2016 年黄仁勋亲手把首台 DGX-1 送到 OpenAI 作比。
另一派提醒别被交付仪式带偏。 说:"'更多 token 每美元'才是真正值得盯的声明,而不是那张交付照片。" 提出反向担忧:"当 CPU 和 GPU 都出自同一家厂商,每个 agentic 应用都会悄悄把一家公司的路线图继承为自己的依赖"(single-vendor dependency)。
首台已交付,200 万张仍是计划
实机到场不等于商用上线。8 月 26 日公告中的 200 万张 GPU 部署仍是计划承诺;Vera CPU 基础设施的表述也仍是"正在合作引入"。在 NVIDIA 与 AWS 已发布的材料中,没有 AWS 客户何时能租到 Vera 实例、价格如何、有哪几款机型的信息。
NVIDIA 博客的副题称 Vera 已"开始规模出货"(shipping at scale),但这同样是公司自述。评论区也在追问更具体的问题: 问"明年 AWS 的资本开支里,Vera 机架和自家 Trainium 芯片各占多少"; 提醒,agentic AI 的硬件指标不能只看峰值 tokens/s,长上下文下的 token 每美元、并发隔离、KV cache 命中率和工具调用等待时间,才会影响真实 agent 任务的成本。
第一台实机已经进了 AWS 的大楼,Vera 实例何时上线、200 万张 GPU 何时兑现,目前都没有时间表。