AREX Feed Article
首批量产 Vera Rubin 运抵微软数据中心,纳德拉发文致谢英伟达
北京时间 8 月 22 日清晨(美东时间 8 月 21 日晚),微软董事长兼 CEO Satya Nadella 在 X 上宣布:首批量产版(production)NVIDIA Vera Rubin 已运抵微软数据中心。写道:"交付日,首批量产 Vera Rubins 抵达我们的微软数据中心。非常感谢我们的合作伙伴英伟达,以及 Azure 硬件和数据中心团队,是你们的出色工作把我们带到了这个里程碑。"推文配发了三张照片。
在可核实的公开信息中,这是英伟达 5 月底宣布 Vera Rubin 进入全面量产以来,第一起由云厂商 CEO 公开确认的量产到货。称,Vera Rubin 平台正爬坡进入全面量产,生产出货将于今年秋季开始。纳德拉没有披露到货数量、部署地点和用途。
英伟达官方下场祝贺,社区开始算机架账
约一小时后,转推祝贺:"NVIDIA Vera Rubin 正在爬坡进入全面量产。祝贺微软的团队达成了这个激动人心的里程碑。"
截至 8 月 22 日凌晨,纳德拉的推文获得约 970 个赞、8.2 万次浏览。讨论很快从"到货"转向"一台机架能装什么"。独立 AI 从业者 Michael Guo 转推算了一笔账:一台 Vera Rubin NVL72 机架装 72 张 Rubin GPU、20.7TB HBM4 显存,提供 3.6 EFLOPS 的 NVFP4 推理算力;按他的估算,这些显存大约能装下 13 套 Kimi K3 的权重,还有余量跑 100 万 token 的上下文。
微软员工 Nicolas Bustamante 称 Vera Rubin"是一头绝对的野兽",AI 算力约为 GB300 的三倍、显存带宽 2.7 倍,"每兆瓦产出的 token 多得多",并预测"加速很快就要来了"。这些是他个人的估计,不是官方数据。
行业分析师 Ryan Shrout(Signal65 总裁兼总经理,前英特尔 Graphics and AI 产品负责人)转推感叹 "As if on queue…"。不到两小时前,他刚在另一条推文里说"下周英伟达和黄仁勋要说什么,关系重大"。
从 CES 官宣到量产到货,走了大半年
这条到货消息是微软 Rubin 时间线上的第四站。
2026 年 1 月 5 日,,称 Rubin 已全面投产、伙伴产品将于 2026 年下半年上市,并把微软列为最早部署 Vera Rubin 实例的云厂商之一;微软将在下一代 AI 数据中心(包括未来的 Fairwater AI 超级工厂)部署 Vera Rubin NVL72。纳德拉当时说:"我们正在建设世界上最强大的 AI 超级工厂……加入 Vera Rubin GPU 后,开发者将以全新的方式进行创造、推理和扩展。"
同一天,解释微软为什么接得住 Rubin:Azure 的机架、供电、液冷和网络在数年前就按 Rubin 的规格预留了余量,现有 Fairwater 站点位于威斯康星州和亚特兰大。
3 月 16 日,宣布成为首家在实验室点亮 Vera Rubin NVL72 的超大规模云厂商,并称过去不到一年已在全球数据中心部署了数十万张液冷 Grace Blackwell GPU。纳德拉次日发帖:"我们是首家把 NVIDIA Vera Rubin NVL72 系统跑起来做验证的云。"
5 月 31 日英伟达宣布全面量产,8 月 21 日首批量产机架到货。从实验室验证到机房交付,微软用了五个月。
单机架 260TB/s 互联,比整张互联网还宽
Rubin 平台由六颗新芯片组成:Vera CPU、Rubin GPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU 和 Spectrum-6 以太网交换机。微软接货的是其中最大的形态 Vera Rubin NVL72——单机架集成 72 张 Rubin GPU 和 36 颗 Vera CPU,经第六代 NVLink 互联,机架级带宽约 260TB/s,英伟达称这比整张互联网的带宽还高。
性能口径上,英伟达称 Rubin 平台相比 Blackwell,推理 token 成本最高降低 10 倍、训练 MoE 模型所需 GPU 数量减少 4 倍;相比上一代 Grace Blackwell 平台,agent 吞吐量提升 10 倍。Azure 博客给出的数字是:每颗 Vera Rubin Superchip 提供 50 PFLOPS NVFP4 推理算力,单机架 3.6 EFLOPS,是 GB200 NVL72 机架的 5 倍。
为支撑这套规格,NVL72 采用全液冷设计,免线缆模块化托盘让装配和维护速度比 Blackwell 快 18 倍;Vera CPU 用 88 颗自研 Olympus 内核,兼容 Armv9.2。黄仁勋在 GTC Taipei 上说,Vera Rubin 是"为这个时刻而生的 AI 工厂引擎"——一个 prompt 可以触发上千步的推理、检索、工具调用和回答生成。
抢 Rubin 的,不止微软一家
微软宣布到货时,其他云厂商的 Rubin 计划大多还停在"即将上线"。据,Google Cloud 计划 2026 年下半年提供 Vera Rubin NVL72;AWS 称未来 12 个月部署超一百万张英伟达 GPU(含 Blackwell 和 Rubin);Nebius 将借与 Meta 最高 270 亿美元的计算合同,启动最早的大规模 Vera Rubin 部署之一。
微软自己的订单还外溢到了别处:Nscale 在 Monarch Compute Campus 为微软建设 1.35GW 的 Vera Rubin 集群。CoreWeave 和 Lambda 则把 Rubin 上线时间排在 2026 年下半年。
在"谁先拿到量产货"这件事上,微软目前公开领先:3 月第一家点亮实验室样机,8 月第一家官宣量产到货。但数量没有披露,领先幅度无从判断。
数量、地点、用途,纳德拉都没说
推文留下的空白和它给出的信息一样多:多少台机架、进哪个数据中心、先跑什么负载,都没有披露,英伟达和微软也都没有给出"上线可售"的时间表。
到货只是交付链的第一环。机架接下来要装机、接线、点亮、跑通基准,才能变成 Azure 上可购买的算力。英伟达 5 月底的说法是生产出货从今年秋季开始,微软这批货属于量产爬坡最早的一批;谁能先把手中的 Rubin 变成跑着推理负载的在线服务,谁才算真正领先——而这一步的公开较量,将从各云厂商公布 Rubin 实例上线时间表开始。