AREX Feed Article
AMD 推介风冷版 Instinct MI350P,称企业无需重构基础设施即可部署 LLM 级 AI
北京时间 9 月 21 日 6 时 20 分(UTC 9 月 20 日 22 时 20 分),AMD 在认证 X 账号 发帖,推介 Instinct MI350P 加速卡。帖文称,这款 GPU 旨在把 LLM(大语言模型)级 AI 带入企业现有环境,风冷(air-cooled)形态让各组织无需重新审视整体基础设施即可完成部署。
这不是 MI350P 第一次露面:它由 AMD 在 2026 年 5 月 7 日随推出,随后出现在 Dell Tech World、HPE Discover 和 Computex 2026 展台上。 7 月 17 日的报道形容它「过去两个月在展会上无处不在」。这条 X 帖文,是 AMD 对「风冷、免重构」这一卖点的又一轮官方传播。
帖文原文:两句产品口径
帖文只有两句:「把 AI 带入企业,未必要从零开始」,以及「AMD Instinct MI350P 旨在把 LLM 级 AI 带入现有环境,其风冷形态帮助各组织无需重新审视整体基础设施即可部署」,并附一段宣传视频。截至北京时间 9 月 21 日下午,这条帖子获得约 6.15 万次浏览、308 次点赞、51 次转发和 27 条回复。
这些表述属于 AMD 的单方产品口径,帖文没有引用第三方测试数据。
「风冷形态」具体指什么:双槽、无风扇、靠机箱风道
按 AMD ,MI350P 是一张全高、全长、双槽的 PCIe 5.0 x16 插卡,长 10.5 英寸(267 毫米),散热方式标注为被动(passive):卡上没有风扇,只有一条贯穿全长的大号散热片,由服务器机箱风道带走热量。这是它与传统 OAM(开放加速器模组)加速器的关键差别——MI350X 这类模组面向高功率密度的专用节点,整卡功耗(TBP)达 1,000W;而 MI350P 把 TBP 控制在 PCIe CEM 规范允许的 600W 上限之内,对供电或散热吃紧的服务器,还可配置到 450W,代价是性能下降。AMD 称,此类风冷系统最多可装 8 张卡;规格页列出的操作系统支持仅有 Linux x86 64 位。
AMD 在 5 月的博客里解释了这套卖点的出发点:上云带来隐私顾虑和不可控的成本,而为大型 GPU 加速平台改造本地机房,往往意味着对供电和散热做昂贵的重新设计。PCIe 插卡因此被 AMD 定位为「第三选项」,直接插进企业现有的服务器。
半颗 MI350X:144GB 显存从哪来
ServeTheHome 在里拆解了这张卡的来路:AMD 没有使用未达标的 MI350X 降级芯片,而是借助 chiplet(小芯片)设计,专门做出一颗小一号的新芯片。MI350X 由 2 个 I/O 裸片和 8 个计算裸片(XCD)组成;MI350P 只用 1 个 I/O 裸片加 4 个 XCD,HBM3E(高带宽内存)堆栈从 8 颗减到 4 颗。反映到规格上几乎是等比减半:128 个计算单元、144GB HBM3E、4TB/s 带宽、MXFP8(微缩 8 位浮点)峰值 2.3 PFLOPS——MI350X 分别是 256 个、288GB、8TB/s 和 4.6 PFLOPS。
按 AMD 博客的口径,这张卡在 MXFP4 精度下峰值算力最高 4,600 TFLOPS,实际交付性能估计约 2,299 TFLOPS,AMD 称这是「当前企业级 PCIe 卡中的最高性能」;博客同时注明,这些数字是基于 2026 年 4 月工程预估的初步数据,可能变动。
取舍也写在纸面上。ServeTheHome 指出,MI350P 没有引出 GPU 间互联 Infinity Fabric,多卡之间只能通过 PCIe Gen5 x16 通信,因此 8 卡服务器更适合同时跑 8 个独立模型,而不是把一个超出单卡 144GB 的模型摊到 8 张卡上。该卡保留了系列的多实例分区能力(CPX),最多切 4 个分区,每区 1 个 XCD 配 36GB 显存。ServeTheHome 还记录了一个细节:AMD 这次同时公布了峰值与交付性能,其中 MXFP6 的交付成绩明显低于峰值——在 MI350X 发布时,AMD 并没有做这类披露。
这张卡要补的市场缝隙
在 ServeTheHome 看来,MI350P 填的是一个被两家巨头跳过的空档:近几年 AMD 与 NVIDIA 主要按节点、整机柜的模组化形态出货数据中心加速器,想在本地跑推理、却容纳不了一台 11kW 计算节点或不打算按机柜采购的客户,长期只能用工作站 GPU 改的产品顶上。ServeTheHome 称,这是 AMD 自 2022 年 Instinct MI210 之后第一款采用当代架构的 Instinct PCIe 卡,而 NVIDIA 目前没有对应的当代服务器级 PCIe 产品,也没有表示将要做。
7 月的报道还把它和两款在售竞品摆在一起:NVIDIA H200 NVL(141GB HBM3E)与 RTX Pro 6000 Blackwell Server Edition(96GB GDDR7)。ServeTheHome 的对照结论是:MI350P 在显存容量和已公布的 FP4/FP6 峰值数字上占优,Blackwell 卡胜在更新的架构、且不受 HBM3E 供应紧张约束;这三款在售的现代 PCIe 卡都是 600W 被动散热。该报道同时注明,Dell 与 HPE 赞助了作者的展会行程,AMD 提供了参观机会。
评论区在问功耗、能效和现货
回复区的讨论大多落在同一类实际问题上。认证账号 说「这种规模还能风冷,挺疯狂的」; 直接问 TDP 是多少; 追问风冷方案与液冷相比的每瓦性能,以及这「是否更多是为了让采购少些阻力」;自称研究计算架构与 AI 的 留言称这张卡「几乎到处缺货」。这些均出自个人账号,不代表行业共识。
这条帖文本身没有回答它们:全文没有价格,也没有供货时间表,性能数字也仍是 AMD 标注为可能变动的初步估计。