AREX Feed Article
月之暗面被曝筹划 Kimi K4 并寻求更多 Blackwell GPU,K3 跨云服务商拼接 Blackwell 训练细节同日曝光
北京时间7月28日,科技媒体 The Information 发布独家报道,披露中国AI公司月之暗面(Moonshot AI)内部正在讨论开发下一代模型 Kimi K4,规模将远超刚刚上线的 2.8 万亿参数 Kimi K3。为此,该公司正设法在美国出口管制框架下获取更多 NVIDIA Blackwell 架构 GPU。
报道同时追述了 Kimi K3 训练环节此前未被披露的芯片来源细节:K3 的部分训练使用了至少两家中国云服务商提供的 Blackwell 芯片完成;由于单一供应商算力不足,月之暗面甚至跨数据中心拼接了多台 8 卡 Blackwell 服务器以凑齐训练所需规模。
关键细节
K3 训练:Blackwell 芯片借道中国云服务商
The Information 报道称,Kimi K3 的训练并未完全依赖合规出口的 H20 等芯片,其部分训练工作负载跑在了 Blackwell 架构 GPU 上——这些芯片通过至少两家中国云服务商间接获取。由于没有任何一家供应商能单独提供足够的 Blackwell 算力,月之暗面采取了跨数据中心拼凑的策略,将多台 8 卡服务器连接起来组成训练集群。
该说法与此前一周美国白宫的公开指控相呼应。7月22日,白宫科技政策办公室主任 Michael Kratsios 曾公开指责月之暗面通过泰国服务器非法获取受限的 NVIDIA GB300 芯片用于 Kimi K3 训练。但 The Information 的新爆料将芯片获取渠道指向了国内云服务商,而非泰国中转路线。
截至目前,上述芯片获取细节均未经独立第三方核实,目前仍属 The Information 单源爆料。月之暗面未就上述报道公开回应。
K4 规划:寻求更多 Blackwell,模型体量远超 K3
报道称月之暗面已在讨论 Kimi K4 的开发计划。虽然具体参数规模尚未披露,但消息指 K4 将"远超"K3 的 2.8 万亿参数。为此,公司正积极寻求获取更多 NVIDIA Blackwell GPU 用于训练。
算力瓶颈:K3 上线 48 小时推理容量打满
报道还提及 Kimi K3 面临的推理侧算力紧张。月之暗面在 7 月 16 日发布 K3 后,仅用 48 小时即因需求远超 GPU 集群承载能力而暂停新用户订阅。公司目前使用 NVIDIA H20 芯片进行推理,建议至少连接 64 颗芯片才能托管 K3 模型。这一瓶颈从侧面印证了该公司在高端 GPU 上的结构性短缺。
阿里 Qwen3.8-Max 也用了 Blackwell
同一报道还披露,阿里巴巴近期发布的 2.4 万亿参数旗舰模型 Qwen3.8-Max,其训练同样使用了含 Blackwell 在内的 NVIDIA 芯片。这一信息为阿里此前对训练硬件的模糊表述提供了来自单一信源的补充细节。
市场反应
消息发布后,ZeroHedge、Whale Insider 等金融类媒体迅速转载,Wall St Engine 发布了包含几乎所有关键细节的摘要帖。ZeroHedge 单条推文浏览量超过 4 万次,Whale Insider 的相关推文获得超过 200 个点赞。金融博主的反应集中在两方面:一是 Blackwell 芯片绕过出口管制的合规风险,二是中国 AI 公司在算力受限背景下仍能推出前沿模型对全球竞争格局的含义。
需注意的不确定性
- 所有关于 K4 讨论和芯片获取方式的细节均来自 The Information 的单一信源报道,未经其他独立渠道证实。
- 月之暗面尚未就 K4 规划或 Blackwell 芯片使用发表任何公开声明。
- K3 训练中 Blackwell 芯片的具体型号(GB300 或其他)、获取方式及规模均未获独立确认。
- 此前白宫关于"泰国中转"的指控与本次"国内云服务商"的说法存在不同路径描述,矛盾尚未厘清。
- Qwen3.8-Max 训练硬件信息同样仅来自该报道,阿里方面未就此单独回应。
来源
- — 2026年7月28日独家报道(付费墙后,摘要及核心细节来自公开转载)
- — 报道要点摘要
- — 消息转载
- — 消息转载
- — 白宫此前关于 Blackwell 芯片的指控(背景)
- — K3 上线48小时暂停订阅(背景)