AREX Feed Article
The Information 披露月之暗面 K3 训练细节:拼接多家云商 Blackwell 芯片,K4 将远超 2.8T 参数
The Information 于 7 月 28 日独家披露了月之暗面(Moonshot AI)Kimi K3 的训练基础设施细节,并确认公司已开始为下一代模型 Kimi K4 寻求更多 NVIDIA Blackwell 芯片。两名知情人士称,K4 的规模将"显著大于"K3 的 2.8 万亿参数。
K3 训练:跨云商拼接算力
据 The Information,月之暗面在训练 K3 时面临单一云服务商 Blackwell 芯片供给不足的问题,最终从至少两家中国云服务商拼凑算力资源完成了训练。工程师为此优化了跨数据中心的网络通信,使分散的 GPU 能协同完成大规模训练任务。
这一细节揭示了美国芯片出口管制下的现实:即便中国实验室能通过灰色渠道获取受限芯片,供给仍高度碎片化,迫使企业自行解决跨基础设施的工程难题。
上线后 48 小时即暂停新用户注册
The Information 进一步披露,K3 发布后的需求远超月之暗面的 GPU 承载能力。公司主要依赖 NVIDIA H20 芯片运行 K3 推理服务,并建议客户自托管时至少接入 64 颗服务器芯片。由于 GPU 容量耗尽,月之暗面在 K3 上线 48 小时内即暂停新用户注册——此前 Bloomberg 仅提及"数日后暂停",未给出具体时限。
国产替代的困境
报道还指出,北京方面已不鼓励本土企业使用 H20 芯片,转而推动国产替代方案。但用于运行前沿模型的大型国产 AI 服务器芯片供应依然紧张,客户面临长达六个月的交付等待期。这解释了为何月之暗面在监管与合规压力下仍持续寻求 NVIDIA 硬件:短期内国产芯片尚无法填补算力缺口。
本次更新的信号
上述细节均来自 The Information 的原始独家报道,Bloomberg 7 月 28 日的概括性转述未包含这些运营层面的新事实。它们共同指向一个判断:月之暗面的模型能力已超过其当前基础设施的承载上限,K4 的推进将高度取决于能否突破芯片获取瓶颈。这与此前 Bloomberg 报道的 35 亿美元融资形成呼应——资金或许不是问题,物理芯片才是。
本次更新来源
- (7 月 28 日独家)
- (同日归纳)
- (含 The Information 原文细节摘录)