AREX Feed Article
月之暗面发布 Kimi K3 完整权重:2.8万亿参数开放模型震动全球 AI 格局
北京时间7月27日,中国 AI 初创公司月之暗面(Moonshot AI)在 Hugging Face 正式发布 Kimi K3 完整模型权重及技术报告,兑现了此前7月16日产品上线时做出的开源承诺。Kimi K3 是一个 2.8 万亿参数的混合专家(MoE)模型,约 104B 激活参数,原生支持文本与图像多模态理解,上下文窗口达 100 万 token。这是迄今参数量最大的开放权重模型,其发布迅速引爆了从开发者社区到国际地缘政治的多层面连锁反应。
模型架构与性能
Kimi K3 采用自研的 Kimi Delta Attention(KDA)和 Attention Residuals(AttnRes)架构,在 896 个专家中每个 token 激活 16 个(外加 2 个共享专家),共 93 层(69 层 KDA + 24 层 Gated MLA)。月之暗面在技术报告中声称,相较上一代 K2,K3 的整体扩展效率提升了约 2.5 倍。权重采用 MXFP4 量化,激活使用 MXFP8,总权重文件约 1.56TB。
在基准测试方面,K3 表现不俗但格局复杂。根据 Artificial Analysis 评估,Kimi K3 在"智能指数"上得分 57,仅落后 Anthropic 的 Claude Opus 5(61 分)和 Claude Fable 5(60 分)以及 OpenAI 的 GPT-5.6 Sol(59 分),与闭源前沿的差距缩小到 2–4 分——这是自今年 2 月 GLM-5 发布以来开放模型与闭源模型之间的最小差距。在 Frontend Code Arena 上,K3 以约 1679–1682 的 Elo 分登顶第一,超越 Claude Fable 5 和 GPT-5.6 Sol。在 BrowseComp(深度搜索)上 K3 也取得了 91.2 的最高分。不过月之暗面自己的技术报告坦承,K3 在整体用户体验上仍落后于 Claude Fable 5 和 GPT-5.6 Sol。
Day-0 生态适配与社区反应
此次权重发布不仅是模型下载,还包含了 FlashKDA 注意力内核、MoonEP(MoE 通信库)和 AgentEnv(分布式智能体环境基础设施)等配套基础设施的开源。社区和平台方反应极为迅速:vLLM 在 Day 0 即宣布支持,Cursor 也纳入了 K3 模型选项,Fireworks AI、Together AI、Baseten、Modal、Cloudflare Workers AI、RunPod、SiliconFlow、OpenRouter 等十余家推理平台在发布当天即上线 K3 API,定价同步为每百万 token 输入 $3、输出 $15。
值得注意的是,K3 对硬件要求极高。完整权重约 1.56TB,vLLM 推理需约 1.68TB VRAM,单张消费级显卡无法承载。社区虽有探索在分布式集群上自托管(包括多张 H100 或 B200 的方案),但大规模自托管对普通开发者而言门槛很高。相比之下,通过推理服务商的 API 调用仍是主流路径。
上线 48 小时推理容量即被挤爆
K3 的火爆程度远超月之暗面的预期。7月16日产品上线后不到 48 小时,月之暗面即宣布暂停新用户订阅,原因是 GPU 推理容量被远超预期的需求耗尽。现有用户的服务未受中断,但新用户注册通道一直未恢复——这在 AI 模型发布史上极为罕见。
月之暗面在纽约时报中文网的采访中拒绝就用户恢复情况置评。据 CNN 和 The New Stack 报道,这一事件凸显了中国 AI 公司在美方芯片出口管制下获取 GPU 能力的持续瓶颈。
许可证争议:开放权重≠开源
尽管 Kimi K3 权重可以自由下载、修改和部署,但其所附的"Kimi K3 License"并非传统开源许可证。该许可证包含两项关键商业限制:
-
模型即服务(MaaS)门槛:如果被许可方或其关联公司在任何连续 12 个月内的总收入超过 2000 万美元,且从事"模型即服务"业务(定义为允许第三方通过 API 等方式进行推理或微调),则必须与月之暗面另行签订商业协议。
-
大规模产品归因:如果基于 K3 或其衍生作品的产品月活用户超过 1 亿或月收入超过 2000 万美元,必须在用户界面上显著标注"Kimi K3"。
相较 Kimi K2 使用的"修订 MIT"许可证(仅有大规模归因要求),K3 新增的 MaaS 营收门槛引发了开发者社区的广泛讨论。月之暗面自身在官方材料中始终使用"开放权重"(open-weight)而非"开源"(open source)一词。AI 研究员 Nathan Lambert 评价称"它受到 MIT 启发,但明显是非商业性的"。对冲基金 Interconnected Capital 创始人 Kevin Xu 指出,月之暗面是"第一家如此明确提出商业许可要求的中国 AI 企业"。
白宫指控"蒸馏"美国模型,制裁威胁升级
K3 的发布迅速升级为中美 AI 政策博弈的焦点。7月22日,白宫科技政策办公室主任 Michael Kratsios 公开指控月之暗面"大规模"蒸馏了 Anthropic 的 Fable 模型,并称其获取了受出口管制限制的 Nvidia GB300(Blackwell 架构)服务器。美国财政部长 Scott Bessent 随即在 X 上表态:"开源不是对美国知识产权的开放猎场",警告将对中国公司实施制裁和实体清单认定。
Anthropic 此前已呼吁国会惩罚涉嫌蒸馏其模型的企业。然而,一些技术专家对指控的时间线提出质疑:Fable 模型 7月1日才公开发布,而 K3 的预训练和后训练周期远在此前已完成。月之暗面和 Anthropic 均未公开详细训练时间线,这一争议尚无独立技术审查结论。
黄仁勋联合 25 家公司发公开信力挺开放权重
7月24日,Nvidia CEO 黄仁勋在其 X 平台首条推文中发布了一封由 25 家科技公司联署的公开信,包括微软、Meta、Palantir 等,呼吁美国政策制定者避免对开放权重 AI 模型实施"过早限制",警告此类限制将"扼杀竞争或将创新推向海外"。
信中称,开放权重模型有助于加强竞争,确保 AI 技术的益处"广泛共享而非集中于少数人手中",并指出"仅依赖闭源模型并非天然安全——它们同样可能被攻破、滥用或出现外部无法检测的故障"。信中还主张,对"蒸馏"的担忧应通过"有针对性的法律和商业框架"而非"全面限制蒸馏技术的使用"来应对。
值得注意的是,OpenAI 和 Anthropic——两家正筹备今年大规模 IPO、估值均接近万亿美元的公司——并未签署此信。OpenAI 总裁 Greg Brockman 随后表示公司相信"广泛获取",并称未参与任何关于禁止中国开放权重模型的讨论;CEO Sam Altman 也在 X 上表态支持"美国在开放权重和闭源模型两方面都取胜"。
未经验证的说法
月之暗面关于"训练成本约 300 万美元"的说法在社交平台和社区讨论中广泛传播,但目前没有公开可查的独立审计或验证记录。技术报告未披露总训练 token 量,多位研究者指出这是一个"有意义的缺失细节"。此外,社区关于在约 80 张 RTX 5090 上复现 K3 推理的说法亦缺乏可追溯的公开证据——目前已知的自托管方案普遍依赖数据中心级 H100/B200 集群。