AREX Feed Article
路透独家:中国军方关联机构利用 OpenAI 与 Anthropic 模型输出训练国防 AI,蒸馏争议升级至军事安全层面
路透社 7 月 31 日发布独家调查报道,审查 80 余篇中国学术论文与专利后披露:与中国人民解放军(PLA)及其他军方机构存在关联的中国研究机构,正在利用 OpenAI 和 Anthropic 前沿模型的输出,通过"模型蒸馏"技术训练本土 AI 系统,应用于监控、网络战、无人机作战与战术决策等国防领域。报道由路透社与华盛顿詹姆斯敦基金会(Jamestown Foundation)合作完成,后者将其研究成果独家提供给路透社。
模型蒸馏:从商业 IP 争议到军事安全危机
模型蒸馏是一种广泛使用的 AI 训练技术——利用大型"教师"模型的输出(包括答案和推理过程)训练更小、更高效的"学生"模型,使后者能以更少的算力完成特定任务。该技术本身并不违法,美国学术界和产业界长期使用。
争议的核心在于未经授权的模型能力提取。中国军方关联机构通过 API 调用或代理渠道访问 OpenAI GPT-3.5 和 Anthropic Claude 3 Haiku 等闭源模型,获取其输出并用于训练本土系统。这在实质上绕过了美国对华先进芯片的出口管制——前沿推理能力以文本形式转移,被压缩进可在国产硬件上运行的小型模型。
詹姆斯敦基金会研究员 Sunny Cheung 分析了其中 60 余篇论文后指出,中国军事科学家正在"系统性地捕获西方模型的推理步骤"。"教模型给出正确答案是一回事,教它答案背后的推理过程要困难得多,"Cheung 表示,"这些论文表明,中国军方关联研究者正试图将昂贵、专有的推理能力转移到他们可以控制和本地部署的小型系统中。"
论文揭示的军事应用场景
路透社与詹姆斯敦基金会在审查中发现了覆盖多个军事领域的应用案例:
- PLA 96941 部队(北京军事情报与网络战部队):研究人员使用 GPT-3.5 处理敏感军事软件代码,生成摘要后训练本土模型,使最终系统完全运行在中国军事网络内,规避了第三方模型无法接触涉密信息的限制。
- 国防科技大学(隶属 PLA):2024 年论文显示,研究者利用蒸馏技术将图像处理模型压缩后部署于无人机,使其能在通信中断时实时分析视频、辅助导航和打击决策。
- 军事科学院:今年早些时候的研究在模拟海上作战中,利用蒸馏技术在战术硬件上运行目标识别模型,涉及无人机、舰艇和无人潜艇。
- 中北大学(与国防工业关系密切):研究者使用 Claude 3 Haiku 生成合成训练数据,用于社交媒体监控与内容审核的文本分类模型。
未解的关键问题
报道留下若干重要未解问题:
- 访问途径不明:OpenAI 和 Anthropic 均禁止在中国提供商业服务,且服务条款明确禁止军事用途和以竞争为目的的模型开发。相关机构是否通过 VPN、第三方代理商或其他代理绕过限制尚不清楚。
- 具体武器系统未知:报道未确认哪些具体国防系统最终搭载了蒸馏模型。
- 各方沉默:白宫、五角大楼、中国外交部、PLA 及 OpenAI 均未回应置评请求。Anthropic 表示不在中国提供 Claude 商业访问,并警告蒸馏模型可能丢失原系统的安全保护机制。
政策背景与影响
此次调查为华盛顿限制中国获取美国 AI 模型提供了新论据,将蒸馏争议从商业知识产权层面正式升级至军事安全层面。此前,美国官员已指控部分中国机构利用蒸馏提取美国模型能力;Anthropic 于 6 月指控阿里巴巴通过近 25,000 个欺诈账户进行了 2,880 万次 Claude 交互的大规模蒸馏;AI 初创公司月之暗面(Moonshot)上周否认特朗普政府关于其 Kimi K3 模型依赖蒸馏的指控。
报道发布之际正值美中 AI 治理与安全谈判前夕。蒸馏技术暴露了出口管制框架的盲点——如果前沿能力可以通过模型输出而非芯片或权重传播,则现有以硬件为中心的控制机制将不足以阻止能力扩散。正如 AI 数据公司 Sapien 联合创始人 Trevor Koverko 所言,蒸馏"最好理解为将选定的能力转移到更便宜、本地控制的系统中,而非实现脱离前沿 AI 的独立。"