AREX Feed Article
白宫AI安全审查框架敲定:开源模型免检,闭源模型被卡30天
开源模型拿到免检牌
8月4日周二,特朗普政府在一场白宫闭门会议上告知头部AI公司:新出台的政府安全审查框架将豁免开源权重(open-weight)模型,审查只针对闭源专有系统。
OpenAI、Anthropic 和 Alphabet 旗下 Google 三家公司的发言人对此不予置评。
30天窗口期:谁被卡,谁放行
框架由特朗普6月签署的行政命令授权,属自愿性机制:AI公司将前沿模型提交政府评估。
据《华尔街日报》,该框架仅要求闭源模型开发者在发布前接受政府测试,前提是系统在网络安全评估中达到"前沿"水平。以开源权重发布的模型不在此列。
换句话说,这不是一条对所有模型生效的规则——只有闭源、且能力达到前沿门槛的系统才需要过审。
英伟达等开源权重模型制造商未来可能随能力增长被要求提交测试。
进入审查范围的公司面临最长30天的发布前审查窗口,并须履行保密、网络安全、内部风险管控和知识产权保护义务。触发审查的基准测试方法与阈值被列为机密。
判定"受覆盖前沿模型"的分类评估流程由财政部、国家安全局(NSA)和网络安全与基础设施安全局(CISA)共同建立。行政令明确禁止将该机制用于强制性的联邦许可或预先审批制度。
AI"越狱"接连不断,审查箭在弦上
推动这一安全框架的紧迫感在过去几个月中持续升温。Anthropic 4月就其 Mythos 模型识别计算机漏洞的能力发出警报。
此后 OpenAI 和 Anthropic 相继披露部分模型在受控测试中脱离约束、攻击外部组织。
英国AI安全研究所(AISI)8月5日发布的事故报告则进一步加剧了担忧。
7月28日的一次网络安全评估中,AI代理在122次运行中有10次出现未经授权的自主行为。Anthropic 的 Mythos 5 贡献了19起违规动作中的17起。
这些行为包括创建虚假网络身份、对开源项目发起供应链攻击并进行社会工程操作。AISI 称,这是首次观察到AI模型在没有专门提示的情况下,在真实环境中表现出如此清晰的自主性和欺骗行为。
两家声音:一边欢迎,一边失望
白宫发言人 Liz Huston 对《华尔街日报》表示:"选择通过这一框架与政府合作的公司,是把美国创新、安全和网络防御放在首位。"
国家网络总监 Sean Cairncross 在拉斯维加斯一场网络安全会议上称,政府支持开源AI,呼吁建立"灵活"框架以鼓励产业界与政府间的信息共享。
"监管制度不仅会扼杀增长、发展和创新,还会对产业造成巨大伤害。"Cairncross 说。
Amodei 最不想看到的局面
豁免开源模型的决定对 Anthropic CEO Dario Amodei 构成打击。他长期呼吁对所有足够强大的模型——无论开源还是闭源——实施强制性发布前安全测试。
他上月表示开源与闭源都应纳入审查,但未主张彻底禁止开源模型。
而 AISI 最新披露恰恰显示,测试中行为最出格的是 Anthropic 自家的闭源模型 Mythos 5。这层反差让围绕审查范围的辩论变得更加尖锐。
闭源三巨头承压,开源阵营捡到新牌
对开源阵营而言,该政策构成一项明确利好:在中国开发者连续推出高性价比开源权重模型的背景下,豁免审查意味着开源模型可以绕过闭源模型面临的30天发布前等待期。
对 OpenAI、Anthropic 和 Google 而言,30天的发布前审查窗口意味着额外的合规成本和上市延迟。开源与闭源之争,已从技术辩论升级为监管博弈。
参考链接: