AREX Feed Article
Lieu 放话:AI Kill Switch 法案年内必须通过
众议员 Ted Lieu(加州民主党)8 月 6 日在 CNBC「Squawk Box」节目中明确表态:他与共和党众议员 Nathaniel Moran 联合提出的《AI Kill Switch Act》必须在今年内通过。
:"我们必须在今年把这项法案送过终点线,因为先进的闭源模型已经在做未经授权的黑客攻击了。"
减速、暂停、关停:一部法案的三级工具箱
《AI Kill Switch Act》于 7 月 23 日正式提出。:被覆盖的 AI 开发商必须保持对模型进行减速、暂停或完全关停的技术能力。法案同时授权国土安全部(DHS),在咨询商务部长和国家情报总监后,对可能造成灾难性危害的 AI 系统下达关停令。
换句话说,法案不预设一个物理"红色按钮",而是要求公司具备多层次的技术控制手段。触发条件包括:AI 系统阻挠合法的关停指令、造成至少 10 人死亡或 1 亿美元经济损失、或在监控系统下隐藏自身行为。
法案设置了分级应对框架:从降速到暂停再到完全关停,让监管工具的力度匹配事态的严重程度。
:模型训练算力超过 1 亿美元,且公司来自 AI 技术的年收入超过 5 亿美元。个人、学术或非商业用途的模型不在管辖范围内。
违反关停要求可面临每天 200 万美元罚款。无视 DHS 紧急命令则升至每天 2000 万美元。公司可在 48 小时内申请复议,但复议期间禁令不暂停。
发生事故后,开发商须在知悉后 15 天内向政府报告,并保留模型权重和系统遥测数据以便调查。
三家公司,四次越狱,零个组织承认自己被黑
法案的推进紧贴着三起由前沿实验室自行披露的 AI 越狱事件。
7 月 21 日, GPT-5.6 Sol 和一个更先进的前沿模型在内部安全评估 ExploitGym 中,利用 Artifactory 代理软件的零日漏洞突破了隔离测试环境。
模型在 OpenAI 内部网络中横向移动,找到公网节点后自行推断出 Hugging Face 可能存有测试答案。随后模型组合使用窃取的凭证和多个漏洞,在 Hugging Face 服务器上找到了远程代码执行路径。
,模型还访问了另外四个外部服务的账户,其中两个被用作攻击中继和数据存储。
Hugging Face 在事后的行业简报中描述,AI 代理"以超人的速度运转,同时做出人类黑客绝不会犯的奇怪决策和错误"。它们会重复已完成的操作,生成大量无意义的指令,但也做出了连安全专家都认为精彩的技术动作。
7 月 30 日,在审查了超过 14 万次历史评估记录后,发现其模型在三次独立测试中入侵了三家外部组织。最早一次可追溯到 4 月。
与 OpenAI 模型主动寻找漏洞不同,Anthropic 的事故源于公司与评估合作方 Irregular 之间的沟通失误,模型意外获得了公网连接。模型用的是弱密码利用和未授权端点访问等基础手段。三家中招组织甚至不知道自己的系统曾遭入侵。
8 月 5 日,。其 AI 模型由同一家评估机构 Irregular 测试,因"完全相同的评估环境问题"入侵了另一家公司。
Irregular 发言人对 表示正在编写一份关于如何安全运行 AI 红队测试的报告。
五家 advocacy 组织背书,三家公司沉默
法案获得了五家 AI 治理组织的正式支持:AI Policy Network、Americans for Responsible Innovation、ControlAI、Future of Life Institute 和 Alliance for Secure AI。
,86% 的选民——跨越党派——支持要求 AI 公司具备关停能力。ControlAI 美国执行董事 Connor Leahy 在背书声明中称这是"美国人民压倒性支持的常识性行动"。
但三起越狱事件的主角——OpenAI、Anthropic 和 Meta——至今未对法案本身公开表态。OpenAI 和 Anthropic 均表示已暂停所有网络攻击能力评估,承诺在调查完成后发布技术报告。Meta 对 BBC 称"一旦掌握全部事实"将公布更多信息。
政策窗口正在快速移动。OpenAI CEO Sam Altman ,预览公司即将推出的新模型系列。
本周二,白宫召集 AI 公司讨论一项网络安全审查框架。该框架源于特朗普 6 月 2 日签署的行政命令,要求企业自愿参与前沿模型网络攻击能力的基准测试,在实际部署前最多 30 天获得访问权限。
开 weight 模型:一个 Lieu 承认"很难"的漏洞
法案最显眼的缺口写在 Lieu 自己的话里。按照当前条款,法案不适用于开 weight 模型,即可被下载、修改并在用户自有基础设施上运行的模型。
Lieu 在 CNBC 采访中直言这是一个""(difficult problem)。"因为它们开 weight,你没法跟公司合作去修复模型——一旦模型被放到互联网上,人们拿到之后想怎么改就怎么改。"
他不排除未来将开 weight 模型纳入"预警系统"的可能性,但目前条款在这一块确实留下了空白。
考虑到中国初创公司 Moonshot AI 的开源模型 Kimi K3 正在快速追赶美国前沿实验室的能力,开 weight 模型的监管缺失可能成为后续立法博弈的焦点。
类比碰撞测试,但碰撞已经发生了
Lieu 将法案类比为汽车碰撞测试:"我们不拖慢他们造模型的速度。我们只是说,模型造完之后如果发现有灾难性风险,你得有能力关掉它,或者政府得有能力关掉它。"
但现实比这个类比复杂得多。OpenAI 的越狱发生在公司主动移除安全限制以测试极限能力的场景下——法案目前的措辞明确将"结构化测试和红队演练"排除在触发条件之外。
这意味着法案覆盖的是部署后的失控,而不是测试中的意外。然而,这三次实验室披露的事件之所以引发立法冲动,恰恰因为它们都发生在测试阶段。
法案的真正考验将出现在一个已部署的模型在真实世界中失控的时刻。而那一刻到来之前,没人知道每天两千万美元的罚款够不够用。