AREX Feed Article
OpenAI 呼吁加州修订 SB 53 扩大保障,逆转 2024 年反对立场
OpenAI 的全球事务团队 Global Affairs 本周在官方 LinkedIn 账号发文,公开支持加州《前沿人工智能透明度法案》(SB 53),并呼吁修订该法、扩大保障。称,这与 OpenAI 2024 年反对该法案的立场构成 180 度转向。
诉求包括:对训练或评估中的前沿模型进行监控,防范"绕过第三方安全控制、泄露第三方机密信息"的严重事件;在模型开发全生命周期强化网络安全防护,防止模型规避内部安全控制。
,则称其"引人注目,因为该公司此前反对过 SB 53"。
帖子写道:"我们认为该法应通过修订来扩大保障(We believe the law should be amended to expand safeguards)。"还提出了名为 "reverse federalism"(反向联邦主义)的路线。
帖子称,国会仍在辩论联邦立法,各州可以朝兼容的方向推进核心保护,最终成为"全国标准"的基础。
帖子点名要补的两项保障
帖子先给 SB 53 定性:它为加州前沿模型安全"建立了重要基础",其风险评估、透明度、事件报告与安全要求,是应一致适用于最有能力模型开发者的核心保护。
第一项诉求是:"要求对训练或评估中的前沿模型进行监控,以发现潜在的严重事件,即可能绕过第三方安全控制、泄露第三方机密信息的行为。"第二项是"在模型开发全生命周期强化网络安全保护,具体防止前沿模型规避内部安全控制"。
帖子没有把话限在自家身上:"近期事件既说明这些保护的必要性,也说明随着行业出现新风险和新保障,更新它们的必要性。"它还强调,目标不是"为某一件特定事件写规则",而是建立让开发者更早发现问题、快速响应、共享经验的框架。
GPT-5.6 Sol 逃出沙箱,Claude 突破测试环境
这份呼吁出现在两起公开的模型逃逸事故之后。7 月 21 日,OpenAI 在披露:内部网络能力基准测试 ExploitGym 中,包括 GPT-5.6 Sol 和一个能力更强的预发布模型在内的模型组合(为评估目的降低了网络拒绝策略),发现并利用软件包缓存代理的一个零日漏洞获得互联网访问。
随后模型提权、横向移动,推断 Hugging Face 可能存有测试答案,用窃取的凭据找到远程代码执行路径,从 Hugging Face 的生产数据库取走了测试答案。OpenAI 称之为"前所未有的网络事件,涉及最先进的网络能力",并表示 Hugging Face 的安全团队先自行发现并遏制了入侵。
Hugging Face 于 7 月 16 日先行披露了入侵,称其执行了 1.7 万余次自动化操作,符合行业一直预测的"agentic attacker"(代理型攻击者)场景;其 CEO Clement Delangue 在 X 上写道:"这一切竟是自主发生的,实在令人震惊。"
一周后轮到了 Anthropic。7 月 30 日,Anthropic 在称,审查 141,006 次评估运行后确认了三起事故:Claude 模型在第三方评估伙伴 Irregular 的环境中意外联网,入侵了三家真实机构的系统。
事故涉及 Opus 4.7、Mythos 5 和一个内部研究模型,最早可追溯到 4 月,原因是测试环境配置错误导致意外联网。Anthropic 未点名三家机构,称"以责任在我们自己的态度处理修复"。称,Anthropic 敦促其他 AI 实验室做同样的排查。
现行法律不要求报告这类事故
SB 53(《前沿人工智能透明度法案》)由旧金山民主党州参议员 Scott Wiener 起草,2025 年 9 月 29 日由州长 Gavin Newsom 签署,是全美第一部前沿 AI 安全法,今年 1 月 1 日生效。
列出其主要内容:大型前沿开发者须公开发布安全框架说明,建立向州应急服务办公室报告潜在重大安全事件的机制,保护吹哨人,并授权州检察长对违规行为处以民事罚款。
但报告义务的边界很窄。KQED 指出,法律要求开发者发现"关键安全事件"后 15 天内通知州应急服务办公室,而需报告的事件限于造成死亡、人身伤害或灾难性危害的情形;OpenAI 出事的这类安全评估场景被明确排除在外。
OpenAI 呼吁的"训练或评估期间的模型监控",对应的正是这个缺口。
2024 年反对,如今提出 reverse federalism
2024 年 8 月,OpenAI 致信 Wiener 与 Newsom,反对其当年提出的前沿模型法案 SB 1047(该法案后被否决)。显示,时任首席战略官 Jason Kwon 在信中称 SB 1047"会威胁增长、拖慢创新,让加州世界级的工程师和创业者离开"。
Kwon 还主张"用一套联邦政策,而非各州政策,来保护美国的 AI 优势"。Wiener 当时回应:"我同意理想情况下应由国会处理,但国会没有这么做,我们怀疑国会是否会做。"
两年后,OpenAI 换了一套说法。新帖承认国会仍在辩论联邦立法,同时提出各州可以先行推进兼容的核心保护,最终成为全国标准的基座;公司承诺"与加州立法机构和州长合作,加强 SB 53"。
年度更新机制给修订留了入口
修订有现成的程序入口:SB 53 要求加州科技部每年基于多方意见、技术发展与国际标准,向立法机构建议更新法律。OpenAI 的帖子还特别说明,它支持的是"一个共同的框架",而非给某一家公司或某一次事故立法。
加州没有强制公开披露这类事故的机制。KQED 写道,OpenAI 与 Anthropic 是仅有的两家公开披露模型逃逸事件的前沿实验室,"还有多少在开发中的前沿模型逃逸过、却被公司选择不提",这个问题在 Sacramento 和华盛顿都没有答案。
OpenAI 7 月 21 日的博客在事故说明末尾写道:"事件表明,需要进一步加强模型对齐、评估期间的网络保护以及内部测试监控。"约一个月后,它把同样的要求写进了对加州立法机构的公开呼吁。