AREX Feed Article
Sam Altman 表态:OpenAI 欢迎联邦 AI 安全框架,但无需等反垄断豁免,前沿训练前先写安全案例
OpenAI CEO Sam Altman 于 9 月 14 日 04:05(UTC)在 X 发布长帖,正面回应 Anthropic CEO Dario Amodei 于 9 月 12 日(周六)发起的 AI 放缓争论:他欢迎一个为前沿 AI 设定一致安全要求的联邦框架,但表示「我们不认为需要等待反垄断豁免或立法」才能开始行动。他同时披露一项具体做法变化——OpenAI 现在会在预期显著提升能力的前沿强化学习(reinforcement learning,通过奖励信号训练模型行为的方法)运行之前,预先制定明确的安全案例(safety cases,即先书面论证为何可以安全开展某次训练)。
背景只有一条需要交代:9 月 12 日,Amodei 发表长文呼吁全行业放慢提升模型能力的速度,并提出三步计划;Anthropic 已单方面承诺第一步,即向第三方评估者开放员工级访问,据,该计划还包括请政府提供有限的反垄断豁免,让实验室之间的安全协调合法进行。记录了随后两天内的阵营分化:Altman、Elon Musk、Demis Hassabis 先后表态支持放缓的方向,而曾担任特朗普 AI 与加密事务负责人的 David Sacks 则批评其中的反垄断豁免诉求。
欢迎联邦框架,但「先做好我们自己能做的」
在中,Altman 写道,美国公司在开发能力越来越强的 AI 时,必须让外界相信它们会负责任地行事,尤其在进展轨迹变陡之后,「每一家前沿实验室都必须兑现这一点,否则我们中任何人都没有理由来上班」。
他对监管的态度是两层的。一方面,他明确欢迎为前沿 AI 设定一致安全要求的联邦框架,认为管理前沿风险的一致规则「是个好主意」,并对「独立审计者」(independent auditors)这类想法表示兴奋。另一方面,他划出界线:提供这种信心的工作不必等反垄断豁免或立法出台才开始。他把需要政府的环节只留给国际协调——「但首先,我们应该做好我们自己能做的事」。
这与 Amodei 原案形成一处实质分歧:Amodei 的三步计划把反垄断豁免列为实验室之间协调安全标准的前提,而 Altman 的表态是,这项工作无需等待,豁免也不是必要条件。
安全重心从部署环节前移到开发过程
帖文中披露的新做法指向开发流程的更前端。Altman 说,数年前 OpenAI 等公司制定的 Responsible Scaling Policies(负责任扩展政策)与 Preparedness Frameworks(准备框架)在当时是合适的,但它们主要针对已完成模型的部署环节,「而不是开发过程中发生的事」。要把重心转向安全的开发与评估,需要新工具。
他给出的例子是:在预期会显著提升能力的前沿强化学习运行之前,OpenAI 现在会预先制定明确的安全案例——这是在模型发布前的既有安全工作之外新增的一层。这一披露与此前几天的动向相接:36Kr 分析稿提到,在 agent(智能体)失控事件后,OpenAI 曾暂停部分前沿模型的推理任务,并一度暂停最新模型的强化学习训练长达两周。按帖文的描述,安全案例机制把这类审查从「出事后暂停」变成「开跑前备好书面论证」。
Altman 还希望其他公司借鉴 OpenAI 的做法并提出各自的方案,认为就不对齐(misalignment,模型行为偏离设计者意图的问题)、监控与安全形成共享标准会带来更好的结果,并表示期待与行业同行合作制定这些标准的最佳版本。
「Pacing 不是 stopping」,以及成本与竞争压力的边界
对「放缓」本身,Altman 在帖文中给出明确定义:「我们说的 pacing 不是 stopping。」进展迅速并将继续,但应当比原本可能的速度更慢;安全案例和监控这类干预代价不小,他认为这些代价是值得的——「任何美国竞争压力都不应成为鲁莽行事的理由,也不应让能力跑在对齐与监控前面」。
这份长帖是在一个已经升温的周末之后发出的。称,Altman 周六已表示同意需要「pace the frontier」;Musk 周日凌晨发帖称「Dario 说得对,应该有某种监督,由竞争对手对 AI 进行同行评审是正确的起点」;Hassabis 则评价 Amodei 的文章「指向正确的方向,但细节还需要推敲」。Sacks 的批评集中在另一处:他称如果两家真认为模型「吓人」到需要放缓,他支持其「负责任的决定」,但要求它们「别再假装需要任何人的许可」,并警告把「你们偏好的监管框架」当作放缓的条件,会像「对公众和政治体系的敲诈」。
投资人加文·贝克(Gavin Baker,Atreides Management 管理合伙人)在中归纳:整个周末唯一「有形」的新事实,是 OpenAI 与 Anthropic 将引入嵌入式第三方评估者。Altman 的 9 月 14 日长帖在这个基础上又推进了一层:把安全重心从部署前移到开发过程,同时表示无需以反垄断豁免为前提。
待解:豁免未落地,标准也尚未共享
Altman 表示不必等待反垄断豁免或立法,而豁免何时落地、联邦框架是否会成为现实,帖文没有给出时间表;其他前沿实验室是否会跟进「训练前安全案例」的做法,同样悬而未决。Amodei 原案中更棘手的部分——与威权政府协调——在 Amodei 自己接受 时被他称为「最艰难的困境」:如果中国不跟进,「我不知道这是否可能,但我们应该尝试」。
Meta 的位置也未定:据 CNBC,Meta AI 负责人 Alexandr Wang 周六未直接回应 Amodei 的文章,只表示 Meta Superintelligence Labs 正随着模型变强而「快速提高投入对齐(alignment)工作的比例」。
Altman 在帖文末尾给出的顺序是:先做实验室自己能做的事,国际协调才需要政府出手——反垄断豁免、联邦立法与各家实验室是否跟进,都排在这之后。