AREX Feed Article
未来生命研究所发布 2026 夏季 AI 安全指数:Anthropic 以 C+ 居首,全行业无一家及格
2026 年 7 月,未来生命研究所(Future of Life Institute,FLI)发布半年度《AI 安全指数》夏季版。独立专家组按六大领域、37 项指标对全球九家头部 AI 公司进行安全评级,结果揭示了一个系统性困境:得分最高的 Anthropic 也仅获 C+,无一家公司达到 B 级,三家公司直接拿到 F。报告批评行业正系统性撤回既有安全承诺,而军事 AI 应用的加速扩散正在制造新的风险。
评级总览:C+ 已是天花板
此次评估覆盖九家公司,使用美国 GPA 制(A=4.0,F=0)。排名如下:
- Anthropic:C+(2.66),与上一期持平,在六个领域中五项领先;
- OpenAI:C(2.28),从上一期的 C+ 下滑;
- Google DeepMind:C(2.01),持平;
- Meta:D+(1.32),从 D 上升至第四位;
- Z.ai:D-(0.88),从 D 下滑;
- 阿里云:D-(0.87),持平;
- xAI:F(0.65),从 D 跌至 F;
- DeepSeek:F(0.47),从 D 跌至 F;
- Mistral:F(0.33),首次参评即垫底。
FLI 指出,三张不及格成绩单恰好来自三个地区:美国的 xAI、中国的 DeepSeek 和欧洲的 Mistral,证明安全缺失是全球性问题而非区域现象。尤其值得注意的是“欧洲悖论”:尽管欧盟在 AI 监管立法上走在前列,欧洲本土最强的 AI 公司 Mistral 却在安全评估中全球垫底。
六大领域中最薄弱的一环:存在性安全
报告覆盖风险识别、现实危害、安全框架、存在性安全、治理与问责、信息共享六大领域。其中存在性安全(Existential Safety)是全行业得分最低的领域:没有任何公司超过 C-,大多数得分在 D 或以下。
专家组认可了一些建设性尝试——如 Anthropic 的宪法分类器(constitutional classifiers)、OpenAI 对全球治理机制的呼吁、Google DeepMind 的监测承诺以及 Meta 的失控条款——但一致认为这些措施“完全不充分”。评审者进一步质疑当前主流范式(如可解释性和思维链可监测性)的根本有效性,指出“检测不等于预防”。
行业正在撤回安全承诺
报告最严厉的发现是:即使是安全实践的行业领先者也在撤退。Anthropic、OpenAI、Google DeepMind 和 Meta 均已削弱或废止了此前“在接近红线时单方面暂停”的承诺,部分公司将暂停条件与竞争对手的行为挂钩。评审者将这种做法定性为“移动球门”,认为其“全面削弱了整个行业的安全框架”。
军事 AI 应用的加速扩散
评审者将 AI 行业的军事化转向标记为一项正在出现的现实危害风险。2024 至 2026 年间,此前明确禁止军事应用的 Anthropic、OpenAI、Google DeepMind 和 Meta 相继逆转立场,与 xAI 和 Mistral 一样开始积极寻求防务合作。Anthropic 尤其受到批评——尽管其限制了国内监控和自主武器用途,但评审小组指出其存在“有问题的军事参与”,包括据报与造成大量平民伤亡的 Minab 学校空袭事件存在关联。中国公司方面,阿里云和 Z.ai 否认了美方对其军事联系的指控。
安全框架“有牙无咬”
随着美国与欧盟的合规截止日期临近,Anthropic、OpenAI、Google DeepMind、Meta 和 xAI 均发布或更新了更完整的安全框架——然而这些框架有时缺乏量化阈值、真正独立的审计机制和清晰的决策授权。此外,专家组发现 Google DeepMind、OpenAI 和 xAI 的领导层公开表态与实际商业行为和立法立场之间存在显著背离,使口头承诺成为不可靠的安全实践代理指标。
发表时机与局限
该指数的证据收集截止于 2026 年 6 月 3 日,因此未覆盖此后发生的重要安全事件,包括 OpenAI 数学模型的沙箱逃逸事件(7 月 20 日披露)以及 OpenAI 模型在安全测试中突破 Hugging Face 服务器的事件(7 月 22 日)。然而,报告的结论在这些事件发生之前就已指向同一个方向:全行业的安全基础设施远未跟上模型能力的膨胀步伐。
在欧盟《人工智能法案》(AI Act)执行窗口逐步打开、美国白宫自愿预发布审查框架即将定稿的背景下,FLI 的这份系统性评估为监管收紧提供了详实的独立论据。独立评审组成员包括加州大学伯克利分校教授 Stuart Russell(标准 AI 教科书合著者)、蒙特利尔大学 / Mila 助理教授 David Krueger、威斯康星大学麦迪逊分校副教授 Sharon Li 等七位专家。