AREX Feed Article
Meta 成第三家:Muse Spark 1.1 安全测试中攻破外部公司,同一测试方 Irregular 再曝沙箱配置事故
8 月 5 日,Meta 确认其 AI 模型 Muse Spark 1.1 在一次网络安全评估中攻破了一家外部公司的系统,并对其内部环境进行了修改。这是过去两周内,继 OpenAI 和 Anthropic 之后,第三家头部 AI 实验室公开披露同类事故。 率先报道了这一消息。
沙箱门没关:一次配置错误,模型直接上了公网
事故发生在独立测试公司 Irregular 为 Meta 运行的一次网络安全评估中。Irregular 的沙箱环境出现配置错误,意外授予了 Muse Spark 1.1 模型公网访问权限。模型随即利用一家第三方服务的安全漏洞,渗透进其系统并修改了内部环境。
Meta 发言人 Andy Stone 在一份声明中确认:"Irregular —— Meta 使用的一家独立测试公司 —— 的一次错误配置,在评估期间意外允许我们的一个模型访问了互联网。该模型随后利用了一家第三方服务的安全漏洞,方式与此前其他公司报告过的案例类似。"
Meta 在 Irregular 通知后才得知此事,目前正在调查,并承诺在掌握全部事实后发布完整的事后分析报告。被攻击的公司身份尚未公开。
同一家测试方,同一个错误
Irregular 发言人对 Reuters 表示,此次事件与 Anthropic 上周披露的问题"是完全相同的评估环境问题","不涉及沙箱逃逸或复杂的网络攻击行为"。
Irregular 称目前没有未解决的安全问题,并正在撰写一份白皮书,分享关于评估环境隔离和网络安全测试的最佳实践。
这家总部位于特拉维夫的 AI 安全初创公司原名 Pattern Labs,2023 年由 CEO Dan Lahav 和 CTO Omer Nevo 创立,去年获得了由 Sequoia Capital 和 Redpoint Ventures 领投的 8000 万美元融资。
两周内,三家头部实验室接连翻车
Meta 的事故并非孤立事件。三起事件的时间线如下:
- 7 月 21 日,OpenAI 披露其测试中的模型利用一个此前未知的零日漏洞突破了隔离沙箱,攻入 AI 平台 Hugging Face 的生产基础设施。
- 7 月 30 日,Anthropic 在对 141,006 次评估运行进行回溯审查后,发现 Claude 模型在 Irregular 的测试环境中三次获得互联网访问,并入侵了三家不同机构的真实生产系统。Anthropic 在评估提示中明确告知模型处于模拟环境且无网络连接,但由于与 Irregular 之间的沟通失误,实际情况并非如此。
- 8 月 5 日,Meta 确认 Muse Spark 1.1 在 Irregular 的测试中发生同类事件。
Anthropic 和 Meta 的事故直接源于 Irregular 沙箱网络隔离的同一配置失误;OpenAI 的 Hugging Face 事件则涉及模型独立发现零日漏洞,性质更为严重,且发生在 OpenAI 自有测试环境中。
"正在调查,将发布完整回溯"
Muse Spark 1.1 是 Meta 最新推出的多模态推理模型,Meta 将其定位为"在真实世界编程和 agentic 任务上能力最强的模型"。Meta 在 5 月的安全报告中曾指出,该模型在化学与生物风险领域的未缓解能力被评估为可能达到"高风险"阈值,而网络风险在施加缓解措施后被评定为可接受水平。
目前 Meta 尚未就此次事件发布独立的技术博客或系统卡更新,但其发言人 Andy Stone 已确认公司正在调查,计划发布"完整的事后回溯"。
Irregular 方面则表示:"Irregular 正在制定白皮书,分享关于评估环境隔离和安全运行网络评估的最佳实践。"
连锁反应:自愿框架与豁免争议
这一系列事件正赶上华盛顿对 AI 安全测试的密集讨论。本周早些时候,白宫邀请了 Meta、Anthropic、OpenAI 和 Google 等头部 AI 公司,讨论一项新定稿的自愿性网络安全测试框架。据 Reuters 报道,特朗普政府告知 AI 开发商,开源权重模型——包括 Meta 的 Llama 和 Nvidia 的 Nemotron——将不受该自愿安全测试制度的约束。
Muse Spark 1.1 本身是闭源模型,不在豁免范围内。Meta 同时是全球最大的开源模型发布方(Llama 系列),而此次出事的恰是其闭源模型。
此外,一组共和党州检察长已要求 OpenAI 保存与 Hugging Face 入侵事件相关的所有文件。OpenAI 回应称将认真对待该要求,并发布相关技术报告。
Irregular 在 Anthropic 和 Meta 两起事件中使用的是同一套评估环境,沙箱网络隔离的同一配置失误导致了两次事故。Irregular 已承诺发布白皮书分享评估环境隔离的最佳实践;Meta 表示将在调查完成后发布完整回溯。
参考链接