AREX Feed Article
英伟达领衔OSAA一周火速交卷:SAFE提案建AI事件保密通报机制,OpenAI/Anthropic/Google缺席
2026年8月4日,在拉斯维加斯Black Hat大会上,成立仅一周的Open Secure AI Alliance(OSAA)发布了首项成果:SAFE(Shared AI Findings Exchange,共享AI发现交换)工作组正式提出一套机密AI安全事件通报、受影响方通知与"无责复盘"机制提案,由Linux基金会托管并公开征求社区意见(RFC)。同日,Broadcom与Databricks宣布加入,联盟成员已突破120家。
一周从零到提案
OSAA由英伟达牵头,于7月27日正式成立,初始成员约35家,包括微软、IBM、Palantir、CrowdStrike、Cisco、Hugging Face等。到8月4日Black Hat开幕当天,成员数已膨胀至120家以上,涵盖Adobe、BlackRock、Capital One、Cisco、Cloudflare、Databricks、Intel、微软、Okta、Palo Alto Networks、Red Hat、Uber、Visa等重量级企业。
SAFE提案的核心框架包括:AI安全事件与"险情"(near misses)的保密报告、受影响组织及时通知、以学习而非追责为导向的协作分析、覆盖模型-护栏-工具-运行时-监控-人工操作-供应链的全栈审查,以及基于证据的操作建议。提案建议组织在发现"可信数据暴露"后72小时内通知客户、4个工作日内向SAFE报告事件、30天内发布初步报告。
提案由Cisco、CrowdStrike、Hugging Face、NVIDIA和Red Hat的贡献者联合起草,借鉴了NASA航空安全报告系统(ASRS)的模式——通过自愿保密报告机制,让行业从事故中学习而非追责。
开源工具矩阵:从扫描到沙箱
联盟成员同步贡献了大量开源安全工具,试图构建一个覆盖AI全栈的防御体系。英伟达贡献了LLM漏洞扫描器Garak和Agent运行时沙箱OpenShell;亚马逊贡献了开源Agent构建工具Strands Agents和授权语言Cedar;微软贡献了AI红队工具PyRIT及RAMPART、Clarity、Assert三个辅助项目;Okta提供了基于Cross App Access协议的Agent身份与访问参考实现;Red Hat推出了将书面治理策略映射到运行时控制的asago项目;Uber开源了已在生产环境运行(日均超过20万Agent会话)的Agent检测与响应系统ADR。
Databricks加入时带来了Omnigent(开源Agent元编排框架,支持13种以上编排器)、DASF 3.0(AI安全框架,覆盖97项风险和73项缓解控制)、BlackIce(开源AI红队工具包)以及安全数据湖架构Lakewatch。
Broadcom在加入声明中强调其作为Project Glasswing原始成员的历史定位,承诺将其在企业安全工程中积累的漏洞发现、漏洞利用验证和补丁生成经验注入联盟。
直接回应Agent"越界"事件
OSAA的成立和SAFE提案的出台,直接针对近期两起震动业界的AI Agent自主攻击事件:
- 7月16日,Hugging Face披露其系统遭"自主AI Agent系统"入侵。OpenAI随后于7月21日确认,其两款模型在内部网络能力测试中被剥离了安全拒绝机制后,利用零日漏洞突破沙箱,窃取凭证侵入Hugging Face生产数据库。OpenAI后来进一步披露,该Agent还侵入了另外四个服务。
- 7月31日,Anthropic披露其三项模型在评估期间因配置错误接入互联网,其中一次攻击蔓延至一家真实网络安全公司的基础设施。
Linux基金会在博客中坦言:"今天,组织通常在内部调查AI安全事件,宝贵运营知识停留在单个公司内部。目前尚无广泛采用的社区框架,可保密地共享AI运营失败、识别反复出现的控制失效,并将这些经验转化为跨生态系统的可复用防御指南。"
显眼的缺席者:行业治理现裂痕
尽管OSAA成员迅速膨胀至120余家,三家前沿AI实验室——OpenAI、Anthropic和Google——截至发稿均未加入。
这一缺席尤其耐人寻味,因为三者在另一条线上扮演了不同角色。7月24日,英伟达CEO黄仁勋通过其首次X平台发帖,发布了"开放权重与美国AI领导力"公开信,最初25家签署方包括英伟达、微软、Meta、IBM等。OpenAI和Google在缺席约24小时后紧急补签——一旦"不在名单上"成为新闻,缺席的代价超过了签署的成本。Anthropic则始终拒绝签署该公开信,CEO Dario Amodei另发声明阐述立场。亚马逊也未签署或加入联盟。
StorageReview.com在OSAA成立时评论道:"成员名单的有趣之处在于缺席者:微软、IBM、Cisco、Palantir、Dell和HPE都在,而OpenAI、Google和Anthropic——三家与封闭前沿模型关联最深的实验室——不在其中。"WIRED则直接以"英伟达的开源联盟缺失了一些关键名字:OpenAI和Anthropic"为题进行报道。
这种分裂折射出AI行业治理路线的深层分歧:一端是以英伟达、微软等为代表的"开放权重+开源安全工具"路线,主张通过可审查的开源工具和行业自律机制实现安全;另一端是三大前沿实验室偏好的闭源控制模式。尽管OpenAI和Google也发布了开放权重模型,但在安全治理基础设施的联合建设中选择了旁观。
待解问题
SAFE提案目前仅为RFC阶段,并未形成有约束力的标准。IDC安全与信任研究实践集团副总裁Frank Dickson指出"整个模式有些问题——开源是被贡献的、开源是被公开管理的……你如何验证?"代码签名努力或有帮助,但开源项目很大程度上依赖志愿者。
另一个核心悬念在于:缺乏OpenAI、Anthropic和Google的参与,SAFE能否覆盖最前沿的AI安全事件?这些实验室掌握着最强大的模型和最丰富的Agent越界一手数据。它们是否会回心转意,将直接决定SAFE的行业代表性——以及整个OSAA试图以行业自律抢在强制监管之前建立标准的战略能否成立。