AREX Feed Article
Anthropic 签下欧盟 AI 透明度行为准则,Claude 输出将自带隐形水印与 C2PA 溯源
Anthropic 已正式签署欧盟《AI 法案》第 50(2) 条 AI 生成内容透明度行为准则。
自 2026 年 8 月 2 日起,在欧盟推出的 Claude 模型将在生成文本中嵌入机器可读水印,并在支持的图片等文件类型上附加 C2PA 签名溯源元数据。这套标记方案不限于欧盟:水印和溯源信息将适用于 Claude 在全球所有产品线,包括 API、Claude、Claude Code、Claude Cowork 与 Claude Tag。
但 Anthropic 自己也承认,检测到这些标记不等于 Claude 就是内容的原作者。文本水印可能被 OCR 工具绕过,C2PA 元数据已有开源移除工具,而缺少标记也不能反证内容不是 AI 生成的。
文本嵌入隐形水印,文件附加 C2PA 签名
根据 Anthropic 帮助中心公布的,Claude 采用两套互补技术来标记生成内容。
第一套是文本水印。Claude 在生成文本时,会在模型层面将一个不可感知的水印编织进文字本身。用户看不到它,它也不会改变文本的含义、质量或可读性。由于水印是文本的组成部分,复制粘贴后水印会随之迁移,部分编辑也不会将其抹掉。这套水印施加在模型层,意味着无论用户通过哪个产品入口,输出的文本都会携带标记。
第二套是文件溯源元数据。当 Claude 生成 .svg、.png、.jpg 等受支持的文件格式时,会附加经过数字签名的溯源元数据。元数据遵循 C2PA(Coalition for Content Provenance and Authenticity)开放标准,记录文件是否经过 Claude 处理,以及溯源信息是否被篡改。
标记范围覆盖所有 Claude 产品,也涵盖通过 AWS、Google Cloud 和 Microsoft Foundry 访问 Claude 模型的第三方渠道。不过 Anthropic 提醒,文件溯源元数据在这些云平台上的支持程度取决于各平台的功能。
对于 2026 年 8 月 2 日之前发布的旧模型,Anthropic 表示正在为其添加标记支持,利用法律允许的过渡期逐步推进。
Article 50(2) 为何此刻生效
欧盟《AI 法案》第 50 条的透明度义务于 2026 年 8 月 2 日起正式适用。该条款要求生成式 AI 系统的提供者确保输出内容以机器可读格式标记,并可被检测为人工生成或篡改。违规罚款最高可达 1500 万欧元,或全球年营业额的 3%,以较高者为准。
Anthropic 签署的行为准则由独立专家在欧盟 AI 办公室协调下起草,经欧盟委员会和 AI 委员会确认后,可作为证明合规的充分自愿工具。截至 2026 年 7 月底,已有约 190 家公司和组织签署了该准则。
Anthropic 并非第一家为此采取行动的公司。指出,Google DeepMind 此前已开发了用于标记 AI 生成文本、图像和音频的 SynthID 技术,OpenAI 也讨论过水印方案,但在大规模部署上动作更慢。Anthropic 此次将文本水印和 C2PA 溯源同时铺到全产品线,且覆盖全球而非仅限欧盟。Euronews 将此描述为欧盟合规标准对全球产生涟漪效应的又一例证。
「检测到标记不代表 Claude 是原作者」
在帮助中心文档中,Anthropic 用了相当篇幅说明标记的局限。
最关键的一条:检测到 Claude 的水印或溯源元数据,只是表明内容可能经过 Claude 处理,并不构成内容来源的决定性证据。Anthropic 列出了几种常见场景:用户可能用 Claude 校对、翻译、总结或转换自己撰写的内容,此时输出会携带标记,但底层思想、文字和数据来自其他来源;标记内容在离开 Claude 后也可能被修改、摘录或与其他材料混合。
反过来,一段文字没有检测到标记,也不意味着它不是 AI 生成的。Anthropic 列举了多种假阴性可能:内容由标记功能上线前的旧模型生成、文本经过重度编辑或翻译、段落过短导致信号不足、文件的元数据因格式转换或截图而被剥离,以及某些平台或文件类型本身不支持特定标记。
水印可以被 OCR 绕过,C2PA 元数据也能被剥离
更为直接。文章指出,构建一套光学字符识别(OCR)系统来剥离或忽略 Claude 文本中的水印标记,并不困难。
C2PA 元数据同样脆弱。已有开源工具可以移除 C2PA 签名,格式转换、重新保存、截图等常规操作也能让溯源信息消失。Anthropic 在帮助中心文档中也承认了这一点。
The Register 还提出了一个更微妙的问题:部分 Claude 用户未必希望自己 AI 生成内容的来源被标记。此前,Claude 用户已对定价变动、可靠性问题和模型安全限制表达过不满。强制加水印可能进一步推动部分用户转向开源权重模型,那些模型不会给输出打上任何标记。
Anthropic 尚未公布具体的技术文档来说明水印的抗移除能力和检测机制。帮助中心文档只表示将在后续技术文档中分享详细信息。
欧盟合规,全球买单
Anthropic 选择将标记方案全球推行而非仅限欧盟。由于水印施加在模型层,无论用户是否在欧盟境内,Claude 输出的透明标记都将成为默认行为。
对内容平台和教育机构而言,这是一套新的检测信号。对依赖 Claude API 构建产品的开发者来说,Anthropic 建议他们自行评估 Article 50 对自身产品和服务的合规要求,并表示将在技术指南可用时提供支持。
由于全球适用且不提供区域排除选项,Claude 在全球任何市场——包括亚太地区——的输出都将默认携带标记。标记能否真正构成可靠的内容来源信号,取决于 Anthropic 尚未公布的技术细节,以及后续是否能经受住实际的绕过测试。