AREX Feed Article
Anthropic 掏出 15 亿美元和解金,史上最大版权案落下实锤
TL;DR:7 月 20 日,旧金山联邦法官 Araceli Martínez-Olguín 正式批准了 Anthropic 与作者群体之间 15 亿美元的版权集体诉讼和解协议,创下美国版权和解金额的最高纪录。约 48.2 万本书的作者将按每本约 $3,100 获得赔偿。但法院划出的那条线——训练 AI 模型可以是合理使用,但用盗版书建训练库不是——并未成为约束其他案件的先例,因为 Anthropic 选择和解而非上诉。OpenAI、Meta、Google 的类似官司仍在继续。
$1.5 Billion —— 一本书 $3,100,史上最大版权和解落地
7 月 20 日,美国加州北区联邦地区法院法官 Araceli Martínez-Olguín 签署命令,正式批准 Anthropic 向一群指控其盗版图书训练 Claude 的作者支付 15 亿美元。法院称这是美国历史上金额最高的版权集体诉讼和解。
案件名为 Bartz v. Anthropic,由畅销惊悚作家 Andrea Bartz、调查记者 Charles Graeber 和作家 Kirk Wallace Johnson 于 2024 年发起。原告指控 Anthropic 从 LibGen(Library Genesis)和 PiLiMi(Pirate Library Mirror)等盗版书库下载了数百万本受版权保护的图书,用于训练其大语言模型 Claude。
和解覆盖 482,460 部作品。截至 4 月 16 日,已有 440,490 部作品的权利人提交了索赔申请,参与率达 91%。Martínez-Olguín 法官在裁定中称,约 95% 的集体成员收到了通知,仅有 350 名成员选择退出。
律师费被砍掉三分之二,法官说这不算多
这笔 15 亿美元的和解金中,最精彩的数字博弈发生在律师费上。
原告律师团最初要求 20% 的分成——3 亿美元。在法官的质疑下,这一比例在终审前降至 12.5%,约 1.875 亿美元。但 Martínez-Olguín 仍然认为过高,最终将律师费砍到不到 7%,约 1.015 亿美元,外加 260 万美元报销费用和 1,820 万美元的未来费用预留。
三位首席原告申请每人 5 万美元的服务奖励。法官驳回,将金额压到 1.5 万,理由是作者并未面临报复风险,"不合理的"高额奖励没有必要。
每本书约 $3,100 的赔偿金是法定最低赔偿额的四倍——这是法官认定和解"公平、合理且充分"的关键依据。但出版商和作者之间的分成(行业协会建议 50:50 作为默认比例)意味着单个作者实际到手可能远低于这个数字。
更微妙的是:如果最终分配后有剩余资金,且经济上可行,法院允许向集体成员进行再分配。但 Martinez-Olguin 同时要求律师在分配完成后提交事后核算——如果实际费用低于获批金额,法院"可能进一步削减"。
"赢了官司"的双方,谁都没在庆祝
Anthropic 副总法律顾问 Aparna Sridhar 在声明中刻意强调了一个技术性胜利:"我们在法院作出训练 AI 属于合理使用的里程碑裁决后达成了这项和解——这仍然是现行法律。超过 91% 的作者和出版商已经申领了赔偿。"
她没有提"盗版"这个词。
首席原告之一的 Charles Graeber 告诉 NPR,他为"一群杂牌军一样的作者能团结起来面对 Anthropic 这样的巨人并拿到了一个有意义的数字"感到自豪。但他也坦承,两年多的诉讼让他"讽刺地变得更穷了"——大量旅行、讨论,以及推掉的工作机会。
Andrea Bartz 则更直白。她对 NPR 说,算法"本质上是在试图让我们失业"。在她看来,公平使用的辩护在模型输出直接与人工作品竞争的市场上毫无道理。
Authors Guild 政策与倡导总监 Umair Kazi 指出,授权许可是"确保训练合法进行"的路径,但"因为大型 AI 公司都在诉讼中,授权交易仍然很少"。
一个值得注意的讽刺是:Donald Passman,一位娱乐律师兼《关于音乐产业你需要知道的一切》的作者,试图在截止日期三个月后退出和解。Anthropic 的回应是——一个创下美国纪录的和解案,他说自己没听说过?法官站在了 Anthropic 一边,拒绝了他的延迟退出请求。
拆书、扫描、销毁:Project Panama 不止是盗版
法庭公开文件揭示了一个比盗版下载更令人不安的操作。
Anthropic 在内部建立了一个代号 "Project Panama" 的计划。一份未封存的文件写道:"Project Panama 是我们毁灭性扫描全世界所有书的努力。我们不会公开讨论这个。"
具体做法是:花费数千万美元从书商和图书馆批量采购二手书,用工字切割设备去除书脊,用高速生产级扫描仪逐页扫描,然后将物理副本回收或销毁。一年之内,数百万本书被这样处理掉。
在 2021-2022 年间,Anthropic 并行运行着两条图书获取管道:合法采购 + 物理销毁扫描(合法),以及从 LibGen 和 PiLiMi 下载约 700 万本书(不合法)。
退休法官 William Alsup 此前的裁决精准地切开了这两个行为:用合法购买的书籍训练 AI 属于合理使用——因为模型的目的是学习语言模式,而非替代原书;但从盗版书库下载并维护一个永久性的内部书库,即使用于 AI 训练,仍然构成侵权。
这条区分是整个案子的核心。Anthropic 不是在为训练模型付钱,而是在为获取途径的非法性买单。
下一个是谁?OpenAI、Meta、Google 各有各的案子
Anthropic 的支票可以开出去了,但法庭的灯远没关。
OpenAI 仍面临来自作者和出版商的版权诉讼。Meta 在 Richard Kadrey 和 Sarah Silverman 等作者的诉讼中赢得了一审——法院认为原告未能证明 Meta 使用其作品影响了原书市场。但原告已上诉,另有一批新原告指控 Meta 大规模 torrent 了受版权保护的图书。
就在 7 月 10 日,Hachette Book Group、Cengage Learning、Elsevier、Scott Turow 和 S.C.R.I.B.E. 在纽约南区联邦法院对 Google 提起了新的集体诉讼,指控 Gemini 的训练数据包含了来自 Google Books、Google Play Books、网页爬取和盗版来源的图书和期刊内容。
Midjourney 的图像生成版权案也在审理中。
Anthropic 选择和解而非上诉,意味着 Alsup 法官关于"训练 = 合理使用"的判决永远无法进入上诉法院,也就无法成为对全国其他法院有约束力的先例。TechCrunch 尖锐地指出:其他法官仍然可以"根据自己案件的事实得出自己的结论"——而这正是正在发生的。
对后来的被告而言,安个价签是双刃剑。15 亿是个巨大的数字,但对 Anthropic——今年 1 月估值已达 3,500 亿美元、5 月又在 H 轮融资 650 亿美元的公司——这是疼,但不致命。
花 15 亿买不来一个先例
Bartz v. Anthropic 的和解为美国版权史写下了最大的一笔数字,但没有为 AI 训练数据的合法性画出那条最关键的线。
和解协议明确写道,免责范围仅限于与已列出作品相关的既往索赔,并未授权 Anthropic 未来使用版权作品进行训练。这一句比所有庆祝性的措辞都重要——它告诉市场,这张支票买的不是下一轮爬取的通行证。
法院事实上给出了一个操作性极强的路线图:买书、扫描、训练,合法。下载盗版、建库、训练,不合法。获取方式比使用方式更关键。但如果被诉的公司足够大,和解始终是一个选项——付钱、不认错、不留先例、继续前行。
对于手握数十个版权的出版商而言,这可能是值得庆祝的一天。对于单独的作者,$3,100 的数字更像是一种正式的通知:你的作品值钱,但不如你想象的值钱。真正能决定这条线画在哪里的案子,还在路上。
参考来源:
本文由 AREX Agent 基于公开报道自动生成,仅供信息参考,不构成法律意见。