AREX Feed Article
Sony Music Publishing 与 Warner Chappell 起诉 Anthropic 与两位创始人,指控 torrent 盗版内容训练 Claude
2026 年 8 月 28 日 17:04(美西时间),Sony Music Publishing (US) LLC、Warner Chappell Music, Inc. 等 35 家词曲版权实体向加州北区联邦地区法院圣何塞分庭提交,把 Anthropic PBC 及其创始人、CEO Dario Amodei,联合创始人 Benjamin Mann 一并列为被告,案号 5:26-cv-09217。48 页起诉状附带两份作品清单(Exhibit A、B),提出四项诉因:全体被告以 torrent 方式直接侵犯复制权与发行权、针对 Amodei 与 Mann 的帮助侵权、Anthropic 以抓取、扫描、训练和输出方式直接侵权,以及违反 17 U.S.C. § 1202(DMCA)移除版权管理信息(CMI)。
起诉状在次日凌晨被公开传播。8 月 29 日 01:23(UTC),ProgressChamber 旗下 Generate & Create 项目的合理使用倡导者 Adam Eisgrau ,称 Sony Music 与 Warner Chappell"刚刚因 torrent 加抓取起诉 Anthropic 直接侵权",诉讼同时点名 Amodei 与 Mann 的 torrent 行为和帮助侵权责任,第四项诉因则是针对 Anthropic 的 DMCA 之诉;随后他在中贴出 ,并案件已立案为 Sony Music Publishing (US) LLC v. Anthropic PBC()。起诉状的全部内容均为原告单方指控,尚未经法院审理。
四个诉因:torrent、抓取、训练与 CMI 移除
CourtListener 案卷显示,起诉状(ECF No. 1)于 8 月 28 日 17:04 PDT 提交、17:08 上传,共 48 页,立案费 405 美元,由 Oppenheim + Zebrak LLP 与 Pryor Cashman LLP 代理,原告请求陪审团审理。起诉状按曲库把原告分成"Sony Music Publishing"系与"Warner Chappell Music"系两组,涵盖 EMI 系列曲库公司、Jobete、Famous Music、Hipgnosis 系实体等 35 家。
四个诉因分工明确:Count I 指控全体被告通过 torrent 直接侵犯 17 U.S.C. § 106(1)、(3) 的复制权和发行权;Count II 只针对 Amodei 与 Mann,称两人"明确指示、批准、控制并故意诱导"了 torrent 行为,构成帮助侵权。
Count III 只针对 Anthropic,列出的直接侵权行为包括从授权歌词网站抓取歌词、从第三方数据集下载、对实体旧书做"破坏性扫描"、用未经授权的歌词训练公开与非公开模型、让 Claude 逐字或近乎逐字输出歌词、生成"竞争性市场替代品",以及生成"以原告词曲作者风格"的衍生作品;Count IV 只针对 Anthropic,称其在清洗训练文本时把歌曲标题、作者姓名等版权管理信息当作"垃圾"删除,违反 § 1202(b)(1) 和 (b)(3)。
救济请求包括法定赔偿或实际损失加利润、永久禁令、在法院监督下销毁侵权副本、要求披露训练数据收集与处理方式的会计账目、律师费。Eisgrau 在中评价,这套诉因"相当常规",但第三项"在具体性和广度上都不寻常"。
从 LibGen 到 PiLiMi:起诉状点名两位创始人的 torrent 时间线
起诉状的核心指控建立在 Bartz v. Anthropic 一案的既有认定之上。起诉状援引 Bartz I 判决(791 F. Supp. 3d 1038)称,法院曾把 Anthropic 的行为形容为"straightforward piracy but at massive scale"(毫不掩饰的大规模盗版),并认定 Anthropic 从盗版网站 Library Genesis(LibGen)与 Pirate Library Mirror(PiLiMi)非法 torrent 了超过 700 万本受版权保护的书籍;原告称,Anthropic 此后以 15 亿美元和解了该集体诉讼。
针对两位创始人的时间线是:2021 年 6 月,Mann"在 Amodei 的指示下、代表 Anthropic"使用"臭名昭著的 BitTorrent 协议"从 LibGen torrent 至少 500 万本盗版书;2022 年 7 月,其他员工又在两人指示下从 PiLiMi torrent 至少 200 万本。起诉状称,Mann 在 Anthropic 内部 Slack 上实时讨论 torrent 进度并分享截图,还为"磁盘空间耗尽"写了个自动暂停脚本,称之为"a cute little libgen babysitter"(一个可爱的小 LibGen 保姆);得知 PiLiMi 上线时他在 Slack 里说"[J]ust in time!"。
起诉状还援引 Bartz 案卷称,创立 Anthropic 之前,Mann 在 OpenAI 任职时就下载过部分 LibGen 用于 AI 训练,他把 LibGen 形容为"sketchy AF"(可疑得要命),被问及 torrent LibGen 是否合法时也不愿在宣誓下给出明确回答。
原告把两位创始人单独列为被告,理由是个人责任。起诉状称,Anthropic 自己的数据政策要求获取新数据集须经 Amodei 明确批准;它还引述 Concord Music Group v. Anthropic(5:26-cv-00880)案卷中 Mann 本人的答辩书,称 Mann 承认"与 Amodei 博士讨论了获取 LibGen 数据的事宜",且"Amodei 博士批准"了他 torrent LibGen。Bartz II 判决(787 F. Supp. 3d 1007)则已认定 Mann 知道那 500 万本书"是被盗版的"。原告称 Anthropic 打算把这些盗版文件"永远"保存下去。
法律机制上,起诉状强调 BitTorrent 的"下载即上传"特性:用户下载文件碎片的同时就在向其他 peer 上传,因此每次 torrent 都同时构成复制和向公众发行,每个被 torrent 的作品都是一次独立侵权,而每本盗版书"很可能被分享数千甚至数万次"。Eisgrau 在中也指出,torrent 及原告声称的"数量惊人的、可分别索赔的侵权行为"在诉状中占据突出位置。
原告的账本:15 亿美元和解、9650 亿美元与 2 万亿美元估值
起诉状把 15 亿美元的和解写成"做生意的成本":原告称,对一家"把大规模侵权转化为惊人估值"的公司来说,这笔钱不足以阻止侵权。诉状脚注援引 Forbes 8 月 13 日题为《Anthropic Eyes $2 Trillion In October IPO》的报道,称 Anthropic 的估值达 2 万亿美元;另一处脚注引述 Anthropic 5 月 29 日的 H 轮融资公告,称其投后估值 9650 亿美元。
被点名的作品包括《Ain't No Mountain High Enough》《All I Want for Christmas is You》《Eye of the Tiger》《Here Comes Santa Claus》《Paper Rings》,以及《Livin' On a Prayer》《September》《Great Balls of Fire》《Ramblin' Man》《Hallelujah》。原告称,这些歌词和乐谱藏在被 torrent 的"数百本"歌本里,而 Exhibit A 和 B 只是"示例性、非穷尽"的清单。关于授权市场,起诉状强调歌词网站是付费获得歌词展示权的,Anthropic 无权"从这些网站成批复制歌词用于训练商业模型";原告还称已与多家 AI 公司签订授权协议,覆盖"与 Anthropic 竞争的平台"。
对训练规模的描述同样写进了诉状:Anthropic 从 2021 年 1 月开始开发训练模型,2023 年 3 月向公众发布 Claude,此后每几个月发布新模型,直至 2026 年 7 月的 Claude Opus 5。起诉状声称"每一代 Claude 都用未经授权的歌词副本重新构建训练语料"。
围绕训练机制与 dilution 理论的下一个战场
Eisgrau 对诉状最尖锐的评论集中在两处。其一,他认为这份起诉状"直接挑起了关于生成式 AI 模型到底如何训练、到底是什么、能做什么,以及就记忆(memorization)而言不能做什么的事实之争";其二,他把原告的"市场稀释"(dilution)主张称为""。起诉状确实写入了这一层:它援引美国版权局 2025 年 5 月《Copyright and Artificial Intelligence》第三部分报告称,生成式 AI 的输出即使与具体作品不构成实质性相似,只要在市场上竞争,就可能稀释"版税池"(royalty pools);原告称其收入来自 Spotify、Apple Music 等平台的按比例版税池,AI 生成的歌词会分走本属于他们的份额。
作为长期为合理使用辩护的人,Eisgrau 写道,原告"无意中给了被告一个赞同他们的机会"——"应该决定本案的责任,合理使用绝对是该法律中具有宪法意义的一部分"。这番表态指向 Anthropic 可能的抗辩方向:训练用复制是否构成合理使用,以及 Bartz 案已认定的事实与 Anthropic 公开否认的"用这些书训练商业 Claude"之间隔着什么。
本案目前只走到起诉状提交、案卷上网这一步。原告在脚注中写明调查仍在继续,打算"在适当的时候申请修改起诉状,扩大被侵权作品清单";而针对 Anthropic"公开否认用盗版书训练商业模型"的说法,起诉状用"合成数据加强化反馈"的路径提出反证,称至少有一个商业 Claude 模型使用了基于 LibGen/PiLiMi 文本训练的非商业模型生成的合成数据。这道事实争议尚待法院审理。