AREX Feed Article
OpenAI 版权 MDL 进入即决判决:原被告 9 月 4 日各自提交动议
9 月 4 日,OpenAI 版权侵权多地区诉讼(In re OpenAI Copyright Infringement Litigation,MDL)的原被告双方递交了各自的即决判决(summary judgment)动议。追踪 AI 版权诉讼案卷的博客 当天发文称,双方将在当日提交各自动议,案件简报(briefing)就此启动;当天稍晚,科技媒体 引述案卷记录确认,Microsoft、《纽约时报》方面与 OpenAI 的多份动议均已递交,并披露了 Microsoft 动议的核心论据。
这起 MDL 由纽约南区联邦地区法院的 Sidney Stein 法官主审,原告分两组:《纽约时报》等新闻机构组成的「News 原告」,以及图书作者与 Authors Guild 组成的「Class 原告」(作者集体),被告是 OpenAI 与 Microsoft。即决判决动议请求法官认定案件不存在需要陪审团裁定的实质事实争议、直接依法给出结论;双方同时申请,等于把「用版权作品训练大模型是否构成合理使用」这道题直接交到 Stein 手里,只是各自要的答案相反。
动议递交前三天(9 月 1 日),美国司法部刚就本案提交利益声明(statement of interest),主张用公开版权文本训练大模型总体构成合理使用。按报道,这是美政府首次在这波 AI 训练版权诉讼中表态;文件属顾问性质、不具约束力,最终裁决权仍在 Stein。追踪博客引述文件称,政府把 AI 训练称作「高度转化性(extraordinarily transformative)」的合理使用目的(文件第 12 页),并申明美国 AI 的进步与发展涉及国家利益与国家安全利益(第 1、2 页)。
上图是 chatgptiseatingtheworld.com 在 9 月 4 日博文中配发的诉讼进展图截图(截至当日共追踪 140 起案件),OpenAI MDL 一组已位列 SUMMARY JUDGMENT(即决判决)栏。
两组原告、两家被告,本轮动议共七份
该博客的标着案号 1:25-md-03143、主审法官 Sidney Stein,并把本轮简报列成七项:图书案(Books cases)与新闻案(News cases)两线各有一份原告方即决判决动议;OpenAI 与 Microsoft 分别在两线递交各自的即决判决动议;此外 Microsoft 还就图书案中的帮助侵权(contributory infringement)指控,单独提交了基于诉答文书的判决动议(judgment on the pleadings),请求法院仅凭诉状驳回该项主张。
Unite.AI 引述案卷记录的报道补充了递交细节:《纽约时报》9 月 4 日提交了自己的即决判决动议,OpenAI 同日就新闻原告的主张提交动议,Microsoft 则在图书与新闻两线都递交了动议。
820 万次对话、24 次匹配:Microsoft 亮出的数字
按 Unite.AI 对 Microsoft 图书案动议备忘录的引述,Microsoft 的核心主张是:用版权书籍训练大模型在法律上构成合理使用,这一使用具有「深度转化性(profoundly transformative)」。备忘录援引此前 Meta 与 Anthropic 两起 AI 训练案的裁决,称两案都把 LLM 训练描述为高度转化性使用;图书被创作出来是供人阅读的,而 OpenAI 对文本的使用服务于技术目的——构建能生成自然语言回复的模型。
支撑这一主张的是一组数字。备忘录称,作者方专家 Shawn Shan 的对抗性提取实验以数百词长的原文段落反复喂给模型、尝试约 530 万次,出现 30 词以上匹配的不足 1%;在真实场景中,Shan 审查了 820 万次 Microsoft Copilot 对话,只找到 24 条含 30 个匹配词的回复,比例 0.00029%,原告主张的 212 本书里有 202 本在日志中没有任何复现。备忘录的结语是:「这很难动摇 LLM 训练的转化性目的。」
Microsoft 还引用原告自己的销售数据:作者们的书卖得和 ChatGPT、Copilot 发布前一样好,几乎找不到现实输出与作品匹配的例子;备忘录引述剧作家 David Henry Hwang 的话称,他不认为 LLM 在损害其戏剧的市场。在数据来源上,Microsoft 称已证实的记录显示它没有从 Library Genesis 下载数据、也未参与获取这些数据集,数据来源不影响合理使用分析;至于应 OpenAI 要求提供的部分 Bing 索引片段,备忘录称证据无法确定其中是否含有原告作品——作者方专家认为转移的片段中可能有 8~24 本主张作品。
对市场损害,Microsoft 要求法官驳回两项理论:训练数据的许可费损失,以及「AI 辅助图书稀释作者市场」。它援引的消费者研究显示(据公司方专家声明),绝大多数消费者即使面对大幅降价的 AI 生成图书也不会购买;而一旦训练必须取得许可,考虑到开发者需要拿下数百万作者的作品授权,这将成为巨大的创新障碍。美国政府本周的利益声明则把矛头对准同类主张:据追踪博客引述,文件称原告的「稀释」市场损害论「存在严重缺陷」(第 15 页)。Microsoft 那份帮助侵权动议的理由同样直白:如果训练被认定为合理使用,该项主张将随之失去依据。
2026 年可能出合理使用裁决的不止本案
用该博客的话说,这是 AI 版权诉讼中的「大时刻」:一次进入裁决程序的案件数量最多,且全部针对 OpenAI 与 Microsoft 两家。2025 年 Bartz v. Anthropic 与 Kadrey v. Meta 两案先后给出合理使用判决之后,2026 年进入即决判决阶段的 AI 版权案屈指可数,本案是其中之一;按博主记忆,年内不会再有其 AI 案件进入这一阶段。他预期可能产生合理使用裁决的还有 Judge Breyer 主审的 In re Mosaic LLM Litigation,以及 Judge Lee 主审的 Concord Music I v. Anthropic。
对本轮动议的走向,案件里已有一处铺垫:2025 年 10 月,Stein 驳回过 OpenAI 针对作者集体「侵权输出」主张的撤案动议,认定原告至少就部分输出提出了足以成立的主张。按该博客当时对裁定的引述,法院以模型生成的《权力的游戏》(A Game of Thrones)摘要为例,认为在「更细致观察者标准」下,陪审团完全可能认定该输出与原著实质性相似(见)。输出侵权这一线并未在撤案阶段止步,如今它与训练复制问题一起,出现在 Microsoft 动议的论证里。
公开版 9 月 17 日放出,裁决日期仍是空白
动议书在递交时先行删去其中的保密信息。该博客在中报道,Stein 已签发约定密封令(stipulated sealing order),管理即决判决简报与 Daubert 专家证据异议简报中保密信息的删节事宜。Unite.AI 引述密封令给出公开时间表:各方须在 9 月 14 日前提出保留删节的请求,9 月 17 日前以未删节版本重新提交即决判决简报与 Rule 56.1 事实陈述;对方响应简报 10 月 5 日到期,其公开版本最迟 10 月 15 日补齐。博客表示会随递交进度陆续公布简报文本。
动议论证的完整文本要等密封令流程走完才会以公开版呈现。案件追踪页上,听证时间与裁决结果两栏目前分别写着 TBD 与 TBA——Stein 何时就这些动议作出裁决,目前没有时间表。