知产前沿获悉,当地时间 7 月 20 日,美国加利福尼亚北区联邦地区法院法官 Araceli Martínez-Olguín 签署最终批准令,正式批准人工智能公司 Anthropic 与作者及出版商达成的 15 亿美元版权集体诉讼和解协议。该金额创下美国版权诉讼和解历史最高纪录。
此次和解消除了 Anthropic 在 IPO 前最大的法律不确定性,但围绕 AI 训练数据的版权争议远未终结。针对 Google、Meta、OpenAI 等巨头的同类诉讼仍在多地法院推进中。
一、案件核心事实与法律结构
本案原告为小说家 Andrea Bartz、Charles Graeber 及非虚构作家 Kirk Wallace Johnson。三人于 2024 年提起诉讼(Bartz v. Anthropic PBC),后被认证为集体诉讼,覆盖约 48.2 万部作品。被告 Anthropic 正处于 IPO 关键期,投后估值达 9650 亿美元。原告指控 Anthropic 从盗版书库 Library Genesis(LibGen)和 Pirate Library Mirror(PiLiMi)下载超 700 万部作品,用于训练 Claude 系列大语言模型。
1. Alsup 法官的“二元切割”裁定
本案最具法律意义的是时任加州北区联邦地区法院资深法官 William Alsup 于 2025 年 6 月作出的部分即决判决,确立了“二元切割”原则:
- 构成合理使用:使用合法获取的书籍训练 AI,或将合法购买的纸质书扫描数字化存入内部资料库。
- 构成侵权:从盗版网站下载作品并存入资料库的行为本身构成侵权,不因后续用于训练而豁免。
若进入审判,Anthropic 面临的潜在法定损害赔偿可能高达数千亿美元。2025 年 9 月,Anthropic 同意以 15 亿美元和解并获初步批准。协议中,Anthropic 确认 LibGen 和 PiLiMi 数据集未用于其已商业发布的大语言模型训练。Alsup 法官退休后,最终批准工作移交至法官 Araceli Martínez-Olguín。
2. Martínez-Olguín 法官的终审批准
Martínez-Olguín 法官在 23 页批准令中认定和解协议“公平、合理、充分”。法院审查要点如下:
- 通知程序:向近 60 万名潜在集体成员发送通知,涉及作品清单(Works List)中 99.98% 的作品,送达率远超联邦司法中心推荐的合理范围。
- 救济充分性:15 亿美元非返还性和解基金为集体成员提供实质性救济,每部作品约 3000 美元的赔偿标准远超版权案件常见水平。
- 非金钱救济:要求 Anthropic 销毁所有从盗版源下载的原始文件副本。
- 响应情况:截至 2026 年 4 月,作品申领率达 91.3%,最终索赔参与率达 92.77%。
法院驳回了全部 54 份异议,明确只有 Works List 上的作品属于集体,不在清单上的权利人仍可另行起诉。350 名成员成功退出,仅两位证明未收到通知的成员获例外允许。
3. 费用调整与索赔豁免范围
法院大幅削减了律师费及原告补偿金申请:
- 律师费:采用衡量报酬法(lodestar method),批准约 1.0156 亿美元(约占和解基金的 6.8%),暂扣 10% 直至提交分配报告。
- 原告补偿:三位集体代表原各申请 5 万美元,最终各批准 1.5 万美元。
- 诉讼费用:批准已发生费用约 263.5 万美元及预计未来管理费用约 1822 万美元。
关于权利放弃范围,集体成员放弃与 Works List 作品相关的过往下载及训练索赔,但保留与 AI 输出相关的过往索赔及 2025 年 8 月 25 日之后行为的单独起诉权。
二、同类案件全景:AI 巨头的版权诉讼矩阵
Anthropic 案虽创下金额纪录,但因以和解结案,Alsup 法官的“合理使用”裁定未形成约束性先例。针对 Google、Meta、OpenAI 等公司的诉讼仍在独立演进。
1. Google 案:合法获取但超范围利用
2026 年 7 月,三大出版商及作家 Scott Turow 在纽约南区起诉 Google,指控其未经授权复制数百万册图书用于训练 Gemini 模型。主要指控包括:
- 超范围使用:将原本用于 Google Books 等服务的授权内容,转而用于商业化 AI 训练。
- 数据来源问题:训练数据集包含来自已知盗版来源及付费墙限制的内容。
- 删除版权信息:涉嫌违反 DMCA 第 1202(b) 条,删除或改变版权管理信息。
- 市场替代风险:生成式 AI 能以极低成本生成长篇文本,冲击传统出版市场。
该案关键在于“合法获取但超范围利用”,这将成为法院评估合理使用抗辩的重要考量。
2. Meta 案:CEO 个人被诉与故意侵权
2026 年 5 月,五家出版社及作家起诉 Meta 及其 CEO Mark Zuckerberg。起诉书强调 Zuckerberg 亲自授权并鼓励侵权行为。此前法院已裁定 Zuckerberg 是公司 AI 平台的主要决策者。
虽然加州法官曾裁定 Meta 使用书籍训练 AI 构成合理使用,但本案将 CEO 个人列为被告,主张其对侵权决策负有直接责任,使得案件在个人责任和潜在惩罚性赔偿层面远超 Anthropic 案的和解框架。
3. OpenAI 案:从版权侵权到证据制裁
《纽约时报》等多家新闻机构起诉 OpenAI 未经授权使用新闻文章训练 ChatGPT。2026 年 7 月,原告申请对 OpenAI 实施制裁,指控其在证据开示阶段恶意行事,拒绝提供关键数据并销毁聊天记录。
与 Anthropic 案不同,OpenAI 案已进入激烈对抗阶段。原告强调“市场替代”理论,侧重输出端对新闻市场的竞争性损害,而非仅聚焦训练数据输入端。
4. Midjourney 与 Stability AI 案:视觉艺术领域的双重争议
视觉艺术领域诉讼同样引发关注。艺术家指控被告利用数十亿张网络图片训练模型侵犯版权。此外,迪士尼、华纳兄弟等好莱坞企业起诉 Midjourney,指控其允许用户生成受版权保护角色的高度相似图像。
此类案件同时涉及训练数据输入端(复制作品是否侵权)和AI 输出端(生成内容相似度是否达标)两个层面。美国版权局明确,单纯由 AI 生成且缺乏人类创造性贡献的作品通常无法获得版权保护,这将影响视觉 AI 内容的商业化路径。
三、行业影响与监管趋势
Anthropic 案的终审批准虽具里程碑意义,但其法律影响存在局限:
- 未形成实体裁判先例:15 亿美元和解未解决 AI 训练数据版权问题的根本法律定性。地区法院关于“合理使用”的裁定尚未经过上诉法院审查,不具有普遍约束力。
- 确立核心区分框架:“训练用途的合理性”与“数据获取方式的合法性”将被作为重要分析框架。即便训练行为符合合理使用,企业仍无法豁免未经授权获取盗版数据等行为的法律风险。数据来源合规已成为模型开发的基础要求。
- 商业不确定性暂除:和解为 Anthropic 消除了诉讼不确定性,但行业根本问题(如许可机制、合理使用边界、市场替代认定)仍待后续案件厘清。
与此同时,AI 版权诉讼正与监管趋势交织。2026 年 6 月,美国总统签署"AI 安全行政令”,强调加强前沿 AI 技术安全评估及网络安全防护。商务部下属机构正推动先进 AI 模型的安全测试和标准建设,这将进一步影响企业的模型治理和风险评估。
四、结语
Anthropic 15 亿美元和解案的收官,标志着 AI 版权诉讼领域迄今最大规模案件的落幕。通过和解,Anthropic 避免了更大的赔偿风险,为其高估值下的 IPO 扫清了障碍。
然而,和解并非争议的终结。针对其他巨头的诉讼仍在推进,部分权利人选择退出另行起诉,政府监管框架也在搭建之中。Alsup 法官划出的“数据获取方式必须合法”界限将被反复检验,视觉艺术领域的输出端侵权争议也正在开辟新战场。对于 AI 行业而言,围绕训练数据的版权合规标准与合理使用边界,仍有待更多司法裁判来明确。
注释

查看 Case 424-cv-05417
编辑:Sharon

