# 同一本书，训练可算合理使用，盗版流程为何要赔 15 亿美元

- 来源：Computing Life · Share · 鸭哥调研
- 发布时间：2026-07-21T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/45855
- 原文：https://yage.ai/share/anthropic-bartz-settlement-20260721.html

## 摘要

Anthropic 花 15 亿美元和解了 Bartz 版权集体诉讼，核心争议不是模型训练本身，而是训练前把几百万本盗版书长期存在服务器里。法院曾倾向认为，把书读进显存训练属于合理使用，因为机器学的是统计规律，不是故事情节。但把从 LibGen 等渠道下载的盗版书长期堆在内部书库里，法院拒绝在开庭前给豁免。按美国法定赔偿，48 万多部作品每部最低赔 7...

## 推荐理由

Anthropic花15亿美元和解Bartz版权集体诉讼，是AI版权领域的一个标志性事件。文章把训练合理使用和服务器存盗版书这两条法律线拆得很清楚，对从业者有直接参考价值。因为目前是和解而非判决，法律先例意义有限，所以分数卡在这里。

## 锐评

这笔钱买的是“历史风险买断”，不是模型合规认证。法院曾倾向认为，把书读进显存训练属于合理使用，因为机器学的是统计规律，不是故事情节。但 Anthropic 从 LibGen 等渠道下载了 48 万多部作品，并长期存放在内部书库里，法院拒绝在开庭前给这个行为豁免。按美国法定赔偿，每部作品最低赔 750 美元，一旦陪审团认定侵权，总赔偿额轻松超过 3.6 亿美元，故意侵权更可能突破 720 亿。15 亿和解金就是在这个天文数字面前，花钱消灾。

但和解协议没给模型发“清白证”。它只免除了特定作品在训练输入端的复制指控，不覆盖模型输出侵权，也不管未来的数据使用。协议要求销毁盗版源文件，但没要求删已训练好的模型权重。正文没披露这 48 万部作品具体是哪些，也没说模型输出端是否做过防抄袭测试。

对 AI 团队来说，这条新闻最大的提醒是：数据流水线里，硬盘上的中间留存步骤是最大的合规地雷。未来光说“用了什么数据集”不够，得能证明每个文件的来源、复制目的、留存状态和删除记录，把整条证据链串起来。
