案件名为 Bartz v. Anthropic,由三位作者在2024年发起:
他们指控 Anthropic 未经许可复制他们的书籍,用于训练Claude系列大型语言模型。
作者方称,这些文本中有相当一部分来自所谓的“影子图书馆”(shadow libraries),例如:
这些网站通常提供 未经授权的电子书下载,在版权领域长期存在争议。
随着案件推进,诉讼升级为 集体诉讼(class action),覆盖的版权作品扩大到 约482,460本书。
如果最终获得批准,Anthropic 将设立 15亿美元赔偿基金,符合条件的作者或出版社 每本书可能获得约3000美元赔偿。
这起案件之所以备受关注,是因为它触及生成式AI最核心的法律问题之一:
AI模型在训练时使用受版权保护作品是否合法?
2025年,负责该案的法官 William Alsup 在一次关键裁定中作出了“部分支持、部分否定”的判断。
法院区分了两种行为:
1. 用合法获得的书籍训练AI
法院认为这种行为具有高度“变革性”(transformative),因此 可能属于合理使用(fair use)。
2. 从盗版网站下载并保存书籍
如果公司通过盗版来源建立大规模数字图书库,则 不受合理使用保护。
法院文件显示,Anthropic 在建立内部训练库时 曾从盗版网站下载超过700万本书。
这一区分——“训练过程”与“数据获取方式”——正成为AI版权争议中的关键法律界线。
根据提交给法院的数据:
到截止时:
在美国集体诉讼中,这一比例非常罕见——多数案件的索赔率通常只有 约10%。
不过法律分析人士指出,这里的统计是 按“作品数量”而非“作者人数”。由于一些大型出版社拥有成千上万本书的版权,实际参与的作者比例可能没有91%那么高。
即使最终以和解收场,Bartz v. Anthropic 仍可能对AI产业产生长期影响。
如果15亿美元和解最终获批,它将成为 美国历史上金额最大的版权和解案。
这可能影响未来AI公司与出版商、媒体和创作者之间的谈判预期。
本案采用 统一赔偿基金 + 按作品分配金额 的结构。面对动辄数十万作品的AI训练数据集,这种模式可能成为未来类似案件的参考方案。
本案中的裁定被认为是 首批真正讨论“AI训练是否属于合理使用”的法院决定之一。
虽然和解本身不会形成法律先例,但法官在案件中的分析已经在其他AI版权诉讼中被频繁引用。
目前,该和解协议仍处于法院审查阶段。
如果法官最终批准:
但无论结果如何,Bartz v. Anthropic 已经成为生成式AI法律史上的标志性案件之一——它正在重新定义一个核心问题:
当机器学习来自人类创作的海量文本时,版权法应该如何适用?