美国特朗普政府已正式在《纽约时报》对 OpenAI 的版权诉讼中表态支持 OpenAI。美国司法部的核心主张是:使用受版权保护材料训练大语言模型(LLM),通常可构成美国版权法中的“合理使用”(fair use)。但这并不是判决,也没有为 AI 公司或版权权利人设定一条全国统一、自动适用的规则。
3
司法部主张了什么?
美国司法部向纽约曼哈顿联邦法院提交文件称,大语言模型训练通常属于对版权作品的合理使用。政府认为,这一用途具有“转换性”:模型从海量材料中学习规律并生成新的内容,而不是直接再出版原始作品。
3
司法部还反对建立一项普遍规则,即 AI 训练若未先取得许可便一律违法。政府认为,这样解读版权法会限制先进 AI 系统的发展。
2
3
不过,这一观点并不等于对所有训练方式、数据来源或模型输出给予“豁免”。具体数据集如何取得、训练过程如何进行、模型最终输出什么内容,仍可能影响法律判断。
29
30
政府为何强调 AI 训练的重要性?
这份文件将争议定位为不止于出版商与科技公司之间的私人纠纷。政府称,一个强大且具有竞争力的美国 AI 产业,关乎创意和科学进步、经济机会、繁荣以及国家安全利益。
3
政府担心,若要求 AI 开发者为训练使用的每一部版权作品逐一取得许可,美国 AI 研发可能变慢、竞争力也可能受损。美国副司法部长斯坦利·伍德沃德将政府立场与维持美国强劲 AI 产业联系起来;美国商务部长霍华德·卢特尼克则另行呼吁,各国应允许 AI 使用创作者作品训练,同时设法“保护艺术家”。
1
17
这份文件有多大法律效力?
司法部提交的是“利益陈述”(statement of interest),并非司法裁决。审理《纽约时报》案件的法官仍须依据美国版权法和案卷证据,独立审查合理使用是否成立。因此,这份文件不约束该案法官,也不约束其他联邦法院或未来涉及其他 AI 开发商的案件。
3
但它的现实影响仍然显著:在版权权利人持续起诉 OpenAI、微软、Anthropic、Meta 等公司之际,美国联邦政府选择支持一种较宽泛的合理使用理论。真正具有约束力的先例,仍将来自上诉法院的裁判,而不是政府提交的意见书。
3
29
《纽约时报》指控了什么?
《纽约时报》于 2023 年起诉 OpenAI 和微软,指控两家公司未经授权使用数百万篇新闻文章,训练支撑 ChatGPT 的模型。该报将新闻内容的商业价值及潜在授权市场置于争议核心。
18
OpenAI 表示,其模型基于公开可得数据训练,并认为其开发方式受合理使用原则保护。
18 因而,争议不只是“是否复制过内容”,还涉及这种复制的目的、性质和后果是否符合合理使用标准。
“转换性”并不能一锤定音
近期美国联邦法院的一些裁决为 AI 公司关于“转换性使用”的论点提供了支持,但尚未形成放之四海而皆准的规则。
在涉及 Anthropic 的案件中,美国地区法官威廉·阿尔苏普将使用书籍进行模型训练称为“典型的转换性”使用。在另一宗涉及 Meta 的案件中,美国地区法官文斯·查布里亚同样认为训练用途具有转换性。
29
但两项裁决也说明,争论远未结束。阿尔苏普将储存盗版书籍与模型训练区分开来;查布里亚则警告,AI 训练在许多情形下可能不构成合理使用,尤其是当证据显示其对现有或新兴市场造成有害替代时。
29
30
这使《纽约时报》案及相关案件仍有几个关键问题待解:
- 训练所用的原始作品是否通过合法方式取得?
- 训练用途是否与原始新闻作品具有足够不同的目的?
- 模型能否生成复现受保护表达的输出?
- 这种做法会不会损害、替代或削弱原作市场及其授权市场?
创新与创作者保护之间的拉锯
特朗普政府的立场倾向于为 AI 训练保留较大空间,并将其视为美国技术领先地位的条件之一。与之相对,《纽约时报》和其他版权权利人认为,创新不应以未经同意或不予补偿地使用有价值作品为代价。
3
18
卢特尼克的表述概括了尚未解决的政策平衡:允许 AI 发展,同时保护艺术家与创作者。
17 不过,法院需要处理的是更具体的法律问题——根据合理使用原则审查特定事实,而不是抽象地选择产业政策。
结论
特朗普政府的文件是对 OpenAI 法律与政策论点的一次重要背书:大语言模型使用受版权保护材料训练,因其转换性和公共利益,通常应被视为合理使用。
3
但它并未决定《纽约时报》案的结果。OpenAI 与微软能否胜诉,仍取决于证据以及法院对合理使用的具体适用,包括训练用途的性质、材料来源、产生侵权输出的风险,以及对新闻内容市场的影响。
29
30