美国司法部支持AI训练的合理使用

The Decoder··作者 Matthias Bastian

关键信息

这起案件围绕《纽约时报》起诉 OpenAI 和 Microsoft 展开,原告称数百万篇《纽约时报》文章被未经许可用于训练 GPT-4 等模型。司法部反对对训练一概禁止,认为合理使用必须逐案分析,而美国版权局此前对 AI 训练的广泛合理使用持更怀疑的态度。

资讯摘要

美国司法部在一宗高风险的版权案件中站到了 AI 公司一边,这起案件涉及《纽约时报》、OpenAI 和 Microsoft。司法部在文件中主张,用受版权保护的文本训练大语言模型在美国版权法下可以构成合理使用。该部门强调,关键在于“为训练而复制”和“模型最终输出”之间存在法律上的区别。司法部认为,训练阶段确实会复制作品,但这些作品不会被公开提供,而模型生成的结果通常也不会与原作高度相似。该文件还反驳了这样一种观点:只要训练中使用了版权作品,就可以直接推定存在广泛的市场伤害。

为了说明这一点,司法部引用了 Joan Didion 年少时通过抄写 Hemingway 作品来学习写作的例子。司法部表示,如果把学习过程和之后的创作输出视为一次整体侵权,那在法律上是站不住脚的。司法部还认为,大语言模型具有公共和创作价值,因为人们会利用它们创作新的作品,而若仅因训练行为就追究责任,可能会抑制版权法本应保护的创造力。此案仍然是观察法院将如何处理 AI 发展与版权许可交叉问题的重要风向标。

美国司法部支持AI训练的合理使用

资讯正文

美国司法部在一宗具有里程碑意义的版权案件中支持 AI 训练的合理使用

要点

- 在涉及《纽约时报》的版权争议中,美国司法部站在 AI 公司一边,认为使用受版权保护的材料训练 AI 模型属于合理使用。

- 司法部表示,用受版权保护的文本训练大型语言模型不构成版权侵权,因为“用于训练的复制”与模型实际输出之间在法律上存在区别。

- 司法部认为,LLM 具有创造性和社会价值;如果仅因 AI 训练本身而承担责任,将会扼杀版权法本应保护的创造力。

美国司法部已在与《纽约时报》及其他权利方合并审理的诉讼中站到 AI 公司一边,主张使用受版权保护的材料训练 AI 模型属于合理使用。

《纽约时报》于 2023 年底在曼哈顿联邦法院起诉 OpenAI 和 Microsoft,指控数百万篇 NYT 文章在未经许可的情况下被用于训练 GPT-4 等模型,并被用来构建与这家报纸作为信息来源相竞争的产品。《纽约时报》援引数十亿美元的损失赔偿,并要求销毁用其文章训练出的语言模型。此后,该案件不断升级,且被广泛视为法院将如何处理版权与 AI 训练问题的风向标。

司法部现在表示,在这起案件中,LLM 训练所使用的受版权保护文本并不构成版权侵权。关键在于训练与输出之间的区别。在训练过程中,整部作品会被复制,但从未向公众公开,而模型输出“往往,如果不是始终如此的话,都不具有与原作实质性相似性”。将二者混为一谈、以一种笼统的市场损害理论来认定侵权,在法律上是错误的。也有人不同意这一点。

这份提交文件还援引 Joan Didion 作为类比。她少年时曾抄写 Hemingway 的故事,以理解其句子的运作方式。司法部认为,按照 Kadrey 判决的逻辑,Didion 在后来发表作品时本可能随时面临责任,因为她的学习过程与后续写作会被视为一次单一用途。引用一项更早的裁决,司法部认为,要求人们在后来借鉴一本书并以新的方式写出新内容时仍然付费,是不可想象的。

司法部还认为,LLM 具有创造性和公共价值。“人类使用 LLM 创作原创作品,”司法部写道。若因 AI 训练而承担责任,将会扼杀版权法本应保护的创造力。据报道,即便是《纽约时报》的记者也会使用 LLM 起草和编辑文章,尽管所链接的来源却讽刺地支持了几乎相反的结论。

而且,所有这些论点都回避了规模问题。单个作者为了学习而抄写文本是一回事;一家市值数十亿美元的公司把这些内容转化为具有竞争性的面向大众市场的产品,则是另一回事,美国版权局对此已明确指出。

特朗普政府在版权争斗中采取亲 AI 立场

这正是美国版权局在一份报告中所表达的观点;该报告否定了将 AI 训练一概视为合理使用。版权局认为,AI 使用的是完美复制件,并且以远超人类创作的速度和规模生成内容。与现有市场中的原创作品相竞争的商业应用,已经超出了合理使用所允许的范围。

在提交的文件中,美国司法部直接反驳了这份报告。司法部认为,前版权登记官 Shira Perlmutter 的评估不具有任何具有约束力的法律效力,而且该报告忽视了按个案进行分析的判例法,以及法规下真正算得上的那类市场损害。

“合理使用的判断取决于每个案件中所涉具体事实和具体用途。但如果施加广泛的版权责任,从而通常会使未经许可训练 AI 模型变得不被允许,那将是有问题的——而且在法律上是错误的,”司法部写道。

Perlmutter 在报告发布后不久就被特朗普政府解雇。民主党人 Joe Morelle 表示,她被解职是因为她拒绝为使用受版权保护作品进行 AI 训练赋予合法性,而这是特朗普盟友 Elon Musk 所支持的立场。司法部在脚注中指出,Perlmutter 目前正在就她的解职提出挑战。

来源与参考

  1. 原始链接
  2. US Department of Justice backs fair use for AI training in landmark copyright case

收录于 2026-09-03