要点
- 在涉及《纽约时报》的版权纠纷中,美国司法部站在了 AI 公司一边,主张使用受版权保护的材料训练 AI 模型属于合理使用。
- 美国司法部表示,使用受版权保护的文本训练大语言模型并不构成版权侵权,因为法律上区分了用于训练目的的复制行为与模型实际输出的内容。
- 美国司法部认为,大语言模型提供了创造性和社会价值。仅因 AI 训练本身而追究责任,将会扼杀版权法本应保护的创造力。
在涉及《纽约时报》及其他权利人的合并诉讼中,美国司法部站在了 AI 公司一边,主张使用受版权保护的材料训练 AI 模型属于合理使用。
《纽约时报》于 2023 年底在曼哈顿联邦法院起诉 OpenAI 和微软,指控其未经许可使用数百万篇《纽约时报》文章来训练 GPT-4 等模型,并构建与这家报纸竞争的信息来源产品。《纽约时报》提出了数十亿美元的损害赔偿要求,并要求销毁基于其文章训练的语言模型。此后,该案件不断升级,被广泛视为法院将如何处理版权与 AI 训练问题的风向标。
美国司法部(DOJ)现在表示,本案中用于大语言模型训练的受版权保护文本并不构成版权侵权。关键在于训练与输出之间的区别。在训练过程中,整部作品会被复制,但从未公之于众,而输出结果“往往(即便不是总是)与原始作品缺乏实质性相似”。那种将两者混为一谈、笼统认定造成市场损害的理论在法律上是错误的。也有人持不同意见。
该文件援引琼·狄迪恩(Joan Didion)作为类比。她十几岁时曾抄写海明威的故事,以理解其句子是如何运作的。DOJ 认为,按照 Kadrey 案裁决的逻辑,狄迪恩每次发表作品时都可能面临责任,因为她的学习过程和随后的写作会被视为同一次使用。该部门援引早先的一项裁决称,要求人们日后借鉴一本书、以新的方式写出新内容时都要付费,这是不可想象的。
DOJ 还主张,大语言模型具有创造性和公共价值。“人类利用大语言模型创作原创作品,”DOJ 写道。对 AI 训练追究责任将扼杀版权法本应保护的创造力。据报道,就连《纽约时报》的撰稿人也在使用大语言模型起草和编辑文章,尽管所引用的来源颇具讽刺意味地主要支持相反的结论。
而所有这些论点都回避了规模问题。单个作者抄写文本用于学习是一回事。一家市值数十亿美元的公司将那些内容转化为面向大众市场的竞争性产品则是另一回事——美国版权局已明确指出了这一点。
特朗普政府在版权之争中采取亲 AI 立场
这正是美国版权局在一份报告中提出的观点,该报告驳回了AI训练适用全面合理使用的说法。版权局认为,AI使用完美副本工作,并以远超人类创作的速度和规模生成内容。在现有市场上与原作竞争的商业应用,超出了合理使用所允许的范围。
美国司法部在其提交的文件中直接针对该报告提出质疑。司法部认为,前版权局局长Shira Perlmutter的评估不具有约束性法律效力,且该报告忽视了关于逐案分析以及根据法规实际构成市场损害类型的判例法。
美国司法部写道:“合理使用(fair use)的判定取决于每个案件中的具体事实和具体使用情形。但如果施加宽泛的版权责任,使得未经许可便普遍禁止训练 AI 模型,那将是有问题的——而且在法律上也是错误的。”
珀尔马特在报告发布后不久便被特朗普政府解雇。民主党人乔·莫雷尔表示,她之所以被解职,是因为她拒绝为使用受版权保护的作品进行 AI 训练的行为正名,而这一立场正是特朗普盟友埃隆·马斯克所支持的。美国司法部在一条脚注中指出,珀尔马特目前正在对她的解雇决定提出异议。
来源:彭博法律
原始发布方:The Decoder:AI News(RSS)
原文时间:2026-09-03 02:24:42 +08:00
