政策与治理

美国政府在《纽约时报》版权案中支持 OpenAI:称 AI 训练通常属于合理使用

美国司法部在纽约时报对 OpenAI 的版权诉讼中提交意见,主张用受版权保护文本训练大型语言模型通常可构成合理使用,称此举关乎科技进步与国家竞争力。该意见为 AI 公司提供政策支持,但并非法院裁决,案件关于责任和市场损害等关键问题仍在审理中。

美国政府在《纽约时报》版权案中支持 OpenAI:称 AI 训练通常属于合理使用

美国司法部在纽约时报对 OpenAI 的版权诉讼中提交意见,主张用受版权保护文本训练大型语言模型通常可构成合理使用,称此举关乎科技进步与国家竞争力。该意见为 AI 公司提供政策支持,但并非法院裁决,案件关于责任和市场损害等关键问题仍在审理中。

美国特朗普政府已在曼哈顿联邦法院提交意见书,支持 OpenAI 应对《纽约时报》及其他新闻机构提出的版权诉讼。政府在当地时间 9 月 1 日提交、9 月 2 日被报道的文件中主张,使用受版权保护的文本训练大型语言模型,通常可以构成美国版权法下的“合理使用”(fair use),并称人工智能发展关系到科学进步、国家安全与美国的经济竞争力。

这份文件并不是法院判决,也没有裁定 OpenAI 已经胜诉。它属于政府向法院表达立场的意见书,对法官没有直接约束力,但可能在一宗涉及新闻内容、人工智能训练和数字出版商业模式的标志性案件中,为 OpenAI 及其他 AI 公司提供重要的政策和法律支持。

美国政府首次介入这一轮 AI 训练版权诉讼

路透社报道,美国政府在文件中表示,国家对于法院拒绝“训练大型语言模型违反版权法”这一主张具有强烈利益。意见书认为,AI 训练对受版权保护作品的使用具有“高度转化性”,生成模型并不是简单地把文章作为另一份文章重新发布,而是通过计算过程学习大量数据中的模式、信息和表达关系。

政府还认为,限制大型语言模型的发展可能阻碍科学和技术进步,并削弱美国在人工智能领域的竞争优势。美国副司法部长 Stanley Woodward 在社交平台上称,“AI 主导地位”对于美国的国家安全、繁荣和经济流动性至关重要;政府不会因为对版权法的错误理解,使美国相对于外国竞争对手处于不利地位。

这代表美国政府首次在这批围绕 AI 训练数据展开的诉讼中正式提交立场文件。相关案件的原告包括作者、出版商、音乐公司和新闻机构,他们普遍认为,AI 公司未经许可复制和使用其作品,建立了具有商业价值的模型和产品,却没有向内容创作者支付相应费用。

《纽约时报》指控 OpenAI 使用新闻内容训练模型

《纽约时报》于 2023 年 12 月 27 日在纽约南区联邦法院起诉 OpenAI 和微软。根据《纽约时报》当时发布的诉讼报道,该报指控两家公司未经许可使用数百万篇文章训练聊天机器人,而这些产品后来又成为读者获取信息的替代渠道。

诉状没有提出一个确定的赔偿金额,但要求被告承担“数十亿美元”的法定及实际损害赔偿。时报还要求销毁使用其受版权保护材料训练的模型和数据。

原告的指控不只涉及训练阶段的复制。时报还列举了聊天机器人在特定提示下近乎逐字复述其文章、提供付费墙内内容,或生成带有错误信息却归因于《纽约时报》的回答。它认为,这些行为可能影响订阅、广告、网站访问量以及 Wirecutter 等业务中的联盟营销收入。

该报发言人称,政府是在牺牲创作者利益的前提下支持少数“万亿美元级 AI 公司”。时报认为,人工智能公司可以与创作者共同发展,但必须为支撑其产品的内容公平付费。OpenAI 截至路透社报道发布时尚未立即回应置评请求。

案件仍未进入最终责任认定

曼哈顿联邦法院 2025 年 4 月的一份裁判意见显示,法官 Sidney H. Stein 驳回了 OpenAI 和微软针对部分诉求提出的起诉阶段抗辩,同时也删除或限制了若干其他主张。

法院当时允许部分直接版权侵权、共同侵权和商标稀释相关诉求继续推进,但驳回了有关不正当竞争和部分数字千年版权法(DMCA)主张。该裁判主要处理的是被告是否可以在案件早期阶段要求法院直接驳回某些诉求,并不是对 AI 训练是否属于合理使用作出的最终判决。

这一区别十分关键。美国版权法中的合理使用通常会综合考察四个因素:使用目的和性质、原作品的性质、使用部分的数量和重要性,以及这种使用对原作品潜在市场的影响。AI 公司强调训练过程的分析性和转化性,新闻机构则强调训练所需的复制、模型可能复现原文,以及聊天机器人对新闻网站流量和许可市场的潜在替代。

《纽约时报》在 2023 年的诉讼中还称,OpenAI 和微软的产品会以新闻内容为基础直接回答用户问题,从而可能使用户不再访问原始报道。另一方面,OpenAI 主张,模型训练并不是把新闻文章作为新闻文章重新销售,而是从海量数据中学习模式,用于产生新的回答;公司还表示,模型经过设计和防护,应避免逐字复现训练材料。

AIFlux此前报道的OpenAI 与巴西两大媒体合作显示,另一条路径是由 AI 公司与出版商达成内容合作,在 ChatGPT 中提供带有来源归属和链接的新闻摘要,并向媒体提供产品和 API 工具。这类合作并不能直接决定诉讼中的法律问题,但说明内容授权、来源展示和商业回报正在成为 AI 平台与新闻机构关系中的重要组成部分。

其他案件的裁决为 AI 公司提供部分依据

美国政府的意见与此前两宗联邦法院案件的部分裁决方向一致。OpenAI 在其专门回应《纽约时报》诉讼的页面中提到,2025 年 6 月,北加州联邦法院在 Bartz v. Anthropic 案中认定,Anthropic 使用合法取得的书籍训练模型属于合理使用;同月,Kadrey v. Meta 案也对模型训练中的转化性作出了对 AI 公司有利的判断。

但这些案件并没有给 AI 训练建立一项适用于所有情形的全面豁免。相关裁决具有具体事实背景,并且区分了训练模型、保存未经授权取得的资料库,以及模型输出是否复现原作等不同问题。围绕盗版来源、输出内容、市场替代和商业许可的争议,仍可能导致不同案件出现不同结果。

美国版权局也在持续研究人工智能与版权的关系。其“版权与人工智能”项目页面指出,美国目前有大量诉讼围绕版权法合理使用原则展开;版权局发布的生成式 AI 训练报告预发布版本则涉及训练数据、许可和潜在补偿机制等政策问题。这表明,法院个案裁判之外,行政部门和国会层面的规则讨论也仍在进行。

争议核心从“能不能训练”延伸到“如何分配价值”

这份意见书的影响可能超出 OpenAI 与《纽约时报》之间的单一案件。若法院最终接受政府关于训练过程高度转化的论证,AI 公司可能获得更大的空间继续使用公开可得的受版权保护材料;如果法院采纳新闻机构关于未经许可复制和市场替代的主张,模型训练数据的来源、授权和付费机制可能需要发生更大变化。

不过,训练阶段的合理使用并不必然解决所有后续争议。即使模型训练被认定为合理使用,模型输出是否逐字复制文章、是否绕过付费墙、是否削弱原作品市场,以及平台是否从新闻内容中获得了不公平的竞争优势,仍可能成为独立的法律问题。

这场诉讼也与搜索平台和新闻出版商之间的另一类冲突相互呼应。AIFlux此前关于法国媒体协会要求调查谷歌 AI 文章摘要的报道显示,出版商关心的不只是内容是否被复制,也关心 AI 摘要是否改变用户访问原始网页的必要性,以及平台是否应为重新组织和分发新闻内容支付独立费用。

因此,案件后续值得关注的并非只有法官是否认可“AI 训练具有转化性”,还包括法院如何处理训练复制与模型输出之间的界线、如何评估新闻市场损害,以及现有版权法能否在创新激励和创作者报酬之间建立更清晰的规则。

截至目前,政府提交的是一份支持 OpenAI 的咨询性意见,并不等同于法院裁决,OpenAI 也尚未在本案中获得最终胜诉。案件关于责任、损害以及合理使用的关键问题,仍有待后续审理。

来源:

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读