美国司法部在 OpenAI 与纽约时报版权诉讼中支持训练属于合理使用

Rohan Paul · @rohanpaul_ai · X·2026-09-03 01:04·14分钟前
AI 导读

美国司法部提交立场声明,正式主张在版权文本上训练 LLM 通常构成合理使用,这是华盛顿首次介入 AI 训练版权诉讼潮,但该文件仅具咨询性、对法院无约束力。司法部区分了获取数据、训练和输出三个环节,认为训练用途不同于发表文章、不会替代原作;并警告一刀切的许可要求会抬高小公司门槛。法院仍需逐案裁定,但采纳该框架会把法律压力更多转向数据获取和具体输出环节。

Rohan Paul@rohanpaul_ai
精选
77AI 编辑部评分,满分 100

美国司法部在 OpenAI 与纽约时报版权诉讼中支持训练属于合理使用

2026-09-03 01:04· 14分钟前
AI 导读

美国司法部提交立场声明,正式主张在版权文本上训练 LLM 通常构成合理使用,这是华盛顿首次介入 AI 训练版权诉讼潮,但该文件仅具咨询性、对法院无约束力。司法部区分了获取数据、训练和输出三个环节,认为训练用途不同于发表文章、不会替代原作;并警告一刀切的许可要求会抬高小公司门槛。法院仍需逐案裁定,但采纳该框架会把法律压力更多转向数据获取和具体输出环节。

推荐理由

原文梳理了 DOJ 意见书的核心论点及其把法律焦点从训练转向数据获取的影响。

正文 · AI 翻译

对 OpenAI(乃至整个 AI 训练领域)而言,在与《纽约时报》的诉讼中取得了一场重大胜利。

美国政府刚刚正式支持 OpenAI 的主张,即受版权保护的文本训练属于合理使用,部分理由是出于国家安全考虑。

这是华盛顿方面在围绕 AI 训练的更广泛版权诉讼浪潮中首次正式介入,不过该文件仅具咨询性质,对法院不具约束力。

美国司法部提交了一份美国政府的利益声明,正式主张在 OpenAI 版权诉讼中,使用受版权保护的文本训练大语言模型通常应被认定为合理使用;

这一区分仍然留下了关于训练数据如何获取以及特定输出是否复制了受保护段落的独立版权问题。 司法部将获取材料、基于材料进行训练以及生成输出这三个环节区分开来,并将其论证重点专门放在训练阶段的复制行为上。

司法部认为,训练与发表文章的目的不同,因为大语言模型是利用文本来学习统计关系并生成新的回复。

在市场损害方面,司法部表示,训练本身并不会替代原作品,因此后续由 AI 生成的竞争性内容不应自动使此前的训练行为变得不合法。

政府还警告称,一刀切的许可要求可能会提高小型 AI 公司的准入门槛,并使美国开发者相对于外国竞争对手处于不利地位。

法院仍需逐案裁定合理使用问题,但若采纳司法部的框架,将把大部分法律压力从模型训练转向数据获取和具体输出内容。

来源:Rohan Paul· x.com