美国政府向法庭表示,用新闻文章训练 AI 属于合理使用

新闻摘要
美国政府已正式介入人工智能行业最受关注的版权纠纷之一,提交了一份利益陈述书,支持 OpenAI 在《纽约时报》提起的诉讼中的立场。该文件于2026年9月2日(美国东部时间)提交给纽约南区联邦地区法院法官 Sidney Stein,这是联邦政府首次就直接针对 AI 开发者模型训练方式而涌现的大量版权案件明确表态。
政府的主张
政府在文件中主张,使用受版权保护的文本训练大语言模型(LLM)具有“极其显著”的转换性,应被视为美国版权法下的合理使用。政府的陈述书表示,“本政府强烈希望本法院驳回任何认为使用受版权保护文本训练 LLM 违反版权法的论点”,并指出这关系到科学进步与国家安全方面的考量。
文件进一步警告称,对合理使用原则作狭义解读可能会产生超出法庭之外的后果。政府主张,“在对合理使用原则存在误解的情况下限制 LLM 的发展,将阻碍……创意与科学进步,同时损害美国的繁荣”与经济机遇。政府立场的核心在于:包括作者、出版商和新闻机构在内的原告正在推动一种过于狭隘的合理使用解释,这在实际上会要求 AI 公司为几乎所有训练数据获取授权,而文件认为这一要求将拖慢“强健”的本土 AI 产业的发展。
诉讼背景
此案可追溯至2023年,当时《纽约时报》起诉 OpenAI 及其最大财务支持者 Microsoft,指控对方未经许可也未支付报酬,使用了该报数百万篇文章来训练 ChatGPT 及相关产品背后的模型。《纽约时报》认为,这种做法破坏了支撑专业新闻业的商业模式,并侵犯了其作为版权所有者的专有权利。
《纽约时报》案并非孤立纠纷。它是纽约南区 Stein 法官审理的多起协同案件之一,也是作者、出版商、唱片公司及其他新闻媒体对主要 AI 开发者发起的更大规模诉讼浪潮的一部分,其中还包括涉及 Anthropic 和 Meta 的独立案件。此前已有两位联邦法官就“使用受版权保护作品训练 AI 是否构成合理使用”作出了相互矛盾的裁决,导致法律前景仍不明朗,也使得任何外部方——尤其是联邦政府——的立场显得更加重要。
《纽约时报》的回应
《纽约时报》发言人对该政府文件提出强烈反驳,称政府“站在少数几家万亿美元级 AI 公司一边,牺牲了无数被窃取作品的美国创作者的利益”。该发言人补充说,允许企业在未经许可的情况下使用受版权保护的内容,将“破坏健康社会所依赖的人类创作内容的可持续性”。
在该消息首次被报道时,OpenAI 和白宫的代表除文件本身内容外,未立即提供进一步评论。
为何这对 AI 行业至关重要
尽管联邦政府提交的利益陈述书对法院没有约束力,但在诉讼中仍具有重要分量。它们表明了行政部门如何看待一个具有广泛经济与政策影响的法律问题,并可能影响法官在此类复杂且史无前例的案件中如何权衡各方论点。由于目前还有数十起类似的版权诉讼正在针对其他 AI 公司进行,政府在 OpenAI 案中的立场很可能会被全国相关诉讼中的原告与被告引用。
对于更广泛的 AI 研究与技术界而言,这份文件凸显出训练数据的合理使用问题已成为决定行业未来的核心议题。全球的高校、研究实验室和初创企业都在关注美国法院如何界定机器学习中合理使用的边界,因为判决结果将决定大规模 AI 训练能否继续广泛普及,还是会被授权要求所束缚。该案目前仍处于协同审前程序的早期阶段,预计将持续产生一系列裁决,供全球法律学者、技术人员和政策制定者在探索现行版权框架如何适用于生成式 AI 系统时深入研究。