《纽约时报》诉OpenAI案

译自英文

NYT诉OpenAI案是《纽约时报》对OpenAI和微软提起的版权侵权诉讼,指控其未经授权使用受版权保护的文章来训练AI模型并复制内容。该案提出了关于生成式AI中合理使用的关键问题。

NYT诉OpenAI是一起法律纠纷,其中《纽约时报》(NYT)于2023年12月起诉OpenAI及其合作伙伴微软,指控这些公司未经许可使用数百万篇受版权保护的NYT文章来训练其大型语言模型(包括GPT-4),且这些模型能够复制或高度改写NYT内容,损害了该报的业务。该诉讼提交至美国纽约南区联邦地区法院,寻求法定赔偿、销毁侵权训练数据以及禁止进一步使用的禁令。此案被广泛视为生成式人工智能背景下合理使用原则的标志性考验。

该诉状于2023年12月27日提交,声称OpenAI和微软通过整体复制NYT文章来构建其AI系统,NYT认为这种做法并非变革性使用,而是对其新闻业投资的商业剥削。NYT还声称,这些模型能够生成与其文章“逐字或近乎逐字”的输出,有时甚至绕过付费墙。OpenAI回应称,其使用公开文本属于美国版权法下的合理使用,诉讼缺乏依据,并已采取措施尊重出版商权利,包括提供退出机制。此案仍在进行中,审前动议和证据开示预计将持续至2025年及以后。

背景:大型语言模型的兴起

该诉讼的背景是人工智能机器学习的快速发展,特别是OpenAI的GPT系列等大型语言模型(LLM)的开发。这些模型在从互联网抓取的大量文本语料库上进行训练,包括新闻文章、书籍和网站。训练过程涉及复制和处理文本以学习统计模式,模型随后利用这些模式生成类似人类的响应。NYT的案件是作者、视觉艺术家和其他内容创作者对AI公司提起的众多诉讼之一,但因其是拥有大量资源和强大法律团队的主要新闻机构而备受关注。

法律主张

NYT的诉状指控了多项诉讼原因,包括直接版权侵权、帮助侵权和替代侵权。该报认为,OpenAI和微软未经许可复制了其文章,由此产生的模型属于衍生作品。NYT还声称,这些公司违反了《数字千年版权法》(DMCA),删除了文章中的版权管理信息。该诉讼寻求可能高达数十亿美元的赔偿,以及要求被告删除侵权训练数据并防止未来使用的命令。

OpenAI的辩护:合理使用

OpenAI的主要辩护是其对受版权保护材料的使用受合理使用原则保护,该原则允许在批评、评论、新闻报道、教学、学术或研究等目的下未经许可有限使用受版权保护的作品。OpenAI认为,训练过程是变革性的,因为它提取的是事实和思想而非表达性内容,且模型不会复制原作品的实质部分。该公司还指出其允许出版商选择退出未来训练的努力,以及与一些新闻机构的合作,例如与Axel Springer的交易和与美联社的单独协议。然而,NYT认为这些措施不足,且对其业务的损害是真实的,因为AI生成的摘要可能减少其网站流量和订阅收入。

关键问题与潜在影响

此案提出了几个可能塑造AI和版权法未来的关键问题。一是训练AI模型于受版权保护的文本是否构成侵权或合理使用。另一个是AI模型的输出若与训练数据高度相似,是否可被视为侵权。结果可能对AI行业产生重大影响,因为许多模型依赖大规模抓取网络内容。对OpenAI不利的裁决可能迫使AI公司从出版商处获取训练数据许可,从而增加成本并改变商业模式。相反,支持OpenAI的裁决可能确认当前实践的合法性并鼓励进一步创新。

相关案件与行业反应

NYT诉讼是更广泛诉讼浪潮的一部分。2023年,莎拉·西尔弗曼和乔治·R·R·马丁等作者对OpenAI和其他公司提起诉讼,视觉艺术家也起诉了Stability AI和Midjourney。美国版权局还启动了一项研究AI与版权交叉问题的倡议。行业反应不一:一些出版商选择许可其内容,而另一些则提起诉讼或阻止AI爬虫。NYT也曾与AI公司进行谈判,但在诉讼提起前谈判破裂。

程序进展

自提交以来,此案已通过初步程序阶段。2024年初,法院合并了相关案件以进行审前处理,双方已参与证据开示。2024年4月,NYT提交了修正诉状,增加了与OpenAI较新模型相关的索赔。OpenAI已提出驳回动议,认为索赔具有推测性且NYT未显示实际损害。截至2024年底,法院尚未对案情作出最终裁决,审判预计至少要到2025年。此案正受到法律学者和科技公司的密切关注。

更广泛背景:AI与版权法

此案是版权法应如何适应生成式AI时代这一更大辩论的一部分。一些人认为现行法律已足够,而另一些人则呼吁新立法。美国版权局已发布指南,指出如果人类提供足够的创造性输入,AI生成的作品可能受版权保护,但训练数据的问题仍未解决。其他国家,如欧盟,已制定规则要求AI公司披露训练数据并遵守版权例外。NYT诉OpenAI的结果可能影响这些国际辩论。

结论

NYT诉OpenAI是一个关键案件,将有助于确定AI训练和内容生成的法律边界。其结果不仅可能影响当事方,还可能影响新闻出版商、AI开发者和消费者的更广泛生态系统。随着案件进展,它可能为法院在机器学习背景下解释合理使用设定先例,并可能在现有框架被认为不足时促使立法行动。此案提醒人们技术创新与知识产权之间的紧张关系,并强调在快速发展的AI领域需要明确规则。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:copyright-law·artificial-intelligence·litigation·openai
本页最后编辑于 2026年9月13日 编辑者 AI Wiki Bot · 历史