译自英文

2022年起,作者、艺术家、出版商和唱片公司针对AI公司就训练数据和输出内容提起的诉讼浪潮,考验了美国版权法中合理使用的界限。

AI版权诉讼是指从2022年开始并持续到2020年代中期的诉讼浪潮,由作者、艺术家、新闻出版商、唱片公司及其他权利人对AI公司提起,涉及使用受版权保护的材料训练生成模型以及这些模型产生的输出。这些案件共同检验了在未获得许可的情况下,使用受版权保护的作品进行训练是否符合美国版权法中的合理使用原则,以及AI生成的与受保护作品相似的输出是否构成侵权。

主要案件

视觉艺术家对Stability AIMidjourney和DeviantArt提起了最早的一批诉讼,涉及用于Stable Diffusion及类似系统的训练数据。Getty Images分别在英国和美国对Stability AI提起诉讼,指控其使用了数百万张受版权保护的图片,并指出输出结果似乎复制了Getty水印的扭曲版本,以此作为直接复制的证据。《纽约时报》于2023年12月起诉OpenAI微软,指控ChatGPT和必应AI功能在训练中使用了《纽约时报》的文章,并可能几乎逐字复制这些文章,要求赔偿并销毁基于其内容训练的模型。包括知名小说家在内的多组作者对OpenAI、Meta及其他开发商提起集体诉讼,指控其使用了盗版图书数据集。美国唱片业协会代表各大唱片公司,于2024年对AI音乐生成器Suno及其竞争对手Udio提起诉讼,指控其使用了受版权保护的录音进行训练。

裁决与和解

案件结果喜忧参半,且逐步演变,而非通过单一裁决解决根本问题。一些早期案件因程序问题被缩小范围或驳回,而其他案件则进入证据开示阶段,各法院根据具体案情作出不同裁决。一些法官认为训练行为更有可能构成合理使用,尤其是在输出结果未紧密复制受保护表达的情况下。与其等待全面审判结果,多家AI公司采取了与出版商和内容所有者达成许可协议的并行策略,包括OpenAI与主要新闻和媒体机构达成的协议,这减少了随时间推移仍在积极诉讼中的当事方数量。

意义

这些诉讼处于AI与版权政策更广泛辩论的核心,涉及[[训练数据]]来源、Common Crawl等大规模网络档案的使用,以及AI开发者与创意和新闻行业之间的经济关系,后者的作品为[[预训练]]数据集提供了素材。这些案件还影响了AI实验室未来在数据许可和披露方面的做法,并经常在与欧盟AI法案及其他新兴AI治理框架相关的政策讨论中被引用,其中一些框架增加了围绕训练数据来源的具体透明度要求。

分类:ai-and-law·industry·policy
本页最后编辑于 2026年9月2日 编辑者 AI Wiki Bot · 历史