Getty Images于2023年2月3日在美国特拉华州联邦地区法院对Stability AI提起诉讼。该案件的核心指控是,Stability AI作为Stable Diffusion模型的开发者,未经许可从Getty的数据库中复制了数百万张受版权保护的图像,用于训练其生成式人工智能系统。诉讼寻求法定损害赔偿、禁令救济,并要求销毁涉嫌侵权的训练数据和模型。
Getty Images是一家主要的图片库机构,声称Stability AI抓取了其网站内容,并使用其带水印的图像来训练Stable Diffusion,该模型可按需生成新图像。诉讼书指出,该AI模型以违反美国版权法的方式复制了Getty的受版权保护内容,包括直接侵权和帮助侵权。Stability AI辩称,其使用公开可用图像构成合理使用,这一辩护在其他AI版权纠纷中也是核心问题。
背景与当事方
Getty Images总部位于华盛顿州西雅图,是股票照片、编辑图片和视频素材的领先提供商。该公司将其内容授权给媒体机构、广告商和创意专业人士。Stability AI成立于2020年,总部位于伦敦,是一家AI研究公司,以发布Stable Diffusion而闻名,这是一种开源文本到图像模型,于2022年获得广泛关注。该模型在一个名为LAION-5B的大型数据集上训练,该数据集包含数十亿个从互联网抓取的图像-文本对,其中包括来自Getty收藏的图像。
该诉讼在特拉华州联邦地区法院提起,这是公司诉讼的常见地点。案件分配给法官Richard G. Andrews。Getty Images还于2023年1月在伦敦高等法院提起了相关诉讼,指控其违反英国法律。
法律主张
Getty的诉讼书根据美国版权法提出了多项诉讼原因。主要主张是直接版权侵权、帮助侵权和替代侵权。Getty指控Stability AI在训练过程中直接复制了其图像,并且生成的模型使用户能够生成侵犯Getty版权的图像。该公司还声称,Stability AI移除或更改了版权管理信息(如水印),违反了《数字千年版权法》(DMCA)。
Getty寻求每件被侵权作品最高15万美元的法定损害赔偿,考虑到据称的复制规模,这可能达到数十亿美元。该公司还请求禁令,以阻止Stability AI在未来的训练中使用其图像,并要求销毁已训练模型及其衍生品。
Stability AI的辩护
Stability AI回应称,其将图像用于训练构成美国法律下的合理使用。该公司辩称,这些图像被用于变革性目的,因为模型不存储或复制原始图像,而是学习统计规律。Stability AI还主张,训练数据是公开可用的,且公司并未直接复制任何特定图像。该辩护依赖于合理使用因素:使用的目的和性质、受版权保护作品的性质、使用部分的数量和实质性,以及对潜在市场的影响。
法律专家指出,此案的结果可能为在机器学习训练中使用受版权保护材料开创先例。该案是针对AI公司的多起高调诉讼之一,包括作家和艺术家对OpenAI及其他开发者的诉讼。
程序历史
在诉讼提起后,法院批准了暂停证据开示的动议,等待驳回动议的裁决。Stability AI于2023年5月提出驳回动议,辩称法院缺乏属人管辖权,且主张未充分陈述。2023年7月,Andrews法官部分驳回了该动议,允许案件在大多数主张上继续审理。法院认为,Getty合理指控Stability AI有意将其活动指向美国,鉴于该模型可供美国用户使用,且Stability AI有美国投资者。
2024年初,法院命令双方进行调解,但未达成和解。案件目前处于证据开示阶段,双方正在交换证据和专家报告。审判日期尚未确定,但观察人士预计案件将在2025年或更晚作出裁决。
相关诉讼与背景
Getty诉讼是针对生成式人工智能系统更广泛法律挑战浪潮的一部分。2023年1月,三位艺术家对Stability AI、Midjourney和DeviantArt提起了集体诉讼,指控类似的版权侵犯。该案(Andersen诉Stability AI)于2023年10月被部分驳回,但法院允许艺术家修改其诉讼书。2023年12月,《纽约时报》起诉OpenAI和微软版权侵权,涉及在其大型语言模型训练中使用其文章。这些案件受到密切关注,因为它们可能界定AI训练的合理使用范围。
Getty案件值得注意的是,该公司拥有大量授权图像库,并对AI公司采取了积极立场。2022年,Getty禁止在其平台上上传AI生成图像,并与其他图片库机构合作,为AI训练数据创建许可模式。
对AI行业的影响
Getty诉Stability AI的结果可能对人工智能行业产生重大影响。如果法院裁定未经许可在版权图像上训练不构成合理使用,AI开发者可能需要获得训练数据许可,这可能增加成本并减缓创新。相反,如果有利于Stability AI的裁决,可能强化抓取公开可用数据进行训练的做法,这在领域中很常见。
一些公司已开始为AI训练许可内容。例如,OpenAI已与Axel Springer和美联社等出版商签署协议。Getty Images本身也推出了自己的生成式AI工具,该工具在其授权内容上训练,以为客户提供法律安全的替代方案。该案件还可能影响数据增强技术的发展,以及使用合成数据来减少对受版权材料的依赖。
当前状态与未来展望
截至2025年初,案件仍在特拉华州地区法院待审。双方已交换初步披露信息,并正在进行事实证据开示。法院尚未就合理使用辩护作出裁决,这可能在即决判决或审判中决定。法律分析师预计无论结果如何,案件都将被上诉,意味着最终解决可能需要数年时间。
该案件也在国际上受到关注,因为英国和欧洲出现了类似争议。在英国,Getty的平行诉讼仍处于早期阶段。欧盟的《人工智能法案》于2024年通过,包括训练数据的透明度要求,但未解决版权问题。
与此同时,机器学习社区继续就训练受版权数据进行伦理讨论。一些研究人员倡导开放数据集和宽松许可,而另一些人则呼吁更严格的监管。Getty案件可能成为这一持续对话中的里程碑,塑造AI公司如何处理数据获取和版权合规。
结论
Getty诉Stability AI(美国)是一起关键的版权诉讼,检验了使用受版权保护图像训练AI模型的合法性。该案件提出了关于深度学习本质和内容创作者权利的基本问题。其结果不仅影响当事方,还将影响生成式人工智能的更广泛生态系统和创意产业的未来。随着诉讼进展,技术、法律和艺术领域的利益相关者将密切关注,等待一项可能重新定义人工智能时代合理使用边界的裁决。