Getty Images 诉 Stability AI 案

译自英文

Getty Images 诉 Stability AI 是一起于2023年提起的版权诉讼,指控在训练生成式AI模型Stable Diffusion时未经授权使用了Getty图片。该案的核心在于AI训练是否构成合理使用。

Getty Images 诉 Stability AI 案是一项民事诉讼,于2023年2月3日由Getty Images在美国特拉华州地区法院对Stability AI提起,后者是Stable Diffusion图像生成模型的开发者。诉状指控Stability AI未经授权复制了Getty Images数据库中的数百万张受版权保护的照片和图像,用于训练其Generative AI系统,违反了版权法。该案是针对在训练Artificial intelligence模型中使用受版权保护材料的几起高调法律挑战之一,其结果可能显著影响Machine learning和创意产业的未来。

该诉讼寻求法定损害赔偿、禁令救济,以及要求Stability AI销毁其训练数据集的法院命令。Getty Images声称Stability AI抓取了其网站和授权内容,利用这些图像构建了一个能够生成与原始图像相似的新图像的模型。Stability AI回应称,其对图像的使用属于合理使用原则,该法律原则允许在批评、评论、新闻报道、教学或研究等目的下,未经许可有限使用受版权保护的材料。该案引起了法律学者、科技公司和艺术家的广泛关注,因为它测试了版权法在Deep learning时代的边界。

背景:Stable Diffusion与训练数据

Stable Diffusion是Stability AI于2022年8月发布的文本到图像模型。它使用U-Net架构的变体开发,这是一种专为图像处理设计的Neural network类型,并在一个名为LAION-5B的大型数据集上训练,该数据集由非营利组织LAION汇编。该数据集包含数十亿个从互联网抓取的图像-文本对,包括托管在Getty Images网站上的图像。Getty Images是一家主要的股票摄影机构,将其图像授权给媒体机构、企业和个人,并严格控制其内容的使用方式。该公司声称,Stability AI未经许可抓取其图像构成直接和辅助性版权侵权。

Stable Diffusion的训练过程涉及向模型输入数百万张图像及其相关说明,使其能够学习视觉特征与文本描述之间的统计关系。这种方法在Deep learning中很常见,并依赖于大规模Data Augmentation技术来提高模型性能。然而,在训练数据集中使用受版权保护的图像已成为一个有争议的问题,因为模型可以生成与训练数据非常相似的输出,引发了对这些输出是否侵犯原始创作者权利的质疑。

法律主张与论点

Getty Images的诉状主张了多项诉讼原因,包括直接版权侵权、辅助侵权和替代责任。该公司声称,Stability AI整体复制了其图像,未进行转换,并利用它们创建了一个竞争性产品,破坏了授权摄影的市场。Getty Images还声称,Stability AI的模型可以再现其图像的可识别元素,如水印和标志,这进一步证明了未经授权的复制。

Stability AI的辩护集中在合理使用原则上,法院根据四个因素进行评估:使用的目的和性质、受版权作品的性质、使用部分的数量和实质性,以及对原始作品潜在市场的影响。Stability AI辩称,其使用是转换性的,因为模型并非简单地复制图像,而是基于学习到的模式生成新的原创输出。该公司还主张,训练过程涉及中间复制,这是Machine learning所必需的,且图像并未直接分发给用户。法律专家指出,结果可能取决于法院如何在AI背景下解释转换性,这一问题在之前的判例中尚未得到明确解决。

程序历史

在2023年2月初步提交后,该案被分配给特拉华州地区法院的Stephanos Bibas法官。2023年5月,Getty Images提交了修正诉状,增加了关于复制规模和涉及的具体图像的更详细指控。Stability AI于2023年7月提出驳回动议,辩称诉状未能陈述诉讼请求,因为图像并未直接复制到模型的输出中,且训练过程受合理使用保护。2023年11月,Bibas法官部分驳回了驳回动议,允许版权侵权索赔继续进行,同时因缺乏充分事实指控而驳回了一些次要责任索赔。

法院允许案件继续进行的决定被视为一个重大进展,因为它拒绝了Stability AI关于索赔过于推测性的论点。证据发现阶段一直在进行,双方正在交换关于训练数据集和模型技术细节的信息。截至2025年初,该案尚未进入审判阶段,也未宣布和解。法院已安排2025年中的状态会议以讨论后续程序。

相关诉讼与背景

Getty Images 诉 Stability AI 案是针对AI公司的更广泛诉讼浪潮的一部分。2023年1月,三位艺术家对Stability AI、Midjourney和DeviantArt提起了集体诉讼,指控类似的版权侵权行为。该案,即Andersen诉Stability AI案,也面临了程序性挑战,联邦法官驳回了部分索赔,但允许其他索赔继续进行。此外,多位作者已就其在训练Large language model中使用其书籍起诉了OpenAI和其他公司,提出了关于合理使用和转换性使用的类似问题。

法律环境因关于AI训练伦理的持续辩论而进一步复杂化。一些学者认为,使用公开可用的数据进行训练类似于人类学习,应被允许,而另一些人则认为创作者应因其作品的使用而获得补偿。美国版权局已启动一项关于AI和版权的研究,欧盟已通过《AI法案》,其中包括对训练数据的透明度要求。这些监管努力可能影响法院的推理,尽管它们对美国法院不具有约束力。

潜在影响

如果Getty Images胜诉,该决定可能要求AI公司为所有训练数据获得许可,这将显著增加开发Generative AI模型的成本。它还可能导致销毁基于未经授权数据训练的现有模型,Stability AI辩称这一补救措施过于繁重。相反,如果Stability AI在合理使用理由上获胜,它可能建立一个广泛的先例,允许AI公司无偿使用受版权保护的材料,可能损害股票摄影行业和其他创意部门。

该案对技术社区也有影响。MIT CSAILStanford AI Lab等机构的研究人员已发表了关于AI训练的法律和技术方面的论文,但法院的决定将提供对这些问题的首次重大司法解释。一些专家建议,该案可能导致新许可模式的发展,例如类似于音乐行业使用的集体许可计划,以促进对受版权内容的合法使用。

公众与行业反应

Getty Images将诉讼框定为对摄影师权利的保护,声称AI公司未经补偿利用他人的作品获利。该公司还推出了自己的生成式AI工具,这些工具基于授权内容训练,将自己定位为Stability AI的负责任替代品。与此同时,Stability AI强调了其技术的转换性及其民主化图像创作的潜力,同时表示愿意与内容所有者协商许可。

艺术家和摄影师表达了不同的反应。一些人支持Getty Images的法律行动,认为这是对AI侵入创意领域的必要制约。另一些人担心限制性的版权裁决可能扼杀创新并限制AI工具的可用性。该案还引发了关于需要新法律框架的讨论,以平衡创作者、AI开发者和公众的利益。

当前状态与展望

截至2025年初,Getty Images 诉 Stability AI 案仍在联邦法院审理中。证据发现阶段已广泛进行,双方提交了关于AI训练技术方面和涉嫌侵权经济影响的专家报告。预计2025年底将提出即决判决动议,如果法院认为事实无争议,可能无需审判即可解决案件。如果案件进入审判,它可能成为首批解决AI训练中版权问题的陪审团审判之一,为未来诉讼设定先例。

结果不确定,法律评论员指出合理使用分析高度依赖具体事实。法院需要权衡Stable Diffusion输出的转换性、涉及的复制量以及对Getty Images潜在市场的损害。无论结果如何,该案都可能影响AI公司处理数据收集和许可的方式,并可能促使立法行动以澄清AI训练的规则。对Artificial intelligence发展和版权法的更广泛影响是巨大的,使其成为数字时代的里程碑案件。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:copyright-law·artificial-intelligence·litigation·generative-ai
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史