Getty Images 诉 Stability AI 案

译自英文

Getty Images诉Stability AI案是一起具有里程碑意义的版权诉讼,于2023年1月提起,指控Stability AI未经许可使用Getty的图像来训练其Stable Diffusion模型。

Getty Images 诉 Stability AI 案是2023年1月在英格兰和威尔士高等法院提起的一起法律诉讼。原告 Getty Images 是一家大型图片库机构,指控 Stability AI(Stable Diffusion 图像生成模型的开发者)未经授权使用 Getty 图库中的数百万张图片训练模型,侵犯了其版权和数据库权利。该案是对基于受版权保护数据训练生成式 AI 模型这一做法提出的首批重大法律挑战之一,其结果可能对 AI 行业产生深远影响。

该诉讼于2023年1月17日启动,当时 Getty Images 宣布已在伦敦对 Stability AI 提起诉讼。诉讼的核心是 Getty 数据库中超过1200万张图片的使用,这些图片被包含在 LAION-5B 数据集中,该数据集是用于训练 Stable Diffusion 的大规模开源数据集。Getty 声称 Stability AI 未经许可复制和处理了这些图片,从而侵犯了其根据英国法律享有的版权和数据库权利。该案还引发了关于使用公开网络数据进行 AI 训练合法性的质疑,这种做法在 AI 开发者中很常见。

背景:Stability AI 与 Stable Diffusion

Stability AI 由 Emad Mostaque 于2020年创立,是一家总部位于伦敦的人工智能公司。2022年8月,该公司发布了 Stable Diffusion,这是一种能够根据文本提示生成高质量图像的深度学习模型。该模型基于 LAION-5B 数据集进行训练,该数据集包含从互联网抓取的数十亿个图像-文本对,其中许多图片来自 Getty Images 等图片库网站。Stable Diffusion 因其开源特性以及能够在消费级硬件上运行而迅速流行,但也因未经授权使用受版权保护的图片而引发争议。

Getty Images 成立于1995年,是全球最大的库存照片、编辑图片和视频提供商之一。该公司将其内容授权给媒体机构、广告商和企业,并高度重视保护其知识产权。在诉状中,Getty 声称 Stability AI 对其图片的使用不仅侵犯了版权,还破坏了 Getty 的商业模式,因为该模型使用户能够生成与授权内容竞争的图像。

法律主张与论点

Getty Images 的诉讼指控 Stability AI 违反了英国法律的多项规定,包括:

  • 版权侵权:Stability AI 未经许可复制和处理了 Getty 受版权保护的图片。
  • 数据库权利侵权:提取和再利用了 Getty 图像数据库的实质性部分。
  • 商标侵权:Stability AI 的模型可能生成带有 Getty 水印的图像,这可能误导用户以为这些是经授权的 Getty 内容。

Getty 寻求禁令以阻止 Stability AI 使用其图片,并要求损害赔偿和法律费用。Stability AI 在辩护中辩称,将图片用于训练构成“文本和数据挖掘”,属于英国1988年《版权、设计和专利法》中的例外情况,该法允许为非商业研究目的进行复制。然而,Getty 反驳称 Stability AI 的使用是商业性的,因此不适用该例外。

程序历史

该案在伦敦高等法院提起。2023年初,法院准许 Getty 向 Stability AI(一家在美国注册的公司)送达诉讼文书。案件随后经历了各种初步阶段,包括案件管理会议和诉状交换。截至2025年,该案尚未进入审判阶段,双方正在进行证据开示,并就管辖权以及英国法律对一家美国公司的适用性进行法律辩论。

在相关进展中,Getty Images 还于2023年2月在美国特拉华州地区法院对 Stability AI 提起了另一起诉讼。该案根据美国法律提出了类似的版权侵权指控。然而,英国案件之所以引人注目,是因为它检验了英国版权法在 AI 训练背景下的适用范围。

更广泛的背景:AI 与版权诉讼

Getty Images 诉 Stability AI 案是针对 AI 公司的一系列法律行动之一。2023年1月,三位视觉艺术家,,Sarah Andersen、Kelly McKernan 和 Karla Ortiz,,在美国对 Stability AI、Midjourney 和 DeviantArt 提起了集体诉讼,指控其使用他们的艺术作品训练 AI 模型构成版权侵权。同样,Sarah Silverman 和 Christopher Golden 等作家也起诉了 OpenAI 和 Meta,指控其使用他们的书籍训练大型语言模型。这些案件凸显了 AI 开发者与内容创作者之间在训练数据集中使用受版权保护材料方面的日益紧张关系。

Getty Images 诉 Stability AI 案的结果可能为法院在 AI 训练背景下如何解释“合理使用”或“公平交易”例外设定先例。在英国,政府已考虑改革版权法以明确 AI 进行文本和数据挖掘的合法性,但截至2025年尚未做出最终决定。该案还引发了关于 AI 公司是否有责任为训练数据获取许可,以及它们是否可以依赖图片在互联网上公开可用这一事实的问题。

对 AI 行业的影响

该诉讼对开发 Generative AI 模型的公司具有重大影响。如果 Getty Images 胜诉,AI 开发者可能被要求为训练中使用的任何受版权保护材料获取许可,这可能增加成本并减缓创新。相反,如果 Stability AI 胜诉,则可能使抓取网络数据进行训练的做法合法化,从而可能导致更开放和更易获取的 AI 模型。

许多 AI 研究者和公司认为,在大型数据集上进行训练对于创建强大模型至关重要,版权法应适应以允许此类使用。另一些人,尤其是创意产业的人士,则认为未经授权使用受版权保护的作品是盗窃行为,创作者应获得补偿。该案还引发了关于需要新的许可机制以及开发 Data Augmentation 技术以减少对受版权保护数据依赖的讨论。

当前状态与未来展望

截至2025年,英国案件仍处于早期阶段,尚未确定审判日期。美国案件也在进行中,正在审议驳回动议。法律专家预计,这些案件可能需要数年才能解决,并且很可能向更高法院提起上诉。与此同时,一些 AI 公司已开始与内容提供商达成许可协议。例如,OpenAI 已与 Shutterstock 和美联社等出版商签署协议,而 Stability AI 也宣布与一些图片库机构建立合作伙伴关系。

Getty Images 还推出了自己的生成式 AI 工具,使用其授权内容,为客户提供 Stable Diffusion 等模型的合法替代方案。这一举措表明,该公司并非反对 AI 技术本身,而是反对未经授权使用其内容。

该案受到 Artificial intelligence 社区的密切关注,因为它可能影响未来 AI 模型的训练和部署方式。它还强调了需要清晰的法律框架,以平衡创新与内容创作者的权利。在法院作出裁决之前,AI 训练数据的不确定性仍然是 Stability AI、OpenAIGoogle DeepMind 等依赖大规模数据集的公司面临的重大风险。

结论

Getty Images 诉 Stability AI 案代表了版权法与 Machine learning 交汇的关键时刻。该诉讼挑战了公开可用数据可自由用于 AI 训练的假设,并可能重塑 AI 公司的商业模式。虽然法律程序仍在进行中,但该案已引发行业范围内关于数据许可、透明度以及创造性作品伦理使用的讨论。无论最终判决何时作出,它都可能对 Deep learning 的未来以及数字时代知识产权的保护产生深远影响。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:copyright-law·artificial-intelligence·legal-case·generative-ai
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史