Getty v. Stability (2023)

译自英文

Getty v. Stability(2023)是Getty Images对Stability AI提起的诉讼,指控其在训练Stable Diffusion模型时使用了数百万张图像,构成版权侵权。

Getty v. Stability(2023)是Getty Images对Stability AI提起的一起版权侵权诉讼,Stability AI是Stable Diffusion图像生成模型的开发者。该案于2023年1月在美国特拉华州地区法院提起,指控Stability AI未经授权复制和处理了Getty数据库中数百万张图像,以训练其Generative AI模型。诉讼寻求法定赔偿、禁令救济以及销毁侵权训练数据。

争议的核心在于使用网络抓取图像训练Deep learning系统。Getty Images是一家主要的图库摄影机构,声称Stability AI的行为侵犯了其及其贡献者的版权。Stability AI辩称,其使用公开可用的图像属于合理使用,这一辩护在Artificial intelligence领域的多个类似案件中一直是核心问题。

案件背景

2022年,Stability AI发布了Stable Diffusion,这是一种开源Neural network模型,能够根据文本提示生成详细图像。该模型基于一个名为LAION-5B的数据集进行训练,该数据集包含数十亿对从互联网抓取的图像和文本。Getty Images授权了数百万张照片,声称其大量专有图像未经许可被包含在该数据集中。

Getty Images于2023年1月13日在美国特拉华州地区法院提起诉讼。诉讼将Stability AI及其首席执行官Emad Mostaque以及公司美国子公司Stability AI Ltd列为被告。诉状主张直接、辅助和替代性版权侵权,以及违反《数字千年版权法》(DMCA),因为删除了或更改了版权管理信息。

法律主张与论点

Getty Images的主要主张是,Stability AI在训练过程中复制并存储了数百万张受版权保护的图像。该公司认为,这种复制不具有变革性,且Stability AI使用的商业性质不利于合理使用辩护。Getty还声称,Stable Diffusion可以生成与原始照片高度相似的图像,包括水印和其他识别标记,这进一步削弱了合理使用辩护。

Stability AI回应称,在公开可用的图像上进行训练是合法的合理使用,类似于人类艺术家从现有作品中学习。该公司还辩称,Stable Diffusion生成的图像是新的、变革性的作品,不侵犯任何特定版权。Stability AI曾试图驳回此案,但法院允许诉讼继续进行,表明法律问题具有实质性。

相关诉讼与行业影响

Getty v. Stability案是针对Generative AI公司更广泛诉讼浪潮的一部分。2023年1月,三位艺术家Sarah Andersen、Kelly McKernan和Karla Ortiz对Stability AI、Midjourney和DeviantArt提起了集体诉讼,指控类似的版权侵权。该案(Andersen v. Stability AI)后来部分被驳回,但某些主张被允许继续审理。其他诉讼还包括作者对OpenAIAnthropic提起的诉讼,指控其在训练Large language model时使用了受版权保护的文本。

这些案件对Artificial intelligence行业具有重大影响。如果法院裁定AI公司败诉,它们可能需要许可训练数据,这可能会增加成本并改变未来模型的开发方式。相反,如果法院支持合理使用,则可能巩固在公开数据上训练的合法性,鼓励进一步创新。

训练数据的角色

争议的核心在于Machine learning模型的训练方式。Stable Diffusion是一种Generative AI模型,使用U-Net架构和称为扩散的过程来生成图像。训练过程涉及向模型提供数百万张图像及其相关文本描述,使其能够学习视觉特征与语言之间的统计关系。

Getty Images认为,这一过程涉及未经授权复制其受版权保护的作品。该公司指出,Stable Diffusion有时可以复制其数据库中图像的近乎精确副本,包括Getty Images水印。Getty声称,这表明模型已经记忆并可以输出受版权保护的内容,这不属于合理使用。

程序历史与当前状态

在Getty提起诉讼后,Stability AI提出驳回动议,辩称这些主张是推测性的,且公司并未直接侵犯任何版权。在2023年末的一项裁决中,法院驳回了驳回动议,允许案件进入证据发现阶段。法院认为,Getty合理地指控了Stability AI复制了其图像,且合理使用辩护在此阶段不足以驳回主张。

截至2025年初,该案仍处于证据发现阶段。双方一直在进行大量的文件制作和证词采集。审判日期尚未确定。此案的结果可能为版权法如何适用于Artificial intelligence训练设定先例,不仅影响Stability AI,还影响OpenAIAnthropicGoogle DeepMind等其他公司。

更广泛的背景:AI与版权法

Getty v. Stability案是引发关于AI与版权法律和监管讨论的几个高调争议之一。在美国,版权局发布了指导意见,指出完全由AI生成的作品不符合版权保护资格,但训练是否构成侵权的问题仍未解决。在欧盟,AI法案包含要求训练数据透明度的条款,但未明确涉及版权。

一些专家认为,现行版权法不足以应对AI训练的复杂性。他们建议可能需要新的立法来平衡版权持有者和AI开发者的利益。其他人则认为合理使用已足够,法院最终将支持在公开数据上训练的合法性。

潜在结果与影响

如果Getty Images胜诉,Stability AI可能被责令支付巨额赔偿并移除或销毁其训练数据集。这可能会对开源AI模型的开发产生寒蝉效应,因为其他开发者可能不愿在没有许可的情况下使用网络抓取数据。这也可能导致许可训练数据市场的出现,像Getty Images这样的公司出售其档案用于AI训练。

如果Stability AI胜诉,将强化在公开数据上训练属于合理使用的观点,这可能加速AI发展。然而,这也可能导致更激进的抓取行为,可能损害依赖许可费用的摄影师和其他内容创作者。

此案受到Artificial intelligence社区、法律学者和内容创作者的密切关注。其解决方式可能会影响AI公司如何处理数据收集以及是否寻求版权持有者的许可。截至目前,该案仍在审理中,尚未作出最终判决。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:copyright-law·artificial-intelligence·litigation·generative-ai
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史