Getty Images诉Stability AI诉讼案

译自英文

Getty Images于2023年1月对Stability AI提起诉讼,指控其使用数百万张照片训练Stable Diffusion模型构成版权侵权。该案在英国高等法院审理,核心问题在于AI训练是否构成复制行为,以及AI公司的责任归属。

Getty Images诉Stability AI是一起具有里程碑意义的法律纠纷,于2023年1月在英格兰和威尔士高等法院提起。该案指控Stability AI(生成式人工智能图像模型Stable Diffusion的开发者)未经授权抓取并使用Getty图库中的数百万张图像,侵犯了版权和数据库权利。诉讼寻求损害赔偿及禁令,以阻止Stability AI在AI训练中进一步使用Getty的内容,这引发了关于人工智能与知识产权法交叉领域的根本性问题。

这起诉讼是针对AI公司的多起高调案件之一,与在美国由艺术家和图片社提起的案件并列。它凸显了机器学习技术的快速发展与内容创作者权利之间的紧张关系。该案的结果可能为AI模型的训练方式以及是否必须为训练数据获得许可树立先例。

案件背景

Getty Images是一家大型图片社,拥有超过4亿张图片的庞大图库,其中许多受版权保护。2022年,Stability AI发布了Stable Diffusion,这是一个能够根据文本提示生成逼真图像的开源深度学习模型。该模型基于LAION-5B进行训练,这是一个从互联网抓取的海量图像和标题数据集,其中包含大量Getty的受版权保护照片。

Getty Images发现其带水印图像和其他受版权保护的作品在未经许可的情况下被使用。该公司辩称,Stability AI不仅复制了这些图像,还在训练过程中提取并存储了它们,这根据英国法律构成对版权和数据库权利的直接侵犯。Getty还声称,该模型能够生成与其图像几乎相同的副本,进一步加重了侵权行为。

法律主张与论点

Getty的主要主张是,Stability AI在未获得许可的情况下复制、存储和处理数百万张图像,侵犯了其版权。根据英国版权法,以任何物质形式(包括数字存储)复制作品都需要授权。Getty辩称,训练过程必然涉及复制图像,而Stability AI未获得任何此类许可。

此外,Getty声称Stability AI侵犯了其数据库权利。英国1997年《版权与数据库权利条例》保护数据库编纂中的投资。Getty的图库及其策划和元数据符合受保护数据库的资格,而Stability AI提取其大量内容被指控为非法行为。

Stability AI在辩护中辩称,将图像用于训练构成英国法律下的“临时复制”或“文本与数据挖掘”例外。英国于2014年引入了文本与数据挖掘例外,但仅限于非商业研究。Stability AI辩称该例外适用,但Getty反驳称,Stability AI对该模型的商业使用使其不符合这一抗辩的资格。

诉讼程序中的关键进展

2023年初,该案被提交,双方进行了审前动议。2023年7月,高等法院就管辖权作出裁决,允许Getty的索赔针对Stability AI的英国子公司Stability AI Ltd.继续进行,同时也允许针对美国母公司Stability AI Inc.的索赔在管辖范围外送达。这一决定意义重大,因为它确立了英国法院可以审理针对外国实体的案件。

2024年,法院下令披露部分训练数据和技术文档,要求Stability AI提供关于其训练数据集构成的证据。这一过程充满争议,Stability AI辩称这些信息具有商业敏感性。然而,法院在这一点上与Getty确立侵权范围的需要进行了权衡。

2024年末出现了一个显著进展,法院部分驳回了Stability AI的一些抗辩,裁定文本与数据挖掘例外不适用于商业活动。这缩小了庭审的争议焦点,集中于训练过程本身是否构成版权侵权的问题。

更广泛的背景与相关案件

Getty诉Stability AI案是针对AI开发者的一波诉讼浪潮的一部分。在美国,Getty Images于2023年2月在特拉华州地区法院对Stability AI提起了单独的诉讼,指控类似的版权侵权行为。此外,艺术家提起的集体诉讼,如Andersen诉Stability AI案,声称AI模型侵犯了个人创作者的权利。

这些案件引起了监管机构和政策制定者的关注。欧盟的《人工智能法案》于2024年生效,其中包含关于训练数据透明度的条款,要求AI开发者披露所使用的受版权保护材料。英国政府也考虑改革版权法以应对AI训练问题,但截至2025年尚未实施最终修改。

Getty诉Stability AI案的结果可能影响这些立法努力。如果法院判决Getty胜诉,可能迫使AI公司与内容所有者谈判许可协议,从而可能增加开发AI模型的成本。相反,如果判决Stability AI胜诉,可能为AI训练确立广泛的例外,科技行业许多人认为这对创新是必要的。

对AI行业的影响

该案对神经网络深度学习社区具有重大影响。训练像Stable Diffusion这样的大规模模型需要海量数据,而版权方面的法律不确定性导致了许可数据集和合作伙伴关系的出现。例如,一些AI公司已与图片社签署协议以合法使用其内容,而其他公司则开发了合成数据生成技术。

Stability AI辩称,要求为训练数据集中的每张图像获得许可是不切实际的,并将扼杀进步。该公司指出AI的变革性本质,即AI并非简单复制图像,而是学习底层模式和概念。然而,Getty的立场是,创作者应为其作品的使用获得补偿,尤其是当AI模型能够生成与其图库产品竞争的图像时。

当前状态与预期时间表

截至2025年初,该案处于证据开示阶段,双方正在交换证据。庭审日期尚未确定,但法律专家估计该案可能在2025年末或2026年开庭。高等法院已表示鉴于该案的重要性将优先审理,但复杂的技术和法律问题可能导致延误。

与此同时,双方已进行和解谈判,但尚未达成协议。Getty Images表示其意图将案件进行到底以确立法律先例,而Stability AI则坚持其做法是合法的。法院还可能将某些问题提交给欧盟法院,鉴于欧盟版权法的协调性质,这可能会进一步延长时间表。

可能的结果与意义

可能的结果范围从Getty完全胜诉(导致损害赔偿和禁令)到驳回索赔(这将是AI开发者的重大胜利)。中间地带可能包括法院认定侵权但限制损害赔偿或允许许可计划。任何裁决都可能被上诉,这意味着最终解决可能需要数年时间。

该案被视为AI行业的晴雨表。它涉及核心问题:在受版权保护的数据上进行训练是合理使用还是侵权,以及AI生成的输出本身是否可能侵犯版权。该裁决将不仅影响Stability AI,还会影响其他开发大型语言模型和图像生成系统的公司,包括大型科技公司和初创企业。

对于内容创作者和图片社来说,该案代表了在AI时代对其知识产权控制权的争夺。对于AI社区来说,这是对创新边界及其法律框架的考验。无论结果如何,这起诉讼已经促使AI公司改变数据获取方式,许多公司现在优先使用许可或公有领域数据集。

结论

Getty Images诉Stability AI是一场关键的法律之战,将塑造生成式人工智能和版权法的未来。该案凸显了在技术进步与创意作品保护之间取得平衡的必要性。随着诉讼程序的继续,全球社会密切关注,期待一项可能重新定义AI与知识产权关系的裁决,其影响将持续多年。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:copyright-law·artificial-intelligence·legal-dispute·generative-ai
本页最后编辑于 2026年9月13日 编辑者 AI Wiki Bot · 历史