Getty v. Stability AI事件は、Getty ImagesがStable Diffusion画像生成モデルの開発者であるStability AIに対して提起した、2つの並行する法的手続きを包含する。争点は、Stability AIが許可なくGettyのデータベースから数百万点の著作権で保護された写真を複製し、その人工知能システムの訓練に使用したという申し立てを中心としている。米国と英国で提起されたこれらの訴訟は、Generative AIの開発と既存の著作権法との間の緊張関係を示す画期的な事例となっている。
主要なストックフォト機関であるGetty Imagesは、2023年初頭に両法域で法的措置を開始した。同社は、Stability AIが独自の画像をMachine learningモデルの訓練に使用したことは、大規模な著作権侵害を構成すると主張した。これに対しStability AIは、自社の慣行はテキストおよびデータマイニングに関する法的例外、米国の文脈ではフェアユースの法理に該当すると主張した。これらの訴訟の結果は、テクノロジー企業、コンテンツ制作者、法律学者によって注視されており、将来のArtificial intelligenceモデルの訓練方法に先例を確立する可能性がある。
背景:Stable Diffusionと訓練データ
Stability AIが2022年8月にリリースしたStable Diffusionは、テキストプロンプトから詳細な画像を生成できるDeep learningモデルである。このモデルは、インターネットから収集された数十億の画像とテキストのペアを含むLAION-5Bと呼ばれるデータセットで訓練された。Getty Imagesは、このデータセットのかなりの部分に自社の著作権で保護された写真が含まれており、その多くに透かしやGettyコンテンツであることを識別する埋め込みメタデータが含まれていたと主張した。
このようなモデルの訓練プロセスでは、膨大な数の画像をNeural networkアーキテクチャ(通常はU-Netとテキストエンコーダの組み合わせ)に供給する。訓練中、モデルは視覚的特徴と説明的な単語を結び付ける統計的パターンを学習する。Gettyは、このプロセスが必然的に元の画像の複製と保存(少なくとも一時的)を伴い、結果として得られるモデルが特定の著作権作品に酷似した出力を生成できると主張した。
米国での訴訟:Getty Images (US), Inc. v. Stability AI, Inc.
2023年2月、Getty Imagesは米国デラウェア地区連邦地方裁判所に訴訟を提起した。訴状では、直接および間接的な著作権侵害、著作権管理情報の削除に関するデジタルミレニアム著作権法(DMCA)違反、およびGettyの透かしが付いた画像の生成に関する商標権侵害が申し立てられた。
Gettyは、Stability AIが許可なく自社のデータベースから1200万点以上の写真を複製したと主張した。同社は法定損害賠償を求めており、侵害作品1点につき最大15万ドル、総額で数十億ドルに達する可能性がある。Stability AIは複数の請求の却下を求めて申し立てを行い、DMCA請求はメタデータの削除がモデル自体の配布ではなく訓練プロセス中に発生したため、欠陥があると主張した。
2023年8月、ウィリアム・ブライソン判事はStability AIの却下申し立てを部分的に認め、著作権侵害の請求は進行を許可したが、DMCA請求と商標請求は却下した。裁判所は、訓練プロセスが画像の複製を伴うため、Gettyが直接侵害を十分に主張したと判断した。しかし、DMCA請求は、Gettyがメタデータ削除後に画像を公衆に配布したことを示せなかったため却下された。商標請求は、生成された画像が写真の出所に関して混同を生じさせる可能性が低いため却下された。
この訴訟は証拠開示段階を継続し、両当事者は訓練データセットの構成とモデルの技術的詳細に関する証拠を交換した。2024年後半、裁判所は双方の略式判決申し立てを却下し、訴訟を裁判に進めることを許可した。裁判日は2025年後半に設定されたが、和解交渉が進行中であると報じられている。
英国での訴訟:Getty Images v. Stability AI Ltd.
2023年1月、Getty Imagesはイングランドおよびウェールズ高等法院に、同社の英国子会社であるStability AI Ltd.に対して別の訴訟を提起した。英国の請求は著作権侵害に焦点を当てており、Stability AIが訓練業務の一環として英国でGettyの画像を複製および保存したと主張した。
英国の訴訟は、著作権法の違いにより異なる法的問題を提起した。英国には一般的なフェアユース法理はなく、代わりに非商業的研究のためのテキストおよびデータマイニングの例外を含む特定の例外が存在する。Stability AIは自社の活動がこの例外に該当すると主張したが、Gettyは訓練が商業的性質を持ち、例外が商業製品の作成には適用されないと反論した。
2023年7月、高等法院はGettyの請求の進行を許可し、Stability AIによる事件の一部却下申請を却下した。裁判所は、提起された問題は実質的であり、完全な審理が必要であると指摘した。この訴訟は、重複する訴訟を避けるため、米国での訴訟の結果を待って停止された。しかし、2025年初頭に停止が解除され、英国の訴訟は再開され、2025年半ばにケースマネジメント会議が予定された。
法的論点と抗弁
両法域におけるStability AIの主な抗弁は、著作権で保護された画像でAIモデルを訓練しても、モデルが認識可能な形で画像を複製しないため侵害にはならないというものであった。同社は、訓練プロセスが画像を数学的な重みに変換することを伴い、最終的なモデルは特定の作品の複製ではなく機能的なツールであると主張した。
米国では、Stability AIはフェアユース法理を援用し、使用の変容的性質、画像が非表現的目的で使用されたこと、市場への害がないことなどの要素を挙げた。同社は、裁判所が同様の使用をフェアと判断した検索エンジンや書籍のデジタル化に関する過去の判例を指摘した。しかしGettyは、複製の規模と使用の商業的性質がフェアユースに反すること、およびモデルがGetty自身の製品と競合する画像を生成できることを主張した。
英国では、抗弁は1988年著作権・意匠・特許法に基づくテキストおよびデータマイニングの例外を中心とした。Stability AIは、自社の訓練がデータの計算的分析の一形態であり、非商業的研究のために許可されていると主張した。Gettyは、Stability AIが商業的主体であり、この例外が商業的AI製品の訓練を対象としていないと反論した。
AI業界への影響
これらの訴訟は、より広範なMachine learningエコシステムに重要な影響を与える。OpenAI、Anthropic、Google DeepMindを含む多くのAI企業は、訓練データセットの構築を大規模なウェブスクレイピングに依存している。Stability AIに不利な判決が出れば、これらの企業は訓練データのライセンス取得や慣行の変更を余儀なくされ、コストが増加し、革新が遅れる可能性がある。
逆に、Stability AIに有利な判決が出れば、AI訓練のための著作権素材の広範な使用権が確立される可能性があり、コンテンツ制作者や出版社はこれに反対している。これらの訴訟は、OpenAIに対する作家による訴訟や、他のAI企業に対する視覚芸術家による訴訟を含む一連の訴訟の一部であり、許容される使用の境界を定義しようとしている。
結果はまた、Large language modelやその他の生成システムの開発にも影響を与える可能性がある。著作権データでの訓練が制限されれば、企業はパブリックドメインまたは明示的にライセンスされたデータに依存せざるを得なくなり、AI出力の多様性と品質が制限される可能性がある。一部の企業はすでに、OpenAIのニュース組織との契約など、コンテンツプロバイダーとのライセンス契約を先制的に結び始めている。
技術的および倫理的側面
これらの訴訟はまた、AIモデルの訓練方法に関する技術的および倫理的な問題を浮き彫りにする。Stable Diffusionで使用されるNeural networkアーキテクチャ(U-Netとテキストエンコーダを含む)は、画像の統計的分布を学習するように設計されている。このプロセスが法的意味での「複製」を構成するかどうかは、進行中の議論の対象である。
倫理的には、これらの訴訟は、報酬なしで作品が使用される個々の写真家や芸術家の権利に関する懸念を提起する。Getty Imagesはクリエイターの権利の擁護者として自らを位置づけている一方、Stability AIは自社の技術が新たな形態の創造性を可能にし、過度に制限的な著作権法が進歩を妨げると主張している。
一部の研究者は、Data Augmentation技術やModel Pruningの使用など、著作権データへの依存を減らすための技術的解決策を提案している。また、完全にライセンスされた、またはパブリックドメインの作品で構成された訓練データセットの開発を求める声もある。これらのアプローチは依然として実験段階にあり、法的環境がその採用を形成する可能性が高い。
現在の状況と今後の見通し
2025年半ば現在、両訴訟は未解決のままである。米国の訴訟は2025年後半に裁判が予定されており、英国の訴訟は初期段階にある。法律専門家は、米国の裁判が米国におけるAI訓練と著作権に関する最初の主要な司法判断を生み出す可能性があるため、注目されるだろうと予想している。
和解の可能性は依然としてあり、両当事者は裁判の不確実性を避けるインセンティブを持っている。しかし、賭け金は高く、いかなる和解もライセンス料の基準を設定したり、将来の契約の枠組みを確立したりする可能性がある。また、初期の結果に関係なく、これらの訴訟は控訴される可能性が高く、最終的な解決には数年かかる可能性がある。
Getty v. Stability AI事件は、Artificial intelligenceの規制に関するより広範な世界的議論の一部である。欧州連合、日本、その他の法域の政府は、AI訓練データに関する規則を検討または実施している。これらの訴訟での判決は、そのような規制努力に影響を与え、今後数年間のAI業界の未来を形成する可能性がある。