Getty Imagesは、2023年2月3日に米国デラウェア地区連邦地方裁判所にStability AIを相手取り訴訟を提起した。この訴訟は、Stable Diffusionモデルの開発者であるStability AIが、同社のGenerative AIシステムを訓練するために、許可なくGettyのデータベースから数百万点の著作権で保護された画像を複製したという申し立てを中心としている。この訴訟では、法定損害賠償、差止命令、および侵害しているとされる訓練データとモデルの破棄を求めている。
主要なストックフォト代理店であるGetty Imagesは、Stability AIが同社のウェブサイトをスクレイピングし、透かし入りの画像を使用して、オンデマンドで新しい画像を生成できるStable Diffusionを訓練したと主張している。訴状では、AIモデルがGettyの著作権で保護されたコンテンツを米国著作権法に違反する方法で複製しており、直接侵害と寄与侵害を含むと主張している。Stability AIは、公開されている画像の使用はフェアユースに該当すると主張しており、この抗弁は他のAI著作権紛争の中心となっている。
背景と当事者
ワシントン州シアトルに本社を置くGetty Imagesは、ストック写真、編集用画像、およびビデオ映像の大手プロバイダーである。同社は、メディア企業、広告主、およびクリエイティブ専門家にコンテンツをライセンス供給している。2020年に設立されロンドンを拠点とするStability AIは、2022年に広く注目を集めたオープンソースのテキストから画像を生成するモデルであるStable Diffusionをリリースしたことで知られるAI研究会社である。このモデルは、インターネットから収集された何億もの画像とテキストのペアを含むLAION-5Bと呼ばれる大規模なデータセットで訓練されており、Gettyのコレクションからの画像も含まれていた。
この訴訟は、企業訴訟の一般的な管轄地であるデラウェア地区連邦地方裁判所に提起された。この事件はリチャード・G・アンドリュース判事に割り当てられた。Getty Imagesはまた、2023年1月にロンドンの高等法院にも関連訴訟を提起し、英国法に基づく著作権侵害を主張している。
法的請求
Gettyの訴状には、米国著作権法に基づく複数の訴訟原因が含まれている。主な請求は、直接著作権侵害、寄与侵害、および代位侵害である。Gettyは、Stability AIが訓練プロセス中に同社の画像を直接複製し、その結果得られたモデルによりユーザーがGettyの著作権を侵害する画像を生成できるようになると主張している。同社はまた、Stability AIがデジタルミレニアム著作権法(DMCA)に違反して、透かしなどの著作権管理情報を削除または変更したと主張している。
Gettyは、侵害された作品ごとに最大15万ドルの法定損害賠償を求めており、これは申し立てられた複製の規模を考えると、数十億ドルに上る可能性がある。同社はまた、将来の訓練での同社画像の使用を防ぎ、訓練済みモデルとその派生モデルの破棄を要求する差止命令も求めている。
Stability AIの抗弁
Stability AIは、訓練のための画像の使用は米国法の下でフェアユースに該当すると主張して応じている。同社は、モデルが元の画像を保存または複製するのではなく統計的パターンを学習するため、画像は転換的使用に使用されていると主張している。Stability AIはまた、訓練データは公開されており、同社は特定の画像を直接複製していないと主張している。この抗弁は、フェアユースの要素、すなわち使用の目的と性質、著作権で保護された作品の性質、使用された部分の量と実質性、および潜在的な市場への影響に依存している。
法律専門家は、この訴訟の結果がMachine learning訓練における著作権で保護された素材の使用に関する前例を確立する可能性があると指摘している。この訴訟は、OpenAIや他の開発者に対する作家やアーティストによる訴訟など、AI企業に対する注目度の高い訴訟の1つである。
手続きの経過
訴状が提出された後、裁判所は却下申立の決定を待つ間、証拠開示手続きの停止を認める命令を出した。Stability AIは2023年5月に却下申立を提出し、裁判所に属人管轄権がなく、請求が十分に主張されていないと主張した。2023年7月、アンドリュース判事は申立を一部却下し、ほとんどの請求について訴訟の続行を認めた。裁判所は、モデルが米国のユーザーが利用でき、Stability AIに米国を拠点とする投資家がいたことを考慮すると、GettyがStability AIがその活動を米国に向けて意図的に行ったと十分に主張したと判断した。
2024年初頭、裁判所は当事者に調停を行うよう命じたが、和解には至らなかった。この訴訟は現在証拠開示段階にあり、双方が証拠と専門家報告書を交換している。裁判期日はまだ設定されていないが、観測筋はこの訴訟が2025年以降に判決されると予想している。
関連訴訟と背景
Getty訴訟は、Generative AIシステムに対するより広範な法的挑戦の波の一部である。2023年1月、3人のアーティストがStability AI、Midjourney、およびDeviantArtに対して同様の著作権侵害を主張する集団訴訟を提起した。その訴訟であるAndersen v. Stability AIは、2023年10月に一部却下されたが、裁判所はアーティストが訴状を修正することを許可した。2023年12月、ニューヨーク・タイムズ紙は、Large language modelの訓練における同紙の記事の使用について、OpenAIとマイクロソフトを著作権侵害で訴えた。これらの訴訟は、AI訓練におけるフェアユースの境界を定義する可能性があるため、注目されている。
Gettyの訴訟は、同社がライセンス供給された画像の大規模なライブラリを有し、AI企業に対して積極的な姿勢を取っていることで注目に値する。2022年、GettyはプラットフォームへのAI生成画像のアップロードを禁止し、他のストックエージェンシーと提携してAI訓練データのライセンスモデルを構築している。
AI業界への影響
Getty v. Stability AIの結果は、Artificial intelligence業界に重大な影響を与える可能性がある。裁判所が、許可なく著作権で保護された画像を訓練に使用することはフェアユースではないと判断した場合、AI開発者は訓練データのライセンスを取得する必要が生じ、コストが増加し、イノベーションが遅くなる可能性がある。逆に、Stability AIに有利な判決が出た場合、この分野で一般的な公開データのスクレイピングという慣行が強化される可能性がある。
一部の企業はすでにAI訓練用のコンテンツのライセンス供給を開始している。例えば、OpenAIはAxel SpringerやAP通信などの出版社と契約を結んでいる。Getty Images自体も、ライセンス供給されたコンテンツで訓練された独自の生成AIツールを立ち上げ、顧客に法的に安全な代替手段を提供している。この訴訟はまた、Data Augmentation技術の開発や、著作権で保護された素材への依存を減らすための合成データの使用に影響を与える可能性がある。
現在の状況と今後の見通し
2025年初頭の時点で、この訴訟はデラウェア地区連邦地方裁判所に係属中である。当事者は初期開示を交換し、事実証拠開示を行っている。裁判所はまだフェアユースの抗弁について判断を下しておらず、これはおそらく略式判決または裁判で決定される見込みである。法律アナリストは、結果に関わらずこの訴訟は控訴されると予想しており、最終的な解決には数年かかる可能性がある。
この訴訟は国際的にも注目されており、英国や欧州でも同様の紛争が発生している。英国では、Gettyの並行訴訟はまだ初期段階にある。2024年に採択された欧州連合のAI法には訓練データに関する透明性要件が含まれているが、著作権問題を解決するものではない。
一方、Machine learningコミュニティでは、著作権で保護されたデータの訓練に関する倫理について議論が続いている。一部の研究者はオープンデータセットと寛容なライセンスを提唱し、他の研究者はより厳格な規制を求めている。Getty訴訟は、この進行中の議論において画期的な出来事となる可能性が高く、AI企業がデータ取得と著作権コンプライアンスにどのように取り組むかを形作るだろう。
結論
Getty v. Stability AI(米国)は、著作権で保護された画像をAIモデルの訓練に使用することの合法性を問う極めて重要な著作権訴訟である。この訴訟は、Deep learningの性質とコンテンツ作成者の権利に関する根本的な疑問を提起している。その結果は、関与する当事者だけでなく、Generative AIのより広範なエコシステムとクリエイティブ産業の未来に影響を与えるだろう。訴訟が進むにつれて、テクノロジー、法律、芸術の分野の利害関係者は、人工知能の時代におけるフェアユースの境界を再定義する可能性のある判決を注視している。