AI著作権訴訟とは、2022年に始まり2020年代半ばまで続いた、作家、芸術家、新聞出版社、音楽レーベル、その他の権利者が、生成モデルの訓練やその出力における著作権素材の使用をめぐってAI企業に対して提起した一連の訴訟の波を指す。これらの訴訟は総じて、米国著作権法の下でライセンスなしに著作物を訓練に使用することがフェアユースに該当するかどうか、また保護された著作物に類似するAI生成出力が侵害を構成するかどうかを問うものである。
主要な訴訟
視覚芸術家たちは、Stability AI、Midjourney、DeviantArtに対して、Stable Diffusionおよび類似システムの訓練に使用されたデータをめぐり、初期の訴訟の一部を提起した。Getty Imagesは別途、英国と米国の両方でStability AIを訴え、数百万点の著作権付き画像の使用を主張し、さらにGettyの透かしの歪んだ複製と思われる出力を直接複製の証拠として指摘した。ニューヨーク・タイムズは2023年12月にOpenAIとMicrosoftを訴え、ChatGPTとBingのAI機能がタイムズの記事をほぼ逐語的に訓練され、再現できると主張し、損害賠償とそのコンテンツで訓練されたモデルの破棄を求めた。著名な小説家を含む作家グループは、海賊版書籍データセットの使用をめぐり、OpenAI、Meta、その他の開発者に対して集団訴訟を提起した。全米レコード協会は、主要レコードレーベルを代表して、2024年にAI音楽生成器Sunoとその競合であるUdioを、著作権付き録音物の訓練をめぐって訴えた。
判決と和解
結果はまちまちであり、単一の判決で根本的な問題を解決するのではなく、徐々に進展した。一部の初期訴訟は手続き上の理由で縮小または却下された一方、他の訴訟は証拠開示手続きに進み、裁判所や具体的な事実によって異なる判決が下され、特に出力が保護された表現を密接に再現しない場合には、一部の裁判官が訓練の側面がフェアユースに該当する可能性が他より高いと判断した。完全な裁判結果を待つ代わりに、複数のAI企業は出版社やコンテンツ所有者とのライセンス契約を並行戦略として追求し、OpenAIと主要な新聞・メディア組織との間の合意を含め、時間の経過とともに積極的な訴訟に関与する当事者の数を減らした。
重要性
これらの訴訟は、AIと著作権政策における広範な議論の中心に位置し、Training dataの出所、Common Crawlなどの大規模ウェブアーカイブの使用、そしてPretrainingデータセットを支える創造産業やジャーナリズム産業とAI開発者との間の経済的関係に関する懸念と交差している。これらの訴訟はまた、AI研究所が今後のデータライセンスと開示にどのように取り組むかを形成し、EU AI法やその他の新興のAIガバナンス枠組みに関連する政策議論で頻繁に引用され、そのいくつかは訓練データソースに関する特定の透明性要件を追加した。