AIと著作権は、著作権で保護されたテキスト、画像、音声、動画を学習データとして利用し、プロンプトに応じて新しいコンテンツを生成する生成AIシステムによって提起される、法的・政策的な問題群である。議論を支配するのは2つの別個の問いである。ライセンスなしに著作権で保護された作品を学習データとして使用することが侵害に当たるかどうか、そして生成モデルの出力自体が著作権で保護され得るかどうか、また誰によって保護されるかである。2020年代半ば時点で、どちらの問いも法域を超えて一様に解決されておらず、その答えは訴訟、立法、およびAI開発者と権利者との間で結ばれる自主的なライセンス契約を通じて模索されている。
学習データをめぐる訴訟
2022年以降、作家、視覚芸術家、音楽レーベル、報道機関は、学習コーパスにおける自らの作品の使用をめぐり、AI開発者に対して数多くの訴訟を提起してきた。Getty Imagesは、Stability AIがStable Diffusion用に画像をスクレイピングしたとして提訴した。視覚芸術家のグループは、Stability AI、Midjourney、DeviantArtに対して同様の訴訟を起こした。コメディアンのサラ・シルバーマンら作家は、OpenAIとMeta AIを、自らの書籍が許可なく使用されたとして提訴し、一部のケースではシャドーライブラリのデータセットに由来することが追跡された。音楽生成スタートアップのSunoとUdioに対する訴訟は、主要レコードレーベルがRIAAのもとで提起し、著作権で保護された録音に関する同様の主張を行った。最も注目された訴訟であるThe New York Times対OpenAIおよびMicrosoftは、2023年12月に提起され、ChatGPTがタイムズ紙の記事をほぼ逐語的に再現でき、これが著作権侵害に当たるとともに、読者を元の情報源から逸らすと主張した。この訴訟は2025年を通じて審理が続いた。AI企業は一般に、米国において著作権で保護された素材を学習に使用することはフェアユースであり、そのプロセスは変形的であると主張してきたが、この法理はこれらの訴訟の大半で控訴審レベルにおいて生成AIに特化して検証されておらず、裁判所は、学習に使用された海賊版コピーがフェアユースの抗弁を失わせるかどうかといった狭い問題について、初期段階でまちまちの判断を下している。
出力の所有権
もう1つの別個の論点は、AI生成の出力がそもそも著作権で保護され得るかどうかである。米国著作権局は、著作権保護には人間の著作者性が必要であるとの立場をとり、人間の関与が最小限の作品、特に完全にAI生成の画像に関する登録を繰り返し拒否してきた。人間がAI支援の出力を有意義に選択、配置、編集する場合、局は人間が著作者として関与した要素を対象とする部分的な登録を認めている。これにより、テキストから画像およびテキストから動画の出力を商業的に使用する場合には大きなグレーゾーンが残り、そのようなコンテンツを制作する企業は、関与した人間の創造的貢献を文書化するよう一般的に助言されている。
ライセンス契約
訴訟と並行して、複数の出版社やプラットフォームは、訴訟を起こす代わりにAI開発者と直接ライセンス契約を結んでいる。OpenAIは、AP通信、アクセル・シュプリンガー、ニューズ・コープなどの報道機関や、Shutterstockなどの画像ライブラリとコンテンツライセンス契約を締結した。Googleも複数の出版社と同様の取り決めを結んだ。これらの契約は通常、ライセンスされたアーカイブを学習に使用したり、そこからスニペットを表示したりする権利に対して料金を支払うものであり、大規模で潤沢なリソースを持つ権利者にとっては、訴訟に代わる業界の好ましい選択肢となっている。一方、同等の交渉力を持たない小規模なクリエイターは、引き続き裁判所に頼っている。
展望
AIと著作権をめぐる未解決の状態は、AIガバナンスの議論への繰り返しの入力となっており、EU AI法は著作権で保護された学習素材の一部開示を義務付け、複数の国の立法機関はクリエイター向けのオプトアウトや補償制度を検討している。個別の訴訟のより詳細な説明については、AI著作権訴訟の記事も参照のこと。