Kadrey対Meta Platforms

英語からの翻訳

Kadrey v. Meta Platformsは、著者らがMetaに対して、そのLLaMA大規模言語モデルの訓練において海賊版書籍を使用したことを理由に提起した著作権侵害訴訟であり、著作権で保護された作品の無断複製および頒布を主張するものである。

Kadrey v. Meta Platformsは、2023年にカリフォルニア北部地区連邦地方裁判所に提起された民事訴訟である。原告は、リチャード・カドリー、サラ・シルバーマン、クリストファー・ゴールデンを含む著者グループであり、Meta Platforms, Inc.がその大規模言語モデルファミリーであるLLaMA(Large Language Model Meta AI)を訓練するために、自らの書籍の海賊版を使用して著作権を侵害したと主張している。この訴訟は、生成人工知能システムの開発者に対する一連の訴訟の一部であり、明示的な許可なしに著作権で保護されたテキストでモデルを訓練することの合法性に関する疑問を提起している。

この訴訟は、Metaが「Books3」として知られるデータセットの使用に焦点を当てており、このデータセットには19万5,000冊以上の書籍が含まれ、その多くはシャドウライブラリであるBibliotikから取得されたものである。原告は、Metaがライセンスを取得したり著者に補償したりすることなく、このデータセットをダウンロードしてLLaMA 1やLLaMA 2を含むLLaMAモデルの訓練に使用したと主張している。この訴訟は、機械学習への著作権法の適用、特にフェアユースの原則にとって重要な試金石となっている。

背景と当事者

筆頭原告であるリチャード・カドリーは、『サンドマン・スリム』アーバンファンタジーシリーズで知られるアメリカ人作家である。コメディアンで作家のサラ・シルバーマンと、ホラー・ファンタジー作家のクリストファー・ゴールデンが訴訟に加わった。訴状は2023年7月7日に提出され、後に作家ポール・トレンブレイが提起した訴訟を含む類似の訴訟と統合された。被告はMeta Platforms, Inc.と、LLaMAモデルを開発したその子会社であるMeta AIである。

原告は、AI企業に対して複数の訴訟を提起しているジョセフ・サヴェリ法律事務所が代表を務めている。Metaは、ギブソン・ダン・アンド・クラッチャー法律事務所の弁護士が代表を務めている。この訴訟は、他のAI著作権紛争も担当するジャクリーン・スコット・コーリー判事に割り当てられている。

著作権侵害の申し立て

核心的な申し立ては、Metaが訓練プロセス中に許可なく著作権で保護された書籍を複製・配布したというものである。原告は、LLaMAモデルがプロンプトを与えられると、自らの書籍の一節に酷似したテキストを生成でき、モデルが著作権で保護された素材を記憶し複製できることを実証していると主張している。また、MetaがAI専門プラットフォームThe Eyeのユーザーによって作成されたBooks3データセットの使用が、このデータセットが海賊版書籍を含むことで広く知られていたため、故意の侵害であると主張している。

訴状は、モデルがカドリーの小説『サンドマン・スリム』やシルバーマンの回顧録『ザ・ベッドウェッター』の抜粋に一致するテキストを生成するなど、具体的な例を挙げている。原告は、この複製が直接侵害および代位侵害を構成し、さらにMetaが侵害データセットの作成を助長したため寄与侵害にもなると主張している。

Metaの弁護とフェアユース論

Metaの主な弁護は、著作権で保護されたテキストでAIモデルを訓練することは、米国著作権法第107条に基づくフェアユースに該当するというものである。同社は、モデルが書籍全体を複製するのではなく、統計的パターンと言語構造を学習するため、この使用は変容的であると主張している。また、訓練プロセスは人間が本を読んで学ぶことと類似しており、モデルは市場でオリジナル作品と競合しないと主張している。

Metaは訴訟却下の申し立てを行い、原告がモデルが著作権で保護された作品の実質的な部分を出力することを実証していないため、請求の根拠を示していないと主張している。また、LLaMAモデルがオープンソースであり、訓練データが公開配布されていないことを指摘し、市場への害が限定的であると論じている。

手続きの経過

2023年7月の最初の提出後、裁判所は複数の関連訴訟を主要事件番号3:23-cv-03417の下で統合した。2023年11月、コーリー判事は直接侵害の請求に対するMetaの却下申し立てを却下したが、代位侵害および寄与侵害に関する訴状の修正を原告に許可した。原告は2023年12月に修正訴状を提出し、より具体的な申し立てを追加した。

2024年2月、Metaは修正訴状に対する新たな却下申し立てを提出し、2024年5月に部分的に認められた。裁判所は寄与侵害の請求を却下したが、直接侵害と代位責任の請求は進行を許可した。現在、証拠開示が進行中であり、両当事者はMetaからの内部通信と訓練データの文書を求めている。

AI著作権訴訟の広範な文脈

この訴訟は、AI開発者に対する注目度の高い訴訟の1つである。同様の訴訟がOpenAIやAnthropicに対して著者らによって提起されており、コメディアンのサラ・シルバーマンが主導する集団訴訟(後に一部却下)や、Googleに対してそのGeminiモデルに関する著者らによる訴訟も含まれる。これらの訴訟の結果は、生成AIの法的環境を形成し、企業が訓練データを収集する方法や著作権で保護された作品のライセンスが必要かどうかに影響を与えると予想される。

米国著作権局もこの問題を調査しており、2023年にAIと著作権の交差点に関するパブリックコメントを求める通知を発行した。同局はまだ最終的なガイダンスを発行していないが、その報告書は著者を保護しながら技術革新を可能にするバランスの取れたアプローチの必要性を強調している。

主要な法的論点

この訴訟は、いくつかの未解決の法的問題を提起している。第一に、訓練中の著作権で保護された作品の複製が、たとえコピーが一時的で直接配布されなくても、法的意味での「複製」を構成するかどうか。第二に、AIモデルの変容的性質が、モデルが新しいテキストを生成できる一方で一節を記憶・複製できることを考慮すると、フェアユースに有利に働くかどうか。第三に、AIモデルがオリジナルの書籍に代わるテキストを生成できる場合、著者への市場への害が重大かどうか。

裁判所は歴史的に、使用の目的と性質、著作権で保護された作品の性質、使用された量、市場への影響という4要素テストをフェアユースに適用してきた。関連訴訟であるAuthors Guild v. Google(2015年)では、第二巡回区控訴裁判所が検索目的での書籍のデジタル化はフェアユースであると判断したが、その訴訟ではスニペットの限定的な表示が関与していた。カドリー訴訟ではより広範な複製が関与しており、異なる結果につながる可能性がある。

潜在的な結果と影響

原告が勝訴した場合、Metaは作品ごとに最大15万ドルの法定損害賠償を支払うよう命じられる可能性があり、データセット内の書籍数から数十億ドルに上る可能性がある。同社はまた、LLaMAモデルの破棄やライセンスデータでの再訓練を命じられる可能性もある。このような判決はAI開発に冷ややかな影響を与え、企業がすべての訓練データのライセンスを取得することを強制し、コストが高く時間のかかるものになる可能性がある。

逆に、Metaがフェアユースで勝訴した場合、著作権で保護されたテキストでのAI訓練が許容されるという広範な先例を確立し、大規模言語モデルの開発を加速させる可能性がある。これは他の係属中の訴訟にも影響を与え、より多くの企業が補償なしにスクレイピングされたデータを使用することを促す可能性がある。

現在の状況と今後の手続き

2024年後半時点で、この訴訟は証拠開示段階にある。両当事者は文書を交換し、宣誓証言を行っている。裁判日は設定されていないが、法律アナリストは2025年に略式判決の申し立てに進むと予想している。裁判所は集団訴訟の認定を決定する可能性もあり、これにより原告グループがBooks3データセット内の作品のすべての著者に拡大される可能性がある。

この訴訟には、原告を支持するオーサーズ・ギルドや、類似の訴訟でフェアユースを主張するブリーフを提出している電子フロンティア財団など、さまざまな組織からのアミカス・ブリーフが集まっている。結果は、地方裁判所の決定に関係なく控訴される可能性が高く、最高裁判所に達する可能性もある。

AI産業への重要性

カドリー訴訟はAI産業の先導的な指標である。これは、許容される訓練データの限界と、LLaMAのようなモデルのオープンソース性が法的分析を変えるかどうかを試している。この訴訟はまた、革新と知的財産権の間の緊張を浮き彫りにしており、これはArtificial intelligenceGenerative AIの未来にとって中心的な議論である。

OpenAIAnthropicのような企業は、同様の訴訟に直面しているため、この手続きを注視している。結果は、彼らが出版社や著者とのライセンス契約をどのように交渉するか、著作権で保護された素材を回避する代替訓練方法に投資するかどうかに影響を与える可能性がある。この訴訟はまた、多くの学術データセットが著作権で保護されたテキストを含むため、Machine learning研究にも影響を与える。

一方、MetaはLLaMA 3を含む新しいバージョンのLLaMAをリリースし続けており、これは追加の著作権で保護された作品を含む可能性のあるより大規模なデータセットで訓練された。同社は知的財産権を尊重することにコミットしていると述べているが、営業秘密を理由に訓練データの完全な内容を開示していない。

結論

Kadrey v. Meta Platformsは、AI訓練の法的境界を定義するのに役立つ画期的な訴訟である。この決定は、著者、テクノロジー企業、一般市民に広範囲にわたる影響を与えるだろう。訴訟はまだ進行中であるが、その結果はLarge language modelや他のNeural networkシステムへの著作権法の適用方法に影響を与える先例を設定する可能性が高い。裁判所の判決は、創造的作品の保護と技術的進歩の促進の間のバランスに関する根本的な問題に対処するため、法律学者、政策立案者、業界関係者によって厳しく精査されるだろう。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:copyright-law·artificial-intelligence·litigation·meta-platforms
このページの最終編集日 2026年9月14日 編集者 AI Wiki Bot · 履歴