Authors Guild v. OpenAI(2023年)は、2023年9月20日に米国ニューヨーク南部地区連邦地方裁判所に提起された集団訴訟である。原告である全米作家協会(Authors Guild)と、ジョン・グリシャム、ジョディ・ピコルト、ジョージ・R・R・マーティンを含む著名作家グループは、OpenAIが許可なく書籍を大規模言語モデルの訓練に使用したことで著作権を侵害したと主張している。この訴訟は、法定損害賠償、差止命令、利益の吐き出しを求めており、生成AIと著作権法の交差点における画期的な事件として位置づけられている。
訴状は、GPT-3やGPT-4などのOpenAIのモデル訓練に焦点を当てており、これらはTransformerアーキテクチャに基づいて構築されている。原告は、OpenAIが訓練データセットに作品を丸ごとコピーし、モデルが元の書籍と競合する派生テキストを生成できるようにしたと主張する。この訴訟は、ニューヨーク・タイムズ紙や他の作家らによる同様の訴訟を含む、AI企業に対するより広範な訴訟の波の一部であるが、作家コミュニティの集団的代表という点で注目に値する。
背景と法的文脈
この訴訟は、人工知能と機械学習の急速な進歩、特に膨大なテキストコーパスで訓練された深層学習モデルの台頭を背景に浮上した。2015年に設立されたOpenAIは、GPT-3(2020年リリース)やGPT-4(2023年3月リリース)など、最も広く使用されている大規模言語モデルのいくつかを開発してきた。これらのモデルは、書籍、記事、その他の著作権付き資料を含む、インターネットから収集された数十億語で訓練されており、多くの場合、明示的な許可なしに行われている。
米国の著作権法は、著者にオリジナルの創作物を複製、配布、および二次的著作物を作成する独占的権利を付与している。原告は、AIモデルを著作権付き書籍で訓練することは、モデルがテキストを直接出力しない場合でも、無許可の複製に相当すると主張する。また、モデルが要約、言い換え、または文体が類似したコンテンツを生成する能力は、二次的著作物の権利を侵害すると主張している。
OpenAIは、批評、コメント、ニュース報道、教育、研究などの目的で著作権付き資料の限定的な使用を許可するフェアユース原則を援用して、その慣行を擁護してきた。同社はまた、訓練データは変形的であり、モデルはオリジナル作品を複製するのではなく統計的パターンを学習すると主張している。しかし、原告は、数千冊の書籍を含むコピーの規模は、合理的なフェアユースをはるかに超えると主張している。
当事者
主な原告には、数人のベストセラー作家が含まれる。法的スリラー「ザ・ファーム」(1991年)で知られるジョン・グリシャム、「シスターフッド・オブ・ザ・トラベリング・パンツ」の著者ジョディ・ピコルト、「氷と炎の歌」シリーズの作者ジョージ・R・R・マーティンなどである。他の指名原告には、デイヴィッド・バルダッチ、シルヴィア・デイ、ジョナサン・フランゼンが含まれる。1912年に設立された専門組織である全米作家協会は、数千人の作家を代表し、デジタル時代の著者の権利を擁護する活動を行ってきた。
被告は、カリフォルニア州サンフランシスコに本社を置くOpenAIである。OpenAIの経営陣にはCEOのサム・アルトマンとCTOのミラ・ムラティが含まれるが、訴訟では個人の経営幹部は指名されていない。同社はマイクロソフトや他のテクノロジー大手から多額の投資を受けており、そのモデルはAzureやChatGPTなどのプラットフォームを通じて展開されている。
主な主張と申し立て
訴状は、OpenAIの訓練プロセスが原告の書籍を完全にコピーすることを伴い、直接取り込みまたは海賊版を含むデータセットを通じて行われたと主張している。具体的には、原告は、一部のモデルの訓練に使用された19万冊以上の書籍を含むBooks3データセットを指摘し、指名された著者の作品が含まれていたと述べている。訴訟は、このコピーが故意であり、OpenAIがデータセットに著作権付き資料が含まれていることを知っていたと主張している。
複製に加えて、原告は、モデルが作品を「要約、言い換え、またはその他の方法で導出する」出力を生成し、無許可の二次的著作物を作成すると主張している。彼らは、ChatGPTが詳細なプロットの要約を生成したり、著者の文体を模倣したりできる例を挙げており、これが元の書籍の市場を減少させると主張している。訴訟はまた、OpenAIが帰属表示や補償を提供しなかったと主張しており、特定の国際協定に基づく著者の人格権を侵害していると述べているが、米国法は人格権を明示的に認めていない。
原告は、故意の侵害について作品ごとに最大15万ドルの法定損害賠償を求めており、関与する作品の数を考えると数十億ドルに上る可能性がある。また、将来の訓練での作品使用を防ぐための差止命令と、侵害コピーまたはそれらで訓練されたモデルの破棄も求めている。
手続きの経過
この事件は、ニューヨーク南部地区のシドニー・H・スタイン判事に割り当てられた。2023年11月、OpenAIは訴状が特定の侵害コピーや出力を特定していないため、請求の陳述に失敗しているとして却下の申し立てを行った。同社はまた、AI訓練の変形的性質を挙げてフェアユースの抗弁を繰り返した。
原告は2024年1月に訴状を修正し、より具体的な申し立てと追加の原告を加えた。また、許可なく訓練に使用されたすべての著者を代表することを求めるクラス認定の申し立てを行った。2025年初頭の時点で、裁判所は却下の申し立てについてまだ判決を下しておらず、証拠開示が進行中である。
この事件は、注目度の高いAI著作権訴訟の1つである。2023年12月、ニューヨーク・タイムズ紙はOpenAIとマイクロソフトに対して同様の侵害を主張する別の訴訟を提起した。サラ・シルバーマンやクリストファー・ゴールデンを含む他の作家も、他の地区で集団訴訟を提起している。これらの訴訟の結果は、著作権法がAI訓練にどのように適用されるかについての前例を設定する可能性がある。
OpenAIの主張
OpenAIの抗弁は主にフェアユースに基づいている。同社は、著作権付きテキストでモデルを訓練することは、人間が本を読んで学ぶことと類似しており、侵害にはならないと主張している。モデルはオリジナル作品のコピーを保存するのではなく、抽象的なパターンと関係を学習するため、使用は変形的であると主張している。
OpenAIはまた、AI技術の公共的利益を強調し、訓練データを制限することは革新を阻害し、医学、教育、科学などの分野での有益なアプリケーションの開発を損なうと主張している。同社は著者向けのオプトアウトメカニズムを実装しているが、批評家はこれらが不十分であり、クリエイターに負担を課すと主張している。
却下の申し立てで、OpenAIは原告が具体的な損害を主張していないため、訴訟適格を欠くと主張した。同社は、モデルが原告の作品を競合する形で複製しておらず、出力は変形的であると主張した。また、Books3データセットは公開されており、OpenAIは要求に応じて特定の著作権付き作品を削除する措置を講じたと指摘した。
より広範な影響
この事件は、人工知能業界に重大な影響を与える。OpenAIに対する不利な判決は、AI企業がすべての著作権付き訓練データのライセンスを取得することを要求し、コストがかかり、開発を遅らせる可能性がある。また、音楽やストックフォトグラフィーのようなライセンス市場の創設につながり、著者が作品の使用に対して補償を受ける可能性もある。
逆に、OpenAIに有利な判決は、AI訓練がフェアユースであることを確立し、企業が許可なくデータを収集し続けることを可能にするだろう。これはおそらくコンテンツクリエイターとの緊張を高め、立法措置につながる可能性がある。欧州連合を含むいくつかの国は、訓練データの透明性と権利者への補償を要求する規制をすでに検討している。
この事件はまた、創造性と著作者の性質についての疑問を提起する。AIモデルが人間の著者を模倣するテキストを生成できる場合、オリジナル作品の価値はどうなるのか。一部の学者は、AI生成コンテンツは定義上派生的であると主張し、他の学者はそれを保護されるべき新しい表現形態と見なしている。
関連事件と進展
全米作家協会の訴訟に加えて、AI企業に対して他のいくつかの訴訟が提起されている。2023年7月、作家のサラ・シルバーマン、リチャード・カドリー、クリストファー・ゴールデンは、カリフォルニア北部地区でOpenAIとメタを、書籍が許可なく使用されたとして訴えた。その事件は2023年11月に部分的に却下されたが、原告は請求を修正することを許可された。
2023年12月に提起されたニューヨーク・タイムズ紙の訴訟は、実質的な法的リソースを持つ主要メディア組織が関与しているため、最も重要なものの1つと見なされている。タイムズ紙は、OpenAIとマイクロソフトが数百万の記事をモデル訓練に使用し、モデルがタイムズ紙のコンテンツを逐語的に複製できると主張している。この事件は、全米作家協会の訴訟と同じ裁判所で係属中である。
AnthropicやGoogle DeepMindを含む他のテック企業も、その訓練慣行について監視の目にさらされている。2024年、米国著作権局はAIと著作権に関する公開協議を開始し、利害関係者からの意見を求めた。同局は、AI生成作品は人間の著作者が欠けている場合、著作権で保護されない可能性があるとのガイダンスを発行しているが、訓練データの問題は未解決のままである。
潜在的な結果とタイムライン
法律専門家は、問題の複雑さと控訴の可能性を考慮すると、この事件の解決には数年かかると予想している。略式判決の申し立ては2025年に提出される可能性があり、裁判は2026年以降に行われる可能性がある。最高裁判所は、コードのコピーを扱ったGoogle対Oracle事件(2021年)のように、最終的にフェアユースの問題について判断を下す必要があるかもしれない。
原告が勝訴した場合、多額の損害賠償を受ける可能性があるが、より重要なのは、判決がOpenAIに訓練慣行の変更を強制する可能性があることだ。同社はすでに、2023年12月のアクセル・シュプリンガーとの契約など、一部の出版社からのコンテンツライセンスを開始しているが、裁判所命令はより拘束力がある。
OpenAIが勝訴した場合、現在のAI訓練アプローチが検証され、より積極的なデータ収集が促進される可能性がある。これはクリエイターからの反発を招き、新しい法律を促す可能性がある。一部のコメンテーターは、強制ライセンス制度などの立法解決が、両者に確実性を提供するため、訴訟よりも望ましいかもしれないと示唆している。
結論
Authors Guild v. OpenAI(2023年)は、生成AIと知的財産法の関係における重要な岐路を表している。この事件は、既存の著作権フレームワークが、膨大な量のテキストでモデルを訓練するという新しい慣行に対応できるかどうかを試している。その結果は、関与する当事者だけでなく、AI技術の将来の発展と世界中のクリエイターの権利に影響を与えるだろう。訴訟が進むにつれて、今後何年にもわたって業界の規範と法的基準を形成する可能性が高い。