The New York Times Company v. Microsoft Corporation and OpenAI, Inc.は、2023年12月27日に米国ニューヨーク南部地区連邦地方裁判所に提起された、画期的な著作権侵害訴訟である。この訴訟は、OpenAIとその主要投資家であるMicrosoftが、許可や対価の支払いなしに、The New York Timesの数百万件の著作権付きニュース記事を大規模言語モデルの訓練に使用し、著作権法に違反し、新聞社のビジネスモデルを脅かしたと主張している。この訴訟は、知的財産法が生成AIシステムとその基盤となる訓練データにどのように適用されるかを試す決定的な試金石として広く見なされている。
この訴訟は、被告らがタイムズ紙が「The Timesの独自の価値ある作品の不法な複製と使用」と表現する行為について責任を負うことを求めている。また、侵害された作品ごとに最高15万ドルの法定損害賠償、タイムズ紙のコンテンツのさらなる使用を禁じる差止命令、そのコンテンツを組み込んだデータセットやモデルの破棄を要求している。同時代の報道によると、この提訴は、新聞社とOpenAIとの間の数ヶ月にわたる交渉がライセンス契約の締結に至らなかった後に起こった。
背景と文脈
この紛争は、人工知能システム、特にTransformer (architecture)アーキテクチャに基づく深層学習モデルの急速な進歩から生じている。2015年に非営利の研究機関として設立され、後に営利部門を持つ組織に再編されたOpenAIは、2020年にGPT-3を、2022年11月にChatGPTをリリースした。これらのシステムは、ニュース記事、書籍、その他の著作権付き資料を含む、インターネットから収集された膨大なテキストコーパスで訓練されている。
1851年に設立されたThe New York Timesは、長年にわたりペイウォールとデジタル購読事業を維持しており、2023年後半までに1000万人以上の購読者を報告している。同紙は、そのジャーナリズムは価値ある独自の資産であり、AI企業がそれを自由に使用できるようにすることは、制作コストを回収する能力を損なうと主張した。また、タイムズ紙は、AIチャットボットが記事の一部を「記憶」して複製し、同紙自身の配信チャネルと直接競合する可能性があると指摘した。
法的主張と論点
申立書は、直接侵害、寄与侵害、代位侵害などの複数の訴因を主張している。タイムズ紙は、ChatGPTや他のOpenAI製品が、同紙の記事(2019年のタクシーメダリオンローンに関する調査や2020年のCOVID-19パンデミックに関する記事を含む)からほぼ逐語的な抜粋を複製したとされる数十の事例を提示した。同紙は、そのような出力は、モデルが同紙のコンテンツで訓練されたことを示しており、複製は変革的ではないと主張した。
OpenAIとMicrosoftは、裁判所への申立書で、著作権付き資料の使用は「フェアユース」原則に該当すると回答した。この原則は、批評、コメント、ニュース報道、教育、研究などの目的での限定的な使用を許可するものである。彼らは、大規模なデータセットでの訓練は変革的なプロセスであり、元の作品を置き換えるのではなく、新しい非表現的な統計的表現を生み出すと主張した。2023年初頭までにOpenAIに130億ドル以上を投資していたMicrosoftは、2024年2月に、タイムズ紙が具体的な損害を示していないと主張して、訴え却下の申し立てを行った。
タイムズ紙は、フェアユースは狭い例外であり、OpenAIの事業の商業的規模と、AIが生成する要約による直接的な競争の組み合わせは、フェアユース認定に反すると反論した。法律学者らは、この訴訟が、米国の判例では未解決の問題であるAI訓練の「目的と性格」を裁判所がどのように解釈するかについて先例を設定する可能性があると指摘した。
主要な出来事と経緯
- 2023年12月27日: タイムズ紙がニューヨーク南部地区で申立書を提出し、OpenAIとMicrosoftの両方を被告とした。
- 2024年1月: OpenAIは、タイムズ紙と生産的な協議を行っていたと述べ、訴訟に「驚き、失望した」と公に表明した。同社はまた、将来の訓練でコンテンツを使用されたくないウェブサイト所有者向けにオプトアウトの仕組みを提供し始めた。
- 2024年2月: Microsoftが訴え却下の申し立てを行い、タイムズ紙の主張は憶測であり、同社はモデルの訓練に直接関与していないと主張した。
- 2024年4月: 裁判所はMicrosoftの訴え却下の申し立てを一部却下し、いくつかの主張について訴訟の進行を許可した。担当のシドニー・H・スタイン判事は、両当事者に証拠開示を命じた。
- 2024年6月: OpenAIが自らの略式判決申し立てを行い、タイムズ紙は特定の記事が市場に損害を与える形で複製されたことを証明できないと主張した。タイムズ紙は、コンテンツライセンスの必要性を認めたOpenAIの内部コミュニケーションを挙げて反対した。
- 2024年10月: 裁判所は、特にOpenAIの訓練データセットへのアクセスに関する証拠開示の紛争に関する予備審問を開催した。タイムズ紙は訓練に含まれる記事の詳細な記録を求めたが、OpenAIはそのような情報は営業秘密であると主張した。
- 2025年初頭時点: 訴訟は証拠開示段階にあり、裁判期日は設定されていない。両当事者は引き続き申し立てと専門家報告書を提出している。
広範な影響
この訴訟は、AI企業に対する一連の法的措置の一部である。2023年には、サラ・シルバーマンやジョージ・R・R・マーティンなどの作家が、同様の主張でOpenAIとMetaに対して集団訴訟を起こした。Getty Imagesは、訓練データに写真を使用したとしてStability AIを英国と米国で提訴した。タイムズ紙の訴訟は、多額の法的リソースと明確な経済的利害関係を持つ主要な報道機関が関与している点で注目に値する。
この結果は、機械学習開発の経済性に影響を与える可能性がある。タイムズ紙が勝訴した場合、AI企業は出版社からコンテンツのライセンスを取得することが求められる可能性があり、これは業界を再編するコストとなる。逆に、OpenAIに有利な判決は、公開されたテキストでの訓練慣行を正当化し、OpenAIやAnthropic、Google DeepMindなどの競合他社の成長を加速させる可能性がある。
報道機関は異なる対応をとっている。AP通信やAxel Springerなどの一部はOpenAIとライセンス契約を結んでいる。タイムズ紙を含む他の報道機関は訴訟を選択した。この訴訟はまた、一部の議員がAI訓練のための「通知とオプトアウト」制度を提案するなど、新しい立法の必要性についての議論を促している。
技術的および倫理的側面
この訴訟は、ニューラルネットワークが情報をどのように保存し、検索するかについての疑問を提起している。研究者らは、大規模言語モデルが長い文章の一節を記憶できることを示しており、特にその一節が訓練データに複数回出現する場合に顕著である。タイムズ紙は、広くシンジケートされ引用される同紙の記事は、OpenAIのデータセットで過剰に表現される可能性が高く、逐語的な複製のリスクを高めると主張した。
倫理的議論は、AI企業がコンテンツクリエイターに補償する道徳的義務があるかどうかに焦点を当てている。フェアユースの支持者は、訓練は人間が記事を読んで学ぶことに類似していると主張する一方、批判者は、AI訓練の規模と商業的性質は根本的に異なると主張する。この訴訟はまた、ほとんどの企業が完全なデータソースを公開していないため、AI訓練の透明性の欠如を浮き彫りにしている。
反応と解説
法律専門家の間では、異なる予測がなされている。スタンフォード大学法学教授のマーク・レムリーなどの一部は、Google Books事件などの前例を挙げて、AI訓練はフェアユースとみなされる可能性が高いと主張している。著作権学者のパメラ・サミュエルソンなどの他者は、タイムズ紙の直接競争の証拠が判断を左右する可能性があると指摘している。MITコンピュータ科学・人工知能研究所とスタンフォードAI研究所は、その学術的重要性を反映して、この訴訟に関するシンポジウムを主催している。
OpenAIのCEOであるサム・アルトマンは、同社はコンテンツの対価を支払う用意があるが、現在の法的枠組みは不明確であると公に述べている。2024年3月のインタビューで、彼は「私たちは出版社の良いパートナーになりたい。問題は公正な価格が何かということだ」と語った。タイムズ紙は、その主要な目標はジャーナリズムを保護し、業界の先例を設定することであると主張し続けている。
現在の状況と将来の見通し
2024年後半時点で、訴訟は解決していない。両当事者は広範な申し立てを行っており、裁判所は中核的なフェアユース問題についてまだ裁定を下していない。一部の観察者は、その国の重要性から、この訴訟が最高裁判所に達する可能性があると予想している。その間、OpenAIはNews CorpやFinancial Timesなどの他の出版社とコンテンツ契約を締約し続けており、訴訟の結果にかかわらず、業界がライセンスモデルに向かっていることを示唆している。
タイムズ紙はまた、英国情報コミッショナー事務所へのデータ保護問題に関する申し立てなど、並行した措置を追求している。同社は、Google Cloudとのデータ分析パートナーシップを含む自社のAI能力への投資を継続すると述べているが、訴訟には引き続き取り組んでいる。
結論
The New York Times対OpenAIの訴訟は、メディアと人工知能の関係における重要な岐路を表している。その解決は、当事者だけでなく、人工知能開発、コンテンツライセンス、著作権法のより広いエコシステムに影響を与える可能性が高い。技術が進化するにつれて、この訴訟で確立された法的原則は将来の紛争の基盤となる可能性があり、この10年で最も注目されている訴訟の1つとなっている。