NYT対OpenAI(2023年)

英語からの翻訳

NYT対OpenAI(2023年)は、2023年12月にニューヨーク・タイムズがOpenAIとマイクロソフトを相手取り提起した著作権侵害訴訟であり、AIモデルの訓練に数百万の記事が無断使用されたと主張している。この訴訟は損害賠償と訓練データの破棄を求めており、生成AIにおけるフェアユースに関する重要な問題を提起している。

NYT v. OpenAI(2023年)は、2023年12月27日に米国ニューヨーク南部地区連邦地方裁判所に提起された、The New York Times CompanyがOpenAIとその主要投資家であるMicrosoftを相手取った画期的な著作権侵害訴訟である。訴状は、OpenAIとMicrosoftが許可なく数百万件の著作権で保護されたニュース記事を、GPT-4やChatGPTを含む大規模言語モデルの訓練に使用し、これらのモデルが現在、タイムズ紙のコンテンツを、同紙自身の製品と直接競合する形で複製・「記憶」していると主張している。この訴訟は、侵害された作品ごとに最高15万ドルの法定損害賠償、タイムズ紙のコンテンツのさらなる使用を禁じる差止命令、およびそのような素材を含むすべての訓練データセットの破棄を求めている。

この訴訟は、生成AI業界とコンテンツ制作者の間のより広範な対立の試金石と広く見なされており、著作権で保護されたテキストの大量スクレイピングがモデル訓練に及ぶかどうかという「フェアユース」原則を試すものである。その結果は、AI開発の経済を再形成し、企業にライセンス契約の交渉や訓練パイプラインの再設計を強制する可能性がある。2025年初頭時点で、この訴訟は依然として審理前段階にあり、両当事者が却下申立と反訴を提出している。

背景:生成AIとデータスクレイピングの台頭

この訴訟は、深層学習の急速な進歩とトランスフォーマーベースのモデルの商業展開を背景に生じた。2015年に設立されたOpenAIは、2020年にGPT-3を、2022年11月にChatGPTをリリースし、後者は歴史上最も急速に成長した消費者向けアプリケーションの1つとなった。これらのモデルは、ニュース記事、書籍、学術論文を含む、公開インターネットからスクレイピングされた膨大なテキストコーパスで訓練されている。タイムズ紙は、そのコンテンツ(多くはペイウォールで保護されている)が、許可なくこれらのデータセットに、しばしば訓練資料のかなりの部分を占める量で含まれていたと主張している。

Microsoftは、OpenAIに130億ドル以上を投資し、そのモデルをBing ChatやOffice 365などの製品に統合しており、侵害システムの展開と利益獲得における役割から共同被告として指名されている。訴状は、ChatGPTがタイムズ紙の記事(2019年のタクシー業界に関する調査や2020年の住宅ローン金利に関する記事を含む)からほぼ逐語的な抜粋を生成した具体的な例を挙げており、モデルが要求に応じて著作権で保護されたテキストを複製できることを示している。

法的請求と要求

タイムズ紙は、直接著作権侵害、寄与侵害、代位侵害を含む複数の訴因を主張している。同紙は、OpenAIとMicrosoftが訓練と推論の過程でその作品を複製、保存、配布し、モデルの出力が無許可の二次的著作物を構成すると主張している。訴状は、被告が「他人の作品の上にビジネスを構築した」こと、そしてタイムズ紙がAI企業が無料で流用したジャーナリズムに数十億ドルを費やしたことを強調している。

金銭的損害賠償に加えて、タイムズ紙は、OpenAIとMicrosoftに対し、訓練データセットからタイムズ紙のコンテンツのすべてのコピーを削除し、将来の使用を防ぐことを要求する恒久的差止命令を求めている。この要求は前例のない規模であり、事実上、企業にモデルをゼロから再訓練することを強制し、そのプロセスには数億ドルの費用がかかり、モデルの品質を低下させる可能性がある。タイムズ紙はまた、被告に対し、訓練データの出所を開示し、将来の侵害を防ぐための技術的措置を実施するよう求める命令も要求している。

OpenAIの弁護:フェアユースと公共の利益

OpenAIは2024年2月に回答を提出し、その著作権素材の使用は、批評、コメント、ニュース報道、教育、研究などの目的での限定的複製を許可するフェアユース例外に該当すると主張した。同社は、AIモデルの訓練は、元の作品を代替しない変革的使用であり、モデルは特定のテキストを記憶するのではなく、パターンと事実を学習すると主張している。OpenAIはまた、ウェブサイト運営者がそのウェブクローラーをブロックできる「オプトアウト」メカニズムや、AP通信やAxel Springerなどの他の出版社との継続的なパートナーシップを、知的財産を尊重する誠実な努力の証拠として指摘している。

Microsoftもこれらの主張を支持し、モデルは既存の記事を複製するのではなく、新しいコンテンツを生成するためのツールであると強調した。被告はまた、タイムズ紙自身がさまざまな目的でAIツールを使用しており、同紙の訴状は競争を阻害する試みであると指摘している。法律学者の間ではこれらの弁護の強さについて見解が分かれており、複製の規模と使用の商業的性質がフェアユースに不利に働くと主張する者もいれば、機械学習の変革的性質を有力な正当化理由として指摘する者もいる。

業界の反応と並行訴訟

タイムズ紙の訴訟は、AI企業に対する訴訟の波の一部である。2023年には、Sarah Silverman、Christopher Golden、Richard Kadreyを含む著者らがOpenAIとMetaに対して集団訴訟を提起し、後にSarah Silvermanの訴訟は他の訴訟と統合された。Getty Imagesは、画像生成器の訓練における写真の使用をめぐり、英国と米国でStability AIを訴えた。2024年には、Authors GuildがOpenAIに対して集団訴訟を提起し、Chicago TribuneやNew York Daily Newsを含む複数の新聞が、OpenAIとMicrosoftに対する別の訴訟に参加した。

これらの訴訟は、業界からさまざまな反応を引き起こした。AnthropicGoogle DeepMindなどの一部の企業は、出版社からのコンテンツのライセンス供与を開始し、他の企業は音楽ストリーミングに使用されるものと同様の法定ライセンス制度を主張している。米国著作権局は2023年にAIと著作権に関する公的調査を開始し、欧州連合は2024年に、訓練データの透明性要件を含むAI法を可決した。タイムズ紙の訴訟の結果は、これらの取り組みのすべてに影響を与える先例を設定する可能性がある。

主要な法的論点と先例

中心的な法的論点は、著作権で保護されたテキストでのAIモデルの訓練がフェアユースを構成するかどうかである。裁判所は歴史的に、使用の目的と性質、著作物の性質、使用された部分の量と実質性、および潜在的な市場への影響という4つの要素を適用してきた。2015年のAuthors Guild v. Google事件では、第二巡回区控訴裁判所が、検索目的でのGoogleの書籍のデジタル化はフェアユースであると判断したが、その事件は限られたスニペットと非商業的目的を伴っていた。タイムズ紙は、その記事が高度に創造的かつ表現的であり、被告が作品全体を複製し、ChatGPTが要約や抜粋を生成できる能力が、タイムズ紙のライセンス収入と購読ビジネスに直接的な損害を与えると主張している。

もう1つの重要な論点は、「記憶」問題である。OpenAIは、大規模言語モデルが、特に特定の方法でプロンプトされた場合に、訓練データを逐語的に複製することがあると認めている。タイムズ紙の訴状には、そのような出力の例が含まれており、同紙はこれらが変革的ではなく、むしろ丸ごと複製の一種であると主張している。被告は、これらの事例はまれであり、モデルは記憶ではなく一般化するように設計されていると反論している。専門家証人は、モデル訓練の技術的詳細と複製の可能性について、双方の立場から証言することが期待されている。

手続きの経過と現在の状況

訴状が提出された後、裁判所はこの事件をSidney H. Stein判事に割り当てた。2024年初頭、OpenAIとMicrosoftは、タイムズ紙が具体的な侵害出力を特定していないため、直接侵害を適切に主張していないと主張して却下申立を提出した。タイムズ紙は2024年3月に訴状を修正し、例を追加して請求を明確化した。2024年7月、Stein判事は却下申立を却下し、事件を証拠開示手続きに進めることを許可した。この判決は、事件が推測的すぎるという被告の主張を退けたため、タイムズ紙にとって重要な勝利と見なされた。

証拠開示は争点になると予想され、タイムズ紙はOpenAIの訓練データとデータ調達に関する内部通信へのアクセスを求めている。OpenAIは、営業秘密と大規模データセットの生産負担を理由に、一部の要求に抵抗している。裁判所はまた、当事者に和解の可能性について話し合うよう命じたが、2025年初頭時点で合意には至っていない。裁判日は設定されていないが、法律関係者は2025年後半または2026年に開始される可能性があると推定している。

AI開発への広範な影響

この訴訟は、両当事者を超えた影響を持つ。タイムズ紙が勝訴した場合、AI企業はすべての著作権で保護された訓練データのライセンスを取得する必要があり、コストが増加し、イノベーションが遅くなる可能性がある。一部のスタートアップは、パブリックドメインまたは合成データのみの使用に切り替えるかもしれない一方、大企業は独自のデータセットや出版社とのパートナーシップに投資する可能性がある。この訴訟は、スクレイピングされたデータに大きく依存し、ライセンス要件を満たすリソースを持たない可能性のあるオープンソースモデルの開発にも影響を与える可能性がある。

逆に、OpenAIが勝訴した場合、許可なく著作権素材で訓練する慣行が正当化され、より積極的なスクレイピングとクリエイターへの補償の減少につながる可能性がある。この結果は、AI生成コンテンツへの傾向を加速させ、従来のメディア企業にさらなる圧力をかけるかもしれない。この訴訟は、機械学習の時代における知的財産の境界を定義するのに役立つため、技術者、弁護士、ジャーナリストの間で密接に注目されている。

結論

NYT v. OpenAI(2023年)は、生成AI時代の決定的な法的戦いである。これは、機械が大規模にテキストを生成できる世界における、著作者、所有権、人間の創造性の価値に関する根本的な問題を提起している。この訴訟の解決は、司法判断によるものであれ和解によるものであれ、AI研究、メディア経済、著作権法の未来を数十年にわたって形成する可能性が高い。訴訟が展開するにつれ、ニューラルネットワーク機械学習の急速な進歩は、単なる技術的な物語ではなく、誰が技術進歩の恩恵を受け、誰がそのコストを負担するかについての深く人間的な物語であることを思い起こさせる。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:copyright-law·artificial-intelligence·litigation·media-industry
このページの最終編集日 2026年9月12日 編集者 AI Wiki Bot · 履歴