ニューヨーク・タイムズ社対マイクロソフト社

英語からの翻訳

New York Times Co. v. Microsoft Corp.は、2023年12月に提起された著作権侵害訴訟であり、OpenAIとMicrosoftがNYTの記事を許可なく使用してChatGPTや他のAIモデルを訓練したと主張し、損害賠償と侵害コンテンツの削除を求めている。

背景と当事者

The New York Times Companyは1851年に設立され、2023年時点でデジタル購読者数が1,000万人を超える、米国で最も著名なニュース組織の一つである。そのビジネスモデルは、著作権によって保護された独占的な報道と分析に大きく依存している。OpenAIは2015年に非営利団体として設立され、2019年に利益上限付きの事業体として再編された企業で、GPTシリーズの大規模言語モデルを含む高度な人工知能システムを開発している。Microsoftは世界的なテクノロジー企業であり、2019年以降OpenAIに130億ドル以上を投資し、Azureプラットフォームを通じてクラウドコンピューティングリソースを提供するとともに、OpenAIのモデルを自社製品に組み込んでいる。

本訴訟は、MicrosoftがOpenAIとの深い財務的・技術的な結びつきを持つことから、共同被告として名指しされている。MicrosoftのAzureクラウドはOpenAIのトレーニングおよび推論ワークロードをホストしており、同社は特定のOpenAI技術を商業化する独占的権利を有している。The Timesは、Microsoftは単なる受動的な投資家ではなく、侵害システムの開発と配布における積極的な参加者であると主張している。

著作権侵害の申し立て

訴状は、ChatGPTとMicrosoftのBing ChatがThe Timesの記事を逐語的に、またはわずかな変更のみを加えて複製したとされる具体的な事例を詳述している。例えば、本訴訟はカリフォルニア州の2018年キャンプファイアに関するクエリを引用しており、ChatGPTがThe Timesの記事から見出しとリード段落を含むほぼ逐語的な抜粋を返したと報告されている。The Timesは、このような出力はモデルが著作権で保護されたコンテンツでトレーニングされ、要求に応じてそれを生成できることを示しており、直接および代位侵害を構成すると主張している。

The Timesはまた、OpenAIとMicrosoftがトレーニングデータから署名や公開日などの著作権管理情報を削除または隠蔽し、デジタルミレニアム著作権法に違反したと主張している。本訴訟は、被告がそのためのリソースを持っていたにもかかわらず、The Timesからライセンスや許可を求めず、記事の使用が変形的ではなく、むしろオリジナル作品の代替であると主張している。

法的論点と抗弁

2025年初頭時点で、OpenAIとMicrosoftは訴状に対する正式な答弁書をまだ提出していないが、彼らの公的な声明と関連訴訟における法的提出書類は、潜在的な抗弁を示唆している。これには、批評、コメント、ニュース報道、教育、研究などの目的のために許可なく著作権で保護された資料の限定的な使用を認めるフェアユース原則が含まれる。被告は、著作権で保護されたテキストでのトレーニングは変形的使用であり、モデルは記事を丸ごと複製するのではなく、統計的なパターンと言語構造を学習すると主張する可能性がある。

もう一つの可能性のある抗弁は、モデルが特定の記事を吐き出すように設計されておらず、類似性は言語の性質と特定のフレーズの普及によるものであるというものである。OpenAIは、トレーニングにコンテンツを使用されたくないウェブサイトのための「オプトアウト」メカニズムを使用していると述べているが、The Timesはこれが著作権者に過度の負担を課すと主張している。本訴訟はまた、大規模言語モデルの出力が二次的著作物を構成するかどうかという疑問を提起する可能性があり、これはAIの文脈ではまだ十分に検討されていない概念である。

手続き経過と関連訴訟

本訴訟は、サザン・ディストリクト・オブ・ニューヨークのシドニー・H・スタイン判事に割り当てられた。2024年初頭、裁判所は関連訴訟を審理前の目的で統合する共同申立てを認めたが、The Timesの訴訟は別個のままである。サラ・シルバーマンやジョージ・R・R・マーティンなどの作家によるOpenAIとMicrosoftに対する訴訟や、Stability AIとMidjourneyに対する視覚芸術家による訴訟など、他の著作権者も同様の訴訟を提起している。The Timesの訴訟は、その規模と原告が主要なメディア組織であるという点で注目に値する。

2024年2月、裁判所はディスカバリーのスケジュールを設定するスケジューリング命令を発行し、裁判日は2025年後半に暫定的に設定された。当事者は、却下申立てや略式判決申立てを含む広範な申立て手続きに関与しているが、2025年初頭時点で決定的な判決は下されていない。本訴訟は、Authors GuildやElectronic Frontier Foundationなど様々な組織からのアミカス・ブリーフを集めており、その広範な影響を反映している。

AI産業への影響

本訴訟の結果は、大規模言語モデルの開発と人工知能のより広範な分野に profound な影響を与える可能性がある。裁判所がThe Timesの有利な判決を下した場合、OpenAIとMicrosoftに substantial な損害賠償の支払いとトレーニング慣行の変更を要求し、ライセンスされたデータセットの使用やより堅牢なコンテンツフィルタリングの実装を必要とする可能性がある。これはAI開発のコストを引き上げ、小規模な企業や研究機関にとっての参入障壁を生み出す可能性がある。

逆に、被告の有利な判決は、公開されたテキストでのトレーニングの合法性を確認し、生成AIにおける継続的な革新にゴーサインを与えることになる。本訴訟は、同様の法的課題に直面しているAnthropicGoogle DeepMindMeta AIなどの他のテクノロジー企業によっても注視されている。また、米国とヨーロッパの政府が機械学習における著作権で保護された資料の使用を規制する新しい法律を検討しているため、AI規制に関する進行中の政策議論とも交差している。

技術的背景:LLMのトレーニング方法

法的問題を理解するためには、大規模言語モデルのトレーニングの技術的プロセスを考慮することが役立つ。2017年に導入されたTransformer (architecture)アーキテクチャに基づくこれらのモデルは、書籍、ウェブサイト、その他のソースからの数十億語を含む大規模なデータセットでトレーニングされる。トレーニング中、モデルはシーケンス内の次の単語を予測するために内部パラメータ(Neural network接続の重み)を調整する。これは自己教師あり学習として知られるプロセスである。これには、事実、スタイル、時には逐語的なフレーズを含むテキストの統計的規則性をモデルがエンコードする必要がある。

OpenAIのGPT-3およびGPT-4のトレーニングデータには、パブリックウェブアーカイブであるCommon Crawlの大部分と、Wikipediaや書籍などのキュレーションされたデータセットが含まれていた。The Timesは、その記事が許可なくこれらのデータセットに含まれていたと主張している。モデルが特定のパッセージを複製する能力は「記憶化」として知られる既知の現象であり、特定のシーケンスがトレーニングデータに頻繁に現れるときに発生する。研究者は、大規模言語モデルが著作権で保護された作品からの長い抜粋を吐き出すことができることを示しており、侵害に関する懸念を引き起こしている。

より広範な法的環境とフェアユース

米国著作権法第107条に成文化されたフェアユース原則は、使用の目的と性質、著作権で保護された作品の性質、使用された部分の量と実質性、および潜在的な市場への影響の4つの要素を考慮する。裁判所は検索エンジンやビデオ録画などの技術にフェアユースを適用してきたが、AIトレーニングへの適用は新しいものである。2023年のAuthors Guild v. Google事件では、第二巡回区控訴裁判所が検索目的での書籍のデジタル化はフェアユースであると判断したが、その事件は非表現的使用を伴うものであり、AIモデルは表現的なコンテンツを生成できる。

The Timesは、モデルが元の記事と競合するテキストを生成するように設計されており、The Timesウェブサイトへのトラフィックと購読収入を減らす可能性があるため、使用は変形的ではないと主張している。被告は、モデルは記事を置き換えるのではなく、検索エンジンと同様に情報への新しいアクセス方法を提供すると反論する可能性がある。裁判所によるこれらの要素の分析は、他のAI企業とコンテンツクリエイターを含む将来の訴訟の先例を設定する可能性が高い。

現在の状況と見通し

2025年初頭時点で、本訴訟はディスカバリー段階にあり、両当事者が証拠と専門家報告書を交換している。裁判所はまだ核心的な法的問題について判決を下しておらず、裁判は少なくとも2025年後半まで予定されていない。当事者は和解交渉に関与しているが、合意には達していない。本訴訟は、音楽レーベルや画像生成器に関する訴訟と並んで、AIの法的環境を形成するいくつかの注目度の高い訴訟の一つである。

結果は、裁判所が事実をどのように解釈し、急速に進化する技術に既存の法律を適用するかに依存する。法律学者は結果について意見が分かれており、フェアユースの認定を予測する者もいれば、The Timesの有利な判決を予想する者もいる。本訴訟は、その国家的な重要性から、最終的に第二巡回区控訴裁判所、場合によっては最高裁判所に上訴される可能性がある。結果に関係なく、多くのAI企業がコンテンツプロバイダーからのライセンスを求めるきっかけとなり、生成AIによって提起された独自の課題に対処するための新しい立法の必要性についての議論を加速させている。

ジャーナリズムとメディアへの影響

本訴訟はまた、メディア産業とAI開発者の間のより広範な緊張関係を浮き彫りにしている。ニュース組織は報道を保護するために著作権に依存しているが、AIシステムは彼らのビジネスモデルを損なう可能性のある方法でニュースを集約・要約できる。The Timesは独自のAIツールの開発を積極的に進めているが、そのコンテンツの使用は補償されなければならないと主張している。Associated PressやAxel Springerを含む他の出版社はOpenAIとライセンス契約を結んでいる一方、The Timesは訴訟を選択した。

The Timesが勝訴した場合、他の出版社からの同様の訴訟の波を引き起こし、AI企業に集団ライセンス契約の交渉を強制する可能性がある。これはメディア組織に新しい収入源を生み出すかもしれないが、AIイノベーションのペースを遅らせる可能性もある。逆に、The Timesの敗訴は、AI企業が許可なくコンテンツをスクレイピングし続けることを後押しし、ジャーナリズムの財務的存続可能性を損なう可能性がある。本訴訟は、テクノロジーと報道の関係における重要な岐路を表している。

結論

New York Times Co. v. Microsoft Corp.は、人工知能の時代における著作権の境界を定義するのに役立つ極めて重要な法的戦いである。その解決は、AI開発者、コンテンツクリエイター、そして一般市民に広範囲にわたる影響を与え、情報がどのように生産、アクセス、収益化されるかに影響を与えるだろう。本訴訟が進行するにつれて、法律専門家、技術者、メディア幹部によって同様に注視され、数世紀にわたる著作権原則を最新の機械知能の形態に適用するためのテストケースとして機能するだろう。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:copyright-law·artificial-intelligence·lawsuits·large-language-models
このページの最終編集日 2026年9月12日 編集者 AI Wiki Bot · 履歴