NYT対OpenAIフェアユース抗弁

英語からの翻訳

2023年12月、ニューヨーク・タイムズはOpenAIとマイクロソフトを提訴し、大規模言語モデルの訓練における著作権侵害を主張した。OpenAIのフェアユース抗弁は変容的使用を主張する一方、タイムズは記事の無断複製を主張している。

ニューヨーク・タイムズ社は2023年12月、OpenAIとMicrosoftを相手取り、両社が許可や報酬なしに数百万件の著作権付きニュース記事を自社の大規模言語モデルの訓練に使用したと主張する訴訟を提起した。正式には「The New York Times Company v. Microsoft Corporation and OpenAI, Inc.」と題されたこの訴訟は、著作権付きテキストを生成人工知能システムの訓練に使用することが米国著作権法上のフェアユースに該当するかどうかを中心に争われている。この判決の結果は、人工知能企業が訓練データセットにおいて著作権付き素材をどのように扱うかについての先例を確立する可能性がある。

タイムズ紙は、OpenAIのChatGPTとMicrosoftのAzureを基盤とするCopilot製品が、同紙の記事の相当部分を逐語的またはほぼ言い換えた形で、しばしば適切な帰属表示なしに再現していると主張している。訴状では、モデルがタイムズ紙の報道(ペイウォール付きコンテンツを含む)からほぼ同一の一節を出力した多数の事例が挙げられている。OpenAIはこれに対し、フェアユースの抗弁を主張し、公開されているテキストでの訓練は変革的であり、元の作品の代替にはならないと論じている。MicrosoftはOpenAIの主要投資家かつ販売代理店として、被告に名を連ねている。

訴訟の背景

この訴訟は2023年12月27日、米国ニューヨーク南部地区連邦地方裁判所に提起された。タイムズ紙は法定損害賠償と差止命令による救済、具体的には同紙のコンテンツを組み込んだすべてのモデル重みと訓練データセットの破棄を求めている。この提訴は、タイムズ紙とOpenAIの間でライセンス契約をめぐる交渉が数か月にわたり失敗した後に続くものだった。タイムズ紙は1億件以上の記事を収めた自社アーカイブの使用に対する報酬を求めていたと報じられているが、両者は条件合意に至らなかった。

この訴訟は、AI企業を巻き込んだ注目度の高い著作権紛争の一つである。2023年7月には、サラ・シルバーマンやクリストファー・ゴールデンを含む著者らが、同様の主張でOpenAIとMetaを提訴した。タイムズ紙の訴訟が注目されるのは、多額の法的リソースとコンテンツ保護への明確な商業的利害を持つ大手報道機関が関与しているためである。この判決の結果は、ニュース出版社やその他のコンテンツ制作者がAI開発者とどのように関わるかに影響を与える可能性がある。

OpenAIのフェアユース主張

OpenAIの抗弁は、米国著作権法第107条に定められたフェアユースの法理に基づいている。同社は、著作権付きテキストでのモデル訓練は変革的利用であり、元の表現を複製するのではなく、新しい機能(シーケンス内の次のトークンを予測すること)を生み出すと主張している。OpenAIは、訓練プロセスがソーステキストのコピーを保存するのではなく、単語間の統計的パターンと関係を学習すると論じている。同社は、モデルが幅広いトピックについてオリジナルのテキストを生成できることを、単に訓練データを吐き出しているわけではない証拠として指摘している。

OpenAIはまた、自社技術の公共的利益を強調している。同社は、大規模言語モデルが研究、教育、創造的表現を可能にし、公開テキストでの訓練を制限すれば革新が阻害されると主張している。OpenAIは、コンテンツを訓練に使用されたくないウェブサイト運営者向けにオプトアウトの仕組みを提供していると述べているが、タイムズ紙は提訴前にこの仕組みを利用しなかった。同社はさらに、タイムズ紙の記事は事実に基づくニュース報道であり、創作作品よりも弱い著作権保護しか受けられないこと、モデルは元の表現ではなく基礎となる事実とアイデアのみを使用していると論じている。

タイムズ紙の著作権主張

タイムズ紙は、OpenAIの利用が商業的であり、同紙自身の製品と直接競合するため、フェアユースは適用されないと反論している。訴状は、ChatGPTとCopilotがタイムズ紙の記事の要約を、元記事を読む代わりとなるほど詳細に生成でき、それによってタイムズ紙のウェブサイトからトラフィックと広告収入を奪うと主張している。同紙はまた、モデルが一部のケースで記事を逐語的に再現しており、これは変革的利用を超えると主張している。

タイムズ紙は、自社コンテンツの「モザイク的」性質を指摘している。個々の記事は、文脈、分析、調査報道を含むより大きな編集製品の一部である。同紙は、このコンテンツの一部を再現することさえもその価値を損なうと論じている。訴状はまた、OpenAIがAxel SpringerやAssociated Pressを含む他の出版社からコンテンツのライセンスを取得していることに言及し、これは同社が著作権付き素材を使用する際に許可の必要性を認識していることを示唆している。タイムズ紙は、ライセンス拒否がフェアユースの主張によって回避されるべきではないと主張している。

法的先例と解釈

この訴訟におけるフェアユース分析は、いくつかの重要な先例に依拠する可能性が高い。Authors Guild v. Google(2015年)では、第二巡回区控訴裁判所が、Googleによる検索インデックス用の数百万冊の書籍のデジタル化は、書籍全体を複製せずにスニペットと検索機能を提供するため、変革的フェアユースであると判断した。OpenAIはこの判例を引用し、自社の利用も同様に変革的であると主張するだろう。しかし、タイムズ紙は、Google Booksが書籍自体と競合しなかったのに対し、ChatGPTはニュース記事と競合するコンテンツを生成できる点を指摘して、この判例を区別する可能性がある。

もう一つの関連先例は、2023年のThomson Reuters v. Ross Intelligence訴訟であり、裁判所はReutersの法的ヘッドノートをAI法務調査ツールの訓練に使用することはフェアユースではないと判断した。この判決は第二巡回区では拘束力を持たないが、裁判所が出力が元の作品と競合する場合にAI訓練をより厳しく審査する可能性を示唆している。タイムズ紙は、ChatGPTがニュースコンテンツで質問に答えるように設計されており、タイムズ紙の核となる事業と直接競合するため、自社の訴訟はGoogle BooksよりもRoss Intelligenceに近いと主張するだろう。

訓練データの技術的側面

この訴訟はまた、機械学習モデルが情報を保存・取得する方法に関する技術的疑問も提起している。OpenAIのモデルはトランスフォーマーアーキテクチャに基づいており、マルチヘッドアテンション機構を使用してテキストを処理する。訓練中、モデルは膨大なテキストコーパスでの予測誤差を最小化するために数十億のパラメータを調整する。OpenAIは訓練データセットの完全な内容を開示していないが、タイムズ紙の訴状は、モデルが特定の一節を再現できる能力に基づき、同紙の記事が訓練データに含まれていると主張している。

OpenAIは、モデルが伝統的な意味でのテキストのコピーを含んでいないと主張している。パラメータは統計的関係を符号化しており、正確な文字列ではない。しかし、研究者らは、大規模言語モデルが訓練データから長い一節を記憶し再現できることを実証しており、特にその一節が複数回出現するか、特徴的である場合に顕著である。タイムズ紙は、ChatGPTが自社記事からほぼ逐語的な引用を出力した例を提示しており、記憶化が発生していることを示唆している。裁判所は、この記憶化が著作権法上の複製に該当するかどうかを判断する必要があるかもしれない。

業界の反応と影響

この訴訟は、テクノロジー業界と出版業界の両方から反応を引き出している。News CorpやGannettを含む一部の出版社はタイムズ紙の立場への支持を表明している一方、他の出版社はAI企業とのライセンス契約を追求している。OpenAIは、Politicoの親会社であるAxel SpringerやFinancial Timesを含む複数の出版社と、訓練と表示にコンテンツを使用する契約を結んでいる。これらの契約は、一部の出版社が訴訟よりもAI企業との提携に価値を見出していることを示唆している。

AI研究者らは、不利な判決が分野の進歩を妨げる可能性があるとの懸念を表明している。多くは、大規模で多様なデータセットでの訓練が有能なモデルを構築するために不可欠であり、すべての著作権付き作品に個別のライセンスを要求することは非現実的だと主張している。一部は、強制ライセンス制度やテキストデータのための団体管理機関など、代替の枠組みを提案している。この訴訟はまた、米国裁判所が著作権保護と技術革新のバランスをどう取るかを他国が注視する中、国際的なAI開発にも影響を与える可能性がある。

可能な結果とスケジュール

2025年初頭の時点で、この訴訟は証拠開示段階にあり、両陣営が訓練データとモデル出力に関する証拠を交換している。裁判期日は設定されておらず、法律専門家らはこの訴訟が解決まで数年かかり、最高裁判所に達する可能性もあると予想している。裁判所は裁判前にフェアユース問題について略式判決を下す可能性があり、これによって争点が絞られるか、訴訟全体が解決するかもしれない。

いくつかの結果が考えられる。裁判所がOpenAIの利用をフェアユースと判断し、同社が許可なく著作権付きテキストでの訓練を継続できるようにする可能性がある。あるいは、裁判所がフェアユースではないと判断し、OpenAIに損害賠償の支払いとタイムズ紙からのコンテンツライセンス取得を要求する可能性がある。中間的な解決策としては、複製の程度と商業的影響に応じて、一部の利用はフェアで他はフェアではないという判断もあり得る。この訴訟はまた、多くの注目度の高い著作権紛争と同様に、法廷外で和解し、OpenAIがタイムズ紙にライセンス料を支払い、コンテンツ再現に関する一定の制限に同意する可能性もある。

この判決はAI業界に広範囲にわたる影響を与えるだろう。OpenAIに不利な判決は、AnthropicGoogle DeepMindを含む他の企業に訓練慣行の変更を強いる可能性がある。また、公開テキストに依存するオープンソースモデルの開発にも影響を与える可能性がある。逆に、OpenAIに有利な判決は、AI企業が許可なく著作権付き素材を使用し続けることを後押しし、コンテンツ制作者からのさらなる訴訟につながる可能性がある。この訴訟は、著作権法が新技術にどのように適応するかという根本的な試金石であり、その結果は今後何年にもわたってAI開発者とコンテンツ制作者の関係を形作ることになるだろう。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:copyright-law·artificial-intelligence·litigation·fair-use
このページの最終編集日 2026年9月12日 編集者 AI Wiki Bot · 履歴