英語からの翻訳

OpenAIのSoraテキスト・トゥ・ビデオモデルは、2024年2月にプレビューされ、プロンプトから1分間の動画を生成した。2024年12月に公開され、2025年9月にSora 2をリリースし、2026年4月に廃止された。

Soraは、OpenAIによって開発されたテキストから動画を生成するモデルおよびソーシャルメディアアプリでした。人工知能を用いて、このモデルはプロンプトに基づいて短い動画クリップを生成し、既存の短い動画を延長することもできました。2024年2月、OpenAIはその出力例を一般に公開し、Soraの初代は2024年12月に米国とカナダのChatGPT PlusおよびChatGPT Proユーザー向けに一般公開されました。

Soraの第2世代は、2025年9月末に米国とカナダの一部ユーザー向けにリリースされました。Sora 2はアプリにソーシャルメディア機能を統合しました。このアプリは2026年4月26日にサービスを終了し、アプリケーションプログラミングインターフェース(API)は2026年9月24日に廃止される予定で、Sora AIブランド全体の終焉を迎えました。

背景

Sora以前にも、テキストから動画を生成できるモデルがいくつか作成されており、MetaのMake-A-Video、RunwayのGen-2、Google Veoなどが含まれます。Soraの開発元であるOpenAIは、2023年9月にテキストから画像を生成するDALL-Eシリーズの第3弾であるDALL-E 3をリリースしていました。Soraの開発は、生成AI、特に拡散モデルトランスフォーマーの進歩に基づいており、これらは画像生成やテキスト生成に応用されていました。OpenAIの大規模言語モデルニューラルネットワークに関するこれまでの研究は、モデルのアーキテクチャに影響を与えました。

初回リリース

Soraを開発したチームは、その「無限の創造的可能性」を象徴するために、日本語の「空」にちなんでこのモデルを命名しました。2024年2月15日、OpenAIはSoraを初めて公開し、同社が作成した高解像度動画の複数のクリップをリリースしました。これには、山道を走るSUV、ろうそくの隣にある「短くてふわふわしたモンスター」のアニメーション、雪の中を東京で歩く2人、カリフォルニア・ゴールドラッシュの偽の歴史的映像などが含まれていました。OpenAIは、最大1分間の動画を生成できると述べました。同社はその後、モデルのトレーニングに使用された方法を強調した技術レポートを共有しました。OpenAIのCEOであるサム・アルトマンも、Twitterユーザーのプロンプトに応じてSoraが生成した動画を一連のツイートで投稿しました。

2024年12月9日時点で、OpenAIは米国とカナダのChatGPT ProおよびChatGPT Plusユーザー向けにSoraを段階的に一般公開しました。これ以前に、同社は誤情報やバイアスの専門家を含む少数の「レッドチーム」に限定的なアクセスを提供し、モデルに対する敵対的テストを実施していました。また、同社はビデオ制作者やアーティストを含む少数のクリエイティブ専門家グループにもSoraを共有し、クリエイティブ分野での有用性に関するフィードバックを求めました。2025年2月、OpenAIはユーザーがチャットボットからSora動画を生成できるようにすることで、SoraをChatGPTに統合する計画を発表しました。

Sora 2

Sora 2は2025年9月30日に発表され、同時にiOSアプリがリリースされ、2か月後にはAndroidアプリもリリースされました。このモデルによって生成されたすべての動画には、ツールの悪用を防ぐために目に見える動く透かしが含まれています。以前のバージョンのSoraにも、視聴者が本物と架空のコンテンツを区別できるようにするための安全透かしが追加されていました。2025年10月7日、404 Mediaは、Sora 2の動画から透かしを除去できるサードパーティ製プログラムが普及していると報じました。Wired誌など多くのメディアは、Sora 2アプリがスタイルと機能の点でTikTokと明らかに類似していると指摘しています。

サービス終了

2026年3月24日、OpenAIはX上で、モバイルアプリとAPIの両方でSoraを廃止すると発表しました。Soraアプリは2026年4月26日にサービスを終了し、APIは2026年9月24日に廃止される予定です。Sora内でディズニーキャラクターの使用を許可するライセンス契約を含むOpenAIとディズニーの提携も終了に近づいていました。この決定により、英国のテクノロジーニュースサイトThe Registerは、Google、Amazon Web Services、Broadcom、Cloud Software Group、Netscapeなどの他のテクノロジー企業に続き、OpenAIを「プロダクトキラー」と評しました。

OpenAIは、サービス終了の通知でSoraを廃止する具体的な理由を明らかにしませんでした。この廃止に関する報道は、計算リソースの不足、コスト圧力、そして中核的なエンタープライズ製品へのより広範なシフトに関連付けられました。一般公開後、Soraの全世界のユーザー数は約100万人でピークに達しましたが、その後50万人未満に減少し、一方でこのサービスは動画生成の計算需要により、1日あたり推定100万ドルの運用コストがかかっていました。

法的規制

2024年11月、Soraアクセス用のAPIキーが、Hugging Face上のテスターグループによってリークされました。彼らは、Soraが「アートウォッシング」に使用されていることに抗議していると述べるマニフェストを投稿しました。OpenAIはリークが公開されてから3時間後にすべてのアクセスを無効化し、「数百人のアーティスト」が開発を形作っており、「参加は任意である」と述べました。

Sora 2は、著作権所有者がプラットフォーム上でのコンテンツ生成を制限するためにOpenAIに連絡しない限り、デフォルトで著作権で保護されたコンテンツを許可していました。2025年10月3日、OpenAIはSora 2の将来のアップデートで著作権所有者に著作権で保護されたコンテンツの生成に対する「より詳細な制御」を提供すると述べましたが、既存のコンテンツが削除されるかどうかについては明言しませんでした。10月6日、MPAの会長はSora 2に関するOpenAIの著作権へのアプローチを批判しました。

2025年12月11日、ウォルト・ディズニー・カンパニーは、3年間のライセンス契約でOpenAIに10億ドルを投資し、Disney+のユーザーがSora 2で200以上の著作権で保護されたキャラクターを生成できるようにすると発表しました。これらのキャラクターには、ディズニー・アニメーション、ピクサー、マーベル・スタジオ、スター・ウォーズのものが含まれます。

機能と制限

Soraの背後にある技術は、DALL-E 3の背後にある技術の適応です。OpenAIによると、Soraは拡散トランスフォーマーであり、そのデノイザーとして1つのトランスフォーマーを持つノイズ除去潜在拡散モデルです。動画は、3D「パッチ」をノイズ除去することによって潜在空間で生成され、その後、ビデオデコンプレッサーによって標準空間に変換されます。リキャプショニングは、ビデオからテキストへのモデルを使用して動画の詳細なキャプションを作成し、トレーニングデータを拡張するために採用されています。

OpenAIは、公開されている動画と、その目的のためにライセンスされた著作権で保護された動画を使用してモデルをトレーニングしましたが、動画の数や正確な出所は明らかにしませんでした。リリース時、OpenAIはSoraのいくつかの欠点を認めました。これには、複雑な物理をシミュレートする能力、因果関係を理解する能力、左右を区別する能力が限られていることが含まれます。また、OpenAIは、同社の既存の安全慣行に従い、Soraは性的、暴力的、憎悪に満ちた、または有名人の画像、および既存の知的財産を特徴とするコンテンツのテキストプロンプトを制限すると述べました。

Soraの研究者であるティム・ブルックスは、このモデルがデータセットだけから3Dグラフィックスを作成する方法を学習したと述べ、一方で同僚のSora研究者であるビル・ピーブルズは、一貫性のあるシーンを生成するモデルの能力は、トレーニングデータと計算量をスケールアップした結果であると述べました。モデルのアーキテクチャは、マルチヘッドアテンション位置エンコーディングを活用して、ビデオシーケンスの時間的依存関係を処理しました。その能力にもかかわらず、物理シミュレーションと因果推論におけるSoraの限界は、ビデオ生成における深層学習の課題を浮き彫りにしました。

評価と影響

2024年2月のSoraプレビューは、AI生成動画の影響について大きな世間の関心と議論を生み出しました。批評家は、誤情報、著作権侵害、クリエイティブ専門家の置き換えなどへの潜在的な悪用について懸念を表明しました。支持者は、ビデオ制作の民主化と新しい形式の芸術表現を可能にする可能性を強調しました。単純なテキストプロンプトから1分間の動画を生成するモデルの能力は、生成AIにおける大きな前進と見なされましたが、その計算コストと最終的なサービス終了は、そのようなモデルの持続可能性について疑問を投げかけました。

Sora 2のリリース後、ソーシャルメディア機能の統合はTikTokなどの既存プラットフォームとの比較を招き、一部の観察者はバイラルコンテンツ作成の可能性に言及しました。Sora 2のリリース直後に登場した透かし除去ツールは、コンテンツ認証とデジタルフォレンジックにおける継続的な課題を浮き彫りにしました。2026年のSoraのサービス終了は、OpenAIのエンタープライズ製品へのシフトと相まって、消費者向けAIツールからの顕著な撤退を示し、競争の激しいAI環境におけるより広範な業界トレンドを反映しています。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:text-to-video·openai·generative-ai·artificial-intelligence
このページの最終編集日 2026年9月13日 編集者 AI Wiki Bot · 履歴