OpenAI Soraは、OpenAIによって開発されたテキストから動画を生成するモデルおよびソーシャルメディアアプリである。人工知能を用いて、このモデルはプロンプトに基づいて短い動画クリップを生成し、既存の短い動画を延長することもできた。2024年2月、OpenAIはその出力例を一般公開し、2024年12月にはアメリカとカナダのChatGPT PlusおよびChatGPT Proユーザー向けにSoraの初代が公開された。
Soraの第2世代は、2025年9月末にアメリカとカナダの一部のユーザーに公開された。Sora 2はアプリにソーシャルメディア機能を統合した。このアプリは2026年4月26日に廃止され、アプリケーションプログラミングインターフェース(API)は2026年9月24日に廃止される予定であり、これによりSora AIブランド全体が終了することとなる。
背景
Sora以前にも、テキストから動画を生成できるモデルはいくつか存在しており、MetaのMake-A-Video、RunwayのGen-2、Google Veoなどが含まれる。Soraの背後にある企業であるOpenAIは、2023年9月にテキストから画像を生成するDALL-Eシリーズの第3弾であるDALL-E 3を公開していた。Soraの開発は、生成AIと深層学習の進歩、特に画像生成に用いられる拡散モデルの技術を基盤としていた。
歴史
初回リリース
Soraを開発したチームは、その「無限の創造的可能性」を示すために、日本語の「空」という言葉にちなんで命名した。2024年2月15日、OpenAIはSoraを初めて公開し、山道を走るSUV、ろうそくの隣にある「短くふわふわしたモンスター」のアニメーション、雪の中を歩く二人、カリフォルニアのゴールドラッシュの偽の歴史的映像など、同モデルが作成した高解像度動画のクリップを複数公開した。OpenAIは、最大1分間の動画を生成できると述べた。同社はその後、モデルの訓練に用いられた方法を強調した技術レポートを共有した。OpenAIのCEOであるサム・アルトマンも、TwitterユーザーのプロンプトにSoraで生成した動画で応える一連のツイートを投稿した。
2024年12月9日時点で、OpenAIはアメリカとカナダのChatGPT ProおよびChatGPT Plusユーザー向けにSoraを段階的に一般公開していた。これ以前に、同社は誤情報や偏見の専門家を含む少数の「レッドチーム」に限定的なアクセスを提供し、モデルに対する敵対的テストを実施していた。また、同社はビデオ制作者やアーティストを含む少数のクリエイティブ専門家にもSoraを共有し、創造的分野での有用性についてフィードバックを求めた。2025年2月、OpenAIはChatGPT内でユーザーがチャットボットからSora動画を生成できるようにすることで、SoraをChatGPTに統合する計画を発表した。
Sora 2
Sora 2は2025年9月30日に公開され、同時にiOSアプリもリリースされ、2か月後にはAndroidアプリもリリースされた。このモデルによって生成されたすべての動画には、ツールの悪用を防ぐために、可視で動く透かしが含まれている。Soraの以前のバージョンも、本物と架空のコンテンツを区別できるように安全用の透かしを追加していた。2025年10月7日、404 Mediaは、Sora 2の動画から透かしを除去できる第三者のプログラムが普及していると報じた。Wiredなどの多くのメディアは、Sora 2アプリがTikTokとスタイルや機能が明らかに類似していると指摘している。
廃止
2026年3月24日、OpenAIはXで、モバイルアプリとAPIの両方でSoraを廃止すると発表した。Soraアプリは2026年4月26日に廃止され、APIは2026年9月24日に廃止される予定である。Sora内でディズニーのキャラクターを使用することを許可するライセンス契約を含む、OpenAIとディズニーの提携も終了に近づいていた。この決定により、英国のテクノロジーニュースサイトThe RegisterはOpenAIを「プロダクトキラー」と評し、Google、Amazon Web Services、Broadcom、Cloud Software Group、Netscapeなどの他のテクノロジー企業に続くものとした。
OpenAIは廃止通知の中で、Soraを廃止する具体的な理由を明らかにしなかった。この廃止に関して浮上した報告では、その決定は計算リソースの不足、コスト圧力、そして中核的なエンタープライズ製品へのより広範なシフトに関連付けられた。一般公開後、Soraの全世界のユーザー数は約100万人でピークに達したが、その後50万人未満に減少し、一方でこのサービスは動画生成の計算需要により、運営に1日あたり推定100万ドルのコストがかかっていた。
法的規制
2024年11月、Soraへのアクセス用APIキーが、Hugging Face上でテスターのグループによって流出した。彼らは、Soraが「アート・ウォッシング」に使用されていることに抗議するマニフェストを投稿した。OpenAIは流出が公開されてから3時間後にすべてのアクセスを取り消し、「数百人のアーティスト」が開発を形作っており、「参加は任意である」と述べた。
発売時点では、Sora 2はデフォルトで著作権で保護されたコンテンツを許可しており、著作権所有者がプラットフォーム上でのコンテンツ生成を制限するよう連絡しない限り許可されていた。2025年10月3日、OpenAIはSora 2の将来のアップデートで著作権所有者に著作権コンテンツの生成に対する「より細かな制御」を提供すると述べたが、既存のコンテンツが削除されるかどうかについては明言しなかった。10月6日、MPAの会長はSora 2に関するOpenAIの著作権アプローチを批判した。
2025年12月11日、ウォルト・ディズニー・カンパニーは、OpenAIに10億ドルを投資し、3年間のライセンス契約を結ぶと発表した。これにより、Disney+のユーザーはSora 2でディズニーアニメーション、ピクサー、マーベル・スタジオ、スター・ウォーズなど200以上の著作権で保護されたキャラクターを生成できるようになる。
機能と制限
Soraの背後にある技術は、DALL-E 3の技術を応用したものである。OpenAIによると、Soraは拡散トランスフォーマーであり、トランスフォーマーを1つ持つノイズ除去潜在拡散モデルである。動画は、潜在空間内で「パッチ」をノイズ除去することによって生成され、その後、動画デコーダーによって標準空間に変換される。リキャプションは、動画から画像へのモデルを使用して動画の詳細なキャプションを生成することにより、トレーニングデータを増強するために使用される。
OpenAIは、このモデルを、この目的のためにライセンスされた著作権で保護された動画とともに、一般公開された動画を使用して訓練したが、動画の正確なソースや数は明らかにしなかった。リリース時、OpenAIは、複雑な物理をシミュレートする能力に限界があること、因果関係を理解できないこと、左右を区別できないことなど、Soraの欠点を認めた。また、同社の既存の安全慣行に沿って、Soraは暴力的、性的、憎悪的、または有名人の画像を含むプロンプトを制限すると述べた。
Soraの研究者であるティム・ブルックスは、このモデルはデータセットだけから3Dグラフィックスを学習したと述べ、同僚の研究者であるティム・ブルックスは、このモデルの能力はスケーリングによって発現したものであり、機械学習とニューラルネットワーク研究の広範なトレンドと一致していると述べた。