Soraは、OpenAIによって開発されたテキストから動画を生成するモデルおよびソーシャルメディアアプリであった。人工知能を用いて、このモデルはテキストプロンプトに基づいて短い動画クリップを生成し、既存の短い動画を延長することもできた。2024年2月、OpenAIはその出力例を一般に公開し、Soraの第一世代は2024年12月に米国とカナダのChatGPT PlusおよびChatGPT Proユーザー向けに一般公開された。第二世代のSora 2は、2025年9月末に米国とカナダの一部ユーザー向けにリリースされ、ソーシャルメディア機能が統合された。このアプリは2026年4月26日に停止され、アプリケーションプログラミングインターフェース(API)は2026年9月24日に廃止される予定であり、Sora AIブランドの終焉を迎えた。
Soraは、DALL-E 3の技術を応用したもので、拡散トランスフォーマーアーキテクチャを採用していた。デフォルトでは、この生成器は著作権者が積極的にオプトアウトしない限り、動画内で著作権のある素材を使用していた。動画には悪用を防ぐための可視で動くデジタルウォーターマークが含まれていたが、Sora 2のリリースから1週間後には、ウォーターマークを除去できるサードパーティ製プログラムが利用可能になった。
背景
Sora以前にも、テキストから動画を生成できる他のモデルがいくつか作成されており、MetaのMake-A-Video、RunwayのGen-2、Google Veoなどが含まれていた。Soraを開発したOpenAIは、2023年9月にテキストから画像を生成するDALL-Eシリーズの3番目のモデルであるDALL-E 3をリリースしていた。これらの初期の開発は、後にSoraが普及させるテキストから動画への生成の基盤を築いた。
初期リリース
Soraを開発したチームは、その「無限の創造的可能性」を象徴するために、日本語の「空」という言葉にちなんで名付けた。2024年2月15日、OpenAIはSoraを初めてプレビューし、山道を走るSUV、ろうそくの隣にある「短くてふわふわしたモンスター」のアニメーション、雪の中を歩く東京の二人、カリフォルニアのゴールドラッシュの偽の歴史的映像など、作成した高解像度動画の複数のクリップを公開した。OpenAIは、最大1分間の動画を生成できると述べた。同社はその後、モデルのトレーニングに使用された方法を強調した技術レポートを共有した。OpenAIのCEOであるサム・アルトマンも、TwitterユーザーのプロンプトにSoraで生成した動画で応答する一連のツイートを投稿した。
2024年12月9日時点で、OpenAIは米国とカナダのChatGPT ProおよびChatGPT Plusユーザー向けにSoraを段階的に一般公開していた。これ以前に、同社は誤情報や偏見の専門家を含む小さな「レッドチーム」に限定的なアクセスを提供し、モデルに対する敵対的テストを実施していた。また、同社はビデオ制作者やアーティストを含む少数のクリエイティブ専門家グループとSoraを共有し、クリエイティブ分野での有用性についてフィードバックを求めた。2025年2月、OpenAIはユーザーがチャットボットからSora動画を生成できるようにすることで、SoraをChatGPTに統合する計画を発表した。
Sora 2
Sora 2は2025年9月30日に発表され、同時にiOSアプリもリリースされ、2か月後にはAndroidアプリもリリースされた。このモデルによって生成されたすべての動画には、ツールの悪用を防ぐための可視で動くウォーターマークが含まれていた。以前のバージョンのSoraにも、視聴者が現実と架空のコンテンツを区別できるようにするための安全ウォーターマークが追加されていた。10月7日、404 Mediaは、Sora 2の動画からウォーターマークを除去できるサードパーティ製プログラムが普及していると報じた。Wired誌などの多くのメディアは、Sora 2アプリがスタイルと機能の点でTikTokと明らかに類似していると指摘した。
廃止
2026年3月24日、OpenAIはX上で、モバイルアプリとAPIの両方でSoraを廃止すると発表した。Soraアプリは2026年4月26日に停止され、APIは2026年9月24日に停止される予定であった。ディズニーキャラクターをSora内で使用できるようにするライセンス契約を含むOpenAIとディズニーの提携も終了しようとしていた。この決定により、英国のテクノロジーニュースサイトThe Registerは、Google、Amazon Web Services、Broadcom、Cloud Software Group、Netscapeなどの他のテクノロジー企業に続き、OpenAIを「プロダクトキラー」と評した。
OpenAIは、廃止通知の中でSoraを廃止する具体的な理由を明らかにしなかった。この廃止に関して浮上した報道は、この決定を計算リソースの不足、コスト圧力、および中核となるエンタープライズ製品へのより広範なシフトに関連付けた。一般公開後、Soraの世界中のユーザー数は約100万人でピークに達した後、50万人未満に減少し、一方でこのサービスは動画生成の計算需要により、1日あたり推定100万ドルの運用コストがかかっていた。
法的規制
2024年11月、Soraアクセス用のAPIキーが、Hugging Face上のテスターグループによってリークされ、彼らはSoraが「アートウォッシング」に使用されていることに抗議していると述べるマニフェストを投稿した。OpenAIはリークが公開されてから3時間後にすべてのアクセスを無効にし、「数百人のアーティスト」が開発を形作っており、「参加は任意である」と述べた。
Sora 2は、著作権者がプラットフォーム上でのコンテンツ生成を制限するためにOpenAIに連絡しない限り、デフォルトで著作権のあるコンテンツを許可していた。2025年10月3日、OpenAIはSora 2の将来のアップデートで著作権者に著作権のあるコンテンツの生成に対する「より細かい制御」を提供すると述べたが、既存のコンテンツが削除されるかどうかは明言しなかった。10月6日、MPAの会長はSora 2に関するOpenAIの著作権へのアプローチを批判した。
2025年12月11日、ウォルト・ディズニー・カンパニーは、OpenAIに10億ドルを投資し、3年間のライセンス契約を結ぶと発表し、Disney+のユーザーがSora 2で200以上の著作権キャラクターを生成できるようにした。これらのキャラクターには、ディズニー・アニメーション、ピクサー、マーベル・スタジオ、スター・ウォーズのものが含まれていた。
機能と制限
Soraの背後にある技術は、DALL-E 3の背後にある技術の応用であった。OpenAIによると、Soraは拡散トランスフォーマーであり、そのデノイザーとして1つのトランスフォーマーを持つノイズ除去潜在拡散モデルであった。動画は、3D「パッチ」をノイズ除去することによって潜在空間で生成され、その後、ビデオデコンプレッサーによって標準空間に変換された。リキャプショニングは、ビデオからテキストへのモデルを使用して動画の詳細なキャプションを作成することにより、トレーニングデータを増強するために採用された。
OpenAIは、公開されている動画とライセンスされた著作権動画を使用してモデルをトレーニングしたが、動画の数や正確な出所は明らかにしなかった。リリース時、OpenAIはSoraのいくつかの欠点を認めており、複雑な物理をシミュレートする能力の限界、因果関係の理解、左右の区別などが含まれていた。また、OpenAIは、同社の既存の安全慣行に従い、Soraは性的、暴力的、憎悪的、または有名人の画像、および既存の知的財産を含むコンテンツのテキストプロンプトを制限すると述べた。
Soraの研究者であるティム・ブルックスは、このモデルがデータセットだけから3Dグラフィックスを作成する方法を学習したと述べ、一方、同僚のSora研究者であるビル・ピーブルズは、このモデルが複雑な物理をシミュレートする能力に限界があると述べた。これらの制限は、時間的一貫性と物理的リアリズムにしばしば苦労した初期の生成AIビデオモデルに典型的なものであった。
影響と遺産
Soraのリリースは、生成AIにおける重要なマイルストーンを示し、深層学習モデルがテキストプロンプトから一貫性のあるビデオコンテンツを生成する可能性を実証した。その急速な採用とその後の廃止は、このような計算集約的なモデルをスケーリングする課題を浮き彫りにした。Sora 2へのソーシャルメディア機能の統合は、TikTokなどのプラットフォームと同様に、コミュニティと共有機能を組み込むAIツールのより広範なトレンドを反映していた。
Soraの停止は、その高い運用コストとユーザー数の減少とともに、スタンドアロンのAIビデオ生成サービスの持続可能性について疑問を提起した。この決定はまた、GoogleやAmazon Web Servicesなどの製品を廃止した他のテック企業との比較を呼び起こした。その短い寿命にもかかわらず、Soraはテキストからビデオへの技術のその後の発展に影響を与え、著作権、ウォーターマーク、およびAI生成コンテンツの倫理的使用に関する進行中の議論に貢献した。