OpenAI Soraは、OpenAIによって開発されたテキストから動画を生成するモデルであり、ソーシャルメディアアプリでもあった。人工知能を用いて、このモデルはテキストプロンプトに基づいて短い動画クリップを生成し、既存の短い動画を延長することもできた。2024年2月に初めてプレビューが公開され、2024年12月に一般公開されたが、2026年4月にサービスが終了し、APIは2026年9月に廃止される予定である。Soraの能力と急速な終了は、生成AIの社会的影響、特にディープフェイクや著作権に関する懸念についての議論を促進した。
背景
Sora以前にも、MetaのMake-A-Video、RunwayのGen-2、Google Veoなど、いくつかのテキストから動画を生成するモデルが存在していた。OpenAIは以前、2023年9月に3番目のテキストから画像を生成するモデルであるDALL-E 3をリリースしていた。Soraはこの系統を引き継ぎ、DALL-E 3の技術を動画生成に適応させた。このモデルは拡散トランスフォーマーであり、深層学習アーキテクチャの一種で、潜在空間内の3Dパッチをノイズ除去し、その後デコンプレッサーを介して標準的な動画に変換する。OpenAIはSoraを公開されている動画とライセンスされた著作権付き動画で訓練したが、正確なソースや量は開示しなかった。
初期リリース
チームは、Soraを日本語の「空」という言葉にちなんで名付け、「無限の創造的可能性」を象徴させた。2024年2月15日、OpenAIはSoraをプレビューし、山道を走るSUV、ろうそくの隣にある「短くふわふわしたモンスター」のアニメーション、雪の中を東京を歩く2人、カリフォルニアのゴールドラッシュの偽の歴史的映像など、いくつかの高解像度動画クリップを公開した。OpenAIは、最大1分間の動画を生成できると述べた。同社は訓練方法を詳述した技術レポートを共有した。CEOのサム・アルトマンも、ユーザーのプロンプトに応答してSoraで生成した動画をツイートで投稿した。
2024年12月9日時点で、OpenAIは米国とカナダのChatGPT ProおよびChatGPT Plusユーザー向けにSoraを段階的に一般公開した。これに先立ち、誤情報やバイアスの専門家からなる小規模な「レッドチーム」が敵対的テストを実施した。OpenAIはまた、フィードバックを得るために、ビデオ制作者やアーティストを含む小規模なクリエイティブ専門家グループとSoraを共有した。2025年2月、OpenAIはSoraをChatGPTに統合し、ユーザーがチャットボットから直接動画を生成できるようにする計画を発表した。
Sora 2
Sora 2は2025年9月30日にiOSアプリとともに発表され、Androidアプリは2か月後に続いた。Sora 2で生成されたすべての動画には、悪用を防ぐための可視で動くデジタルウォーターマークが付いていた。以前のバージョンにも安全用のウォーターマークがあった。2025年10月7日、404 Mediaは、ウォーターマークを除去できるサードパーティ製プログラムが普及していると報じた。Wiredなど多くのメディアは、Sora 2アプリがスタイルや機能においてTikTokと明らかに類似していると指摘した。
サービス終了
2026年3月24日、OpenAIはX上で、モバイルアプリとAPIの両方でSoraを廃止すると発表した。Soraアプリは2026年4月26日にシャットダウンされ、APIは2026年9月24日にシャットダウンされる予定だった。OpenAIとディズニーのパートナーシップも終了しており、これにはSoraでディズニーキャラクターを許可するライセンス契約が含まれていた。この決定は、英国のテクノロジーニュースサイトThe Registerが、Google、Amazon Web Services、Broadcom、Cloud Software Group、Netscapeなどの他のテクノロジー企業に続き、OpenAIを「プロダクトキラー」とレッテルを貼るきっかけとなった。
OpenAIは、シャットダウン通知でSoraを廃止する具体的な理由を提供しなかった。報道では、この決定は計算リソースの不足、コスト圧力、そして中核的なエンタープライズ製品へのより広範なシフトに関連付けられた。一般公開後、Soraの世界中のユーザー数は約100万人でピークに達した後、50万人未満に減少し、一方でサービスは動画生成の計算需要により、1日あたり推定100万ドルの運用コストがかかっていた。
法的規制
2024年11月、Soraアクセス用のAPIキーが、Hugging Face上のテスターグループによってリークされ、彼らはSoraが「アートウォッシング」に使用されていると抗議するマニフェストを投稿した。OpenAIはリークから3時間後にすべてのアクセスを無効化し、「数百人のアーティスト」が開発を形作り、「参加は任意である」と述べた。
Sora 2は、著作権所有者がOpenAIに連絡して生成を制限しない限り、デフォルトで著作権付きコンテンツを許可していた。2025年10月3日、OpenAIは将来のアップデートで著作権所有者に「より詳細な制御」を提供すると述べたが、既存のコンテンツが削除されるかどうかは明記しなかった。10月6日、MPAの会長はSora 2に関するOpenAIの著作権アプローチを批判した。
2025年12月11日、ウォルト・ディズニー・カンパニーはOpenAIへの10億ドルの投資を発表し、3年間のライセンス契約により、Disney+ユーザーはSora 2でディズニーアニメーション、ピクサー、マーベル・スタジオ、スター・ウォーズを含む200以上の著作権付きキャラクターを生成できるようになった。
能力と制限
Soraの背後にある技術は、DALL-E 3の技術の適応であった。OpenAIによると、Soraは拡散トランスフォーマーであり、ノイズ除去器として1つのトランスフォーマーを持つノイズ除去潜在拡散モデルである。動画は潜在空間内で3Dパッチをノイズ除去することによって生成され、その後ビデオデコンプレッサーによって標準空間に変換された。リキャプショニングは、動画の詳細なキャプションを作成することによってトレーニングデータを増強するために使用された。
OpenAIは、公開されている動画とライセンスされた著作権付き動画を使用してモデルを訓練したが、正確な数やソースは明らかにしなかった。リリース時に、OpenAIは複雑な物理をシミュレートする能力の限界、因果関係の理解、左右の区別など、欠点を認めた。OpenAIはまた、安全慣行に従い、Soraは性的、暴力的、憎悪的、または有名人の画像、および既存の知的財産を含むコンテンツのテキストプロンプトを制限すると述べた。
Soraの研究者ティム・ブルックスは、モデルがデータセットだけから3Dグラフィックスを作成する方法を学習したと述べ、同僚の研究者ビル・ピーブルズは、モデルが一貫したシーンを生成する能力は、トランスフォーマーアーキテクチャとトレーニングデータのスケールアップの結果であると述べた。
影響と議論
Soraのリリースは、深層学習と生成AIの悪用の可能性、特にディープフェイクに関する公共の議論を激化させた。可視のウォーターマークは緩和策であったが、サードパーティ製ツールによる除去は、コンテンツの真正性における課題を浮き彫りにした。モデルがオプトアウトしない限りデフォルトで著作権付き素材を使用することは、著作権所有者やMPAなどの業界団体から批判を招いた。Soraのサービス終了はまた、運用コストとユーザー減少が終焉に寄与したため、リソース集約型AI製品の持続可能性についての疑問を提起した。
遺産
Soraの短い存在は、テキストから動画を生成するAIの技術的可能性と商業的課題の両方を実証した。その拡散トランスフォーマーアプローチは、その後の動画生成研究に影響を与え、一方でそのシャットダウンは、そのようなモデルを大規模に実行する経済的現実を浮き彫りにした。Soraが引き起こした著作権とウォーターマーキングに関する議論は、AIコンテンツ生成に関する政策議論を形成し続けている。