Sora était un modèle de texte-vers-vidéo et une application de médias sociaux développés par OpenAI. Grâce à l'intelligence artificielle, le modèle générait de courts clips vidéo à partir d'invites et pouvait également étendre des vidéos courtes existantes. En février 2024, OpenAI a présenté des exemples de ses sorties au public, la première génération de Sora étant rendue publique pour les utilisateurs de ChatGPT Plus et ChatGPT Pro aux États-Unis et au Canada en décembre 2024.
La deuxième génération de Sora a été dévoilée à certains utilisateurs aux États-Unis et au Canada à la fin de septembre 2025. Sora 2 a intégré des fonctionnalités de médias sociaux dans l'application. L'application a été fermée le 26 avril 2026, et l'interface de programmation d'application (API) devrait être interrompue le 24 septembre 2026, marquant la fin de la marque Sora AI dans son ensemble.
Contexte
Plusieurs autres modèles capables de générer des vidéos à partir de texte avaient été créés avant Sora, notamment Make-A-Video de Meta, Gen-2 de Runway et Google Veo. OpenAI, la société derrière Sora, avait publié DALL-E 3, le troisième de ses modèles de texte-vers-image DALL-E, en septembre 2023. Le développement de Sora s'est appuyé sur les avancées en IA générative, en particulier les modèles de diffusion et les transformateurs, qui avaient été appliqués à la génération d'images et de texte. Les travaux antérieurs d'OpenAI sur les grands modèles de langage et les réseaux neuronaux ont informé l'architecture du modèle.
Lancement initial
L'équipe qui a développé Sora l'a nommé d'après le mot japonais pour « ciel » afin de signifier son « potentiel créatif illimité ». Le 15 février 2024, OpenAI a présenté Sora pour la première fois en publiant plusieurs clips de vidéos haute définition qu'il avait créées, notamment un SUV roulant sur une route de montagne, une animation d'un « monstre duveteux » à côté d'une bougie, deux personnes marchant dans Tokyo sous la neige, et de fausses images historiques de la ruée vers l'or en Californie. OpenAI a déclaré qu'il était capable de générer des vidéos d'une durée allant jusqu'à une minute. L'entreprise a ensuite partagé un rapport technique mettant en évidence les méthodes utilisées pour entraîner le modèle. Le PDG d'OpenAI, Sam Altman, a également publié une série de tweets répondant aux invites des utilisateurs de Twitter avec des vidéos générées par Sora à partir de ces invites.
À partir du 9 décembre 2024, OpenAI a progressivement rendu Sora accessible au public pour les utilisateurs de ChatGPT Pro et ChatGPT Plus aux États-Unis et au Canada. Avant cela, l'entreprise avait fourni un accès limité à une petite « équipe rouge », comprenant des experts en désinformation et en biais, pour effectuer des tests contradictoires sur le modèle. L'entreprise a également partagé Sora avec un petit groupe de professionnels créatifs, notamment des créateurs de vidéos et des artistes, pour solliciter des retours sur son utilité dans les domaines créatifs. En février 2025, OpenAI a annoncé son intention d'intégrer Sora dans ChatGPT en permettant aux utilisateurs de générer des vidéos Sora à partir du chatbot.
Sora 2
Sora 2 a été dévoilé le 30 septembre 2025, avec une application iOS en même temps, ainsi qu'une application Android deux mois plus tard. Toutes les vidéos générées par le modèle comportent un filigrane visible et animé pour empêcher toute utilisation abusive de l'outil. La version précédente de Sora avait également ajouté un filigrane de sécurité pour permettre aux spectateurs de distinguer le contenu réel du contenu fictif. Le 7 octobre, 404 Media a rapporté que des programmes tiers capables de supprimer le filigrane des vidéos Sora 2 étaient devenus courants. De nombreux médias, comme le magazine Wired, ont noté que l'application Sora 2 est ouvertement similaire à TikTok dans son style et ses fonctionnalités.
Interruption
Le 24 mars 2026, OpenAI a annoncé sur X qu'il interrompait Sora à la fois dans l'application mobile et dans l'API. L'application Sora a été fermée le 26 avril 2026, tandis que l'API devrait être fermée le 24 septembre 2026. Le partenariat d'OpenAI avec Disney, qui comprenait un accord de licence permettant l'utilisation des personnages Disney dans Sora, touchait également à sa fin. Cette décision a poussé le site d'actualités technologiques britannique The Register à qualifier OpenAI de « tueur de produits », suivant les traces d'autres entreprises technologiques comme Google, Amazon Web Services, Broadcom, Cloud Software Group et Netscape.
OpenAI n'a pas fourni de raison spécifique pour l'interruption de Sora dans son avis de fermeture. Les rapports qui ont émergé concernant cette interruption ont lié la décision à des pénuries de calcul, à des pressions sur les coûts et à un changement plus large vers des produits d'entreprise de base. Après son lancement public, le nombre d'utilisateurs mondiaux de Sora a culminé à environ un million avant de diminuer à moins de 500 000, tandis que le service coûtait environ 1 million de dollars par jour à exploiter en raison des exigences computationnelles de la génération vidéo.
Réglementation légale
En novembre 2024, une clé API pour l'accès à Sora a été divulguée par un groupe de testeurs sur Hugging Face qui ont publié un manifeste déclarant qu'ils protestaient contre le fait que Sora était utilisé pour le « blanchiment d'art ». OpenAI a révoqué tous les accès trois heures après que la fuite a été rendue publique et a déclaré que « des centaines d'artistes » ont façonné le développement et que « la participation est volontaire ».
Au moment de son lancement, Sora 2 permettait le contenu protégé par le droit d'auteur par défaut, à moins que les détenteurs de droits d'auteur ne contactent OpenAI pour restreindre la génération de leur contenu sur la plateforme. Le 3 octobre 2025, OpenAI a déclaré qu'une future mise à jour de Sora 2 donnerait aux détenteurs de droits d'auteur un « contrôle plus granulaire » sur la génération de contenu protégé, mais l'entreprise n'a pas précisé si le contenu existant serait supprimé. Le 6 octobre, le président de la MPA a critiqué l'approche d'OpenAI en matière de droits d'auteur avec Sora 2.
Le 11 décembre 2025, la Walt Disney Company a annoncé qu'elle investirait 1 milliard de dollars dans OpenAI, dans le cadre d'un accord de licence de trois ans, pour permettre aux utilisateurs de Disney+ de générer plus de 200 de ses personnages protégés par le droit d'auteur sur Sora 2. Ces personnages incluent ceux de Disney Animation, Pixar, Marvel Studios et Star Wars.
Capacités et limites
La technologie derrière Sora est une adaptation de la technologie derrière DALL-E 3. Selon OpenAI, Sora est un transformateur de diffusion, un modèle de diffusion latente avec débruitage utilisant un transformateur comme débruiteur. Une vidéo est générée dans l'espace latent en débruitant des « patchs » 3D, puis transformée en espace standard par un décompresseur vidéo. La recaptioning est utilisée pour augmenter les données d'entraînement en utilisant un modèle vidéo-texte pour créer des légendes détaillées pour les vidéos.
OpenAI a entraîné le modèle en utilisant des vidéos publiquement disponibles ainsi que des vidéos protégées par le droit d'auteur sous licence à cette fin, mais n'a pas révélé le nombre ou la source exacte des vidéos. Lors de sa sortie, OpenAI a reconnu certaines lacunes de Sora, notamment sa capacité limitée à simuler la physique complexe, à comprendre la causalité et à différencier la gauche de la droite. OpenAI a également déclaré que, conformément aux pratiques de sécurité existantes de l'entreprise, Sora restreindrait les invites textuelles pour les images sexuelles, violentes, haineuses ou de célébrités, ainsi que le contenu présentant une propriété intellectuelle existante.
Le chercheur de Sora, Tim Brooks, a déclaré que le modèle avait appris à créer des graphiques 3D à partir de son ensemble de données seul, tandis que son collègue chercheur de Sora, Bill Peebles, a déclaré que la capacité du modèle à générer des scènes cohérentes était le résultat de l'augmentation des données d'entraînement et du calcul. L'architecture du modèle exploitait l'attention multi-têtes et l'encodage positionnel pour gérer les dépendances temporelles dans les séquences vidéo. Malgré ses capacités, les limites de Sora en simulation physique et en raisonnement causal ont mis en évidence les défis de l'apprentissage profond dans la génération vidéo.
Réception et impact
L'aperçu de Sora en février 2024 a suscité un intérêt public significatif et un débat sur les implications de la vidéo générée par IA. Les critiques ont soulevé des préoccupations concernant une utilisation abusive potentielle pour la désinformation, la violation du droit d'auteur et le déplacement des professionnels créatifs. Les partisans ont souligné le potentiel de démocratisation de la production vidéo et de permettre de nouvelles formes d'expression artistique. La capacité du modèle à générer des vidéos d'une minute à partir de simples invites textuelles a été considérée comme une avancée majeure dans l'IA générative, bien que son coût computationnel et son interruption éventuelle aient soulevé des questions sur la durabilité de tels modèles.
Après la sortie de Sora 2, l'intégration de fonctionnalités de médias sociaux a suscité des comparaisons avec des plateformes existantes comme TikTok, certains observateurs notant le potentiel de création de contenu viral. Les outils de suppression de filigrane qui ont émergé peu après la sortie de Sora 2 ont souligné les défis persistants en matière d'authentification de contenu et de criminalistique numérique. La fermeture de Sora en 2026, couplée au changement d'OpenAI vers des produits d'entreprise, a marqué un retrait notable des outils d'IA destinés aux consommateurs, reflétant des tendances industrielles plus larges dans le paysage concurrentiel de l'IA.