Lancement d'OpenAI Sora

Traduit de l'anglais

Le modèle texte-vers-vidéo d'OpenAI, présenté pour la première fois en février 2024 et lancé publiquement en décembre 2024, générait de courts clips à partir de prompts. Il a été abandonné en avril 2026, avec la fin de l'API en septembre 2026.

Sora était un modèle de texte-vers-vidéo et une application de médias sociaux développés par OpenAI. Grâce à l'intelligence artificielle, le modèle générait de courts clips vidéo à partir de prompts textuels et pouvait également prolonger des vidéos courtes existantes. En février 2024, OpenAI a présenté des exemples de ses résultats au public, et la première génération de Sora a été publiée publiquement pour les utilisateurs de ChatGPT Plus et ChatGPT Pro aux États-Unis et au Canada en décembre 2024. Une deuxième génération, Sora 2, a été diffusée à des utilisateurs sélectionnés aux États-Unis et au Canada à la fin de septembre 2025, intégrant des fonctionnalités de médias sociaux. L'application a été fermée le 26 avril 2026, et l'interface de programmation d'application (API) devait être abandonnée le 24 septembre 2026, marquant la fin de la marque IA Sora.

Sora reposait sur une adaptation de la technologie derrière DALL-E 3, utilisant une architecture de transformateur à diffusion. Par défaut, le générateur utilisait du matériel protégé par le droit d'auteur dans ses vidéos, sauf si les titulaires des droits choisissaient activement de se retirer. Les vidéos contenaient un filigrane numérique visible et mobile pour prévenir les abus, mais une semaine après la sortie de Sora 2, des programmes tiers capables de supprimer le filigrane sont devenus disponibles.

Contexte

Avant Sora, plusieurs autres modèles capables de générer des vidéos à partir de texte avaient été créés, notamment Make-A-Video de Meta, Gen-2 de Runway et Google Veo. OpenAI, l'entreprise derrière Sora, avait publié DALL-E 3, le troisième de ses modèles texte-vers-image DALL-E, en septembre 2023. Ces développements antérieurs ont jeté les bases de la génération de vidéos à partir de texte que Sora populariserait plus tard.

Première diffusion

L'équipe qui a développé Sora l'a nommé d'après le mot japonais pour « ciel » afin de signifier son « potentiel créatif illimité ». Le 15 février 2024, OpenAI a présenté Sora pour la première fois en publiant plusieurs clips de vidéos haute définition qu'il avait créées, notamment un SUV roulant sur une route de montagne, une animation d'un « monstre duveteux court » à côté d'une bougie, deux personnes marchant dans Tokyo sous la neige et de fausses images historiques de la ruée vers l'or en Californie. OpenAI a déclaré qu'il était capable de générer des vidéos d'une durée allant jusqu'à une minute. L'entreprise a ensuite partagé un rapport technique mettant en évidence les méthodes utilisées pour entraîner le modèle. Le PDG d'OpenAI, Sam Altman, a également publié une série de tweets répondant aux prompts des utilisateurs de Twitter avec des vidéos générées par Sora.

À partir du 9 décembre 2024, OpenAI avait progressivement rendu Sora disponible au public pour les utilisateurs de ChatGPT Pro et ChatGPT Plus aux États-Unis et au Canada. Avant cela, l'entreprise avait fourni un accès limité à une petite « équipe rouge », comprenant des experts en désinformation et en biais, pour effectuer des tests contradictoires sur le modèle. L'entreprise a également partagé Sora avec un petit groupe de professionnels créatifs, notamment des vidéastes et des artistes, pour solliciter des retours sur son utilité dans les domaines créatifs. En février 2025, OpenAI a annoncé son intention d'intégrer Sora dans ChatGPT en permettant aux utilisateurs de générer des vidéos Sora à partir du chatbot.

Sora 2

Sora 2 a été dévoilé le 30 septembre 2025, avec une application iOS en même temps, ainsi qu'une application Android deux mois plus tard. Toutes les vidéos générées par le modèle comportaient un filigrane visible et mobile pour prévenir les abus de l'outil. La version précédente de Sora avait également ajouté un filigrane de sécurité pour permettre aux spectateurs de distinguer le contenu réel du contenu fictif. Le 7 octobre, 404 Media a rapporté que des programmes tiers capables de supprimer le filigrane des vidéos Sora 2 étaient devenus courants. De nombreux médias, comme le magazine Wired, ont noté que l'application Sora 2 était ouvertement similaire à TikTok dans son style et ses fonctionnalités.

Abandon

Le 24 mars 2026, OpenAI a annoncé sur X qu'il abandonnait Sora à la fois dans l'application mobile et dans l'API. L'application Sora a été fermée le 26 avril 2026, tandis que l'API devait être fermée le 24 septembre 2026. Le partenariat d'OpenAI avec Disney, qui comprenait un accord de licence permettant l'utilisation de personnages Disney dans Sora, touchait également à sa fin. Cette décision a incité le site d'actualités technologiques britannique The Register à qualifier OpenAI de « tueur de produits », suivant les traces d'autres entreprises technologiques telles que Google, Amazon Web Services, Broadcom, Cloud Software Group et Netscape.

OpenAI n'a pas fourni de raison spécifique pour l'abandon de Sora dans son avis de fermeture. Des rapports émergents concernant cet abandon ont lié la décision à des pénuries de calcul, à des pressions sur les coûts et à un virage plus large vers des produits d'entreprise de base. Après son lancement public, les utilisateurs mondiaux de Sora ont culminé à environ un million avant de décliner à moins de 500 000, tandis que le service coûtait environ 1 million de dollars par jour à exploiter en raison des exigences computationnelles de la génération vidéo.

Réglementation légale

En novembre 2024, une clé API pour l'accès à Sora a été divulguée par un groupe de testeurs sur Hugging Face, qui ont publié un manifeste déclarant qu'ils protestaient contre l'utilisation de Sora pour du « blanchiment artistique ». OpenAI a révoqué tout accès trois heures après la divulgation publique et a déclaré que « des centaines d'artistes » ont façonné le développement et que « la participation est volontaire ».

Au moment de son lancement, Sora 2 autorisait le contenu protégé par le droit d'auteur par défaut, sauf si les titulaires des droits contactaient OpenAI pour restreindre la génération de leur contenu sur la plateforme. Le 3 octobre 2025, OpenAI a déclaré qu'une future mise à jour de Sora 2 donnerait aux titulaires des droits « un contrôle plus granulaire » sur la génération de contenu protégé, mais l'entreprise n'a pas précisé si le contenu existant serait supprimé. Le 6 octobre, le président de la MPA a critiqué l'approche d'OpenAI en matière de droit d'auteur avec Sora 2.

Le 11 décembre 2025, la Walt Disney Company a annoncé qu'elle investirait 1 milliard de dollars dans OpenAI, dans le cadre d'un accord de licence de trois ans, pour permettre aux utilisateurs de Disney+ de générer plus de 200 de ses personnages protégés par le droit d'auteur sur Sora 2. Ces personnages comprenaient ceux de Disney Animation, Pixar, Marvel Studios et Star Wars.

Capacités et limites

La technologie derrière Sora était une adaptation de celle derrière DALL-E 3. Selon OpenAI, Sora était un transformateur à diffusion, un modèle de diffusion latente avec débruitage utilisant un transformateur comme débruteur. Une vidéo était générée dans l'espace latent en débruitant des « patchs » 3D, puis transformée en espace standard par un décompresseur vidéo. La recaptioning était utilisée pour augmenter les données d'entraînement en utilisant un modèle vidéo-vers-texte pour créer des légendes détaillées pour les vidéos.

OpenAI a entraîné le modèle en utilisant des vidéos publiquement disponibles ainsi que des vidéos protégées par le droit d'auteur sous licence à cette fin, mais n'a pas révélé le nombre ni la source exacte des vidéos. Lors de sa sortie, OpenAI a reconnu certaines lacunes de Sora, notamment sa capacité limitée à simuler la physique complexe, à comprendre la causalité et à différencier la gauche de la droite. OpenAI a également déclaré que, conformément aux pratiques de sécurité existantes de l'entreprise, Sora restreindrait les prompts textuels pour les images sexuelles, violentes, haineuses ou de célébrités, ainsi que le contenu présentant une propriété intellectuelle existante.

Le chercheur de Sora, Tim Brooks, a déclaré que le modèle avait appris à créer des graphiques 3D à partir de son ensemble de données seul, tandis que son collègue chercheur de Sora, Bill Peebles, a déclaré que le modèle avait une capacité limitée à simuler la physique complexe. Ces limitations étaient typiques des premiers modèles vidéo IA générative, qui avaient souvent du mal avec la cohérence temporelle et le réalisme physique.

Impact et héritage

La sortie de Sora a marqué une étape importante dans l'IA générative, démontrant le potentiel des modèles de apprentissage profond à générer un contenu vidéo cohérent à partir de prompts textuels. Son adoption rapide et son abandon ultérieur ont mis en évidence les défis liés à la mise à l'échelle de tels modèles intensifs en calcul. L'intégration de fonctionnalités de médias sociaux dans Sora 2 reflétait une tendance plus large des outils d'IA à incorporer des capacités communautaires et de partage, similaires à des plateformes comme TikTok.

La fermeture de Sora, ainsi que ses coûts opérationnels élevés et la baisse du nombre d'utilisateurs, a soulevé des questions sur la durabilité des services autonomes de génération vidéo par IA. La décision a également suscité des comparaisons avec d'autres entreprises technologiques ayant abandonné des produits, comme Google et Amazon Web Services. Malgré sa courte durée de vie, Sora a influencé les développements ultérieurs dans la technologie texte-vers-vidéo et a contribué aux débats en cours sur le droit d'auteur, le filigrane et l'utilisation éthique du contenu généré par IA.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:text-to-video·openai·generative-ai·artificial-intelligence
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique