Sora (modèle texte-vers-vidéo)

Traduit de l'anglais

Sora était un modèle de texte-vers-vidéo et une application de médias sociaux développés par OpenAI, présenté en février 2024 et publié en décembre 2024. Il générait de courtes vidéos à partir de prompts et a été interrompu en 2026.

Sora était un modèle de texte-vers-vidéo et une application de médias sociaux développés par OpenAI, une organisation de premier plan dans la recherche en intelligence artificielle. Utilisant l'intelligence artificielle générative, le modèle générait de courtes vidéos à partir de prompts textuels et pouvait également prolonger des vidéos courtes existantes. En février 2024, OpenAI a présenté des exemples de ses sorties au public, avec la première génération de Sora publiée publiquement pour les utilisateurs de ChatGPT Plus et ChatGPT Pro aux États-Unis et au Canada en décembre 2024.

La deuxième génération de Sora, connue sous le nom de Sora 2, a été publiée pour certains utilisateurs aux États-Unis et au Canada à la fin de septembre 2025. Sora 2 a intégré des fonctionnalités de médias sociaux dans l'application. L'application a été fermée le 26 avril 2026, et l'interface de programmation d'application (API) devrait être interrompue le 24 septembre 2026, marquant la fin de la marque Sora AI dans son ensemble.

Contexte

Plusieurs autres modèles capables de générer des vidéos à partir de texte avaient été créés avant Sora, notamment Make-A-Video de Meta, Gen-2 de Runway et Google Veo. OpenAI, la société derrière Sora, avait publié DALL-E 3, le troisième de ses modèles de texte-vers-image DALL-E, en septembre 2023. Ces développements s'inscrivaient dans une tendance plus large du apprentissage automatique et du apprentissage profond, où les réseaux de neurones et les transformateurs étaient de plus en plus appliqués à des tâches multimodales.

Histoire

Première publication

L'équipe qui a développé Sora l'a nommé d'après le mot japonais pour « ciel » afin de signifier son « potentiel créatif illimité ». Le 15 février 2024, OpenAI a présenté Sora pour la première fois en publiant plusieurs clips de vidéos haute définition qu'il avait créées, notamment un SUV roulant sur une route de montagne, une animation d'un « monstre poilu et court » à côté d'une bougie, deux personnes marchant dans Tokyo sous la neige et de fausses images historiques de la ruée vers l'or en Californie. OpenAI a déclaré qu'il était capable de générer des vidéos d'une durée maximale d'une minute. La société a ensuite partagé un rapport technique mettant en évidence les méthodes utilisées pour entraîner le modèle. Le PDG d'OpenAI, Sam Altman, a également publié une série de tweets répondant aux prompts des utilisateurs de Twitter avec des vidéos générées par Sora.

À partir du 9 décembre 2024, OpenAI avait progressivement rendu Sora disponible au public pour les utilisateurs de ChatGPT Pro et ChatGPT Plus aux États-Unis et au Canada. Avant cela, la société avait fourni un accès limité à une petite « équipe rouge », comprenant des experts en désinformation et en biais, pour effectuer des tests contradictoires sur le modèle. La société a également partagé Sora avec un petit groupe de professionnels créatifs, notamment des créateurs de vidéos et des artistes, pour solliciter des retours sur son utilité dans les domaines créatifs. En février 2025, OpenAI a annoncé son intention d'intégrer Sora dans ChatGPT en permettant aux utilisateurs de générer des vidéos Sora à partir du chatbot.

Sora 2

Sora 2 a été dévoilé le 30 septembre 2025, avec une application iOS en même temps, ainsi qu'une application Android deux mois plus tard. Toutes les vidéos générées par le modèle présentent un filigrane visible et animé pour prévenir une utilisation abusive de l'outil. La version précédente de Sora avait également ajouté un filigrane de sécurité pour permettre aux spectateurs de distinguer le contenu réel du contenu fictif. Le 7 octobre, 404 Media a rapporté que des programmes tiers capables de supprimer le filigrane des vidéos Sora 2 étaient devenus courants. De nombreux médias, comme le magazine Wired, ont noté que l'application Sora 2 est ouvertement similaire à TikTok dans son style et ses fonctionnalités.

Interruption

Le 24 mars 2026, OpenAI a annoncé sur X qu'il interrompait Sora à la fois dans l'application mobile et l'API. L'application Sora a été fermée le 26 avril 2026, tandis que l'API devrait être fermée le 24 septembre 2026. Le partenariat d'OpenAI avec Disney, qui comprenait un accord de licence permettant d'utiliser les personnages Disney dans Sora, touchait également à sa fin. La décision a incité le site d'actualités technologiques britannique The Register à qualifier OpenAI de « tueur de produits », suivant les traces d'autres entreprises technologiques comme Google, Amazon Web Services, Broadcom, Cloud Software Group et Netscape.

OpenAI n'a pas fourni de raison spécifique pour l'interruption de Sora dans son avis de fermeture. Les rapports qui ont émergé concernant cette interruption ont lié la décision à des pénuries de calcul, des pressions sur les coûts et un changement plus large vers des produits d'entreprise de base. Après son lancement public, les utilisateurs mondiaux de Sora ont atteint un pic d'environ un million avant de décliner à moins de 500 000, tandis que le service coûtait environ 1 million de dollars par jour à exploiter en raison des exigences computationnelles de la génération vidéo.

Réglementation légale

En novembre 2024, une clé API pour l'accès à Sora a été divulguée par un groupe de testeurs sur Hugging Face qui ont publié un manifeste déclarant qu'ils protestaient contre l'utilisation de Sora pour le « blanchiment artistique ». OpenAI a révoqué tout accès trois heures après la divulgation publique et a déclaré que « des centaines d'artistes » ont façonné le développement et que « la participation est volontaire ».

Au moment de son lancement, Sora 2 permettait le contenu protégé par le droit d'auteur par défaut, sauf si les titulaires de droits contactaient OpenAI pour restreindre la génération de leur contenu sur la plateforme. Le 3 octobre 2025, OpenAI a déclaré qu'une future mise à jour de Sora 2 donnerait aux titulaires de droits « un contrôle plus granulaire » sur la génération de contenu protégé, mais la société n'a pas précisé si le contenu existant serait supprimé. Le 6 octobre, le président de la MPA a critiqué l'approche d'OpenAI en matière de droit d'auteur avec Sora 2.

Le 11 décembre 2025, la Walt Disney Company a annoncé qu'elle investirait 1 milliard de dollars dans OpenAI, dans le cadre d'un accord de licence de trois ans, pour permettre aux utilisateurs de Disney+ de générer plus de 200 de ses personnages protégés par le droit d'auteur sur Sora 2. Ces personnages incluent ceux de Disney Animation, Pixar, Marvel Studios et Star Wars.

Capacités et limites

La technologie derrière Sora est une adaptation de celle derrière DALL-E 3. Selon OpenAI, Sora est un transformateur de diffusion, un modèle de diffusion latente de débruitage avec un transformateur comme débruiteur. Une vidéo est générée dans l'espace latent en débruitant des « patchs » 3D, puis transformée en espace standard par un décompresseur vidéo. Le recaptioning est utilisé pour augmenter les données d'entraînement en utilisant un modèle vidéo-à-texte pour créer des légendes détaillées pour les vidéos.

OpenAI a entraîné le modèle en utilisant des vidéos publiquement disponibles ainsi que des vidéos protégées par le droit d'auteur sous licence à cette fin, mais n'a pas révélé le nombre ou la source exacte des vidéos. Lors de sa publication, OpenAI a reconnu certaines lacunes de Sora, notamment sa capacité limitée à simuler la physique complexe, à comprendre la causalité et à différencier la gauche de la droite. OpenAI a également déclaré que, conformément aux pratiques de sécurité existantes de la société, Sora restreindra les prompts textuels pour les images sexuelles, violentes, haineuses ou de célébrités, ainsi que le contenu présentant une propriété intellectuelle existante.

Le chercheur de Sora, Tim Brooks, a déclaré que le modèle avait appris à créer des graphiques 3D à partir de son ensemble de données seul, tandis que son collègue chercheur de Sora, Bill Peebles, a déclaré que le modèle avait appris certains aspects de la physique, comme la façon dont la lumière se propage, mais qu'il n'était pas encore entièrement précis. L'architecture du modèle s'appuyait sur des techniques des grands modèles de langage, telles que l'attention multi-têtes et l'encodage positionnel, pour traiter les données visuelles de manière analogue au texte.

Réception et impact

La première présentation de Sora en février 2024 a généré un intérêt public et une couverture médiatique significatifs, de nombreux commentateurs soulignant son potentiel à transformer les industries créatives. Cependant, le modèle a également soulevé des préoccupations concernant la désinformation et la violation du droit d'auteur. Le filigrane visible a été introduit pour atténuer les abus, mais l'émergence d'outils de suppression de filigrane peu après la publication de Sora 2 a compromis ces efforts.

L'interruption de Sora a été accueillie avec des réactions mitigées. Certains utilisateurs ont exprimé leur déception, tandis que d'autres ont noté les coûts opérationnels élevés et le paysage concurrentiel de la génération vidéo par IA. La fermeture a été perçue comme faisant partie d'une tendance plus large dans l'industrie technologique où les entreprises interrompent parfois des produits qui ne répondent pas aux objectifs financiers ou stratégiques.

Voir aussi

Références

(Aucun lien externe ou référence n'est inclus conformément aux instructions.)

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:text-to-video·openai·generative-ai·discontinued-software
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique