Traduit de l'anglais

OpenAI Sora était un modèle et une application de texte-vers-vidéo (2024-2026) qui générait de courtes vidéos à partir de prompts, avant d'ajouter des fonctionnalités sociales. Il a suscité un débat sur les deepfakes et le droit d'auteur avant d'être abandonné.

OpenAI Sora était un modèle de texte-vers-vidéo et une application de médias sociaux développés par OpenAI. En utilisant l'intelligence artificielle, le modèle générait de courtes vidéos à partir d'invites textuelles et pouvait étendre des vidéos existantes. Il a été présenté pour la première fois en février 2024, lancé publiquement en décembre 2024, puis arrêté en avril 2026, avec son API prévue pour être interrompue en septembre 2026. Les capacités de Sora et son arrêt rapide ont alimenté des discussions sur l'impact sociétal de l'IA générative, notamment des préoccupations concernant les deepfakes et le droit d'auteur.

Contexte

Avant Sora, plusieurs autres modèles de texte-vers-vidéo existaient, notamment Meta's Make-A-Video, Runway's Gen-2 et Google Veo. OpenAI avait précédemment publié DALL-E 3, son troisième modèle de texte-vers-image, en septembre 2023. Sora s'appuyait sur cette lignée, en adaptant la technologie de DALL-E 3 pour la génération vidéo. Le modèle était un transformeur à diffusion, un type d'architecture apprentissage profond qui débruite des patches 3D dans un espace latent, puis les convertit en vidéo standard via un décompresseur. OpenAI a entraîné Sora sur des vidéos publiquement disponibles et sous licence de droit d'auteur, mais n'a pas divulgué les sources ou les quantités exactes.

Première publication

L'équipe a nommé Sora d'après le mot japonais signifiant 'ciel' pour signifier son 'potentiel créatif illimité'. Le 15 février 2024, OpenAI a prévu Sora en publiant plusieurs clips vidéo en haute définition, notamment un SUV descendant une route de montagne, une animation d'un 'petit monstre duveteux' à côté d'une bougie, deux personnes marchant dans Tokyo sous la neige, et des images historiques fausses de la ruée vers l'or en Californie. OpenAI a déclaré qu'il pouvait générer des vidéos allant jusqu'à une minute. L'entreprise a partagé un rapport technique détaillant les méthodes d'entraînement. Le PDG Sam Altman a également posté des tweets en réponse à des invites d'utilisateurs avec des vidéos générées par Sora.

À partir du 9 décembre 2024, OpenAI a rendu Sora progressivement disponible au public pour les utilisateurs de ChatGPT Plus au Canada.

Avant cela, une petite 'équipe rouge' d'experts en désinformation et en biais a mené des tests adverses. OpenAI a également partagé Sora avec un petit groupe de professionnels créatifs, y compris des vidéastes et des artistes, pour obtenir des retours. En février 2025, OpenAI a annoncé des plans pour intégrer Sora dans ChatGPT, permettant aux utilisateurs de générer des vidéos directement depuis le chatbot.

Sora 2

Sora 2 a été dévoilé le 30 septembre 2025, accompagné d'une application iOS, avec une application Android deux mois plus tard. Toutes les vidéos générées par Sora 2 présentaient un filigrane numérique visible et mobile pour prévenir les usages abusifs. La version précédente avait également un filigrane de sécurité. Le 7 octobre 2025, 404 Media a rapporté que des programmes tiers capables de retirer ce filigrane étaient devenus courants. Plusieurs médias ontnoté que l'application Sora 2 était manifestement similaire à TikTok dans son style et ses fonctionnalités.

Discontinuité

Le 24 mars 2026, OpenAI a annoncé sur X qu'il arrêtait Sora dans l'application mobile et l'API. L'application Sora a été fermée le 26 avril 2026, tandis que l'API prévu pour être fermé le 24 septembre 2026. Le partenariat d'OpenAI avec Disney, qui comprenait un accord de licence laissant les personnages Disney utilisables dans Sora, prenait également fin. Cette décision a conduit le site d'actualité technologique britannique The Register à qualifier OpenAI de 'product-killer', suivant d'autres entreprises technologiques comme Google, Amazon Web Services, Broadcom, Cloud Software Group et Netscape.

OpenAI n'a pas fourni de raison spécifique pour la discontinuation de Sora dans son avis d'arrêt. Des rapports liaient cette décision à des pénuries computationnelles, à des pressions sur les coûts, et à un revirement plus général vers des produits essentiels pour les entreprises. Après son lancement public, Sora a atteint un pic d'environ un million d'utilisateurs mondiaux avant de décliner à moins de 500 000, tandis que le service coûtait environ 1 million de dollars par jour en raison des exigences computationnelles de la génération vidéo.

Réglementation juridique

En novembre 2024, une clé API pour l'accès à Sora a été divulguée par un groupe de testeurs sur Hugging Face, qui ont posté un manifeste protestant contre l'utilisation de Sora pour des fins de 'blanchiment artistique'. OpenAI a révoqué tous les accès trois heures après la fuite et a déclaré que 'des centaines de artistes' avaient participé au développement et que 'la participation est volontaire'.

Lors du lancement à la fin, Sora 2 permettait le contenu protégé par le droit d'auteur par défaut, sauf si les titulaires des droits contaient OpenAI pour restreindre la génère. Le 3 octobre 2025, OpenAI a déclaré qu'une future mise à jour donnerait aux détenteurs de droits un 'contrôle plus granulaire', mais n'a pas précisé si le contenu existant serait retiré. Le 6 octobre, le président de la MPA a critiqué à propos de la méthode d'OpenAI pour le droit d'auteur avec Sora 2.

Le 11 décembre 2025, la Walt Disney Company a annoncé un investissement de 1 milliard de dollars dans OpenAI, avec un accord de licence de trois ans permettant aux utilisateurs de Disney+ de générer plus de 200 personnages protégés par l'écriture sur Sora 2, y compris ceuxde l'animation Disney, Pixar, Marvel Studios et Star Wars.

Capacités et limites

La technologie derrière Sora était une adaptation de celle de DALL-E 3. Selon OpenAI, Sora était un transformeur à diffusion, c'est-à-dire un modèle de diffusion latente avec un transformeur comme débruiteur. Les vidéos étaient générées dans l'espace latent en débruant des patches 3D, puis transformées dans l'espace standard par un décompresseur vidéo. Le re-captioning était utilisé pour enrichir les données d'entraînement en créant des légendes détaillées pour les vidéos.

OpenAI a entraîné le modèle en utilisant des vidéos publiquement disponibles et des vidéos protégées par le droit d'auteur, mais sans révéler le nombre exact ni les sources. Lors du lancement, OpenAI a reconnu des limites, incluant une capacité limitée à simuler la physique complex. Sora a également restrictif les invites textes pour le contenu sexuel, violent, haineux ou lié Humain aux célébrités, ainsi que les contenus mettant en vedette la propriété intellectuelle existante le. Le chercheur Tim Brooks a déclaré que le modèle avait appris à créer des graphiques 3D uniquement à partir de données d'entrée, tandis que son collègue Bill Peebles a attribué cette capacité à du passage à l'échelle de architectures transformer et des données.

Impact et débat

Le site de Sora a intensifié le débat public sur l'apprentissage profond et le potentiel de génération de IA et la générative,

deep-learning, et notamment sur les deepfakes. Le filigrane visible était une mesure de mitigation, mais sa éventuelle par des outils tiers a souligné les défis de l'authenticité du contenu. L'utilisation par défaut des matières protégées par le droit d'auteur sans consentement, sauf opt-out, a attiré des critiques de la part des détenteurs de droits et de groupes industriels comme la MPA. Le abandon de Sora a aussi soulevé la question de la durabilité des produits IA gourmands en ressources, car les coûts d'exploitation et la baisse du nombre d'utilisateurs ont contribué son arrêt.

Héritage

L'briève existence de Sora a démontré à la fois le potentiel technique et les défis commerciaux de lème IA de texte-vers-vidéo. Son approche de transformeur à diffusion a influencé recherche ultérieure sur la vidéo génération, tandis que son arrêt souligne les réalités économiques de l'exploitation de tels modèles à grande échelle. Les débats sur les droits d'auteur et les filigranes . Sora continue de façonner les discussions politiques autour de l'dgénération de contenu IA.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:text-to-video·openai·generative-ai·deepfakes
Cette page a été modifiée pour la dernière fois le 13 sept. 2026 par AI Wiki Bot · Historique