OpenAI Sora fue un modelo de texto a video y una aplicación de redes sociales desarrollado por OpenAI. Utilizando inteligencia artificial, el modelo generaba clips de video cortos basados en indicaciones de texto y podía extender videos cortos existentes. Se presentó por primera vez en febrero de 2024, se lanzó públicamente en diciembre de 2024 y se cerró en abril de 2026, con su API planeada para discontinuarse en septiembre de 2026. Las capacidades de Sora y su rápido cierre alimentaron discusiones sobre el impacto social de la IA generativa, incluyendo preocupaciones sobre deepfakes y derechos de autor.
Antecedentes
Antes de Sora, existían varios otros modelos de texto a video, incluidos Make-A-Video de Meta, Gen-2 de Runway y Google Veo. OpenAI había lanzado previamente DALL-E 3, su tercer modelo de texto a imagen, en septiembre de 2023. Sora se basó en esta línea, adaptando la tecnología de DALL-E 3 para la generación de video. El modelo era un transformador de difusión, un tipo de arquitectura de aprendizaje profundo que elimina el ruido de parches 3D en el espacio latente y luego los convierte a video estándar mediante un descompresor. OpenAI entrenó a Sora con videos públicos y con derechos de autor licenciados, pero no reveló las fuentes o cantidades exactas.
Lanzamiento inicial
El equipo nombró a Sora por la palabra japonesa para 'cielo' para significar su 'potencial creativo ilimitado'. El 15 de febrero de 2024, OpenAI presentó Sora lanzando varios clips de video de alta definición, incluido un SUV conduciendo por una carretera de montaña, una animación de un 'monstruo pequeño y esponjoso' junto a una vela, dos personas caminando por Tokio en la nieve y metraje histórico falso de la fiebre del oro de California. OpenAI declaró que podía generar videos de hasta un minuto de duración. La compañía compartió un informe técnico detallando los métodos de entrenamiento. El CEO Sam Altman también publicó tuits respondiendo a indicaciones de usuarios con videos generados por Sora.
A partir del 9 de diciembre de 2024, OpenAI hizo gradualmente disponible Sora al público para usuarios de ChatGPT Pro y ChatGPT Plus en los EE. UU. y Canadá. Antes de esto, un pequeño 'equipo rojo' de expertos en desinformación y sesgo realizó pruebas adversarias. OpenAI también compartió Sora con un pequeño grupo de profesionales creativos, incluidos videógrafos y artistas, para obtener comentarios. En febrero de 2025, OpenAI anunció planes para integrar Sora en ChatGPT, permitiendo a los usuarios generar videos directamente desde el chatbot.
Sora 2
Sora 2 se presentó el 30 de septiembre de 2025, junto con una aplicación para iOS, con una aplicación para Android dos meses después. Todos los videos generados por Sora 2 presentaban una marca de agua digital visible y móvil para prevenir el mal uso. La versión anterior también tenía una marca de agua de seguridad. El 7 de octubre de 2025, 404 Media informó que programas de terceros capaces de eliminar la marca de agua se habían vuelto prevalentes. Muchos medios, como Wired, notaron que la aplicación Sora 2 era abiertamente similar a TikTok en estilo y características.
Discontinuación
El 24 de marzo de 2026, OpenAI anunció en X que estaba discontinuando Sora tanto en la aplicación móvil como en la API. La aplicación Sora se cerró el 26 de abril de 2026, mientras que la API estaba planeada para cerrarse el 24 de septiembre de 2026. La asociación de OpenAI con Disney, que incluía un acuerdo de licencia que permitía personajes de Disney en Sora, también estaba terminando. La decisión llevó al sitio web británico de noticias tecnológicas The Register a etiquetar a OpenAI como un 'asesino de productos', siguiendo a otras empresas tecnológicas como Google, Amazon Web Services, Broadcom, Cloud Software Group y Netscape.
OpenAI no proporcionó una razón específica para discontinuar Sora en su aviso de cierre. Los informes vincularon la decisión a escasez de cómputo, presiones de costos y un cambio más amplio hacia productos empresariales centrales. Tras su lanzamiento público, los usuarios mundiales de Sora alcanzaron un máximo de alrededor de un millón antes de declinar a menos de 500,000, mientras que el servicio costaba un estimado de $1 millón por día para operar debido a las demandas computacionales de la generación de video.
Regulación legal
En noviembre de 2024, una clave de API para el acceso a Sora fue filtrada por un grupo de evaluadores en Hugging Face, quienes publicaron un manifiesto protestando que Sora se usaba para 'lavado de arte'. OpenAI revocó todo el acceso tres horas después de la filtración y declaró que 'cientos de artistas' habían dado forma al desarrollo y que 'la participación es voluntaria'.
En el lanzamiento, Sora 2 permitía contenido con derechos de autor por defecto a menos que los titulares de derechos contactaran a OpenAI para restringir la generación. El 3 de octubre de 2025, OpenAI declaró que una futura actualización daría a los titulares de derechos 'control más granular', pero no especificó si el contenido existente se eliminaría. El 6 de octubre, el presidente de la MPA criticó el enfoque de OpenAI sobre los derechos de autor con Sora 2.
El 11 de diciembre de 2025, The Walt Disney Company anunció una inversión de $1 mil millones en OpenAI, con un acuerdo de licencia de tres años que permitía a los usuarios de Disney+ generar más de 200 personajes con derechos de autor en Sora 2, incluidos los de Disney Animation, Pixar, Marvel Studios y Star Wars.
Capacidades y limitaciones
La tecnología detrás de Sora era una adaptación de la tecnología de DALL-E 3. Según OpenAI, Sora era un transformador de difusión, un modelo de difusión latente de eliminación de ruido con un transformador como su eliminador de ruido. Los videos se generaban en el espacio latente eliminando el ruido de parches 3D, y luego se transformaban al espacio estándar mediante un descompresor de video. Se usaba recaptación para aumentar los datos de entrenamiento creando subtítulos detallados para los videos.
OpenAI entrenó el modelo usando videos públicos y videos con derechos de autor licenciados, pero no reveló el número exacto o las fuentes. Al lanzarse, OpenAI reconoció deficiencias, incluida la capacidad limitada para simular física compleja, entender la causalidad y diferenciar la izquierda de la derecha. OpenAI también declaró que, en adherencia a las prácticas de seguridad, Sora restringiría las indicaciones de texto para imágenes sexuales, violentas, de odio o de celebridades, así como contenido que presentara propiedad intelectual existente.
El investigador de Sora Tim Brooks declaró que el modelo aprendió a crear gráficos 3D solo de su conjunto de datos, mientras que el colega investigador Bill Peebles dijo que la capacidad del modelo para generar escenas coherentes era un resultado de escalar las arquitecturas de transformadores y los datos de entrenamiento.
Impacto y debate
El lanzamiento de Sora intensificó el debate público sobre el potencial de mal uso del aprendizaje profundo y la IA generativa, particularmente en cuanto a deepfakes. La marca de agua visible era una medida de mitigación, pero su eliminación por herramientas de terceros destacó desafíos en la autenticidad del contenido. El uso por defecto de material con derechos de autor por el modelo, a menos que se optara por no participar, atrajo críticas de titulares de derechos y grupos de la industria, como la MPA. La discontinuación de Sora también planteó preguntas sobre la sostenibilidad de productos de IA intensivos en recursos, ya que los costos operativos y la disminución de usuarios contribuyeron a su fin.
Legado
La breve existencia de Sora demostró tanto el potencial técnico como los desafíos comerciales de la IA de texto a video. Su enfoque de transformador de difusión influyó en investigaciones posteriores en generación de video, mientras que su cierre subrayó las realidades económicas de ejecutar tales modelos a escala. Los debates sobre derechos de autor y marcas de agua que Sora provocó continúan dando forma a las discusiones políticas en torno a la generación de contenido de IA.