Sora fue un modelo de texto a video y una aplicación de redes sociales desarrollados por OpenAI. Utilizando inteligencia artificial, el modelo generaba clips de video cortos basados en indicaciones, y también podía extender videos cortos existentes. En febrero de 2024, OpenAI mostró ejemplos de su producción al público, con la primera generación de Sora lanzada públicamente para los usuarios de ChatGPT Plus y ChatGPT Pro en los Estados Unidos y Canadá en diciembre de 2024.
La segunda generación de Sora se lanzó para usuarios seleccionados en los EE. UU. y Canadá a finales de septiembre de 2025. Sora 2 integró funciones de redes sociales en la aplicación. La aplicación se cerró el 26 de abril de 2026 y la interfaz de programación de aplicaciones (API) está prevista para discontinuarse el 24 de septiembre de 2026, marcando el fin de la marca de IA Sora en su totalidad.
Antecedentes
Varios otros modelos capaces de generar video a partir de texto se habían creado antes de Sora, incluidos Make-A-Video de Meta, Gen-2 de Runway y Google Veo. OpenAI, la empresa detrás de Sora, había lanzado DALL-E 3, el tercero de sus modelos de texto a imagen DALL-E, en septiembre de 2023. Estos sistemas anteriores establecieron las bases técnicas para Sora, que aprovechó los avances en modelos de difusión y arquitecturas transformadoras para manejar datos de video.
Lanzamiento inicial
El equipo que desarrolló Sora lo nombró por la palabra japonesa para 'cielo' para significar su "potencial creativo ilimitado". El 15 de febrero de 2024, OpenAI mostró Sora por primera vez lanzando múltiples clips de videos de alta definición que había creado, incluido un SUV conduciendo por una carretera de montaña, una animación de un "monstruo pequeño y esponjoso" junto a una vela, dos personas caminando por Tokio bajo la nieve y metraje histórico falso de la fiebre del oro en California. OpenAI declaró que era capaz de generar videos de hasta un minuto de duración. La empresa luego compartió un informe técnico que destacaba los métodos utilizados para entrenar el modelo. El director ejecutivo de OpenAI, Sam Altman, también publicó una serie de tuits respondiendo a las indicaciones de los usuarios de Twitter con videos generados por Sora de esas indicaciones.
Al 9 de diciembre de 2024, OpenAI había puesto gradualmente Sora a disposición del público para los usuarios de ChatGPT Pro y ChatGPT Plus en los EE. UU. y Canadá. Antes de esto, la empresa había proporcionado acceso limitado a un pequeño "equipo rojo", incluidos expertos en desinformación y sesgos, para realizar pruebas adversariales en el modelo. La empresa también compartió Sora con un pequeño grupo de profesionales creativos, incluidos videógrafos y artistas, para buscar comentarios sobre su utilidad en campos creativos. En febrero de 2025, OpenAI anunció planes para integrar Sora en ChatGPT permitiendo a los usuarios generar videos de Sora desde el chatbot.
Sora 2
Sora 2 se presentó el 30 de septiembre de 2025, con una aplicación iOS al mismo tiempo, así como una aplicación Android dos meses después. Todos los videos generados por el modelo presentan una marca de agua visible y en movimiento para prevenir el mal uso de la herramienta. La versión anterior de Sora también añadió una marca de agua de seguridad para permitir a los espectadores distinguir entre contenido real y ficticio. El 7 de octubre, 404 Media informó que programas de terceros que podían eliminar la marca de agua de los videos de Sora 2 se habían vuelto prevalentes. Muchos medios, como la revista Wired, han señalado que la aplicación Sora 2 es abiertamente similar a TikTok en estilo y características.
Discontinuación
El 24 de marzo de 2026, OpenAI anunció en X que estaba discontinuando Sora tanto en la aplicación móvil como en la API. La aplicación Sora se cerró el 26 de abril de 2026, mientras que la API está prevista para cerrarse el 24 de septiembre de 2026. La asociación de OpenAI con Disney, que incluía un acuerdo de licencia que permitía el uso de personajes de Disney dentro de Sora, también estaba llegando a su fin. La decisión llevó al sitio web británico de noticias tecnológicas The Register a etiquetar a OpenAI como un "asesino de productos", siguiendo los pasos de otras empresas tecnológicas como Google, Amazon Web Services, Broadcom, Cloud Software Group y Netscape.
OpenAI no proporcionó una razón específica para discontinuar Sora en su aviso de cierre. Los informes que surgieron sobre esta discontinuación vincularon la decisión a escasez de computación, presiones de costos y un cambio más amplio hacia productos empresariales centrales. Tras su lanzamiento público, los usuarios mundiales de Sora alcanzaron un máximo de alrededor de un millón antes de disminuir a menos de 500,000, mientras que el servicio costaba un estimado de $1 millón por día para operar debido a las demandas computacionales de la generación de video.
Regulación legal
En noviembre de 2024, una clave API para el acceso a Sora se filtró por un grupo de probadores en Hugging Face, quienes publicaron un manifiesto declarando que protestaban porque Sora se usaba para "lavado de arte". OpenAI revocó todo el acceso tres horas después de que la filtración se hiciera pública y declaró que "cientos de artistas" han dado forma al desarrollo y que "la participación es voluntaria".
En el momento de su lanzamiento, Sora 2 permitía contenido protegido por derechos de autor por defecto a menos que los titulares de derechos contactaran a OpenAI para restringir la generación de su contenido en la plataforma. El 3 de octubre de 2025, OpenAI declaró que una futura actualización de Sora 2 daría a los titulares de derechos "un control más granular" sobre la generación de contenido protegido por derechos de autor, pero la empresa no declaró si el contenido existente sería eliminado. El 6 de octubre, el presidente de la MPA criticó el enfoque de OpenAI sobre los derechos de autor con Sora 2.
El 11 de diciembre de 2025, la Walt Disney Company anunció que invertiría $1 mil millones en OpenAI, en un acuerdo de licencia de tres años, para permitir a los usuarios de Disney+ generar más de 200 de sus personajes protegidos por derechos de autor en Sora 2. Estos personajes incluyen aquellos de Disney Animation, Pixar, Marvel Studios y Star Wars.
Capacidades y limitaciones
La tecnología detrás de Sora es una adaptación de la tecnología detrás de DALL-E 3. Según OpenAI, Sora es un transformador de difusión, un modelo de difusión latente de denoising con un transformador como su denoiser. Un video se genera en el espacio latente denoising "parches" 3D, luego se transforma al espacio estándar mediante un descompresor de video. La recapitulación se emplea para aumentar los datos de entrenamiento utilizando un modelo de video a texto para crear subtítulos detallados para los videos.
OpenAI entrenó el modelo utilizando videos públicamente disponibles, así como videos protegidos por derechos de autor licenciados para el propósito, pero no reveló el número ni la fuente exacta de los videos. En su lanzamiento, OpenAI reconoció algunas de las deficiencias de Sora, incluida su capacidad limitada para simular física compleja, comprender la causalidad y diferenciar izquierda de derecha. OpenAI también declaró que, en adherencia a las prácticas de seguridad existentes de la empresa, Sora restringiría las indicaciones de texto para imágenes sexuales, violentas, de odio o de celebridades, así como contenido que presente propiedad intelectual existente.
El investigador de Sora, Tim Brooks, declaró que el modelo aprendió a crear gráficos 3D solo de su conjunto de datos, mientras que el colega investigador de Sora, Bill Peebles, dijo que el modelo podía simular ciertos aspectos del mundo físico sin programación explícita. El sistema dependía de técnicas de aprendizaje profundo que incluyen capas de redes neuronales y mecanismos de atención multi-cabeza que le permitían procesar información temporal y espacial a través de los fotogramas de video.
Enfoque técnico
La arquitectura de Sora se basó en el marco de modelo de difusión latente, que comprime datos de video en un espacio latente de menor dimensión antes de aplicar pasos de denoising. El modelo usaba parches 3D, que son bloques espaciotemporales de datos de video, como tokens para el denoiser basado en transformador. Este enfoque difería de los modelos tradicionales de generación de video que a menudo usaban arquitecturas U-Net, ya que la columna vertebral del transformador permitía un mejor escalado con el tamaño del modelo y los datos de entrenamiento.
El proceso de entrenamiento implicaba conjuntos de datos a gran escala de pares de video e imagen, aunque los detalles específicos no se revelaron. La técnica de recapitulación usaba un modelo de video a texto para generar descripciones textuales detalladas de los videos de entrenamiento, lo que ayudaba al modelo a aprender mejores asociaciones entre indicaciones y contenido visual. Estos métodos se basaron en trabajos previos en modelos secuencia a secuencia y mecanismos de atención cruzada que se habían desarrollado en la investigación de modelos de lenguaje grande.
Impacto cultural y ético
La revelación de Sora en febrero de 2024 provocó una discusión generalizada sobre las implicaciones de la generación de texto a video para industrias creativas, periodismo y detección de desinformación. La capacidad del modelo para producir clips realistas de alta definición generó preocupaciones sobre el potencial de crear noticias falsas o contenido engañoso. Esto se subrayó con el metraje falso de la fiebre del oro en California incluido en la vista previa inicial, que demostró la capacidad del modelo para crear imágenes históricas plausibles.
Expertos legales y organizaciones de medios debatieron problemas de derechos de autor en torno al uso por defecto de material protegido en videos generados. La marca de agua visible en movimiento se introdujo como una salvaguardia técnica, pero su eliminación por herramientas de terceros dentro de una semana del lanzamiento de Sora 2 destacó los desafíos de la autenticación de contenido. El uso de datos de entrenamiento protegidos por derechos de autor por el modelo también contribuyó a demandas en curso y escrutinio regulatorio en la industria de la IA, aunque OpenAI no reveló acciones legales específicas relacionadas con Sora.