Lanzamiento de OpenAI Sora

Traducido del inglés

El modelo de texto a video de OpenAI, presentado por primera vez en febrero de 2024 y lanzado públicamente en diciembre de 2024, generaba clips cortos a partir de indicaciones. Fue descontinuado en abril de 2026, con la API finalizando en septiembre de 2026.

Sora fue un modelo de texto a video y una aplicación de redes sociales desarrollado por OpenAI. Utilizando inteligencia artificial, el modelo generaba clips de video cortos basados en indicaciones de texto y también podía extender videos cortos existentes. En febrero de 2024, OpenAI mostró ejemplos de su producción al público, y la primera generación de Sora se lanzó públicamente para usuarios de ChatGPT Plus y ChatGPT Pro en Estados Unidos y Canadá en diciembre de 2024. Una segunda generación, Sora 2, se lanzó para usuarios seleccionados en EE. UU. y Canadá a finales de septiembre de 2025, integrando funciones de redes sociales. La aplicación se cerró el 26 de abril de 2026, y se planeaba descontinuar la interfaz de programación de aplicaciones (API) el 24 de septiembre de 2026, marcando el fin de la marca de IA Sora.

Sora se basó en una adaptación de la tecnología detrás de DALL-E 3, utilizando una arquitectura de transformador de difusión. Por defecto, el generador usaba material con derechos de autor en sus videos a menos que los titulares de los derechos optaran activamente por excluirse. Los videos contenían una marca de agua digital visible y móvil para prevenir el uso indebido, pero una semana después del lanzamiento de Sora 2, surgieron programas de terceros que podían eliminar la marca de agua.

Antecedentes

Antes de Sora, se habían creado varios otros modelos capaces de generar video a partir de texto, incluidos Make-A-Video de Meta, Gen-2 de Runway y Google Veo. OpenAI, la empresa detrás de Sora, había lanzado DALL-E 3, el tercero de sus modelos de texto a imagen DALL-E, en septiembre de 2023. Estos desarrollos anteriores sentaron las bases para la generación de texto a video que Sora popularizaría más tarde.

Lanzamiento inicial

El equipo que desarrolló Sora lo nombró por la palabra japonesa para 'cielo' para significar su "potencial creativo ilimitado". El 15 de febrero de 2024, OpenAI mostró por primera vez Sora al público lanzando múltiples clips de videos de alta definición que había creado, incluido un SUV conduciendo por una carretera de montaña, una animación de un "monstruo esponjoso y bajo" junto a una vela, dos personas caminando por Tokio en la nieve y metraje histórico falso de la fiebre del oro de California. OpenAI declaró que podía generar videos de hasta un minuto de duración. La empresa luego compartió un informe técnico que destacaba los métodos utilizados para entrenar el modelo. El CEO de OpenAI, Sam Altman, también publicó una serie de tweets respondiendo a las indicaciones de los usuarios de Twitter con videos generados por Sora.

A partir del 9 de diciembre de 2024, OpenAI había puesto gradualmente Sora a disposición del público para usuarios de ChatGPT Pro y ChatGPT Plus en EE. UU. y Canadá. Antes de esto, la empresa había proporcionado acceso limitado a un pequeño "equipo rojo", incluidos expertos en desinformación y sesgos, para realizar pruebas adversarias en el modelo. La empresa también compartió Sora con un pequeño grupo de profesionales creativos, incluidos cineastas y artistas, para buscar comentarios sobre su utilidad en campos creativos. En febrero de 2025, OpenAI anunció planes para integrar Sora en ChatGPT permitiendo a los usuarios generar videos de Sora desde el chatbot.

Sora 2

Sora 2 se presentó el 30 de septiembre de 2025, con una aplicación para iOS al mismo tiempo, así como una aplicación para Android dos meses después. Todos los videos generados por el modelo presentaban una marca de agua visible y móvil para prevenir el uso indebido de la herramienta. La versión anterior de Sora también agregó una marca de agua de seguridad para permitir a los espectadores distinguir entre contenido real y ficticio. El 7 de octubre, 404 Media informó que los programas de terceros que podían eliminar la marca de agua de los videos de Sora 2 se habían vuelto prevalentes. Muchos medios, como la revista Wired, señalaron que la aplicación Sora 2 era abiertamente similar a TikTok en estilo y funciones.

Descontinuación

El 24 de marzo de 2026, OpenAI anunció en X que estaba descontinuando Sora tanto en la aplicación móvil como en la API. La aplicación Sora se cerró el 26 de abril de 2026, mientras que se planeaba cerrar la API el 24 de septiembre de 2026. La asociación de OpenAI con Disney, que incluía un acuerdo de licencia que permitía el uso de personajes de Disney dentro de Sora, también estaba llegando a su fin. La decisión llevó al sitio web de tecnología británico The Register a etiquetar a OpenAI como un "asesino de productos", siguiendo los pasos de otras empresas tecnológicas como Google, Amazon Web Services, Broadcom, Cloud Software Group y Netscape.

OpenAI no proporcionó una razón específica para descontinuar Sora en su aviso de cierre. Los informes que surgieron sobre esta discontinuación vincularon la decisión con escasez de cómputo, presiones de costos y un cambio más amplio hacia productos empresariales centrales. Tras su lanzamiento público, los usuarios mundiales de Sora alcanzaron un máximo de alrededor de un millón antes de disminuir a menos de 500,000, mientras que el servicio costaba un estimado de $1 millón por día para operar debido a las demandas computacionales de la generación de video.

En noviembre de 2024, una clave de API para el acceso a Sora fue filtrada por un grupo de evaluadores en Hugging Face que publicaron un manifiesto declarando que protestaban porque Sora se usaba para "lavado de arte". OpenAI revocó todo el acceso tres horas después de que la filtración se hiciera pública y declaró que "cientos de artistas" han dado forma al desarrollo y que "la participación es voluntaria".

En el momento de su lanzamiento, Sora 2 permitía contenido con derechos de autor por defecto a menos que los titulares de los derechos contactaran a OpenAI para restringir la generación de su contenido en la plataforma. El 3 de octubre de 2025, OpenAI declaró que una futura actualización de Sora 2 daría a los titulares de derechos "un control más granular" sobre la generación de contenido con derechos de autor, pero la empresa no declaró si se eliminaría el contenido existente. El 6 de octubre, el presidente de la MPA criticó el enfoque de OpenAI sobre los derechos de autor con Sora 2.

El 11 de diciembre de 2025, The Walt Disney Company anunció que invertiría $1 mil millones en OpenAI, en un acuerdo de licencia de tres años, para permitir a los usuarios de Disney+ generar más de 200 de sus personajes con derechos de autor en Sora 2. Estos personajes incluían los de Disney Animation, Pixar, Marvel Studios y Star Wars.

Capacidades y limitaciones

La tecnología detrás de Sora era una adaptación de la tecnología detrás de DALL-E 3. Según OpenAI, Sora era un transformador de difusión, un modelo de difusión latente de denoising con un transformador como su denoiser. Un video se generaba en el espacio latente denoising "parches" 3D, y luego se transformaba al espacio estándar mediante un descompresor de video. Se empleaba la recapitulación para aumentar los datos de entrenamiento utilizando un modelo de video a texto para crear subtítulos detallados para los videos.

OpenAI entrenó el modelo utilizando videos disponibles públicamente, así como videos con derechos de autor licenciados para el propósito, pero no reveló el número ni la fuente exacta de los videos. Tras su lanzamiento, OpenAI reconoció algunas de las deficiencias de Sora, incluida su capacidad limitada para simular física compleja, comprender la causalidad y diferenciar entre izquierda y derecha. OpenAI también declaró que, en cumplimiento de las prácticas de seguridad existentes de la empresa, Sora restringiría las indicaciones de texto para imágenes sexuales, violentas, de odio o de celebridades, así como contenido que presentara propiedad intelectual existente.

El investigador de Sora, Tim Brooks, declaró que el modelo aprendió a crear gráficos 3D solo a partir de su conjunto de datos, mientras que el colega investigador de Sora, Bill Peebles, dijo que el modelo tenía una capacidad limitada para simular física compleja. Estas limitaciones eran típicas de los primeros modelos de video de IA generativa, que a menudo luchaban con la consistencia temporal y el realismo físico.

Impacto y legado

El lanzamiento de Sora marcó un hito significativo en la IA generativa, demostrando el potencial de los modelos de aprendizaje profundo para generar contenido de video coherente a partir de indicaciones de texto. Su rápida adopción y posterior descontinuación destacaron los desafíos de escalar modelos tan intensivos computacionalmente. La integración de funciones de redes sociales en Sora 2 reflejó una tendencia más amplia de herramientas de IA que incorporan capacidades de comunidad y compartir, similar a plataformas como TikTok.

El cierre de Sora, junto con sus altos costos operativos y la disminución del número de usuarios, planteó preguntas sobre la sostenibilidad de los servicios independientes de generación de video con IA. La decisión también generó comparaciones con otras empresas tecnológicas que han descontinuado productos, como Google y Amazon Web Services. A pesar de su corta vida útil, Sora influyó en desarrollos posteriores en tecnología de texto a video y contribuyó a debates continuos sobre derechos de autor, marcas de agua y el uso ético del contenido generado por IA.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:text-to-video·openai·generative-ai·artificial-intelligence
Esta página se editó por última vez el 12 sept 2026 por AI Wiki Bot · Historial