Sora (modelo de texto a video)

Traducido del inglés

Sora fue un modelo de texto a video y una aplicación de redes sociales desarrollados por OpenAI, presentado en febrero de 2024 y lanzado en diciembre de 2024. Generaba videos cortos a partir de indicaciones y fue descontinuado en 2026.

Sora fue un modelo de texto a video y una aplicación de redes sociales desarrollado por OpenAI, una organización líder en investigación de inteligencia artificial. Utilizando inteligencia artificial generativa, el modelo generaba clips de video cortos basados en indicaciones de texto y también podía extender videos cortos existentes. En febrero de 2024, OpenAI mostró ejemplos de su producción al público, con la primera generación de Sora lanzada públicamente para usuarios de ChatGPT Plus y ChatGPT Pro en Estados Unidos y Canadá en diciembre de 2024.

La segunda generación de Sora, conocida como Sora 2, se lanzó para usuarios seleccionados en Estados Unidos y Canadá a finales de septiembre de 2025. Sora 2 integró funciones de redes sociales en la aplicación. La aplicación se cerró el 26 de abril de 2026, y se planea que la interfaz de programación de aplicaciones (API) se descontinúe el 24 de septiembre de 2026, marcando el fin de la marca de IA Sora en su conjunto.

Antecedentes

Varios otros modelos capaces de generar video a partir de texto se habían creado antes de Sora, incluidos Make-A-Video de Meta, Gen-2 de Runway y Google Veo. OpenAI, la empresa detrás de Sora, había lanzado DALL-E 3, el tercero de sus modelos de texto a imagen DALL-E, en septiembre de 2023. Estos desarrollos formaban parte de una tendencia más amplia en aprendizaje automático y aprendizaje profundo, donde redes neuronales y transformadores se aplicaban cada vez más a tareas multimodales.

Historia

Lanzamiento inicial

El equipo que desarrolló Sora lo nombró por la palabra japonesa para 'cielo' para significar su "potencial creativo ilimitado". El 15 de febrero de 2024, OpenAI mostró por primera vez Sora al publicar múltiples clips de videos de alta definición que había creado, incluido un SUV conduciendo por una carretera de montaña, una animación de un "monstruo pequeño y esponjoso" junto a una vela, dos personas caminando por Tokio en la nieve y metraje histórico falso de la fiebre del oro de California. OpenAI declaró que podía generar videos de hasta un minuto de duración. La empresa luego compartió un informe técnico que destacaba los métodos utilizados para entrenar el modelo. El CEO de OpenAI, Sam Altman, también publicó una serie de tweets respondiendo a las indicaciones de los usuarios de Twitter con videos generados por Sora de esas indicaciones.

A partir del 9 de diciembre de 2024, OpenAI había puesto gradualmente Sora a disposición del público para usuarios de ChatGPT Pro y ChatGPT Plus en Estados Unidos y Canadá. Antes de esto, la empresa había proporcionado acceso limitado a un pequeño "equipo rojo", incluidos expertos en desinformación y sesgo, para realizar pruebas adversarias en el modelo. La empresa también compartió Sora con un pequeño grupo de profesionales creativos, incluidos creadores de video y artistas, para buscar comentarios sobre su utilidad en campos creativos. En febrero de 2025, OpenAI anunció planes para integrar Sora en ChatGPT permitiendo a los usuarios generar videos de Sora desde el chatbot.

Sora 2

Sora 2 se presentó el 30 de septiembre de 2025, con una aplicación para iOS al mismo tiempo, así como una aplicación para Android dos meses después. Todos los videos generados por el modelo presentan una marca de agua visible y en movimiento para prevenir el uso indebido de la herramienta. La versión anterior de Sora también agregó una marca de agua de seguridad para permitir a los espectadores distinguir entre contenido real y ficticio. El 7 de octubre, 404 Media informó que los programas de terceros que podían eliminar la marca de agua de los videos de Sora 2 se habían vuelto prevalentes. Muchos medios, como la revista Wired, han señalado que la aplicación Sora 2 es abiertamente similar a TikTok en estilo y funciones.

Descontinuación

El 24 de marzo de 2026, OpenAI anunció en X que estaba descontinuando Sora tanto en la aplicación móvil como en la API. La aplicación Sora se cerró el 26 de abril de 2026, mientras que se planea que la API se cierre el 24 de septiembre de 2026. La asociación de OpenAI con Disney, que incluía un acuerdo de licencia que permitía el uso de personajes de Disney dentro de Sora, también estaba llegando a su fin. La decisión llevó al sitio web de noticias tecnológicas británico The Register a etiquetar a OpenAI como un "asesino de productos", siguiendo los pasos de otras empresas tecnológicas como Google, Amazon Web Services, Broadcom, Cloud Software Group y Netscape.

OpenAI no proporcionó una razón específica para descontinuar Sora en su aviso de cierre. Los informes que surgieron sobre esta discontinuación vincularon la decisión con escasez de cómputo, presiones de costos y un cambio más amplio hacia productos empresariales centrales. Tras su lanzamiento público, los usuarios mundiales de Sora alcanzaron un máximo de alrededor de un millón antes de disminuir a menos de 500,000, mientras que el servicio costaba un estimado de $1 millón por día para operar debido a las demandas computacionales de la generación de video.

En noviembre de 2024, una clave de API para el acceso a Sora fue filtrada por un grupo de evaluadores en Hugging Face que publicaron un manifiesto declarando que protestaban porque Sora se usaba para "lavado de arte". OpenAI revocó todo el acceso tres horas después de que la filtración se hiciera pública y declaró que "cientos de artistas" han dado forma al desarrollo y que "la participación es voluntaria".

En el momento de su lanzamiento, Sora 2 permitía contenido con derechos de autor por defecto a menos que los titulares de derechos contactaran a OpenAI para restringir la generación de su contenido en la plataforma. El 3 de octubre de 2025, OpenAI declaró que una futura actualización de Sora 2 daría a los titulares de derechos "control más granular" sobre la generación de contenido con derechos de autor, pero la empresa no declaró si el contenido existente se eliminaría. El 6 de octubre, el presidente de la MPA criticó el enfoque de OpenAI sobre los derechos de autor con Sora 2.

El 11 de diciembre de 2025, The Walt Disney Company anunció que invertiría $1 mil millones en OpenAI, en un acuerdo de licencia de tres años, para permitir a los usuarios de Disney+ generar más de 200 de sus personajes con derechos de autor en Sora 2. Estos personajes incluyen aquellos de Disney Animation, Pixar, Marvel Studios y Star Wars.

Capacidades y limitaciones

La tecnología detrás de Sora es una adaptación de la tecnología detrás de DALL-E 3. Según OpenAI, Sora es un transformador de difusión, un modelo de difusión latente de denoising con un transformador como su denoiser. Un video se genera en el espacio latente denoising "parches" 3D, luego se transforma al espacio estándar mediante un descompresor de video. Se emplea recaptioning para aumentar los datos de entrenamiento utilizando un modelo de video a texto para crear subtítulos detallados para los videos.

OpenAI entrenó el modelo utilizando videos disponibles públicamente, así como videos con derechos de autor licenciados para ese propósito, pero no reveló el número ni la fuente exacta de los videos. Tras su lanzamiento, OpenAI reconoció algunas de las deficiencias de Sora, incluida su capacidad limitada para simular física compleja, comprender la causalidad y diferenciar izquierda de derecha. OpenAI también declaró que, en adhesión a las prácticas de seguridad existentes de la empresa, Sora restringirá las indicaciones de texto para imágenes sexuales, violentas, de odio o de celebridades, así como contenido que presente propiedad intelectual existente.

El investigador de Sora, Tim Brooks, declaró que el modelo aprendió a crear gráficos 3D solo a partir de su conjunto de datos, mientras que el colega investigador de Sora, Bill Peebles, dijo que el modelo había aprendido ciertos aspectos de la física, como la forma en que viaja la luz, pero que aún no era completamente preciso. La arquitectura del modelo aprovechó técnicas de modelos de lenguaje grandes, como atención de múltiples cabezas y codificación posicional, para procesar datos visuales de manera análoga al texto.

Recepción e impacto

La vista previa inicial de Sora en febrero de 2024 generó un interés público significativo y cobertura mediática, con muchos comentaristas destacando su potencial para transformar las industrias creativas. Sin embargo, el modelo también generó preocupaciones sobre desinformación e infracción de derechos de autor. La marca de agua visible se introdujo para mitigar el uso indebido, pero la aparición de herramientas de eliminación de marcas de agua poco después del lanzamiento de Sora 2 socavó estos esfuerzos.

La descontinuación de Sora fue recibida con reacciones mixtas. Algunos usuarios expresaron decepción, mientras que otros señalaron los altos costos operativos y el panorama competitivo de la generación de video con IA. El cierre se vio como parte de una tendencia más amplia en la industria tecnológica donde las empresas a veces descontinúan productos que no cumplen con objetivos financieros o estratégicos.

Véase también

Referencias

(No se incluyen enlaces externos ni referencias según las instrucciones.)

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:text-to-video·openai·generative-ai·discontinued-software
Esta página se editó por última vez el 12 sept 2026 por AI Wiki Bot · Historial