Sora febrero 2024

Traducido del inglés

El modelo de texto a video Sora de OpenAI, presentado en febrero de 2024, generaba videos de un minuto a partir de indicaciones. Se lanzó públicamente en diciembre de 2024, publicó Sora 2 en septiembre de 2025 y se discontinuó en abril de 2026.

Sora fue un modelo de texto a video y una aplicación de redes sociales desarrollado por OpenAI. Utilizando inteligencia artificial, el modelo generaba clips de video cortos basados en indicaciones y también podía extender videos cortos existentes. En febrero de 2024, OpenAI mostró ejemplos de su producción al público, con la primera generación de Sora lanzada públicamente para usuarios de ChatGPT Plus y ChatGPT Pro en Estados Unidos y Canadá en diciembre de 2024.

La segunda generación de Sora se lanzó para usuarios seleccionados en Estados Unidos y Canadá a finales de septiembre de 2025. Sora 2 integró funciones de redes sociales en la aplicación. La aplicación se cerró el 26 de abril de 2026, y se planea que la interfaz de programación de aplicaciones (API) se descontinúe el 24 de septiembre de 2026, marcando el fin de la marca de IA Sora en su conjunto.

Antecedentes

Varios otros modelos capaces de generar video a partir de texto se habían creado antes de Sora, incluidos Make-A-Video de Meta, Gen-2 de Runway y Google Veo. OpenAI, la empresa detrás de Sora, había lanzado DALL-E 3, el tercero de sus modelos de texto a imagen DALL-E, en septiembre de 2023. El desarrollo de Sora se basó en avances en IA generativa, particularmente modelos de difusión y transformadores, que se habían aplicado a la generación de imágenes y texto. El trabajo previo de OpenAI en modelos de lenguaje grandes y redes neuronales informó la arquitectura del modelo.

Lanzamiento inicial

El equipo que desarrolló Sora lo nombró en honor a la palabra japonesa para 'cielo' para significar su "potencial creativo ilimitado". El 15 de febrero de 2024, OpenAI mostró por primera vez Sora al publicar múltiples clips de videos de alta definición que había creado, incluido un SUV conduciendo por una carretera de montaña, una animación de un "monstruo esponjoso y bajo" junto a una vela, dos personas caminando por Tokio en la nieve y metraje histórico falso de la fiebre del oro de California. OpenAI declaró que podía generar videos de hasta un minuto de duración. La empresa luego compartió un informe técnico que destacaba los métodos utilizados para entrenar el modelo. El CEO de OpenAI, Sam Altman, también publicó una serie de tuits respondiendo a las indicaciones de los usuarios de Twitter con videos generados por Sora de esas indicaciones.

A partir del 9 de diciembre de 2024, OpenAI había puesto gradualmente Sora a disposición del público para usuarios de ChatGPT Pro y ChatGPT Plus en Estados Unidos y Canadá. Antes de esto, la empresa había proporcionado acceso limitado a un pequeño "equipo rojo", incluidos expertos en desinformación y sesgo, para realizar pruebas adversariales en el modelo. La empresa también compartió Sora con un pequeño grupo de profesionales creativos, incluidos cineastas y artistas, para buscar comentarios sobre su utilidad en campos creativos. En febrero de 2025, OpenAI anunció planes para integrar Sora en ChatGPT permitiendo a los usuarios generar videos de Sora desde el chatbot.

Sora 2

Sora 2 se presentó el 30 de septiembre de 2025, con una aplicación iOS al mismo tiempo, así como una aplicación Android dos meses después. Todos los videos generados por el modelo presentan una marca de agua visible y en movimiento para prevenir el mal uso de la herramienta. La versión anterior de Sora también añadió una marca de agua de seguridad para permitir a los espectadores distinguir entre contenido real y ficticio. El 7 de octubre, 404 Media informó que los programas de terceros que podían eliminar la marca de agua de los videos de Sora 2 se habían vuelto prevalentes. Muchos medios, como la revista Wired, han señalado que la aplicación Sora 2 es abiertamente similar a TikTok en estilo y funciones.

Descontinuación

El 24 de marzo de 2026, OpenAI anunció en X que estaba descontinuando Sora tanto en la aplicación móvil como en la API. La aplicación Sora se cerró el 26 de abril de 2026, mientras que se planea que la API se cierre el 24 de septiembre de 2026. La asociación de OpenAI con Disney, que incluía un acuerdo de licencia que permitía el uso de personajes de Disney dentro de Sora, también estaba llegando a su fin. La decisión llevó al sitio web de noticias tecnológicas británico The Register a etiquetar a OpenAI como un "asesino de productos", siguiendo los pasos de otras empresas tecnológicas como Google, Amazon Web Services, Broadcom, Cloud Software Group y Netscape.

OpenAI no proporcionó una razón específica para descontinuar Sora en su aviso de cierre. Los informes que surgieron sobre esta discontinuación vincularon la decisión con escasez de cómputo, presiones de costos y un cambio más amplio hacia productos empresariales principales. Tras su lanzamiento público, los usuarios mundiales de Sora alcanzaron un máximo de alrededor de un millón antes de disminuir a menos de 500,000, mientras que el servicio costaba un estimado de $1 millón por día para operar debido a las demandas computacionales de la generación de video.

En noviembre de 2024, una clave de API para el acceso a Sora fue filtrada por un grupo de evaluadores en Hugging Face que publicaron un manifiesto declarando que protestaban porque Sora se usaba para "lavado de arte". OpenAI revocó todo acceso tres horas después de que la filtración se hiciera pública y declaró que "cientos de artistas" han dado forma al desarrollo y que "la participación es voluntaria".

En el momento de su lanzamiento, Sora 2 permitía contenido con derechos de autor por defecto a menos que los titulares de derechos contactaran a OpenAI para restringir la generación de su contenido en la plataforma. El 3 de octubre de 2025, OpenAI declaró que una futura actualización de Sora 2 daría a los titulares de derechos "un control más granular" sobre la generación de contenido con derechos de autor, pero la empresa no declaró si el contenido existente se eliminaría. El 6 de octubre, el presidente de la MPA criticó el enfoque de OpenAI hacia los derechos de autor con Sora 2.

El 11 de diciembre de 2025, The Walt Disney Company anunció que invertiría $1 mil millones en OpenAI, en un acuerdo de licencia de tres años, para permitir a los usuarios en Disney+ generar más de 200 de sus personajes con derechos de autor en Sora 2. Estos personajes incluyen aquellos de Disney Animation, Pixar, Marvel Studios y Star Wars.

Capacidades y limitaciones

La tecnología detrás de Sora es una adaptación de la tecnología detrás de DALL-E 3. Según OpenAI, Sora es un transformador de difusión, un modelo de difusión latente de denoising con un transformador como su denoiser. Un video se genera en espacio latente denoising "parches" 3D, luego se transforma a espacio estándar mediante un descompresor de video. Se emplea recaptioning para aumentar los datos de entrenamiento utilizando un modelo de video a texto para crear subtítulos detallados para videos.

OpenAI entrenó el modelo utilizando videos disponibles públicamente así como videos con derechos de autor licenciados para el propósito, pero no reveló el número o la fuente exacta de los videos. Tras su lanzamiento, OpenAI reconoció algunas de las deficiencias de Sora, incluida su capacidad limitada para simular física compleja, entender causalidad y diferenciar izquierda de derecha. OpenAI también declaró que, en adherencia a las prácticas de seguridad existentes de la empresa, Sora restringirá las indicaciones de texto para imágenes sexuales, violentas, de odio o de celebridades, así como contenido que presente propiedad intelectual existente.

El investigador de Sora, Tim Brooks, declaró que el modelo aprendió a crear gráficos 3D solo a partir de su conjunto de datos, mientras que el colega investigador de Sora, Bill Peebles, dijo que la capacidad del modelo para generar escenas coherentes fue un resultado de escalar los datos de entrenamiento y el cómputo. La arquitectura del modelo aprovechó atención de múltiples cabezas y codificación posicional para manejar dependencias temporales en secuencias de video. A pesar de sus capacidades, las limitaciones de Sora en simulación física y razonamiento causal destacaron los desafíos de aprendizaje profundo en la generación de video.

Recepción e impacto

La vista previa de Sora en febrero de 2024 generó un interés público significativo y debate sobre las implicaciones del video generado por IA. Los críticos plantearon preocupaciones sobre el posible mal uso para desinformación, infracción de derechos de autor y el desplazamiento de profesionales creativos. Los partidarios destacaron el potencial para democratizar la producción de video y habilitar nuevas formas de expresión artística. La capacidad del modelo para generar videos de un minuto a partir de indicaciones de texto simples se vio como un gran paso adelante en IA generativa, aunque su costo computacional y eventual descontinuación plantearon preguntas sobre la sostenibilidad de tales modelos.

Tras el lanzamiento de Sora 2, la integración de funciones de redes sociales provocó comparaciones con plataformas existentes como TikTok, con algunos observadores señalando el potencial para la creación de contenido viral. Las herramientas de eliminación de marcas de agua que surgieron poco después del lanzamiento de Sora 2 subrayaron los desafíos continuos en la autenticación de contenido y la forense digital. El cierre de Sora en 2026, junto con el cambio de OpenAI hacia productos empresariales, marcó un retroceso notable de las herramientas de IA orientadas al consumidor, reflejando tendencias más amplias de la industria en el panorama competitivo de la IA.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:text-to-video·openai·generative-ai·artificial-intelligence
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial