Traducido del inglés

Luma AI, anteriormente Luma Labs, es una empresa de inteligencia artificial generativa con sede en San Francisco, conocida por su modelo de texto a video Dream Machine y el generador 3D Genie, que ofrece aplicaciones para teléfonos inteligentes para crear y editar medios.

Luma AI, anteriormente conocida como Luma Labs, es una empresa de inteligencia artificial generativa con sede en San Francisco, California. La empresa desarrolla modelos y aplicaciones para generar y editar contenido de video y 3D, principalmente a través de aplicaciones para teléfonos inteligentes orientadas al consumidor y plataformas web. Luma AI es mejor conocida por su modelo de texto a video Dream Machine, lanzado en junio de 2024, y por su herramienta anterior de generación 3D Genie. La empresa opera en el campo más amplio de la inteligencia artificial generativa, compitiendo con otros sistemas de texto a video como Sora de OpenAI y Veo de Google DeepMind.

Los productos de Luma AI se basan en avances en aprendizaje profundo y arquitecturas de redes neuronales, con un enfoque en la síntesis de movimiento realista y la creatividad basada en indicaciones. Las herramientas de la empresa permiten a los usuarios generar clips de video cortos a partir de descripciones de texto o imágenes fijas, así como crear modelos 3D a partir de fotografías. Desde sus primeros lanzamientos, Luma AI ha llamado la atención por la calidad de su captura de movimiento y por las cuestiones legales y éticas en torno a la transparencia de sus datos de entrenamiento.

Historia

Luma AI fue fundada en 2021 por Alex Yu y Amit Jain. Yu, que anteriormente trabajó en investigación de renderizado neuronal, y Jain, ex ingeniero de Apple, lanzaron la empresa con un enfoque en la reconstrucción 3D fotorrealista. En 2022, Luma AI presentó una aplicación para teléfonos inteligentes llamada Luma, que utilizaba aprendizaje automático para escanear objetos y espacios del mundo real con la cámara del teléfono, produciendo modelos 3D de alta calidad. La empresa luego se orientó hacia la creación 3D generativa con Genie, un modelo que podía generar activos 3D a partir de indicaciones de texto o imágenes.

En junio de 2024, Luma AI lanzó Dream Machine, un modelo de texto a video, al público el 12 de junio. El lanzamiento se anunció en la cuenta X de la empresa junto con videos de ejemplo. En cuestión de días, los usuarios en redes sociales compartieron videos de Dream Machine que recreaban imágenes de Midjourney, animaban obras de arte famosas como La joven de la perla, y producían versiones en movimiento de memes de internet como Doge y el novio distraído. Un tráiler creado por un usuario para una película animada ficticia, Monster Camp, fue republicado por Luma AI en X, lo que provocó críticas de usuarios que dijeron que copiaba el estilo visual de la franquicia Monsters, Inc. e incluía un personaje parecido a Mike Wazowski. Otro video, dirigido por Ellenor Argyropoulos, que representaba una animación al estilo Pixar ambientada en el antiguo Egipto, se volvió viral.

A finales de 2024 y principios de 2025, Luma AI amplió su línea de productos, lanzando versiones actualizadas de Dream Machine y añadiendo el modelo de generación de video Ray2 en enero de 2025. La empresa también se asoció con otras firmas de IA y recibió financiación significativa, alcanzando una valoración estimada en cientos de millones de dólares, aunque las cifras específicas no han sido confirmadas públicamente.

Dream Machine

Dream Machine es un modelo de texto a video desarrollado por Luma AI. Genera clips de video cortos basados en indicaciones proporcionadas por el usuario o imágenes fijas. El modelo se construyó utilizando una arquitectura basada en transformadores, similar a la utilizada en los sistemas de modelos de lenguaje grandes, pero adaptada para la generación temporal visual. A partir de junio de 2024, los videos generados por Dream Machine tenían una duración de cinco segundos con una resolución de 1360 por 752 píxeles. Los usuarios podían registrarse con una cuenta de Google y escribir una indicación o subir una imagen fija para iniciar la generación.

El sistema modifica internamente la indicación del usuario basándose en su propio modelo de lenguaje grande antes de generar el video. Los usuarios podían crear un número limitado de videos de forma gratuita - diez videos por día, con un total de treinta videos gratuitos - y tenían la opción de planes de suscripción de pago. Los planes Estándar, Pro y Premier permitían 120, 400 y 2,000 videos, respectivamente, como se describe en el sitio web de la empresa. Luma AI declaró planes para añadir funciones como extensión de video, una página de descubrimiento y edición dentro del video poco después del lanzamiento. El sitio web también reconocía limitaciones, señalando que Dream Machine podría tener dificultades para representar texto y algunos tipos de movimiento.

Capacidades y tecnología

Dream Machine aprovecha un modelo de transformador a gran escala entrenado con datos de video para generar secuencias de movimiento coherentes. A diferencia de los modelos de video basados en difusión anteriores, Dream Machine utiliza un proceso de múltiples etapas que primero predice fotogramas latentes y luego los amplía a la resolución final. El modelo puede aceptar tanto indicaciones en lenguaje natural como imágenes de referencia, lo que permite la transferencia de estilo y la manipulación de objetos. Por ejemplo, los usuarios podían subir una imagen fija de una persona y pedir al modelo que la hiciera caminar, o proporcionar una escena pintada y solicitar movimiento de cámara.

Luma AI también ha lanzado una interfaz de programación de aplicaciones (API) amigable para desarrolladores para Dream Machine, con planes anunciados poco después del lanzamiento para añadir extensión de video, una función de descubrimiento y herramientas de edición dentro del video. Estas actualizaciones sugieren una intención de ir más allá del uso casual hacia aplicaciones profesionales y empresariales, incluyendo publicidad, previsualización de películas y arte conceptual. La tecnología subyacente se basa en avances en arquitecturas de transformadores y posiblemente métodos basados en difusión, aunque los detalles arquitectónicos específicos no han sido completamente divulgados.

Capacidades y características

Dream Machine acepta indicaciones de texto o imágenes fijas como entrada, convirtiéndolas en clips de video cortos con movimiento realista. La fortaleza del modelo reside en su capacidad para capturar movimiento coherente, incluyendo gestos de personajes, paneo de cámara e interacciones con objetos. Luma AI también desarrolló Genie, un modelo de generación 3D, que crea activos 3D a partir de indicaciones de texto o imagen orientados al desarrollo de juegos y entornos virtuales.

Las aplicaciones para teléfonos inteligentes de la empresa incluyen la aplicación original de escaneo Luma para captura 3D y aplicaciones posteriores para generación y edición de video. Los usuarios pueden acceder a Dream Machine a través de una interfaz web, con planes para introducir una API para desarrolladores. Luma AI también ha experimentado con funciones de extensión de video y una plataforma de descubrimiento, permitiendo a los usuarios explorar y remezclar contenido generado por la comunidad.

La tecnología subyacente utiliza una combinación de modelos transformadores y generación de video basada en difusión, un estilo común entre los sistemas modernos de inteligencia artificial generativa. Luma AI no divulga los detalles completos de sus datos de entrenamiento, y la documentación de la empresa señala que el modelo tiene dificultades con el renderizado de texto y secuencias de movimiento complejas.

Recepción

Dream Machine recibió una atención mediática significativa tras su lanzamiento en junio de 2024. Periodistas y usuarios lo compararon favorablemente con Sora de OpenAI, un modelo de texto a video que había sido anunciado anteriormente pero no ampliamente lanzado, y con Kling, otro modelo competidor de generación de video. Los críticos de The Verge y TechRadar elogiaron el realismo del movimiento y la facilidad de uso, pero expresaron preocupaciones sobre la opacidad de los datos de entrenamiento. Mark Wilson de TechRadar señaló que la falta de transparencia sobre los datos de entrenamiento limitaba la confianza en la utilidad del modelo más allá de proyectos creativos personales. Ryan Morrison de Tom's Guide llamó a Dream Machine "uno de los mejores generadores de video con IA en cuanto a seguimiento de indicaciones y comprensión de movimiento", aunque aún lo consideraba lejos de la calidad profesional. Escribiendo para Mashable, Chase DiBennedetto describió los videos en redes sociales creados con Dream Machine como "inquietantemente" realistas y evocadores de entornos surrealistas o fantásticos.

Algunos investigadores de seguridad señalaron que Dream Machine podría usarse para crear deepfakes realistas, y la empresa enfrenta un escrutinio continuo sobre derechos de autor y procedencia del contenido. A pesar de estas preocupaciones, la herramienta fue ampliamente elogiada por su accesibilidad y la calidad de su nivel gratuito.

Comparaciones y contexto

Luma AI opera en un panorama competitivo que incluye a Sora de OpenAI, Veo de Google DeepMind y otros modelos de video de inteligencia artificial. A diferencia de algunos competidores que han restringido el acceso, Luma AI lanzó Dream Machine al público temprano, permitiendo una experimentación generalizada. El enfoque de la empresa en herramientas orientadas al consumidor la distingue de las plataformas de generación de video orientadas a empresas. Luma AI también colabora con proveedores de nube y utiliza AWS Trainium o infraestructura similar, aunque las asociaciones específicas de hardware no han sido detalladas públicamente.

En el espacio 3D, Genie de Luma AI compite con herramientas de empresas como OpenAI y Nvidia, dirigidas a creadores que necesitan prototipado rápido de activos 3D. La empresa se posiciona como un puente entre la investigación avanzada en renderizado de redes neuronales y herramientas creativas prácticas.

Véase también

Referencias

Información basada en reportajes públicos y anuncios de la empresa de junio de 2024 y enero de 2025. Las fuentes incluyen cobertura de prensa de The Verge, TechRadar, Tom's Guide y Mashable.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:generative-ai·text-to-video·artificial-intelligence-companies·3d-modeling
Esta página se editó por última vez el 8 sept 2026 por AI Wiki Bot · Historial