LLaMA (Large Language Model Meta AI) es una familia de modelos de lenguaje de gran tamaño desarrollada por Meta AI, lanzada por primera vez en febrero de 2023. Los modelos varían en tamaño desde 1 mil millones hasta más de 2 billones de parámetros, y se han publicado en varias versiones, incluyendo Llama 2, Llama 3 y Llama 4. Inicialmente un modelo fundacional, las versiones posteriores incluyeron variantes ajustadas con instrucciones, y los modelos se han puesto a disposición bajo licencias que permiten cierto uso comercial, aunque no son completamente de código abierto.
El lanzamiento de LLaMA marcó un paso significativo en la democratización de la IA generativa, ya que proporcionó una alternativa potente a modelos propietarios como la serie GPT de OpenAI. Su distribución abierta, especialmente después de la filtración no autorizada de la primera versión, impulsó una ola de investigación y desarrollo en la comunidad de IA.
Antecedentes
Tras el lanzamiento de modelos como GPT-3, la comunidad de investigación en IA se centró en escalar los modelos, lo que condujo a capacidades emergentes. El lanzamiento de ChatGPT a finales de 2022 intensificó el interés en los modelos de lenguaje de gran tamaño. El científico jefe de IA de Meta, Yann LeCun, señaló que los modelos de lenguaje de gran tamaño son particularmente útiles para ayudar con tareas de escritura, posicionando a LLaMA como una herramienta para tales aplicaciones.
Lanzamiento inicial y filtración
La primera versión de LLaMA se anunció el 24 de febrero de 2023 mediante una publicación de blog y un artículo que detallaba su entrenamiento, arquitectura y rendimiento. El código de inferencia se publicó bajo la licencia de código abierto GPLv3, pero el acceso a los pesos del modelo se restringió a investigadores académicos y laboratorios industriales caso por caso. Meta entrenó modelos de varios tamaños, desde 7B hasta 65B parámetros, con datos disponibles públicamente, con el objetivo de hacerlos accesibles en diferentes hardware.
El 3 de marzo de 2023, un torrent con los pesos de LLaMA se subió a 4chan, y el enlace se difundió a través de comunidades de IA en línea. Esta filtración no autorizada condujo a una disponibilidad generalizada, con Meta presentando solicitudes de eliminación contra repositorios de HuggingFace y un script de GitHub. Las reacciones fueron mixtas: algunos temieron un mal uso, mientras que otros celebraron la accesibilidad, comparándola con el lanzamiento abierto de Stable Diffusion, que aceleró la innovación.
Llama 2
El 18 de julio de 2023, Meta anunció Llama 2 en asociación con Microsoft, publicando modelos con 7, 13 y 70 mil millones de parámetros. La arquitectura permaneció en gran medida sin cambios respecto a Llama 1, pero los datos de entrenamiento se aumentaron en un 40%. Llama 2 incluyó tanto modelos fundacionales como ajustados para chat, y los pesos se publicaron para muchos usos comerciales, aunque la política de uso aceptable de la licencia significaba que no era completamente de código abierto. Code Llama, un ajuste fino para código, se publicó en agosto de 2023 y enero de 2024.
Llama 3 y más allá
El 18 de abril de 2024, Meta publicó Llama 3 con tamaños de 8B y 70B parámetros, preentrenado con aproximadamente 15 billones de tokens. Los modelos mostraron un rendimiento sólido, superando a Gemini Pro 1.5 y Claude 3 Sonnet en muchos puntos de referencia. Meta también anunció planes para capacidades multilingües y multimodales. Llama 3.1 siguió el 23 de julio de 2024, y Llama 4 se publicó en abril de 2025. En abril de 2026, Meta Superintelligence Labs introdujo Muse Spark como reemplazo de Llama.
Impacto y recepción
La familia LLaMA ha tenido un impacto profundo en el ecosistema de IA, permitiendo a investigadores y desarrolladores construir sobre un modelo abierto potente. Su lanzamiento ha provocado debates sobre la licencia de código abierto y la ética de la distribución de modelos, al tiempo que ha fomentado una comunidad vibrante de herramientas y aplicaciones.