LLaMA 2 publicado

Traducido del inglés

LLaMA 2, lanzado por Meta AI el 18 de julio de 2023, es una familia de modelos de lenguaje grandes de pesos abiertos con parámetros de 7B, 13B y 70B, destacándose por permitir uso comercial.

LLaMA 2 (estilizado como LLaMa 2) es una familia de modelos de lenguaje grandes publicada por Meta AI el 18 de julio de 2023, en colaboración con Microsoft. Sucedió al modelo LLaMA original y destacó por poner los pesos del modelo a disposición para uso comercial, un cambio respecto al acceso exclusivamente académico y restringido de la versión anterior. El lanzamiento incluyó tanto modelos fundacionales como variantes de chat ajustadas por instrucciones, con tamaños de 7, 13 y 70 mil millones de parámetros.

La arquitectura del modelo permaneció en gran medida sin cambios respecto a LLaMA 1, pero los datos de entrenamiento se incrementaron en un 40%. LLaMA 2 se entrenó con datos disponibles públicamente, y las versiones de chat se ajustaron mediante técnicas como RLHF (aprendizaje por refuerzo a partir de retroalimentación humana). Los modelos se distribuyeron bajo una licencia personalizada que permitía el uso comercial pero imponía una política de uso aceptable, lo que generó disputas sobre si calificaban como software de código abierto.

Antecedentes

El lanzamiento de ChatGPT a finales de 2022 y su rápida popularidad intensificaron el interés en IA generativa y modelos de lenguaje grandes. El científico jefe de IA de Meta, Yann LeCun, había declarado previamente que dichos modelos eran más adecuados para ayudar en la escritura, posicionando el enfoque de Meta dentro del panorama más amplio de la inteligencia artificial.

LLaMA 1, anunciado el 24 de febrero de 2023, fue una familia de modelos fundacionales que abarcaba de 1B a 65B de parámetros. Sus pesos estaban inicialmente disponibles solo para investigadores caso por caso bajo una licencia no comercial. En marzo de 2023, copias no autorizadas de LLaMA 1 se filtraron a través de BitTorrent y HuggingFace, lo que llevó a Meta a presentar solicitudes de eliminación. La filtración se comparó con la distribución abierta de Stable Diffusion, que había impulsado una rápida innovación comunitaria.

Lanzamiento y características

LLaMA 2 se anunció el 18 de julio de 2023, con tres tamaños de parámetros: 7B, 13B y 70B. Los modelos fundacionales se entrenaron con 2 billones de tokens de datos disponibles públicamente, un aumento del 40% respecto a LLaMA 1. Los modelos de chat se ajustaron con más de 1 millón de anotaciones humanas y utilizaron RLHF para alinear las respuestas con la intención del usuario.

La licencia de LLaMA 2 permitía el uso comercial, pero incluía restricciones como prohibir su uso para mejorar otros modelos de lenguaje grandes. Esto llevó a la Open Source Initiative a argumentar que LLaMA 2 no era realmente de código abierto, a pesar del uso del término por parte de Meta.

Impacto comercial y en el ecosistema

La disponibilidad comercial de LLaMA 2 lo convirtió en una opción popular para startups y empresas que buscaban una alternativa a los modelos propietarios de OpenAI y Anthropic. Se integró en plataformas de Amazon Web Services (AWS), Azure y Google Cloud, permitiendo su implementación mediante servicios gestionados. El modelo de 70B destacó especialmente por su rendimiento en puntos de referencia, a menudo rivalizando con modelos propietarios más grandes.

En agosto de 2023, Meta lanzó Code Llama, una versión ajustada de LLaMA 2 especializada en generación de código, con tamaños de 7B, 13B, 34B y, posteriormente, 70B. Esto amplió la aplicabilidad de LLaMA 2 a tareas de desarrollo de software.

Sucesores y legado

LLaMA 2 fue sucedido por LLaMA 3 el 18 de abril de 2024, que introdujo modelos de 8B y 70B entrenados con 15 billones de tokens. LLaMA 3 demostró que el rendimiento seguía mejorando incluso más allá de la cantidad de datos de entrenamiento óptima según Chinchilla, un hallazgo que influyó en las prácticas de escalado. LLaMA 3.1 siguió el 23 de julio de 2024, con un modelo de 405B de parámetros, y LLaMA 4 se lanzó en abril de 2025.

En abril de 2026, Meta Superintelligence Labs presentó Muse Spark como reemplazo de LLaMA, marcando un cambio en la estrategia de modelos de IA de Meta. LLaMA 2 sigue siendo un hito significativo en la historia de los modelos de lenguaje grandes de pesos abiertos, al haber establecido un precedente de accesibilidad comercial y haber moldeado el ecosistema de la IA generativa.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:large-language-models·meta-ai·open-source-ai·2023-releases
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial