A LLaMA (Large Language Model Meta AI - Grande Modelo de Linguagem Meta IA) é uma família de grandes modelos de linguagem desenvolvidos pela Meta AI, lançada pela primeira vez em fevereiro de 2023. Os modelos variam em tamanho de 1 bilhão a mais de 2 trilhões de parâmetros e foram lançados em várias versões, incluindo Llama 2, Llama 3 e Llama 4. Inicialmente um modelo de fundação, as versões posteriores incluíram variantes ajustadas com instruções, e os modelos foram disponibilizados sob licenças que permitem algum uso comercial, embora não sejam totalmente de código aberto.
O lançamento da LLaMA marcou um passo significativo na democratização da IA generativa, pois forneceu uma alternativa poderosa aos modelos proprietários como a série GPT da OpenAI. Sua distribuição aberta, especialmente após o vazamento não autorizado da primeira versão, estimulou uma onda de pesquisa e desenvolvimento na comunidade de IA.
Contexto
Após o lançamento de modelos como o GPT-3, a comunidade de pesquisa em IA concentrou-se em aumentar a escala dos modelos, o que levou a capacidades emergentes. O lançamento do ChatGPT no final de 2022 intensificou o interesse em grandes modelos de linguagem. O cientista-chefe de IA da Meta, Yann LeCun, observou que os grandes modelos de linguagem são particularmente úteis para auxiliar em tarefas de escrita, posicionando a LLaMA como uma ferramenta para tais aplicações.
Lançamento Inicial e Vazamento
A primeira versão da LLaMA foi anunciada em 24 de fevereiro de 2023, por meio de uma postagem no blog e um artigo detalhando seu treinamento, arquitetura e desempenho. O código de tratamento foi publicado sob a licença de código aberto GPLv3, mas o acesso aos dados do modelo foi restrito a pesquisadores acadêmicos e laboratórios da indústria, caso a caso. A Meta treinou modelos de vários tamanhos, de 7B a 65B parâmetros, em dados públicos disponíveis, visando torná-los acessíveis em diferentes hardwares.
Em 13 de março de 2023, um torrent com os pesos da LLaMA foi hospedado em 4chan, e o link se espalhou pelas comunidades de IA online. Esse vazamento não autorizado levou à ampla disponibilidade, com a Meta registrando pedidos de remoção contra repositórios no HuggingFace e um script. As reações foram divididas: alguns temiam o uso indevido, enquanto outros celebravam a acessibilidade, comparando-o ao lançamento aberto do Stable Diffusion, que acelerou a inovação no setor.
Llama 2
Em 18 de julho de 2023, a Meta anunciou o Llama 2 em parceria com a Microsoft, lançando modelos com 7, 13 e 70 bilhões de parâmetros. A arquitetura era amplamente inalterada da Llama 1, mas os dados de treinamento foram aumentados em 40%. O Llama 2 incluía modelos de base e ajustados para chat, e os pesos eram liberados para muitos usos comerciais, embora a política de uso aceitável da licença significasse que não era totalmente de código aberto. O Code Llama, um ajuste para código, foi lançado em agosto de 2023 e janeiro de 2024.
Llama 3 e Além
Em 18 de abril de 2024, a Meta lançou o Llama 3 com tamanhos de 8B e 70B parâmetros, pré-treinado em aproximadamente 15 trilhões de tokens. Os modelos mostraram um desempenho forte, superando o Gemini Pro 1.5 e o Claude 3 Sonnet em muitos benchmarks. A Meta também anunciou planos para capacidades multilíngues e multimodais. O Llama 3.1 surgiu em 23 de julho de 2024, e o Llama 4 foi lançado em abril de 2025. Em abril de 2026, o Meta Superintelligence Labs apresentou o Muse Spark, voltado a substituir o Llama.
Impacto e Recepção
A família LLaMA teve um impacto profundo no ecossistema de IA, permitindo que pesquisadores e desenvolvedores construam sobre um modelo aberto poderoso. Seu lançamento gerou debates sobre tecnologias de código aberto e éticas de distribuição de modelos, além de fomentar uma comunidade vibrante de ferramentas e aplicações.