Llama 2 é uma família de modelos de linguagem de grande porte (LLMs) desenvolvida e lançada pela Meta AI em julho de 2023. É a sucessora do modelo Llama original e foi projetada para ser mais acessível e comercialmente utilizável do que sua antecessora. Llama 2 inclui modelos com 7, 13 e 70 bilhões de parâmetros, cada um disponível tanto em uma versão base quanto em uma versão ajustada para aplicações de chat. Os modelos são lançados com pesos, permitindo amplo uso, mas sob uma licença que restringe certas aplicações, gerando debate sobre se eles se qualificam como código aberto.
A arquitetura do Llama 2 segue em grande parte a do Llama original, mas os dados de treinamento foram aumentados em 40%. Essa expansão visou melhorar o desempenho e a generalização em várias tarefas de processamento de linguagem natural. O lançamento do Llama 2 marcou um passo significativo na estratégia da Meta para competir com outros provedores de LLMs, como OpenAI e Google DeepMind, oferecendo uma alternativa poderosa e acessível.
Histórico
O desenvolvimento do Llama 2 ocorreu em meio a avanços rápidos em modelos de linguagem de grande porte, especialmente após o lançamento do GPT-3 e a subsequente popularidade do ChatGPT. Esses modelos demonstraram que o escalonamento de redes neurais poderia levar a melhorias significativas em capacidades, despertando intenso interesse no campo. O cientista-chefe de IA da Meta, Yann LeCun, observou que LLMs são particularmente eficazes para auxílio à escrita, posicionando o Llama como uma ferramenta para tarefas de escrita criativa e profissional.
O Llama original, lançado em fevereiro de 2023, estava inicialmente disponível apenas para pesquisadores sob uma licença não comercial. No entanto, seus pesos foram vazados online em março de 2023, levando a uma distribuição não oficial generalizada. Esse vazamento, embora controverso, também destacou a demanda por LLMs acessíveis e influenciou a decisão da Meta de lançar o Llama 2 com uma licença mais permissiva.
Versões
Lançamento Inicial
A primeira versão do Llama, às vezes chamada de Llama 1, foi anunciada em 24 de fevereiro de 2023. Foi treinada em dados publicamente disponíveis e veio em tamanhos variando de 1 bilhão a 65 bilhões de parâmetros. O modelo de 13B parâmetros superou o muito maior GPT-3 em muitos benchmarks, enquanto o modelo de 65B foi competitivo com modelos de última geração como PaLM e Chinchilla. O acesso aos pesos era restrito a pesquisadores acadêmicos e laboratórios da indústria, mas o código de inferência foi lançado sob a licença de código aberto GPLv3.
#### Vazamento
Em 3 de março de 2023, um torrent contendo os pesos do Llama foi enviado ao 4chan, e os links se espalharam rapidamente pelas comunidades de IA online. A Meta protocolou pedidos de remoção junto ao HuggingFace e ao GitHub, mas o vazamento já havia facilitado o uso generalizado. Comentaristas compararam a situação ao lançamento do Stable Diffusion, sugerindo que o acesso aberto poderia estimular a inovação e o desenvolvimento de ferramentas, apesar das preocupações com o uso indevido.
Llama 2
O Llama 2 foi anunciado em 18 de julho de 2023, em parceria com a Microsoft. Foi lançado em três tamanhos: 7B, 13B e 70B parâmetros. A arquitetura permaneceu semelhante à do Llama 1, mas os dados de treinamento foram aumentados em 40%. Diferentemente de sua antecessora, os pesos do Llama 2 foram disponibilizados para uso comercial, sujeitos a uma política de uso aceitável. Essa política proíbe certas aplicações, levando a Open Source Initiative a contestar a caracterização do Llama como código aberto pela Meta.
O Llama 2 também serviu de base para o Code Llama, uma versão especializada ajustada para geração de código. O Code Llama foi lançado em agosto de 2023 e janeiro de 2024, com versões variando de 7B a 70B parâmetros, treinadas em conjuntos de dados adicionais específicos para código.
Llama 3
Em 18 de abril de 2024, a Meta lançou o Llama 3 com tamanhos de 8B e 70B parâmetros. Esses modelos foram pré-treinados em aproximadamente 15 trilhões de tokens de texto publicamente disponível, com ajuste fino por instruções em mais de 10 milhões de exemplos anotados por humanos. O Llama 3 70B superou o Gemini Pro 1.5 e o Claude 3 Sonnet em muitos benchmarks. Os modelos demonstraram que o desempenho continua melhorando mesmo quando treinados em dados muito além da quantidade ótima de Chinchilla, com o modelo de 8B mostrando escalonamento log-linear até 15 trilhões de tokens.
A Meta também anunciou planos para tornar o Llama 3 multilíngue e multimodal, e para aumentar sua janela de contexto. A versão mais recente, Llama 4, foi lançada em abril de 2025, e em abril de 2026, a Meta Superintelligence Labs introduziu o Muse Spark como substituto do Llama.
Impacto e Recepção
O lançamento do Llama 2 e das versões subsequentes teve um impacto significativo no cenário da IA. Ao fornecer pesos abertos, a Meta permitiu que pesquisadores e desenvolvedores ajustassem modelos para aplicações específicas, promovendo um ecossistema vibrante de ferramentas e derivados. No entanto, os termos de licenciamento geraram debates sobre a definição de código aberto, com críticos argumentando que a política de uso aceitável restringe a liberdade.
Os modelos Llama foram amplamente adotados tanto na academia quanto na indústria, com aplicações que vão de chatbots a geração de código. O desempenho dos modelos, particularmente em relação ao seu tamanho, os tornou atraentes para organizações com recursos computacionais limitados. Em 2025, o Llama continua sendo uma das famílias de LLMs de pesos abertos mais proeminentes, influenciando o desenvolvimento de modelos subsequentes e moldando discussões sobre acessibilidade da IA e governança.