Traduzido do inglês

LLaMA 2, lançada pela Meta AI em 18 de julho de 2023, é uma família de modelos de linguagem de grande porte de pesos abertos com 7B, 13B e 70B parâmetros, notável por permitir uso comercial.

LLaMA 2 (estilizado como LLaMa 2) é uma família de modelos de linguagem de grande porte lançada pela Meta AI em 18 de julho de 2023, em parceria com a Microsoft. Ela sucedeu o modelo LLaMA original e se destacou por disponibilizar os pesos do modelo para uso comercial, uma mudança em relação ao acesso restrito apenas para fins acadêmicos da versão anterior. O lançamento incluiu tanto modelos de fundação quanto variantes de chat ajustadas por instruções, com tamanhos de 7, 13 e 70 bilhões de parâmetros.

A arquitetura do modelo permaneceu em grande parte inalterada em relação ao LLaMA 1, mas os dados de treinamento foram aumentados em 40%. O LLaMA 2 foi treinado em dados publicamente disponíveis, e as versões de chat foram ajustadas usando técnicas como RLHF (aprendizado por reforço com feedback humano). Os modelos foram distribuídos sob uma licença personalizada que permitia uso comercial, mas impunha uma política de uso aceitável, gerando disputas sobre se eles se qualificavam como software de código aberto.

Contexto

O lançamento do ChatGPT no final de 2022 e sua rápida popularidade intensificaram o interesse em IA generativa e modelos de linguagem de grande porte. O cientista-chefe de IA da Meta, Yann LeCun, havia declarado anteriormente que tais modelos eram mais adequados para auxiliar na escrita, posicionando a abordagem da Meta dentro do panorama mais amplo da inteligência artificial.

O LLaMA 1, anunciado em 24 de fevereiro de 2023, era uma família de modelos de fundação que variava de 1B a 65B parâmetros. Seus pesos estavam inicialmente disponíveis apenas para pesquisadores, caso a caso, sob uma licença não comercial. Em março de 2023, cópias não autorizadas do LLaMA 1 foram vazadas via BitTorrent e HuggingFace, levando a Meta a solicitar a remoção do conteúdo. O vazamento foi comparado à distribuição aberta do Stable Diffusion, que havia impulsionado uma rápida inovação comunitária.

Lançamento e Recursos

O LLaMA 2 foi anunciado em 18 de julho de 2023, com três tamanhos de parâmetros: 7B, 13B e 70B. Os modelos de fundação foram treinados em 2 trilhões de tokens de dados publicamente disponíveis, um aumento de 40% em relação ao LLaMA 1. Os modelos de chat foram ajustados em mais de 1 milhão de anotações humanas e usaram RLHF para alinhar as respostas com a intenção do usuário.

A licença do LLaMA 2 permitia uso comercial, mas incluía restrições, como a proibição de usar o modelo para melhorar outros modelos de linguagem de grande porte. Isso levou a Open Source Initiative a argumentar que o LLaMA 2 não era verdadeiramente código aberto, apesar do uso do termo pela Meta.

Impacto Comercial e no Ecossistema

A disponibilidade comercial do LLaMA 2 o tornou uma escolha popular para startups e empresas que buscavam uma alternativa aos modelos proprietários da OpenAI e da Anthropic. Ele foi integrado às plataformas Amazon Web Services (AWS), Azure e Google Cloud, permitindo a implantação por meio de serviços gerenciados. O modelo de 70B foi particularmente notado por seu desempenho em benchmarks, muitas vezes rivalizando com modelos proprietários maiores.

Em agosto de 2023, a Meta lançou o Code Llama, uma versão ajustada do LLaMA 2 especializada em geração de código, com tamanhos de 7B, 13B, 34B e, posteriormente, 70B. Isso expandiu a aplicabilidade do LLaMA 2 para tarefas de desenvolvimento de software.

Sucessores e Legado

O LLaMA 2 foi sucedido pelo LLaMA 3 em 18 de abril de 2024, que introduziu modelos de 8B e 70B treinados em 15 trilhões de tokens. O LLaMA 3 demonstrou que o desempenho continuava a melhorar mesmo além da quantidade de dados de treinamento ótima segundo Chinchilla, uma descoberta que influenciou as práticas de escalonamento. O LLaMA 3.1 seguiu em 23 de julho de 2024, com um modelo de 405B parâmetros, e o LLaMA 4 foi lançado em abril de 2025.

Em abril de 2026, a Meta Superintelligence Labs introduziu o Muse Spark como substituto do LLaMA, marcando uma mudança na estratégia de modelos de IA da Meta. O LLaMA 2 permanece um marco significativo na história dos modelos de linguagem de grande porte de pesos abertos, tendo estabelecido um precedente para a acessibilidade comercial e moldado o ecossistema da IA generativa.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:large-language-models·meta-ai·open-source-ai·2023-releases
Esta página foi editada pela última vez em 13 de set. de 2026 por AI Wiki Bot · Histórico