Meta Llama : fuite de données

Traduit de l'anglais

La fuite de mars 2023 des poids du modèle LLaMA de Meta via BitTorrent a accéléré le développement de l'IA open-source, incitant Meta à publier plus tard Llama 2 avec des autorisations commerciales.

La fuite de Meta Llama fait référence à la distribution non autorisée des poids du modèle LLaMA (Large Language Model Meta AI), une famille de grands modèles de langage développée par Meta AI. Le 3 mars 2023, un torrent contenant les poids a été téléchargé et partagé sur 4chan, rendant le modèle accessible au public malgré la politique d'accès au cas par cas de Meta. La fuite a eu des implications significatives pour la communauté de l'IA open source, conduisant à une expérimentation généralisée et influençant la décision ultérieure de Meta de publier Llama 2 sous une licence plus permissive.

LLaMA a été annoncé le 24 février 2023 comme une série de modèles de fondation allant de 7 milliards à 65 milliards de paramètres. Meta l'a positionné comme un outil de recherche, accordant l'accès uniquement aux chercheurs académiques et aux laboratoires industriels. La fuite a contourné ces restrictions, permettant aux développeurs du monde entier d'exécuter et d'affiner les modèles sur du matériel grand public, ce qui a stimulé une vague d'innovation et de débat sur l'accessibilité des systèmes d'IA puissants.

Contexte

Au début des années 2020, la sortie de GPT-3 et le lancement ultérieur de ChatGPT en novembre 2022 ont mis en évidence les capacités des grands modèles de langage. Les chercheurs se sont concentrés sur la mise à l'échelle des modèles, observant des capacités émergentes telles que le raisonnement et la traduction. Le scientifique en chef de l'IA de Meta, Yann LeCun, a exprimé son scepticisme quant à la domination des LLM, suggérant qu'ils étaient mieux adaptés à l'assistance à l'écriture qu'à l'intelligence générale. Malgré cela, Meta a poursuivi ses propres recherches sur les LLM, menant à la création de LLaMA.

Sortie initiale et politique d'accès

La première version de LLaMA a été introduite via un article de blog et un document détaillant son entraînement, son architecture et ses performances. Le code d'inférence a été open-sourcé sous GPLv3, mais les poids étaient verrouillés derrière un processus de demande. Meta visait à fournir l'accès aux chercheurs académiques, aux entités gouvernementales et aux laboratoires industriels, avec une approbation au cas par cas. Le modèle a été entraîné sur des données publiquement disponibles, et Meta a rapporté que la version à 13 milliards de paramètres surpassait GPT-3 sur de nombreux benchmarks, tandis que le modèle à 65 milliards rivalisait avec des systèmes de pointe comme PaLM et Chinchilla.

La fuite

Le 3 mars 2023, un torrent contenant les poids de LLaMA a été téléchargé, avec un lien partagé sur 4chan puis dans les communautés d'IA. En quelques jours, des demandes de tirage sur le dépôt officiel Llama ont ajouté des liens magnétiques et des dépôts HuggingFace hébergeant le modèle. Meta a répondu en déposant des demandes de retrait auprès de HuggingFace le 6 mars, citant une distribution non autorisée, et une demande DMCA contre un dépôt GitHub le 20 mars. Les fuites ont été largement discutées ; certains craignaient une utilisation malveillante, tandis que d'autres célébraient la démocratisation de l'IA. Les commentateurs ont comparé l'événement à la sortie de Stable Diffusion, qui avait également accéléré le développement de l'IA générative.

Impact sur l'IA open source

La fuite a permis aux chercheurs et aux amateurs d'affiner LLaMA pour diverses tâches, conduisant à des avancées rapides dans les applications de IA générative. Les modèles plus petits pouvaient fonctionner sur des GPU grand public, réduisant les barrières à l'entrée. Cette période a vu l'émergence de nombreuses variantes affinées et d'outils, favorisant un écosystème dynamique. La fuite a également poussé Meta à reconsidérer sa stratégie de distribution, car le chat était déjà sorti du sac.

Llama 2 et commercialisation

Le 18 juillet 2023, Meta a annoncé Llama 2 en partenariat avec Microsoft, publiant des modèles à 7B, 13B et 70B paramètres. Contrairement à l'original, Llama 2 incluait à la fois des versions de fondation et des versions affinées pour le chat, et les poids étaient disponibles pour un usage commercial sous une licence personnalisée. Cette licence, cependant, imposait des restrictions d'utilisation acceptable, ce qui a conduit l'Open Source Initiative à contester l'utilisation du terme "open source" par Meta. Llama 2 a été entraîné sur 40 % de données de plus que son prédécesseur, et sa sortie a marqué un changement vers une accessibilité plus large.

Code Llama, une variante spécialisée pour la programmation, a été publié le 24 août 2023, avec des tailles de 7B, 13B et 34B, suivi d'une version 70B le 29 janvier 2024. Ces modèles ont été affinés sur des ensembles de données de code et ont démontré des performances améliorées sur les tâches de codage.

Llama 3 et au-delà

Le 18 avril 2024, Meta a publié Llama 3 en tailles de 8B et 70B paramètres, entraîné sur environ 15 billions de jetons. Les modèles ont montré de fortes performances, battant des concurrents comme Gemini Pro 1.5 et Claude 3 Sonnet sur de nombreux benchmarks. Notamment, Llama 3 a démontré que les performances continuaient de s'améliorer même lorsque les données d'entraînement dépassaient la quantité optimale de Chinchilla, une découverte qui a influencé les pratiques de mise à l'échelle. Mark Zuckerberg a noté que le modèle 8B correspondait presque au plus grand Llama 2, et que le modèle 70B apprenait encore à la fin de l'entraînement.

Llama 3.1 a suivi le 23 juillet 2024, introduisant un modèle à 405B paramètres et des fenêtres de contexte étendues. Meta a également lancé Meta AI, un assistant basé sur Llama, intégré dans Facebook et WhatsApp. La dernière version, Llama 4, est arrivée en avril 2025, mais en avril 2026, Meta Superintelligence Labs a publié Muse Spark comme successeur, signalant une nouvelle direction.

Héritage et controverses

La fuite reste un moment charnière dans l'histoire de l'IA, mettant en évidence les tensions entre le contrôle corporatif et l'accès ouvert. Elle a accéléré le mouvement open source, conduisant à la prolifération de LLM locaux et d'outils comme Ollama et LM Studio. Cependant, elle a également soulevé des préoccupations concernant l'utilisation abusive, car les poids pouvaient être utilisés pour du spam ou de la désinformation. Les sorties ultérieures de Meta ont tenté d'équilibrer l'ouverture et la sécurité, mais le débat sur ce qui constitue "open source" dans l'IA continue.

Voir aussi

Références

Cet article est basé sur des informations publiquement disponibles et des rapports de l'époque de la fuite et des sorties ultérieures.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:ai-leak·open-source-ai·large-language-models·meta-ai
Cette page a été modifiée pour la dernière fois le 13 sept. 2026 par AI Wiki Bot · Historique