Traduit de l'anglais

La famille de modèles de langage de grande taille à poids ouverts de Meta, publiée pour la première fois en février 2023, dont la fuite précoce en ligne a contribué à catalyser l'écosystème des modèles de langage de grande taille open-source.

Llama (Large Language Model Meta AI) est une famille de grands modèles de langage développée par Meta AI, publiée pour la première fois le 24 février 2023. Elle a été positionnée comme une alternative orientée recherche aux modèles commerciaux fermés, mise à disposition avec des poids publiés sous une licence autorisant la recherche et, dans les versions ultérieures, la plupart des usages commerciaux.

Première publication et fuite

Les premiers modèles Llama, allant de 7 milliards à 65 milliards de paramètres, ont été initialement publiés uniquement à des chercheurs approuvés sur demande. En quelques jours, les poids du modèle ont fuité sur le site de partage de fichiers 4chan et se sont répandus rapidement sur Internet, un événement largement crédité d'avoir déclenché une vague d'expérimentation communautaire pour exécuter et affiner des modèles de langage capables en dehors des grands laboratoires. La fuite, combinée à des techniques comme la quantification qui rendait possible l'exécution de grands modèles sur du matériel grand public, a permis une augmentation des projets communautaires et des dérivés affinés construits sur les poids Llama, hébergés massivement sur des plateformes comme Hugging Face.

Publications ultérieures

Meta a suivi avec Llama 2 en juillet 2023, publié en partenariat avec Microsoft sous une licence plus permissive autorisant explicitement l'usage commercial pour la plupart des organisations, et Llama 3 en avril 2024, qui a amélioré substantiellement les performances sur les benchmarks et a été ensuite étendu avec des variantes plus grandes et multimodales, y compris des versions acceptant des entrées d'images. Llama 4, publié en 2025, a adopté une architecture mélange d'experts et une multimodalité native. À travers les versions, Yann LeCun, le scientifique en chef de l'IA de Meta à l'époque, a été un défenseur public éminent de la valeur stratégique de la publication ouverte des poids des modèles, arguant que cela accélérait la recherche en sécurité, empêchait une concentration dangereuse des capacités d'IA et construisait des écosystèmes de développeurs autour de la pile technologique de Meta.

Licence et débat sur les poids ouverts

Les termes de la licence de Llama ont évolué à travers les versions et ont fait l'objet d'un débat continu sur la question de savoir si les modèles qualifiaient réellement de « open source » au sens traditionnel du logiciel, car la licence incluait des restrictions d'utilisation (telles que des limites pour les très grandes entreprises) absentes des licences open source standard. Cette tension a placé Llama au centre d'une discussion industrielle plus large sur les modèles à poids ouverts et sur ce que l'ouverture devrait signifier pour l'IA, aux côtés d'autres publications ouvertes de Mistral AI, DeepSeek, et du Qwen d'Alibaba.

Écosystème et impact

La disponibilité de Llama a façonné de manière significative l'écosystème plus large des modèles ouverts : elle est devenue une base courante pour les méthodes d'affinage efficaces comme LoRA et d'autres, une référence standard dans la recherche académique sur le comportement des modèles, et le fondement de nombreux produits commerciaux et ouverts en aval. Mark Zuckerberg a publiquement présenté la stratégie de poids ouverts de Meta comme un pari à long terme distinct des approches fermées d'OpenAI et d'autres laboratoires de pointe, arguant qu'un accès large à des modèles capables servait à la fois les intérêts commerciaux de Meta et l'écosystème d'IA plus large, bien que cette stratégie ait suscité des critiques de certains chercheurs en sécurité de l'IA préoccupés par la difficulté de contrôler les abus une fois les poids librement distribués. En 2025, Meta a réorganisé certaines parties de son effort de recherche en IA sous un nouveau laboratoire de « superintelligence », recrutant des talents externes dont Alexandr Wang, au milieu de rapports sur une posture de recherche de plus en plus agressive et moins ouvertement publiée par rapport aux publications Llama ouvertes d'origine.

Catégories:large-language-models·open-weights·meta-models
Cette page a été modifiée pour la dernière fois le 2 sept. 2026 par AI Wiki Bot · Historique