Llama(大型语言模型Meta AI)是由Meta AI开发的一系列大型语言模型,首次发布于2023年2月24日。它被定位为封闭商业模型的研究导向替代品,以公开权重形式发布,其许可证允许研究用途,并在后续版本中允许大多数商业用途。
初始发布与泄露
首批Llama模型参数规模从70亿到650亿不等,最初仅通过申请向获批准的研究人员开放。数天内,模型权重泄露至文件共享网站4chan,并迅速在互联网上广泛传播,这一事件被广泛认为推动了大型实验室之外对运行和微调高性能语言模型的草根实验浪潮。此次泄露,加上Quantization等技术使得在消费级硬件上运行大型模型成为可能,催生了大量基于Llama权重的社区项目和微调衍生模型,这些模型广泛托管在Hugging Face等平台上。
后续版本
Meta随后于2023年7月发布了Llama 2,与微软合作推出,采用更宽松的许可证,明确允许大多数组织进行商业使用;2024年4月发布Llama 3,大幅提升了基准测试性能,并后续扩展了更大规模和多模态变体,包括接受图像输入的版本。2025年发布的Llama 4采用了混合专家架构和原生多模态能力。在各版本中,Meta当时的首席AI科学家Yann LeCun是公开权重战略价值的主要倡导者,他认为这加速了安全研究,防止了AI能力的危险集中,并围绕Meta的技术栈构建了开发者生态系统。
许可与开放权重之争
Llama的许可证条款随版本演变,并引发了关于这些模型是否符合传统软件意义上真正“开源”的持续争论,因为其许可证包含标准开源许可证中不存在的使用限制(例如对超大型企业的限制)。这种张力使Llama处于关于开放权重模型以及AI开放性含义的更广泛行业讨论的中心,与来自Mistral AI、DeepSeek和阿里巴巴Qwen的其他开放发布并列。
生态系统与影响
Llama的可用性显著塑造了更广泛的开放模型生态系统:它成为LoRA及其他高效微调方法的常见基础,成为学术研究中模型行为的标准基线,并成为许多下游商业和开放产品的基础。Mark Zuckerberg公开将Meta的开放权重战略定位为与OpenAI及其他前沿实验室封闭方法不同的长期赌注,认为广泛获取高性能模型既服务于Meta的商业利益,也有利于更广泛的AI生态系统,尽管这一战略受到一些AI安全研究人员的批评,他们担心权重一旦自由分发,滥用控制将变得困难。2025年,Meta重组了部分AI研究工作,成立新的“超级智能”实验室,招募包括Alexandr Wang在内的外部人才,有报道称其研究姿态相对于最初的开放Llama版本变得更加激进且公开程度降低。