Llama(Large Language Model Meta AI)는 Meta AI가 개발한 대규모 언어 모델 계열로, 2023년 2월 24일에 처음 출시되었다. 이는 폐쇄형 상용 모델에 대한 연구 중심의 대안으로 자리 잡았으며, 연구 및 이후 버전에서는 대부분의 상업적 사용을 허용하는 라이선스 하에 공개된 가중치와 함께 제공되었다.
초기 출시와 유출
첫 번째 Llama 모델은 70억 개에서 650억 개의 매개변수로 구성되었으며, 처음에는 승인된 연구자에게만 신청을 통해 공개되었다. 며칠 내에 모델 가중치가 파일 공유 사이트 4chan에 유출되어 인터넷 전역으로 빠르게 확산되었고, 이는 주요 연구소 외부에서 유능한 언어 모델을 실행하고 미세 조정하는 풀뿌리 실험의 물결을 촉발한 사건으로 널리 평가된다. 이 유출은 Quantization과 같은 기술과 결합되어 소비자 하드웨어에서 대규모 모델을 실행하는 것을 가능하게 했으며, Hugging Face와 같은 플랫폼에 광범위하게 호스팅된 커뮤니티 프로젝트와 Llama 가중치 기반의 미세 조정 파생 모델의 급증을 가능하게 했다.
이후 출시
Meta는 2023년 7월에 Microsoft와 협력하여 대부분의 조직에 상업적 사용을 명시적으로 허용하는 더 관대한 라이선스로 Llama 2를 출시했고, 2024년 4월에는 벤치마크 성능을 크게 개선한 Llama 3를 출시했으며, 이후 더 크고 다중 모드 변형(이미지 입력을 수용하는 버전 포함)으로 확장되었다. 2025년에 출시된 Llama 4는 혼합 전문가 아키텍처와 기본 다중 모드 기능을 채택했다. 여러 버전에 걸쳐 당시 Meta의 최고 AI 과학자였던 Yann LeCun은 모델 가중치를 공개적으로 배포하는 전략적 가치에 대한 저명한 공개 옹호자였으며, 이는 안전 연구를 가속화하고 AI 능력의 위험한 집중을 방지하며 Meta의 기술 스택 주변에 개발자 생태계를 구축한다고 주장했다.
라이선스와 오픈 가중치 논쟁
Llama의 라이선스 조건은 버전에 따라 진화했으며, 표준 오픈소스 라이선스에 없는 사용 제한(예: 매우 큰 기업에 대한 제한)이 포함되어 있어 전통적인 소프트웨어 의미에서 진정한 "오픈소스"로 간주될 수 있는지에 대한 지속적인 논쟁의 대상이었다. 이러한 긴장은 Llama를 오픈 가중치 모델과 AI에서 개방성이 무엇을 의미해야 하는지에 대한 광범위한 산업 논의의 중심에 두었으며, Mistral AI, DeepSeek, 알리바바의 Qwen과 같은 다른 오픈 출시와 함께 다루어졌다.
생태계와 영향
Llama의 가용성은 더 넓은 오픈 모델 생태계를 크게 형성했다. 이는 LoRA 및 기타 효율적인 미세 조정 방법의 일반적인 기반이 되었고, 모델 행동에 대한 학술 연구의 표준 기준선이 되었으며, 많은 다운스트림 상업 및 오픈 제품의 기초가 되었다. Mark Zuckerberg는 Meta의 오픈 가중치 전략을 OpenAI 및 다른 최첨단 연구소의 폐쇄적 접근 방식과 구별되는 장기적 베팅으로 공개적으로 설명했으며, 유능한 모델에 대한 광범위한 접근이 Meta의 비즈니스 이익과 더 넓은 AI 생태계 모두에 도움이 된다고 주장했다. 그러나 이 전략은 가중치가 자유롭게 배포되면 오용을 통제하기 어렵다는 우려를 가진 일부 AI 안전 연구자들로부터 비판을 받았다. 2025년, Meta는 AI 연구 노력의 일부를 새로운 "초지능" 연구소로 재편하고 Alexandr Wang을 포함한 외부 인재를 영입했으며, 원래의 공개적인 Llama 출시에 비해 점점 더 공격적이고 덜 공개적인 연구 태도를 취했다는 보도가 있었다.