Gemma 3는 Google DeepMind가 개발한 오픈 가중치 대규모 언어 모델 제품군이다. 2025년 3월 12일에 출시된 이 모델들은 Gemini 2.0 모델과 동일한 연구 및 기술을 기반으로 하지만, 개발자와 연구자가 로컬 또는 자체 인프라에서 실행할 수 있도록 설계되었다. Gemma 3는 1B, 4B, 12B, 27B 매개변수의 네 가지 주요 크기를 포함하며, 각각 기본 및 명령어 튜닝 변형으로 제공되어 2025년 말 기준 공개 벤치마크 스냅샷에 총 11개 변형이 등장한다.
이 모델들은 텍스트와 이미지 입력을 모두 수용하는 멀티모달 기능과 최대 128,000개 토큰의 컨텍스트 창 지원으로 주목할 만하다. Gemma 3는 또한 이전 Gemma 릴리스에서 크게 확장된 140개 이상의 언어를 지원한다. 이 제품군은 특히 30B 미만 매개변수 범위에서 OpenAI 및 Anthropic의 모델에 대한 경쟁력 있는 오픈 가중치 대안으로 자리매김하고 있다.
아키텍처 및 학습
Gemma 3 모델은 멀티 헤드 어텐션을 갖춘 트랜스포머 아키텍처를 사용하며, 더 큰 크기에서는 효율성을 위해 그룹 쿼리 어텐션을 통합한다. 모델은 고품질 필터링에 중점을 두고 웹 문서, 코드, 수학 데이터의 혼합으로 학습된다. 27B 모델은 SwiGLU 활성화 함수와 회전 위치 임베딩을 사용한다. 학습에는 Adam 최적화 기법과 코사인 학습률 스케줄 및 그래디언트 클리핑이 사용되었다.
일부 독점 모델과 달리 Gemma 3 가중치는 상업적 사용과 미세 조정을 허용하는 허용적 라이선스로 공개된다. 명령어 튜닝 변형은 RLHF(인간 피드백 기반 강화 학습)와 지도 미세 조정을 통해 정렬되었으며, 추가 안전 필터링이 적용되었다.
성능 및 벤치마크
공개 리더보드에서 Gemma 3 27B는 MMLU(대규모 멀티태스크 언어 이해), GSM8K(초등 수학), HumanEval(코드 생성)과 같은 표준 벤치마크에서 경쟁력 있는 점수를 달성한다. 2025년 중반 기준으로 27B 명령어 모델은 특정 추론 작업에서 많은 대형 독점 모델을 능가하지만, 복잡한 다단계 추론에서는 최첨단 프론티어 모델에는 미치지 못한다. 4B 및 12B 크기는 엣지 디바이스와 소비자 하드웨어 배포에 최적화되어 있으며, 1B 모델은 모바일 애플리케이션에 적합하다.
Gemma 3는 또한 특히 저자원 언어에서 강력한 다국어 작업 성능을 보여준다. 모델은 전작에 비해 개선된 장기 컨텍스트 처리 능력을 보여주며, 128K 토큰 입력에서도 일관성을 유지한다.
배포 및 생태계
Gemma 3는 여러 채널을 통해 제공된다. Google Cloud Vertex AI와 Amazon Web Services SageMaker를 통해 접근할 수 있으며, 고속 추론을 위해 Groq 및 SambaNova를 통해서도 사용할 수 있다. 모델은 Hugging Face Transformers 및 vLLM을 포함한 표준 머신 러닝 프레임워크와 호환된다.
로컬 배포의 경우 Gemma 3는 프루닝 및 4비트 양자화와 같은 양자화 기법을 지원하여 27B 모델을 단일 고성능 GPU에서 실행할 수 있게 한다. 더 작은 변형은 노트북과 Raspberry Pi급 디바이스에서 실행할 수 있다. Google은 미세 조정 및 배포 예제가 포함된 Gemma Cookbook을 제공한다.
안전 및 책임 있는 사용
Google DeepMind는 Gemma 3에 계층적 안전 접근 방식을 구현했다. 명령어 튜닝 모델에는 유해한 프롬프트를 거부하도록 학습된 안전 필터가 포함되어 있으며, 회사는 안전 벤치마크 평가를 상세히 설명하는 모델 카드를 게시했다. 그러나 오픈 가중치 모델로서 Gemma 3는 안전 장치를 제거하도록 미세 조정될 수 있으며, 이는 개발자들이 인정한 절충점이다. 라이선스에는 무기 개발이나 감시와 같은 특정 고위험 애플리케이션에 모델을 사용하는 것을 금지하는 조항이 포함되어 있다.
평가 및 영향
Gemma 3는 성능과 접근성의 균형으로 AI 커뮤니티에서 긍정적인 평가를 받았다. 독립 평가에 따르면 27B 모델은 특정 작업에서 더 큰 폐쇄형 모델의 품질과 일치하거나 능가하는 경우가 많으며, 실행 비용은 상당히 저렴하다. 이번 출시는 Alibaba 및 AI21 Labs와 같은 다른 조직의 노력과 함께 오픈 가중치 모델이 독점 시스템에 도전하는 성장 추세에 기여했다.
2025년 말 현재 Gemma 3는 온프레미스 또는 프라이버시 보호 AI가 필요한 연구 및 프로덕션 애플리케이션에서 여전히 인기 있는 선택이다. 후속 모델인 Gemma 3n이 2025년 말에 발표되었지만, Gemma 3는 학계와 산업계에서 계속 널리 사용되고 있다.