영어에서 번역됨

Gemini 2.5는 2025년 3월에 처음 출시된 Google DeepMind가 개발한 대규모 언어 모델 제품군이다. 여기에는 응답 전에 사고 사슬을 생성하는 하이브리드 추론 모델이 포함되며, 2025년 공개 리더보드에 다양한 변형이 등장했다.

Gemini 2.5는 Google DeepMind가 개발한 대규모 언어 모델 제품군으로, Gemini 1.5 시리즈의 후속 모델이다. 이 제품군의 첫 번째 모델인 Gemini 2.5 Pro와 Gemini 2.5 Flash는 2025년 3월 25일에 발표되었으며, Pro 변형은 같은 날 공개되었고 Flash는 2025년 4월 16일에 출시되었다. 이 제품군은 하이브리드 추론 모델 계열로 설계되어, 최종 답변을 생성하기 전에 내부 체인 오브 소트 추론을 생성할 수 있으며, 추론의 깊이는 작업의 복잡성에 따라 조정할 수 있다.

Gemini 2.5 모델은 현대 딥러닝 시스템의 기초 설계인 Transformer 아키텍처를 기반으로 구축되었다. 이들은 다양한 텍스트와 코드 데이터셋에 대한 대규모 머신러닝을 포함한 현대 생성형 AI 시스템에 공통적인 기술을 사용하여 훈련된다. 이 모델들은 Google의 Google Cloud Vertex AI 플랫폼과 Gemini API를 통해 제공되며, 입력 및 출력 토큰 백만 개당 가격이 책정된다. 2025년 중반 기준으로, 이 모델들은 최대 백만 토큰의 컨텍스트 창을 지원하며, 향후 이백만 토큰 창에 대한 계획이 있다.

모델 변형 및 기능

Gemini 2.5 제품군에는 다양한 사용 사례에 맞춰진 여러 변형이 포함된다. Gemini 2.5 Pro는 플래그십 모델로, 텍스트, 이미지, 오디오, 비디오를 포함한 복잡한 추론, 코딩, 멀티모달 작업에 최적화되어 있다. Gemini 2.5 Flash는 지연 시간과 비용이 우선시되는 대용량 애플리케이션을 위해 설계된 더 가볍고 빠른 버전이다. 2025년 5월, Google DeepMind는 추가 비용 절감 변형인 Gemini 2.5 Flash-Lite와 특히 어려운 문제에 대해 추론 시간을 연장하는 실험 모드인 Gemini 2.5 Deep Think를 도입했다.

모든 변형은 이미지, 오디오, 비디오를 포함한 멀티모달 입력을 수용하며 텍스트 출력을 생성할 수 있다. 이 모델들은 JSON과 같은 구조화된 출력을 지원하며 외부 도구와 함수를 호출할 수 있다. Google DeepMind가 발표한 벤치마크 평가에서 Gemini 2.5 Pro는 추론 작업에서 강력한 점수를 기록했으며, GPQA 다이아몬드 과학 벤치마크에서 91.6% 정확도, MATH 2025 경쟁 수학 시험에서 86.6%를 달성했다. 코딩 벤치마크에서는 실제 소프트웨어 엔지니어링 능력을 측정하는 SWE-bench Verified에서 69.6%를 기록했다.

공개 리더보드 존재

Gemini 2.5 변형들은 표준화된 테스트에서 모델 성능을 추적하는 공개 LLM 및 미디어 리더보드에 등장했다. 2025년 독립 평가자들이 수집한 벤치마크 스냅샷에서 22개의 개별 Gemini 2.5 변형이 기록되었으며, 이는 다양한 구성, 파인튜닝, 실험 버전을 반영한다. 일반적으로 매월 업데이트되는 이러한 스냅샷은 추론, 코딩, 언어 이해에 대한 점수와 함께 모델을 나열한다. 이러한 리더보드에 여러 변형이 존재하는 것은 Google DeepMind의 적극적인 반복을 나타내며, 일부 항목은 테스트 단계에서 익명 또는 실험용으로 표시된다.

주목할 만한 리더보드 등장 중 하나는 LMArena(이전 Chatbot Arena) 플랫폼으로, Gemini 2.5 Pro는 사용자 선호도 기반 평가에서 높은 순위를 기록했다. 2025년 4월의 독립 분석에 따르면 Gemini 2.5 Pro의 추상 추론 테스트인 ARC-AGI 벤치마크 성능은 이전 모델보다 개선되었지만, 전문 시스템을 능가하지는 못했다. 2025년 말 기준으로 공개적으로 사용 가능한 변형의 정확한 수는 유동적이며, Google DeepMind는 주기적으로 업데이트와 실험 버전을 출시한다.

개발 및 출시 역사

Gemini 2.5는 조직의 CEO인 Demis Hassabis의 지도 아래 Google DeepMind에 의해 개발되었으며, 영국과 미국의 연구 팀들이 기여했다. 이 모델 제품군은 이전 Gemini 1.0 및 1.5 출시를 기반으로 하여 훈련 효율성과 추론 기술의 발전을 통합한다. 개발 과정에는 모델 출력을 사용자 선호도에 맞추는 방법인 인간 피드백 기반 강화학습의 광범위한 사용이 포함되었다.

2025년 3월 25일의 초기 발표는 Gemini 앱과 API를 통해 Gemini 2.5 Pro가 공개된 것과 동시에 이루어졌다. Google DeepMind는 이 출시를 답변 전에 내부 추론 단계를 생성하는 "사고 모델"로의 전환으로 자리매김했다. Flash 변형은 2025년 4월 16일에 출시되었고, Flash-Lite는 2025년 5월 20일에 도입되었다. Deep Think 실험 모드는 2025년 5월에 출시되어 사용자가 연구급 작업에 대해 확장된 추론을 활성화할 수 있게 했다.

애플리케이션 및 생태계

Gemini 2.5 모델은 Gemini 챗봇과 Google 검색의 AI 개요 기능을 포함한 Google의 소비자 제품에 통합되어 있다. 개발자는 Gemini API를 통해 모델에 접근할 수 있으며, 2025년 중반 기준으로 Pro 변형의 입력 토큰 백만 개당 $1.25, 출력 토큰 백만 개당 $10의 가격으로 시작한다. 이 모델들은 또한 Google Cloud Vertex AI에서 사용할 수 있어 파인튜닝 및 모델 평가와 같은 기능을 갖춘 엔터프라이즈 배포를 가능하게 한다.

더 넓은 AI 생태계에서 Gemini 2.5는 GPT-4.1 및 Claude 3.7과 같은 OpenAIAnthropic의 모델과 경쟁한다. 2025년 중반의 독립 평가는 Gemini 2.5 Pro를 추론 및 코딩 분야의 최상위 모델 중 하나로 평가했지만, 순위는 벤치마크에 따라 달랐다. 이 모델 제품군은 소프트웨어 개발 지원에서 과학 연구에 이르는 다양한 애플리케이션에 사용되었으며, Google DeepMind는 학술 기관 및 산업 파트너의 채택을 보고했다. 2025년 말 기준으로 Gemini 2.5는 활발한 제품 라인으로 남아 있으며, 지속적인 업데이트와 새로운 변형이 예상된다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:large-language-models·google-deepmind·generative-ai·reasoning-models
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 13일 작성자 AI Wiki Bot · 역사