Google Gemini 2.5 출시

영어에서 번역됨

Google Gemini 2.5는 향상된 추론 및 코딩 기능을 갖춘 사고 모델로, Google DeepMind가 개발한 Gemini 계열의 멀티모달 대규모 언어 모델의 일부로 2025년 3월에 출시되었습니다.

Google Gemini 2.5는 2025년 3월에 출시된 Google DeepMind가 개발한 다중 모드 대규모 언어 모델(LLM) 제품군이다. 이는 이전 Gemini 버전의 후속 모델로, 응답을 생성하기 전에 문제를 단계별로 추론할 수 있는 "사고 모델"로 설계되었으며, 특히 코딩 및 복잡한 추론 작업에서 개선된 성능을 보여준다. 이번 출시는 2023년 12월 원래 Gemini 발표로 마련된 기반 위에 구축되어, Google이 제품 및 클라우드 서비스에 고급 AI를 통합하려는 전략을 지속한 것이다.

Gemini Pro, Gemini Flash, Gemini Nano와 같은 모델을 포함하는 Gemini 제품군은 2023년 12월 6일 LaMDA 및 PaLM 2의 후속 모델로 처음 발표되었다. Gemini 2.5는 향상된 추론 능력과 소프트웨어 개발, 수학, 과학적 문제 해결에서의 개선된 성능에 초점을 맞춘 중요한 진화를 나타낸다. 이번 출시는 이전 모델들이 보다 직접적으로 응답을 생성했던 것과 대조적으로, 모델이 더 신중하게 "생각"할 수 있는 AI 산업의 광범위한 추세의 일부였다.

개발 및 배경

Gemini의 개발은 2025년 출시 훨씬 이전에 시작되었다. 2023년 5월 10일 Google I/O 기조 연설에서 Google CEO 순다르 피차이는 Gemini를 PaLM 2보다 더 강력한 후속 모델로 발표하며, 텍스트, 이미지, 오디오, 비디오 및 코드를 동시에 처리하도록 설계된 다중 모드 특성을 강조했다. 이 프로젝트는 DeepMind와 Google Brain의 협업으로, 두 조직은 합병하여 Google DeepMind를 형성했다. DeepMind CEO 데미스 허사비스는 Gemini가 2016년 바둑 챔피언 이세돌을 물리친 프로그램인 AlphaGo의 강점과 고급 언어 능력을 결합할 것이라고 강조했다.

2023년 8월까지, Google은 2023년 말까지 Gemini를 출시하는 것을 목표로 하고 있으며, 이미지 생성 및 맥락 이해를 통합하여 OpenAI와 같은 경쟁사를 능가할 계획이라는 보도가 있었다. Google 공동 창업자 세르게이 브린이 지원을 위해 복귀했으며, Google Brain과 DeepMind의 수백 명의 엔지니어가 기여했다. 법무 팀은 YouTube 대본을 포함한 훈련 데이터에서 잠재적으로 저작권이 있는 자료를 걸러냈다.

2023년 12월 6일에 발표된 원래 Gemini 1.0은 매우 복잡한 작업을 위한 Ultra, 다양한 작업을 위한 Pro, 기기 내 작업을 위한 Nano의 세 가지 모델을 포함했다. Gemini Ultra는 57개 주제의 대규모 다중 작업 언어 이해(MMLU) 테스트에서 인간 전문가를 능가한 최초의 LLM으로, 90%의 점수를 기록했다. 이 모델들은 Google의 텐서 처리 장치(TPU)에서 훈련되었다.

사고 모델 접근 방식

Gemini 2.5는 AI가 최종 답변을 생성하기 전에 문제를 명시적으로 추론하는 "사고 모델" 패러다임을 도입했다. 다른 고급 LLM에서 사용되는 기술과 유사한 이 접근 방식은 모델이 복잡한 질의를 중간 단계로 분해하여 정확성과 논리적 일관성을 향상시킬 수 있게 한다. 사고 과정이 항상 사용자에게 표시되는 것은 아니며, 일부 구성에서는 모델이 추론에 대한 간결한 요약을 제공할 수 있고, 다른 구성에서는 전체 사고 사슬을 표시할 수 있다.

이 설계는 단계별 디버깅과 알고리즘 설계가 중요한 코딩 작업에 특히 유용하다. Gemini 2.5 모델은 실제 소프트웨어 엔지니어링 문제를 테스트하는 SWE-Bench와 같은 코딩 벤치마크에서 최첨단 결과를 달성한 것으로 보고되었다. 향상된 추론은 수학적 증명, 과학적 추론 및 다단계 계획으로도 확장된다.

사고 모델 아키텍처는 대부분의 현대 LLM의 기반이 되는 트랜스포머 프레임워크 위에 구축된다. 이는 멀티 헤드 어텐션사고 사슬 프롬프팅과 같은 기술을 통합하지만, 모델이 응답하기 전에 내부적으로 추론하도록 훈련되는 보다 통합된 접근 방식을 사용한다.

출시 및 가용성

Gemini 2.5는 2025년 3월에 출시되었으며, 초기 출시는 Pro 및 Flash 변형에 초점을 맞췄다. 이 모델들은 Google Cloud의 Vertex AI 및 AI Studio를 포함한 Google의 AI 플랫폼과 Gemini 챗봇을 통해 제공되었다. 개발자는 다른 상용 LLM과 유사하게 토큰당 가격이 책정된 API를 통해 모델에 액세스할 수 있었다.

출시와 함께 Google의 소비자 제품 업데이트도 이루어졌다. 예를 들어, Gemini 2.5는 Android 및 iOS용 Gemini 앱에 통합되었고, 이후 Google 검색의 AI 개요에도 통합되었다. 이 모델들은 또한 Android Studio 및 Colab과 같은 Google 개발자 도구 내의 코딩 어시스턴트를 지원했다.

2025년 6월, Google은 Gemini CLI를 도입했다. 이는 Gemini 기능을 터미널로 직접 가져오는 오픈 소스 AI 에이전트로, 고급 코딩, 자동화 및 문제 해결 기능을 제공하며 개별 개발자에게 넉넉한 무료 사용 한도를 제공한다. 이 움직임은 명령줄 인터페이스를 선호하는 개발자를 유치하는 것을 목표로 했다.

성능 및 벤치마크

Gemini 2.5 모델은 이전 모델에 비해 상당한 성능 향상을 보여주었다. 57개 주제에 걸친 지식을 테스트하는 MMLU 벤치마크에서 Gemini 2.5 Pro는 90%를 초과하는 점수를 기록하여 이전 Gemini Ultra를 능가한 것으로 보고되었다. HumanEval 및 SWE-Bench와 같은 코딩 벤치마크에서 모델은 뚜렷한 향상을 보였으며, Gemini 2.5 Pro는 이전 버전에 비해 더 높은 비율의 실제 GitHub 문제를 해결했다.

이 모델들은 또한 GPQA(대학원 수준 Google-Proof Q&A) 및 AIME(미국 수학 초청 시험)와 같은 추론 벤치마크에서 뛰어난 성과를 보여 과학 및 수학에서 강력한 능력을 나타냈다. 이러한 결과는 Gemini 2.5를 경쟁 환경에서 선도적인 모델로 자리매김하게 했으며, OpenAI(GPT-4 및 이후 모델) 및 Anthropic(Claude 3 및 이후 모델)의 제품과 경쟁했다.

그러나 독립적인 평가에서는 Gemini 2.5가 매우 유능하지만 긴 맥락 검색 및 환각 방지와 같은 특정 영역에서 여전히 한계가 있다고 지적했다. Google은 안정성과 효율성을 개선한 업데이트 버전을 출시하며 계속해서 반복했다.

Google 생태계와의 통합

Gemini 2.5는 Google의 제품 제품군에 깊이 통합되었다. Google Cloud 플랫폼에서 기업을 위한 핵심 제공물이 되어 문서 요약, 코드 생성 및 고객 지원 자동화와 같은 사용 사례를 가능하게 했다. 이 모델들은 또한 Google Workspace를 통해 제공되어 이메일 초안 작성, 프레젠테이션 생성 및 Sheets에서 데이터 분석을 지원했다.

소비자 측면에서 Gemini 2.5는 2024년 2월 Bard에서 브랜드가 변경된 Gemini 챗봇을 지원했다. 챗봇은 이미지 및 오디오를 포함한 다중 모드 입력을 처리할 수 있었고 실시간 응답을 제공했다. 또한 Gemini 2.5는 Android 기기에서 사용되었으며, 효율성을 위해 Nano 변형을 활용하여 텍스트 요약 및 스마트 답장과 같은 작업을 위한 기기 내 추론을 제공했다.

Google은 또한 Gemini의 범위를 확장하기 위해 다른 회사와 파트너십을 맺었다. 예를 들어, 2024년 1월 Google은 삼성과 파트너십을 맺어 Galaxy S24 스마트폰 라인업에 Gemini Nano 및 Pro를 통합했다. 이러한 협력은 Google이 Apple의 기기 내 AI 및 다른 생태계 플레이어와 경쟁하는 데 도움이 되었다.

경쟁 환경

Gemini 2.5의 출시는 AI 산업의 경쟁을 강화했다. OpenAI는 GPT-4를 출시하고 GPT-4.5 및 GPT-5를 작업 중이었으며, Anthropic은 Claude 3 및 이후 모델을 제공했다. Meta(LLaMA 포함) 및 AI21 LabsInflection AI와 같은 스타트업도 시장 점유율을 놓고 경쟁했다.

Gemini 2.5의 추론 및 코딩 강조는 OpenAI의 Codex 및 Anthropic의 Claude Code에 대한 직접적인 도전으로 여겨졌다. Google의 강점은 TPU 및 Google Cloud 데이터 센터를 포함한 방대한 인프라에 있었으며, 이를 통해 효율적인 훈련과 배포가 가능했다. 회사는 또한 강화 학습 및 신경망 설계에서 강력한 실적을 가진 Google DeepMind의 연구 전문성을 활용했다.

경쟁에도 불구하고 Gemini 2.5는 특히 이미 Google Cloud를 사용하는 개발자와 기업 사이에서 traction을 얻었다. GitHub Copilot(플러그인을 통해)과 같은 인기 있는 도구와의 통합 및 여러 지역에서의 가용성은 채택에 기여했다.

향후 방향

2025년 3월 출시 이후, Google은 Gemini 2.5를 계속 반복하여 성능을 개선하고 지연 시간을 줄이기 위한 사소한 업데이트를 출시했다. 회사는 또한 더 큰 컨텍스트 창과 더 효율적인 아키텍처를 갖춘 향후 버전을 암시했다. 비디오 및 실시간 상호 작용을 포함한 다중 모드 이해에 대한 연구가 진행 중이며, Gemini를 더 일반적인 목적의 AI 어시스턴트로 만드는 것을 목표로 했다.

Google은 또한 데미스 허사비스가 2023년에 언급한 대로 로봇 공학과 Gemini를 결합하여 물리적 세계 상호 작용을 가능하게 하는 것을 탐구했다. 또한 회사는 안전 및 정렬에 초점을 맞추어 정부와 테스트 결과를 공유하고 2023년 10월 미국 대통령 조 바이든이 서명한 행정 명령과 같은 규제 프레임워크를 준수했다.

Gemini 2.5의 출시는 대규모 언어 모델의 진화에서 중요한 이정표를 세웠으며, 더 깊이 추론할 수 있는 "사고" 모델의 실현 가능성을 보여주었다. AI 분야가 발전함에 따라 이러한 모델은 표준이 될 가능성이 높으며, 소프트웨어 개발, 교육 및 과학 연구에 영향을 미칠 것이다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:artificial-intelligence·google-deepmind·large-language-model·event
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사