Google Gemini 3는 Google DeepMind가 개발하고 2025년 11월에 출시한 다중 모드 대규모 언어 모델 제품군이다. Gemini 3 뉴스 출시는 이번 출시에 대한 공개 발표를 의미하며, 인공 지능 업계의 주요 진전이자 2023년 12월에 도입된 Gemini 모델 라인의 차세대 버전으로 제시되었다.
Gemini는 Google의 초기 LaMDA 및 PaLM 2 모델의 후속 모델이며 Gemini 챗봇을 구동한다. 이름은 쌍둥이자리에서 유래했다. 초기 Gemini 제품군에는 Gemini Pro, Gemini Deep Think, Gemini Flash, Gemini Flash Lite가 포함되었으며, 이후 버전은 Gemini 1.5 및 Gemini 2.0으로 확장되었다. Gemini 3는 모델이 텍스트, 이미지, 오디오, 비디오 및 컴퓨터 코드를 처리할 수 있도록 하는 다중 모드 접근 방식을 기반으로 구축된 가장 강력한 버전으로 자리매김했다.
배경
Google은 2023년 5월 10일 Google I/O 기조 연설에서 자회사인 Google DeepMind가 개발한 대규모 언어 모델인 Gemini를 처음 발표했다. 이는 같은 행사에서 공개된 PaLM 2보다 더 강력한 후속 모델로 설명되었다. Google CEO 순다르 피차이는 당시 Gemini가 아직 초기 개발 단계에 있다고 말했다. 다른 많은 언어 모델과 달리 Gemini는 처음부터 다중 모드로 설계되어 텍스트, 이미지, 오디오, 비디오 및 컴퓨터 코드를 포함한 여러 유형의 데이터를 동시에 처리할 수 있었다. 이 프로젝트는 Google DeepMind로 합병된 Google의 두 부서인 DeepMind와 Google Brain 간의 협업이었다.
와이어드와의 인터뷰에서 DeepMind CEO 데미스 허사비스는 Gemini의 고급 기능을 통해 GPT-4에서 실행되는 OpenAI의 ChatGPT를 능가할 수 있을 것이라고 말했다. 허사비스는 2016년 바둑 챔피언 이세돌을 꺾으며 전 세계의 주목을 받은 DeepMind의 AlphaGo 프로그램의 강점을 강조하며 Gemini가 AlphaGo의 힘을 다른 Google DeepMind 언어 모델과 결합할 것이라고 말했다. 2023년 8월, The Information은 Google이 2023년 말 출시를 목표로 하고 있으며 대화형 텍스트 기능과 AI 기반 이미지 생성을 결합하여 OpenAI 및 기타 경쟁사를 능가하기를 희망한다고 보도했다. Google 공동 창업자 세르게이 브린이 Gemini 개발을 돕기 위해 은퇴에서 소환된 것으로 알려졌으며, Google Brain과 DeepMind의 수백 명의 엔지니어도 참여했다. Gemini가 YouTube 동영상의 대본으로 훈련되었기 때문에 잠재적인 저작권 자료를 걸러내기 위해 변호사들이 투입되었다.
출시 전 개발
2023년 12월 6일, 피차이와 허사비스는 가상 기자 회견에서 Gemini 1.0을 발표했다. 초기 출시에는 매우 복잡한 작업을 위한 Gemini Ultra, 다양한 작업을 위한 Gemini Pro, 기기 내 작업을 위한 Gemini Nano의 세 가지 모델이 포함되었다. 출시 당시 Gemini Pro와 Nano는 각각 Bard와 Pixel 8 Pro 스마트폰에 통합되었다. Gemini Ultra는 이후 "Bard Advanced" 등급을 구동하고 2024년 초에 소프트웨어 개발자에게 제공될 예정이었다. Google은 광범위한 안전 테스트의 필요성 때문에 Gemini를 다음 해까지 널리 제공하지 않을 것이라고 밝혔다. Gemini는 Google의 Tensor Processing Unit에서 훈련되었으며, 이름은 NASA의 제미니 계획과 DeepMind-Google Brain 합병을 모두 언급한 것이기도 하다.
Gemini Ultra는 다양한 업계 벤치마크에서 GPT-4, Anthropic의 Claude 2, Inflection AI의 Inflection-2, Meta의 LLaMA 2 및 xAI의 Grok 1보다 우수한 성능을 보인 것으로 보고되었다. 또한 57개 과목의 Massive Multitask Language Understanding 테스트에서 90%의 점수로 인간 전문가를 능가한 최초의 언어 모델이었다. Gemini Pro는 2023년 12월 13일에 AI Studio 및 Vertex AI의 Google Cloud 고객에게 제공되었다. 2023년 10월 조 바이든 미국 대통령이 서명한 행정 명령에 따라 Google은 Gemini Ultra의 테스트 결과를 연방 정부와 공유할 것이라고 밝혔다. 또한 회사는 블레츨리 파크 AI 안전 정상 회의의 원칙을 준수하기 위해 영국 정부와 논의했다.
2024년 1월, Google은 삼성과 협력하여 Gemini Nano와 Gemini Pro를 Galaxy S24 스마트폰 라인업에 통합했다. 다음 달, Bard와 Duet AI는 Gemini 브랜드로 통합되었고, Gemini Advanced with Ultra 1.0은 Google One의 새로운 AI Premium 등급을 통해 출시되었다. 2024년 2월, Google은 Gemini 1.5를 출시하면서 1.0 Ultra보다 더 강력하고, 새로운 아키텍처, 전문가 혼합 접근 방식, 더 큰 100만 토큰 컨텍스트 창을 갖추었다고 설명했다. 같은 달, Google은 더 작고 무료이며 오픈 소스인 Gemma 모델 범위를 공개했다. 2024년 5월 14일 Google I/O 기조 연설에서 Google은 Gemini 1.5 Flash와 Chrome 브라우저에 데스크톱 최적화 빌드인 Gemini Nano를 Built-in AI 아키텍처를 통해 통합할 계획을 발표했다. 업데이트된 두 모델인 Gemini-1.5-Pro-002 및 Gemini-1.5-Flash-002는 2024년 9월 24일에 출시되었다.
2024년 12월 11일, Google은 Gemini 2.0 Flash Experimental을 발표했다. 이 버전은 실시간 오디오 및 비디오 상호 작용을 위한 Multimodal Live API, 워터마킹이 포함된 기본 이미지 및 제어 가능한 텍스트 음성 변환 생성, 통합 Google 검색을 도입했다. 2025년 6월, Google은 Gemini 기능을 터미널에 제공하는 오픈 소스 AI 에이전트인 Gemini CLI를 도입하여 개별 개발자에게 넉넉한 무료 사용 한도와 함께 코딩, 자동화 및 문제 해결 기능을 제공했다. 이러한 출시는 그해 말 Gemini 3 출시의 발판을 마련했다.
2025년 11월 출시 행사
Gemini 3 뉴스 출시는 2025년 11월 가상 언론 행사로 진행되었다. Google DeepMind는 Gemini 3를 Gemini 2.0의 후속 모델이자 Gemini 제품군의 최신 주요 릴리스로 발표했다. 이 행사는 생성형 AI 업계의 관심을 끌었으며 2023년 12월의 원래 Gemini 1.0 발표와 비교되었다. Google에 따르면 Gemini 3는 Gemini 2.0에서 도입된 기본 이미지 생성 및 제어 가능한 텍스트 음성 변환과 같은 기능을 기반으로 추론, 긴 컨텍스트 이해 및 다중 모드 출력의 개선을 통합했다.
이전 Gemini 출시와 마찬가지로 회사는 안전 테스트와 책임 있는 배포를 강조했다. Google은 Gemini Ultra로 설정된 선례에 따라 정부 기관과 평가 결과를 계속 공유할 것이라고 밝혔다. 또한 회사는 Search, Chrome 및 Google Cloud를 포함한 Google 서비스와의 Gemini 3 통합을 강조했다. 행사에서 Google은 Gemini 3가 2023년 12월 Gemini Pro에 사용된 배포 모델을 확장하여 Vertex AI 및 AI Studio를 통해 개발자에게 제공될 것이라고 발표했다.
모델 제품군 및 기술 아키텍처
Gemini 3는 Gemini 제품군을 텍스트 전용 대규모 언어 모델과 구별하는 다중 모드 설계를 지속했다. 기본 아키텍처는 2017년에 도입되어 현대 언어 모델의 표준이 된 딥 러닝 접근 방식인 트랜스포머 모델을 기반으로 한다. Gemini 1.5와 마찬가지로 Gemini 3는 신경망의 서로 다른 부분이 서로 다른 유형의 입력에 대해 활성화되는 전문가 혼합 설계를 사용할 것으로 예상되었다. 이 접근 방식은 모델이 많은 양의 데이터를 처리하면서 계산 비용을 관리 가능한 수준으로 유지하는 데 도움이 된다.
Gemini 제품군은 역사적으로 다양한 사용 사례를 제공하기 위해 여러 등급을 포함했다. 초기 라인업은 Gemini Ultra, Pro 및 Nano로 구성되었으며 이후 버전에는 Flash 및 Flash Lite가 추가되었다. Gemini 3의 경우 Google은 전체 모델 변형 세트를 즉시 공개하지 않았지만 출시에는 Pro, Flash 및 Deep Think 등급이 포함될 것으로 예상되었다. 출시 시점 현재 매개변수 수 및 훈련 데이터 크기와 같은 자세한 기술 사양은 완전히 공개되지 않았다. Google은 Gemini 3가 이전 Gemini 모델에 사용된 하드웨어 전략을 이어받아 Tensor Processing Unit에서 훈련되었다고 밝혔다.
모델의 다중 모드 기능을 통해 텍스트, 이미지, 오디오 및 비디오를 처리하고 생성할 수 있다. 이는 많은 모델이 단일 양식으로 제한되는 머신 러닝 분야의 핵심 차별화 요소이다. 단일 시스템에서 이러한 양식을 결합하는 Gemini 3의 능력은 더 풍부한 방식으로 세계와 상호 작용할 수 있는 보다 일반적인 인공 지능 시스템을 향한 단계로 제시되었다.
업계 및 경쟁 구도
Gemini 3 출시는 대규모 언어 모델 시장에서 치열한 경쟁이 벌어지는 시기에 이루어졌다. OpenAI는 GPT-4를 출시하고 ChatGPT 서비스를 계속 업데이트했으며, Anthropic은 Claude 시리즈 모델을 개발했다. Google은 이전 Gemini 버전의 벤치마크 성능을 기반으로 Gemini 3를 이러한 시스템의 직접적인 경쟁자로 포지셔닝했다. Gemini Ultra는 이미 여러 업계 벤치마크에서 GPT-4 및 Claude 2를 능가했으며 Google은 Gemini 3가 그 격차를 더욱 확대했다고 주장했지만 출시 시점 현재 독립적인 검증은 아직 이루어지지 않았다.
이 행사는 또한 AI 인프라에 대한 투자가 증가하는 배경에서 열렸다. Google Cloud, Amazon Web Services 및 Microsoft Azure를 포함한 주요 클라우드 제공업체는 주요 모델에 대한 액세스를 제공하기 위해 경쟁하고 있었다. Google이 Vertex AI 및 AI Studio를 통해 Gemini 3를 제공하기로 한 결정은 개발자와 기업 고객을 유치하기 위한 광범위한 전략의 일부였다. 회사는 또한 2024년 2월 Gemma의 데뷔로 이어진 오픈 소스 모델 출시의 압력에 직면했다. Gemini 3의 출시는 안전, 저작권 및 대규모 모델 훈련의 환경 영향에 대한 우려를 해결하면서 AI 업계 최전선에서 Google의 위치를 유지하려는 시도로 여겨졌다.
가용성 및 생태계
Gemini 3는 출시 시 여러 채널을 통해 제공되었다. 개발자는 2023년 12월 Gemini Pro에 사용된 것과 동일한 경로를 따라 Google Cloud의 Vertex AI 및 AI Studio를 통해 모델에 액세스할 수 있었다. Google은 또한 Gemini 3가 Gemini 챗봇과 Search, Chrome 및 Workspace를 포함한 다른 Google 제품에 통합될 것이라고 밝혔다. 이는 Search, Ads, Chrome, Duet AI 및 AlphaCode 2를 포함한 Gemini 1.0에 대해 발표된 통합 계획을 반영한 것이다.
소비자 측면에서 Google은 이전에 삼성과 협력하여 Gemini Nano 및 Pro를 Galaxy S24에 도입했으며 Gemini 3는 향후 Android 기기에 등장할 것으로 예상되었다. 2025년 6월에 도입된 오픈 소스 Gemini CLI도 Gemini 3를 지원하도록 업데이트되어 개발자에게 코딩 및 자동화 작업을 위한 터미널 기반 인터페이스를 제공했다. Google의 광범위한 생태계 전략은 독점 서비스와 오픈 도구를 통해 Gemini를 제공하는 것이었으며, 이는 회사가 Gemma 출시 이후 다듬어 온 균형이었다.
반응 및 의의
Gemini 3 뉴스 출시는 AI 업계의 주요 사건으로 널리 보도되었다. 분석가들은 이번 출시가 원래 Gemini 1.0 발표 이후 2년도 채 되지 않아 이루어졌으며, 이는 해당 분야의 빠른 개발 속도를 반영한다고 언급했다. 이 행사는 Google DeepMind의 다중 모드 AI에 대한 지속적인 투자와 OpenAI 및 Anthropic과 경쟁하려는 노력을 강조했다. 출시 시점 현재 Gemini 3에 대한 독립적인 벤치마크 결과는 아직 발표되지 않았으며 모델의 장기적인 영향은 아직 지켜봐야 한다. 그럼에도 불구하고 이번 출시는 초기 LaMDA 및 PaLM 2 시스템에서 생성형 AI를 위한 광범위한 플랫폼으로 진화한 모델 제품군을 통해 Google DeepMind가 인공 지능 분야의 선도적인 연구 기관 중 하나로 자리매김했음을 강화했다.