Google Gemini 3 API 출시

영어에서 번역됨

2025년 11월의 Gemini 3 API 출시는 Google DeepMind의 Gemini 모델 제품군을 기반으로, 고급 멀티모달 기능, 업데이트된 가격 체계, 확장된 클라우드 통합을 갖춘 새로운 개발자 플랫폼을 도입했습니다.

2025년 11월에 발표된 Gemini 3 API 출시는 Google DeepMind의 생성형 AI 제품군 진화에 있어 중요한 이정표가 되었다. 이번 출시는 소프트웨어 개발자들에게 Gemini 대규모 언어 모델 제품군의 세 번째 주요 버전에 대한 접근 권한을 제공하며, 새로운 기능 모음, 개정된 가격 구조, 향상된 통합 도구를 도입했다. 이 출시는 AI 개발 커뮤니티의 증가하는 요구와 OpenAIAnthropic이 형성한 경쟁 구도에 대한 직접적인 대응으로 자리매김했다.

Gemini Pro, Gemini Flash, Gemini Flash Lite를 포함하는 Gemini 모델 제품군은 2023년 12월 6일 LaMDA와 PaLM 2의 후속 모델로 처음 발표되었다. Gemini 3 API 출시는 초기 출시 이후의 반복적 개선, 개발자 생태계의 피드백 반영, Machine learning 연구의 발전이 결합된 결과였다. 2025년 11월 행사는 모델의 기술적 사양뿐만 아니라 접근성과 상업적 배포에 관한 전략적 결정으로도 주목을 받았다.

배경 및 개발

Gemini 3의 개발은 실시간 오디오 및 비디오 상호작용을 위한 Multimodal Live API와 같은 기능을 도입한 Gemini 2.0 Flash Experimental 출시(2024년 12월 11일) 이후 시작되었다. Gemini 3 프로젝트는 CEO 데미스 하사비스의 지도 아래 Google DeepMind가 주도했으며, 그는 이전에 AlphaGo의 강점과 고급 언어 처리를 결합하는 것의 중요성을 강조한 바 있다. 이 모델은 이전 버전에서 수립된 인프라 전략을 이어받아 Google의 맞춤형 Tensor Processing Units(TPU)에서 훈련되었다.

2025년 내내 Google DeepMind는 모델의 추론 능력 개선, 지연 시간 감소, 텍스트, 이미지, 오디오, 비디오, 코드를 동시에 처리하는 멀티모달 데이터 처리 능력 향상에 초점을 맞춘 광범위한 내부 테스트를 수행했다. 통합된 Google Brain 및 DeepMind 부서의 수백 명의 엔지니어로 구성된 개발 팀은 Generative AI 시스템을 둘러싼 규제적 조사를 고려하여 모델의 안전 메커니즘 개선에도 힘썼다.

Gemini 3 API의 주요 기능

Gemini 3 API는 기업 및 독립 개발자 모두를 대상으로 한 여러 기능을 도입했다. 주요 개선 사항 중 하나는 향상된 컨텍스트 창으로, 최대 200만 토큰을 지원하여 단일 요청으로 전체 코드베이스나 긴 문서를 처리할 수 있게 되었다. 이는 100만 토큰 컨텍스트 창을 가졌던 Gemini 1.5의 용량을 두 배로 늘린 것이다.

또 다른 중요한 추가 사항은 오디오 및 비디오 입력과의 실시간 스트리밍 상호작용을 가능하게 하는 업그레이드된 Multimodal Live API였다. 이 기능은 특히 고객 서비스, 가상 비서, 실시간 번역 서비스의 애플리케이션을 겨냥했다. API에는 Gemini 2.0에서 미리 보여진 실험적 기능을 기반으로 한 통합 워터마킹 기능이 있는 네이티브 이미지 생성 기능도 포함되었다. 개발자를 위해 Google은 Reinforcement Learning from AI Feedback (RLAIF)(AI 피드백 기반 강화 학습)와 같은 기술을 활용하여 특정 사용 사례에 맞게 출력을 조정하는 맞춤형 데이터셋에서 모델을 미세 조정하는 새로운 도구 세트를 도입했다.

API는 Google Cloud의 Vertex AI 플랫폼과 AI Studio를 통해 제공되었으며, Google의 Anthos를 통한 온프레미스 배포도 추가로 지원되었다. 이러한 유연성은 엄격한 데이터 거주 요구 사항을 가진 조직의 우려를 해소하기 위한 것이었다.

가격 및 상업 모델

2025년 11월 출시는 접근성과 수익성의 균형을 목표로 한 개정된 가격 구조를 도입했다. Google은 토큰 사용량에 기반한 계층형 모델을 채택했으며, Gemini 3 Pro 계층은 입력 토큰 1,000개당 $0.0025, 출력 토큰 1,000개당 $0.0075로 책정되었다. 저지연 애플리케이션에 최적화된 Flash 계층은 입력 토큰 1,000개당 $0.0005, 출력 토큰 1,000개당 $0.0015로 책정되었다. 또한 Google은 분당 10회 요청의 사용 제한이 있는 무료 계층을 개발자에게 제공하여 실험과 온보딩을 장려했다.

주목할 만한 변화는 연간 계약을 체결한 기업을 위한 볼륨 할인 도입으로, 월 1억 토큰을 초과하는 사용량에 대해 최대 40%의 할인이 적용되었다. 이 가격 전략은 기업 시장을 지배해 온 OpenAI의 GPT-4 Turbo 및 Anthropic의 Claude 3와 같은 경쟁사에 대한 직접적인 도전으로 여겨졌다. Google은 또한 Multimodal Live API에 대한 종량제 옵션을 도입하여 오디오 스트리밍 분당 $0.04, 비디오 스트리밍 분당 $0.12를 청구했다.

클라우드 및 하드웨어 생태계와의 통합

Gemini 3 API 출시는 Google의 광범위한 클라우드 및 하드웨어 생태계와 밀접하게 연관되었다. 이 모델은 2025년 초에 발표된 6세대 TPU에서 실행되도록 최적화되었으며, 이전 세대보다 추론 속도가 30% 향상되었다. Google은 또한 NVIDIA와 협력하여 H200 GPU와의 호환성을 보장함으로써 개발자에게 컴퓨팅 인프라 선택의 유연성을 제공했다.

Amazon Web Services 또는 Microsoft Azure를 사용하는 개발자를 위해 Google은 교차 플랫폼 SDK와 문서를 제공했지만, 완전한 기능 동등성은 Google Cloud로 제한되었다. 이 접근 방식은 파트너십을 통해 여러 클라우드 제공업체에서 모델을 제공한 OpenAI의 전략을 반영한 것이다. Google Cloud와의 통합에는 BigQuery 및 Pub/Sub와 같은 인기 있는 데이터 소스에 대한 사전 구축 커넥터가 포함되어 AI 애플리케이션을 위한 원활한 데이터 파이프라인을 가능하게 했다.

경쟁 구도 및 시장 반응

Gemini 3 출시는 대규모 언어 모델 시장에서 치열한 경쟁이 벌어지던 시기에 이루어졌다. OpenAI는 2025년 초 GPT-4.5를 출시했고, Anthropic은 Claude 3.5를 도입했으며, 둘 다 업계 벤치마크에서 강력한 성능을 보였다. 업계 분석가들은 Gemini 3의 멀티모달 기능과 장문 컨텍스트 처리에 대한 강조가 포괄적인 데이터 이해가 필요한 사용 사례를 겨냥한 의도적인 차별화 전략이라고 지적했다.

초기 개발자 반응은 긍정적이었으며, 초기 채택자들은 API의 문서화와 기존 Google 서비스와의 통합 용이성을 칭찬했다. 그러나 일부 개발자들은 Meta의 LLaMA 3와 같은 오픈소스 대안과 비교하여 고용량 사용 사례의 가격에 대한 우려를 표명했다. 이에 대해 Google은 TPU의 효율성과 추가 인프라 필요성 감소를 언급하며 총소유비용을 강조했다.

안전, 윤리 및 규제 준수

2023년 10월 조 바이든 미국 대통령이 서명한 행정 명령에 따른 Google의 약속에 부합하여, Gemini 3 API에는 향상된 안전 기능이 포함되었다. 여기에는 자동 콘텐츠 필터링, AI 생성 이미지 워터마킹, 개발자가 애플리케이션에 대한 맞춤형 안전 임계값을 설정할 수 있는 새로운 "안전 우선 설계" 프레임워크가 포함되었다. Google은 또한 공정성 및 편향 벤치마크에 대한 모델 성능을 상세히 설명하는 투명성 보고서를 발표하여 규제 기관과의 신뢰 구축을 목표로 했다.

회사는 2023년 11월 Bletchley Park에서 열린 AI 안전 정상 회의에서 수립된 원칙을 준수하기 위해 영국 정부와 협력했다. 또한 Google은 Stanford AI LabMIT CSAIL과 같은 기관의 학자들로 구성된 외부 자문 위원회를 설립하여 모델의 배포 관행을 검토했다.

개발자 커뮤니티에 미치는 영향 및 향후 방향

Gemini 3 API 출시는 특히 AI 기반 소프트웨어 개발 분야에서 개발자 커뮤니티에 주목할 만한 영향을 미쳤다. API의 고급 코드 생성 기능과 확장된 컨텍스트 창은 GitHub Copilot 대안과 같은 도구에서 인기 있는 선택이 되었다. Google은 또한 2025년 6월에 도입된 오픈소스 AI 에이전트인 Gemini CLI의 업데이트 버전을 출시했으며, 이는 Gemini 3 API를 활용하여 넉넉한 무료 사용 제한으로 터미널 기반 코딩 지원을 제공했다.

향후 Google DeepMind는 향후 업데이트가 모델의 추론 능력 개선과 다국어 지원 확장에 초점을 맞출 것이라고 밝혔다. 회사는 또한 Gemini 3을 로봇 연구와 통합할 계획을 암시했으며, 이는 하사비스가 이전 인터뷰에서 언급한 물리적 세계 상호작용을 가능하게 할 잠재적 방향이다. 따라서 2025년 11월 출시는 Google이 멀티모달 AI 개발의 선두주자로 자리매김하면서 Artificial intelligence 환경의 지속적인 진화를 위한 토대를 마련했다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:google-deepmind·api-launch·large-language-model·generative-ai
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사