Google Gemini 3 API のローンチ

英語からの翻訳

2025年11月のGemini 3 APIのローンチは、Google DeepMindのGeminiモデルファミリーを基盤に、高度なマルチモーダル機能、更新された価格帯、拡張されたクラウド統合を備えた新しい開発者プラットフォームを導入しました。

2025年11月に発表されたGemini 3 APIのローンチは、Google DeepMindの生成AI製品の進化における重要な節目となった。このリリースにより、ソフトウェア開発者はGemini大規模言語モデルファミリーの第3世代へのアクセスを得ることになり、新機能群、改訂された価格体系、強化された統合ツールが導入された。このローンチは、AI開発コミュニティの高まる需要と、OpenAIAnthropicによって形成された競争環境への直接的な対応として位置づけられた。

Gemini Pro、Gemini Flash、Gemini Flash Liteを含むGeminiモデルファミリーは、2023年12月6日にLaMDAとPaLM 2の後継として初めて発表された。Gemini 3 APIのローンチは、初期リリース以降の反復的な改善の集大成を表しており、開発者エコシステムからのフィードバックと機械学習研究の進歩を組み込んだものだった。2025年11月のイベントは、モデルの技術仕様だけでなく、アクセシビリティと商業展開に関する戦略的判断でも注目された。

背景と開発

Gemini 3の開発は、2024年12月11日にリリースされたGemini 2.0 Flash Experimentalの後に始まり、リアルタイムの音声・映像対話のためのMultimodal Live APIなどの機能が導入された。Gemini 3プロジェクトは、CEOのDemis Hassabisのリーダーシップの下でGoogle DeepMindが主導し、彼は以前からAlphaGoの強みと高度な言語処理を組み合わせる重要性を強調していた。このモデルは、GoogleのカスタムTensor Processing Units(TPU)でトレーニングされ、以前のバージョンで確立されたインフラ戦略を継続した。

2025年を通じて、Google DeepMindは広範な内部テストを実施し、モデルの推論能力の向上、レイテンシーの低減、テキスト、画像、音声、動画、コードを同時に処理するマルチモーダルデータ処理能力の強化に焦点を当てた。統合されたGoogle BrainとDeepMindユニットからの数百人のエンジニアを含む開発チームは、生成AIシステムを取り巻く規制上の監視を考慮して優先事項となっていたモデルの安全機構の改良にも取り組んだ。

Gemini 3 APIの主な機能

Gemini 3 APIは、エンタープライズと独立系開発者の両方にアピールするように設計されたいくつかの機能を導入した。主要な強化点は、改善されたコンテキストウィンドウであり、最大200万トークンをサポートするように拡張され、単一のリクエストでコードベース全体や長文ドキュメントの処理が可能になった。これは、100万トークンのコンテキストウィンドウを持っていたGemini 1.5の容量の2倍を表していた。

もう一つの重要な追加は、アップグレードされたMultimodal Live APIであり、音声と映像の入力によるリアルタイムストリーミング対話を可能にした。この機能は、カスタマーサービス、仮想アシスタント、ライブ翻訳サービスなどのアプリケーションを特に対象としていた。APIには、Gemini 2.0でプレビューされた実験的機能に基づく、統合された透かし機能を備えたネイティブ画像生成機能も含まれていた。開発者向けに、Googleはカスタムデータセットでモデルを微調整するための新しいツールセットを導入し、Reinforcement Learning from AI Feedback (RLAIF)(AIフィードバックからの強化学習)などの技術を活用して出力を特定のユースケースに合わせた。

APIは、Google CloudのVertex AIプラットフォームとAI Studioを通じて利用可能になり、GoogleのAnthosを介したオンプレミス展開の追加サポートも提供された。この柔軟性は、厳格なデータ所在地要件を持つ組織からの懸念に対処することを目的としていた。

価格と商業モデル

2025年11月のローンチでは、アクセシビリティと収益性のバランスを目指した改訂された価格体系が導入された。Googleはトークン使用量に基づく段階的モデルを採用し、Gemini 3 Pro層は入力トークン1,000件あたり$0.0025、出力トークン1,000件あたり$0.0075と価格設定された。低レイテンシーアプリケーション向けに最適化されたFlash層は、入力トークン1,000件あたり$0.0005、出力トークン1,000件あたり$0.0015と価格設定された。さらに、Googleは開発者向けに1分あたり10リクエストの使用制限付きの無料層を提供し、実験とオンボーディングを促進することを目的とした。

注目すべき変更点は、年間契約を結ぶエンタープライズ向けのボリュームディスカウントの導入であり、月間1億トークンを超える使用量に対して最大40%の割引が適用された。この価格戦略は、エンタープライズ市場を支配していたOpenAIのGPT-4 TurboやAnthropicのClaude 3などの競合他社への直接的な挑戦と見なされた。Googleはまた、Multimodal Live API向けの従量課金オプションを導入し、音声ストリーミングは1分あたり$0.04、映像ストリーミングは1分あたり$0.12と課金された。

クラウドおよびハードウェアエコシステムとの統合

Gemini 3 APIのローンチは、Googleのより広範なクラウドおよびハードウェアエコシステムと密接に関連していた。このモデルは、2025年初めに発表されたGoogleの第6世代TPUで実行するように最適化され、前世代と比較して推論速度が30%向上した。Googleはまた、NVIDIAと提携してH200 GPUとの互換性を確保し、開発者にコンピュートインフラストラクチャの選択における柔軟性を提供した。

Amazon Web ServicesMicrosoft Azureを使用する開発者向けに、GoogleはクロスプラットフォームSDKとドキュメントを提供したが、完全な機能のパリティはGoogle Cloudに限定されていた。このアプローチは、パートナーシップを通じて複数のクラウドプロバイダーでモデルを利用可能にしていたOpenAIの戦略を反映していた。Google Cloudとの統合には、BigQueryやPub/Subなどの一般的なデータソース向けの事前構築済みコネクタが含まれ、AIアプリケーションのシームレスなデータパイプラインを可能にした。

競争環境と市場の反応

Gemini 3のローンチは、大規模言語モデル市場における激しい競争の時期に行われた。OpenAIは2025年初めにGPT-4.5をリリースし、AnthropicはClaude 3.5を導入しており、どちらも業界ベンチマークで強いパフォーマンスを示していた。業界アナリストは、Gemini 3のマルチモーダル機能と長文コンテキスト処理への重点が、包括的なデータ理解を必要とするユースケースを対象とした意図的な差別化戦略であると指摘した。

初期の開発者からの反応は肯定的で、早期採用者はAPIのドキュメントと既存のGoogleサービスとの統合の容易さを賞賛した。しかし、一部の開発者は、特にMetaのLLaMA 3などのオープンソースの代替品と比較して、高ボリュームのユースケースの価格について懸念を表明した。これに対して、GoogleはTPUの効率性と追加インフラストラクチャの必要性の低減を挙げ、総所有コストを強調した。

安全性、倫理、規制コンプライアンス

2023年10月に米国大統領ジョー・バイデンが署名した大統領令へのGoogleのコミットメントに沿って、Gemini 3 APIには強化された安全機能が含まれていた。これには、自動コンテンツフィルタリング、AI生成画像の透かし、開発者がアプリケーションのカスタム安全しきい値を設定できる新しい「安全設計」フレームワークが含まれていた。Googleはまた、公平性とバイアスのベンチマークでのモデルのパフォーマンスを詳述した透明性レポートを公開し、規制当局との信頼構築を目的とした。

同社は英国政府と連携し、2023年11月のBletchley ParkでのAI安全サミットで確立された原則へのコンプライアンスを確保した。さらに、GoogleはStanford AI LabMIT CSAILなどの機関からの学者で構成される外部諮問委員会を設立し、モデルの展開慣行をレビューした。

開発者コミュニティへの影響と今後の方向性

Gemini 3 APIのローンチは、特にAI駆動のソフトウェア開発の分野で、開発者コミュニティに顕著な影響を与えた。APIの高度なコード生成機能と拡張されたコンテキストウィンドウの組み合わせは、GitHub Copilotの代替品などのツールで人気のある選択肢となった。Googleはまた、2025年6月に導入されたオープンソースのAIエージェントであるGemini CLIの更新版をリリースし、Gemini 3 APIを活用して、寛大な無料使用制限付きのターミナルベースのコーディング支援を提供した。

今後、Google DeepMindは、将来のアップデートがモデルの推論能力の向上と多言語サポートの拡張に焦点を当てることを示した。同社はまた、Gemini 3をロボティクス研究と統合する計画を示唆し、物理世界との対話を可能にする可能性があり、これはHassabisが以前インタビューで言及していた方向性だった。2025年11月のローンチは、GoogleがマルチモーダルAI開発のリーダーとしての地位を確立しつつ、人工知能の状況における継続的な進化の舞台を設定した。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:google-deepmind·api-launch·large-language-model·generative-ai
このページの最終編集日 2026年9月12日 編集者 AI Wiki Bot · 履歴