Google Gemini 3は、Google DeepMindによって開発され、2025年11月に公開されたマルチモーダル大規模言語モデルのファミリーである。Gemini 3ニュースローンチとは、このリリースの公的な発表を指し、人工知能業界における大きな前進であり、2023年12月に導入されたGeminiモデルラインの次世代として提示された。
Geminiは、Googleの初期のLaMDAやPaLM 2の後継であり、Geminiチャットボットを支えている。その名前は、ふたご座に由来する。当初のGeminiファミリーには、Gemini Pro、Gemini Deep Think、Gemini Flash、Gemini Flash Liteが含まれ、後のバージョンではGemini 1.5とGemini 2.0が追加された。Gemini 3は、これまでで最も高性能なバージョンとして位置づけられ、テキスト、画像、音声、動画、コンピュータコードを処理できるマルチモーダルなアプローチを基盤としていた。
背景
Googleは、2023年5月10日のGoogle I/O基調講演で、子会社であるGoogle DeepMindが開発した大規模言語モデルであるGeminiを初めて発表した。これは、同じイベントで発表されたPaLM 2のより強力な後継として説明された。当時、GoogleのCEOであるサンダー・ピチャイは、Geminiはまだ開発初期段階にあると述べた。他の多くの言語モデルとは異なり、Geminiは当初からマルチモーダルになるように設計されており、テキスト、画像、音声、動画、コンピュータコードなど、複数の種類のデータを同時に処理できることを意味していた。このプロジェクトは、DeepMindとGoogle Brainという、後にGoogle DeepMindに統合されたGoogleの2つの部門の協力によるものだった。
Wiredとのインタビューで、DeepMindのCEOであるデミス・ハサビスは、Geminiの高度な機能により、GPT-4上で動作するOpenAIのChatGPTを凌駕できるようになると述べた。ハサビスは、2016年に囲碁チャンピオンのイ・セドルを破って世界的な注目を集めたDeepMindのAlphaGoプログラムの強みを強調し、GeminiはAlphaGoの能力と他のGoogle DeepMind言語モデルを組み合わせたものになると述べた。2023年8月、The Informationは、Googleが2023年末のリリースを目標としており、会話型テキスト機能とAIによる画像生成を組み合わせることで、OpenAIや他の競合他社を凌駕しようとしていると報じた。Googleの共同創業者であるサーゲイ・ブリンは、引退から呼び戻されてGeminiの開発を支援したと報じられており、Google BrainとDeepMindの数百人のエンジニアも参加した。GeminiはYouTube動画の書き起こしで訓練されたため、著作権の可能性のある素材を除外するために弁護士が起用された。
発売前の開発
2023年12月6日、ピチャイとハサビスはオンライン記者会見でGemini 1.0を発表した。初期リリースには、非常に複雑なタスク向けのGemini Ultra、幅広いタスク向けのGemini Pro、デバイス上のタスク向けのGemini Nanoの3つのモデルが含まれていた。発売時点で、Gemini ProとNanoはそれぞれBardとPixel 8 Proスマートフォンに統合された。Gemini Ultraは、後の「Bard Advanced」ティアを支え、2024年初頭にソフトウェア開発者に提供される予定だった。Googleは、広範な安全性テストの必要性から、Geminiを翌年まで広く利用可能にしないと述べた。GeminiはGoogleのTensor Processing Unitで訓練され、その名前はNASAのジェミニ計画とDeepMindとGoogle Brainの合併の両方を参照していた。
Gemini Ultraは、さまざまな業界ベンチマークで、GPT-4、AnthropicのClaude 2、Inflection AIのInflection-2、MetaのLLaMA 2、xAIのGrok 1を上回ったと報告された。また、57科目のMassive Multitask Language Understandingテストで、人間の専門家を上回った最初の言語モデルとなり、90パーセントのスコアを達成した。Gemini Proは、2023年12月13日にGoogle Cloudの顧客向けにAI StudioとVertex AIで利用可能になった。2023年10月に米国大統領ジョー・バイデンが署名した大統領令に従い、GoogleはGemini Ultraのテスト結果を連邦政府と共有すると述べた。同社はまた、ブレッチリー・パークでのAI安全サミットの原則を順守するため、英国政府との協議にも参加した。
2024年1月、Googleはサムスンと提携し、Gemini NanoとGemini ProをGalaxy S24スマートフォンラインナップに統合した。翌月、BardとDuet AIはGeminiブランドの下に統合され、Gemini Advanced with Ultra 1.0がGoogle Oneの新しいAI Premiumティアを通じてリリースされた。2024年2月、GoogleはGemini 1.5を発表し、1.0 Ultraよりも強力で、新しいアーキテクチャ、混合専門家アプローチ、より大きな1万トークンのコンテキストウィンドウを備えていると説明した。同月、Googleはより小型で無料のオープンソースのGeminiモデル群であるGemmaを発表した。2024年5月14日のGoogle I/O基調講演で、GoogleはGemini 1.5 Flashと、デスクトップ最適化ビルドのGemini NanoをChromeブラウザにBuilt-in AIアーキテクチャを通じて統合する計画を発表した。2つの更新モデル、Gemini-1.5-Pro-002とGemini-1.5-Flash-002は、2024年9月24日にリリースされた。
2024年12月11日、GoogleはGemini 2.0 Flash Experimentalを発表した。このバージョンでは、リアルタイムの音声・動画インタラクションのためのMultimodal Live API、透かし入りのネイティブ画像生成と制御可能なテキスト読み上げ、統合されたGoogle検索が導入された。2025年6月、GoogleはGeminiの機能をターミナルにもたらすオープンソースのAIエージェントであるGemini CLIを導入し、コーディング、自動化、問題解決機能を個人開発者向けに手厚い無料利用枠で提供した。これらのリリースは、その年の後半のGemini 3ローンチの舞台を整えた。
2025年11月の発表イベント
Gemini 3ニュースローンチは、2025年11月にオンライン記者会見として行われた。Google DeepMindは、Gemini 3をGemini 2.0の後継であり、Geminiファミリーの最新のメジャーリリースとして発表した。このイベントは、生成AI業界全体で注目を集め、2023年12月の当初のGemini 1.0発表と比較された。Googleによると、Gemini 3は、Gemini 2.0で導入されたネイティブ画像生成や制御可能なテキスト読み上げなどの機能を基盤に、推論、長文脈理解、マルチモーダル出力の改善を組み込んだという。
以前のGeminiローンチと同様に、同社は安全性テストと責任ある展開を強調した。Googleは、Gemini Ultraで確立された前例に従い、政府機関と評価結果を共有し続けると述べた。同社はまた、Search、Chrome、Google CloudなどのGoogleサービスとのGemini 3の統合を強調した。イベントで、GoogleはGemini 3がVertex AIとAI Studioを通じて開発者に提供され、2023年12月にGemini Proで使用された配布モデルを拡張すると発表した。
モデルファミリーと技術的アーキテクチャ
Gemini 3は、Geminiファミリーをテキストのみの大規模言語モデルと区別するマルチモーダル設計を継続した。基盤となるアーキテクチャは、2017年に導入され、現代の言語モデルで標準となっているトランスフォーマーモデル、すなわち深層学習アプローチに基づいている。Gemini 1.5と同様に、Gemini 3は混合専門家設計を使用すると予想され、ニューラルネットワークの異なる部分が異なる種類の入力に対して活性化される。このアプローチは、モデルが大量のデータを処理しながら、計算コストを管理可能に保つのに役立つ。
Geminiファミリーは歴史的に、さまざまなユースケースに対応するために複数のティアを含んでいた。当初のラインナップはGemini Ultra、Pro、Nanoで構成され、後のバージョンではFlashとFlash Liteが追加された。Gemini 3については、Googleはモデルバリアントの完全なセットをすぐには開示しなかったが、ローンチにはPro、Flash、Deep Thinkティアが含まれると予想された。ローンチ時点では、パラメータ数やトレーニングデータサイズなどの詳細な技術仕様は完全には公開されていなかった。Googleは、Gemini 3が以前のGeminiモデルに使用されたハードウェア戦略を継続し、Tensor Processing Unitで訓練されたと述べた。
モデルのマルチモーダル機能により、テキスト、画像、音声、動画を処理および生成できる。これは、多くのモデルが単一モダリティに限定されている機械学習分野における重要な差別化要因である。Gemini 3がこれらのモダリティを単一システムで組み合わせる能力は、より豊かな方法で世界と対話できる、より一般的な人工知能システムへの一歩として提示された。
業界と競争の状況
Gemini 3のローンチは、大規模言語モデル市場での激しい競争の時期に行われた。OpenAIはGPT-4をリリースし、ChatGPTサービスを更新し続けていた一方、AnthropicはClaudeシリーズのモデルを開発していた。GoogleはGemini 3をこれらのシステムの直接の競合として位置づけ、以前のGeminiバージョンのベンチマークパフォーマンスに基づいていた。Gemini Ultraはすでにいくつかの業界ベンチマークでGPT-4とClaude 2を上回っており、GoogleはGemini 3がそのリードを拡大したと主張したが、ローンチ時点では独立した検証はまだ利用できなかった。
このイベントはまた、AIインフラストラクチャへの投資が高まる中で行われた。Google Cloud、Amazon Web Services、Microsoft Azureなどの主要なクラウドプロバイダーは、主要モデルへのアクセスを提供するために競争していた。GoogleがGemini 3をVertex AIとAI Studioを通じて利用可能にする決定は、開発者とエンタープライズ顧客を引き付けるためのより広範な戦略の一部だった。同社はまた、2024年2月のGemmaのデビューにつながったオープンソースモデルのリリースからの圧力にも直面していた。Gemini 3のローンチは、安全性、著作権、大規模モデルトレーニングの環境への影響に関する懸念に対処しながら、AI業界の最前線でのGoogleの地位を維持する試みと見なされた。
可用性とエコシステム
Gemini 3は、ローンチ時に複数のチャネルを通じて利用可能になった。開発者は、2023年12月にGemini Proに使用されたのと同じルートを通じて、Google CloudのVertex AIとAI Studioでモデルにアクセスできた。Googleはまた、Gemini 3がGeminiチャットボットや、Search、Chrome、Workspaceなどの他のGoogle製品に統合されると述べた。これは、Search、Ads、Chrome、Duet AI、AlphaCode 2を含むGemini 1.0で発表された統合計画を反映していた。
消費者側では、Googleは以前にサムスンと提携してGemini NanoとProをGalaxy S24に搭載しており、Gemini 3は将来のAndroidデバイスに登場すると予想された。2025年6月に導入されたオープンソースのGemini CLIもGemini 3をサポートするように更新され、開発者にコーディングと自動化タスクのためのターミナルベースのインターフェースを提供した。Googleのより広範なエコシステム戦略には、独自サービスとオープンツールの両方を通じてGeminiを利用可能にすることが含まれており、これは同社がGemmaのリリース以来洗練してきたバランスだった。
評価と意義
Gemini 3ニュースローンチは、AI業界の主要なイベントとして広く報じられた。アナリストは、このリリースが当初のGemini 1.0発表から2年足らずで行われたことを指摘し、この分野の急速な発展のペースを反映していると述べた。このイベントは、Google DeepMindのマルチモーダルAIへの継続的な投資と、OpenAIやAnthropicとの競争への取り組みを浮き彫りにした。ローンチ時点では、Gemini 3の独立したベンチマーク結果はまだ公開されておらず、モデルの長期的な影響は未知数だった。それでも、このリリースは、初期のLaMDAやPaLM 2システムから生成AIのための広範なプラットフォームへと進化したモデルファミリーを持つ、人工知能研究における主要な研究機関の1つとしてのGoogle DeepMindの地位を強化した。