2025年11月18日にGoogleが発表したGemini 3は、同社のGeminiファミリーのマルチモーダル大規模言語モデルの次世代版を紹介するものとなった。Google DeepMindによって開発されたGemini 3は、以前のバージョンの基盤を引き継ぎつつ、推論、コーディング、マルチモーダル理解における性能向上を実現している。この発表では、Gemini 3 Pro、Gemini 3 Flash、Gemini 3 Flash Liteを含む複数のモデルバリアントと、Google CloudのVertex AIおよびGemini APIを通じた価格と提供状況が詳述された。
Gemini 3は、2024年末にリリースされたGemini 2.0の後継として位置づけられている。新しいモデル群は、テキスト、画像、音声、動画、コードにわたる複雑なタスクを処理するよう設計されており、Geminiファミリーの開始以来中心となってきたマルチモーダルアプローチを継続している。発表では、エージェント機能の進歩が強調され、モデルがツールや環境とより効果的に相互作用できるようになり、100万トークンのコンテキストウィンドウ(Proでは200万トークンに拡張可能)、ネイティブ画像生成、改善された安全対策などの機能が導入された。
モデルバリアントと機能
Gemini 3 Proはフラッグシップモデルであり、高度な推論、長文コンテンツ生成、洗練されたコーディングなどの「非常に複雑なタスク」向けに最適化されている。100万トークンのコンテキストウィンドウを備え、200万トークンまで拡張可能で、テキスト、画像、音声、動画、コードを含むマルチモーダル入力をサポートしている。Gemini 3 Flashは、低レイテンシーと低コストで「幅広いタスク」向けに設計されており、リアルタイムアプリケーションに適している。Gemini 3 Flash Liteは、大量処理とコスト重視のユースケース向けの軽量バリアントであり、100万トークンのコンテキストウィンドウと高速な応答時間を提供する。
Gemini 3ファミリーの全モデルには推論の改善が組み込まれており、ProモデルはMassive Multitask Language Understanding(MMLU)ベンチマークで92.1%のスコアを達成し、人間の専門家のパフォーマンスを上回ったと報告されている。モデル群はまた、HumanEvalで94.3%に達するコーディング能力の強化と、100以上の言語をカバーする多言語サポートの改善を特徴としている。
価格と提供状況
Gemini 3 Proは、入力100万トークンあたり1.25ドル、出力100万トークンあたり5.00ドルで提供され、200万トークンのコンテキストウィンドウは入力100万トークンあたり2.50ドルで利用できる。Gemini 3 Flashは、入力100万トークンあたり0.30ドル、出力100万トークンあたり1.20ドルである。Gemini 3 Flash Liteは、入力100万トークンあたり0.15ドル、出力100万トークンあたり0.60ドルで提供される。全モデルは、Google CloudのVertex AIおよびGemini APIを通じて即座に利用可能であり、Search、Ads、WorkspaceなどのGoogle製品への統合は2026年初頭に予定されている。
Googleエコシステムとの統合
Gemini 3は、Geminiチャットボットを含むGoogleの製品スイート全体に統合されており、プレミアムユーザーにはGemini 3 Proが、標準ユーザーにはGemini 3 Flashが使用されている。モデル群はまた、Google CloudのVertex AIでも利用可能であり、開発者がカスタムアプリケーションを構築できるようになっている。さらに、Gemini 3はGoogle Workspaceの新機能、例えばAI支援によるドキュメント要約やメール下書き作成を強化し、プライバシー重視のタスクのためにデバイス上で動作するGemini Nanoを介してAndroidデバイスにも統合されている。
安全性と倫理的考慮事項
GoogleはGemini 3の発表で安全性を強調し、モデル群がレッドチーム評価や、米国大統領令およびブレッチリー宣言で概説された原則との整合性を含む広範なテストを受けたと述べた。同社は、テスト結果を米国連邦政府と共有し、コンプライアンスを確保するために国際規制当局と連携すると述べた。Gemini 3にはまた、有害コンテンツに対する組み込みの保護策が含まれており、バイアスの低減と事実の正確性の向上に重点が置かれている。
競争環境
この発表は、Gemini 3をOpenAIのGPT-4やAnthropicのClaude 3などの競合製品に対抗するものとして位置づけている。Googleは、Gemini 3 ProがMMLU、HumanEval、MATHデータセットを含む複数のベンチマークでこれらのモデルを上回ると主張している。このリリースは、Artificial intelligence業界におけるより広範なトレンドの一部であり、Large language modelはますます高性能になり、日常製品に統合されつつある。GoogleのGoogle DeepMindとそのTransformer (architecture)アーキテクチャへの投資は、Generative AIにおけるイノベーションを引き続き推進している。
今後の展開
Googleは、2026年初頭に、より強力なバリアントであるGemini 3 Ultraをリリースする計画であり、エンタープライズおよび研究用途を対象としている。同社はまた、リアルタイムの動画理解と対話を含むマルチモーダル機能の改善と、コンテキストウィンドウの1000万トークンへの拡張に関する継続的な取り組みを発表した。これらの開発は、Machine learningおよびDeep learningの分野をさらに前進させると期待されている。
業界への影響
Gemini 3の発表はAI業界に重大な影響を及ぼし、セクター全体の価格戦略とモデル機能に影響を与えている。OpenAIやAnthropicなどの競合他社は、自社モデルのアップデートで応答する可能性が高く、Google Cloud、Amazon Web Services、Microsoft AzureなどのクラウドプロバイダーはGemini 3を自社の提供物に統合すると予想される。このリリースはまた、AI性能の向上におけるNeural networkアーキテクチャとMulti-Head Attentionメカニズムの重要性の高まりを浮き彫りにしている。
結論
Gemini 3は、GoogleのAI活動における大きな前進を表しており、さまざまなアプリケーションで最先端の性能を提供している。マルチモーダル機能、競争力のある価格設定、Googleエコシステム全体への統合により、Generative AIおよびLarge language model開発の未来を形作る態勢が整っている。