Gemini 2.5は、Google DeepMindによって開発された大規模言語モデルのファミリーであり、Gemini 1.5シリーズの後継にあたる。このファミリーの最初のモデルであるGemini 2.5 ProとGemini 2.5 Flashは2025年3月25日に発表され、Pro版は同日に一般公開され、Flash版は2025年4月16日に続いて公開された。このファミリーはハイブリッド推論モデルラインとして設計されており、最終的な回答を生成する前に内部の思考連鎖推論を生成でき、推論の深さはタスクの複雑さに応じて調整可能である。
Gemini 2.5モデルは、現代の深層学習システムにおける基礎的な設計であるTransformerアーキテクチャに基づいて構築されている。これらは、多様なテキストとコードのデータセットに対する大規模な機械学習を含む、現代の生成AIシステムに共通する技術を用いて訓練されている。モデルはGoogleのGoogle Cloud Vertex AIプラットフォームとGemini APIを通じて利用可能であり、入力と出力の100万トークンあたりの価格が設定されている。2025年半ばの時点で、モデルは最大100万トークンのコンテキストウィンドウをサポートしており、将来的には200万トークンのウィンドウが計画されている。
モデルのバリエーションと機能
Gemini 2.5ファミリーには、さまざまなユースケースに合わせた複数のバリエーションが含まれている。Gemini 2.5 Proはフラッグシップモデルとして位置付けられており、テキスト、画像、音声、動画を含む複雑な推論、コーディング、マルチモーダルタスク向けに最適化されている。Gemini 2.5 Flashは、レイテンシとコストが優先される高ボリュームアプリケーション向けに設計された、より軽量で高速なバージョンである。2025年5月、Google DeepMindはさらに低コストのバリアントであるGemini 2.5 Flash-Liteと、特に困難な問題に対して推論時間を延長する実験モードであるGemini 2.5 Deep Thinkを導入した。
すべてのバリアントは、画像、音声、動画を含むマルチモーダル入力を受け入れ、テキスト出力を生成できる。モデルはJSONなどの構造化出力をサポートし、外部ツールや関数を呼び出すことができる。Google DeepMindが公開したベンチマーク評価では、Gemini 2.5 Proは推論タスクで高いスコアを達成し、GPQAダイヤモンド科学ベンチマークで91.6%の精度、MATH 2025競技数学テストで86.6%を記録した。コーディングベンチマークでは、実世界のソフトウェアエンジニアリング能力を測定するSWE-bench Verifiedで69.6%を獲得した。
公開リーダーボードでの存在感
Gemini 2.5のバリアントは、標準化されたテストでのモデル性能を追跡する公開LLMおよびメディアのリーダーボードに登場している。2025年に独立した評価者によって収集されたベンチマークスナップショットでは、22の異なるGemini 2.5バリアントが記録されており、さまざまな構成、ファインチューン、実験バージョンを反映している。これらのスナップショットは通常毎月更新され、推論、コーディング、言語理解のスコアとともにモデルをリストアップする。このようなリーダーボードに複数のバリアントが存在することは、Google DeepMindによる活発な反復を示しており、テスト段階では匿名または実験的とラベル付けされたエントリもある。
注目すべきリーダーボード登場の1つは、LMArena(旧Chatbot Arena)プラットフォームであり、Gemini 2.5 Proはユーザー嗜好ベースの評価で高いランクを獲得した。2025年4月の独立分析では、Gemini 2.5 ProのARC-AGIベンチマーク(抽象推論のテスト)でのパフォーマンスが以前のモデルよりも改善されたものの、専門システムを上回ることはなかったと指摘された。2025年後半の時点で、公開されているバリアントの正確な数は流動的であり、Google DeepMindは定期的にアップデートや実験バージョンをリリースしている。
開発とリリースの歴史
Gemini 2.5は、組織のCEOであるDemis Hassabisのリーダーシップの下でGoogle DeepMindによって開発され、英国と米国の研究チームからの貢献があった。このモデルファミリーは、以前のGemini 1.0および1.5リリースに基づいており、トレーニング効率と推論技術の進歩を組み込んでいる。開発プロセスには、モデルの出力をユーザーの好みに合わせる手法である人間のフィードバックからの強化学習の広範な使用が含まれていた。
2025年3月25日の最初の発表は、GeminiアプリとAPIを通じたGemini 2.5 Proの一般公開と同時期に行われた。Google DeepMindはこのリリースを、回答前に内部の推論ステップを生成する「思考モデル」への移行として位置付けた。Flashバリアントは2025年4月16日に続き、Flash-Liteは2025年5月20日に導入された。Deep Think実験モードは2025年5月に展開され、ユーザーが研究グレードのタスクに対して拡張推論を有効にできるようにした。
アプリケーションとエコシステム
Gemini 2.5モデルは、GeminiチャットボットやGoogle検索のAI Overviews機能など、Googleの消費者向け製品に統合されている。開発者はGemini APIを通じてモデルにアクセスでき、2025年半ばの時点でProバリアントの価格は入力100万トークンあたり1.25ドル、出力100万トークンあたり10ドルから始まる。モデルはGoogle Cloud Vertex AIでも利用可能であり、ファインチューニングやモデル評価などの機能を備えたエンタープライズ展開を可能にする。
より広範なAIエコシステムでは、Gemini 2.5はOpenAIやAnthropicのモデル(GPT-4.1やClaude 3.7など)と競合している。2025年半ばの独立評価では、Gemini 2.5 Proは推論とコーディングのトップティアモデルの中に位置付けられたが、ランキングはベンチマークによって異なった。このモデルファミリーは、ソフトウェア開発支援から科学研究までさまざまなアプリケーションで使用されており、Google DeepMindは学術機関や業界パートナーによる採用を報告している。2025年後半の時点で、Gemini 2.5は活発な製品ラインであり、継続的なアップデートと新しいバリアントが期待されている。