Gemini 2.5 est une famille de grands modèles de langage développée par Google DeepMind, succédant à la série Gemini 1.5. Les premiers modèles de la famille, Gemini 2.5 Pro et Gemini 2.5 Flash, ont été annoncés le 25 mars 2025, avec la variante Pro publiée au public le même jour et Flash suivant le 16 avril 2025. La famille est conçue comme une ligne de modèles de raisonnement hybride, ce qui signifie qu'elle peut générer un raisonnement interne de chaîne de pensée avant de produire une réponse finale, avec une profondeur de raisonnement ajustable en fonction de la complexité de la tâche.
Les modèles Gemini 2.5 sont construits sur l'architecture Transformer, une conception fondamentale dans les systèmes modernes de apprentissage profond. Ils sont entraînés à l'aide de techniques courantes dans les systèmes de IA générative contemporains, notamment l'apprentissage automatique à grande échelle sur des ensembles de données diversifiés de texte et de code. Les modèles sont disponibles via la plateforme Google Cloud Vertex AI de Google et l'API Gemini, avec un prix fixé par million de jetons pour l'entrée et la sortie. À la mi-2025, les modèles prennent en charge une fenêtre de contexte allant jusqu'à un million de jetons, avec des projets pour une fenêtre de deux millions de jetons à l'avenir.
Variantes de modèles et capacités
La famille Gemini 2.5 comprend plusieurs variantes adaptées à différents cas d'utilisation. Gemini 2.5 Pro est positionné comme le modèle phare, optimisé pour le raisonnement complexe, le codage et les tâches multimodales impliquant du texte, des images, de l'audio et de la vidéo. Gemini 2.5 Flash est une version plus légère et plus rapide conçue pour les applications à volume élevé où la latence et le coût sont prioritaires. En mai 2025, Google DeepMind a introduit Gemini 2.5 Flash-Lite, une variante à coût réduit supplémentaire, et Gemini 2.5 Deep Think, un mode expérimental qui prolonge le temps de raisonnement pour des problèmes particulièrement difficiles.
Toutes les variantes acceptent des entrées multimodales, y compris des images, de l'audio et de la vidéo, et peuvent générer des sorties textuelles. Les modèles prennent en charge des sorties structurées, telles que JSON, et peuvent invoquer des outils et fonctions externes. Dans les évaluations de référence publiées par Google DeepMind, Gemini 2.5 Pro a obtenu des scores élevés sur les tâches de raisonnement, notamment une précision de 91,6 % sur le benchmark scientifique GPQA diamond et de 86,6 % sur le test de mathématiques de compétition MATH 2025. Sur les benchmarks de codage, il a obtenu 69,6 % sur SWE-bench Verified, une mesure de la capacité réelle en ingénierie logicielle.
Présence sur les classements publics
Les variantes de Gemini 2.5 sont apparues sur des classements publics de LLM et de médias, qui suivent les performances des modèles à travers des tests standardisés. Dans des instantanés de benchmarks collectés par des évaluateurs indépendants en 2025, 22 variantes distinctes de Gemini 2.5 ont été enregistrées, reflétant différentes configurations, ajustements fins et versions expérimentales. Ces instantanés, généralement mis à jour mensuellement, listent les modèles avec des scores pour le raisonnement, le codage et la compréhension du langage. La présence de multiples variantes sur ces classements indique une itération active de Google DeepMind, certaines entrées étant étiquetées comme anonymes ou expérimentales pendant les phases de test.
Une apparition notable sur un classement a été sur la plateforme LMArena (anciennement Chatbot Arena), où Gemini 2.5 Pro s'est classé en tête des évaluations basées sur les préférences des utilisateurs. Des analyses indépendantes en avril 2025 ont noté que la performance de Gemini 2.5 Pro sur le benchmark ARC-AGI, un test de raisonnement abstrait, montrait une amélioration par rapport aux modèles précédents, bien qu'il n'ait pas surpassé les systèmes spécialisés. À la fin de 2025, le nombre exact de variantes publiquement disponibles reste fluide, car Google DeepMind publie périodiquement des mises à jour et des versions expérimentales.
Historique de développement et de publication
Gemini 2.5 a été développé par Google DeepMind sous la direction de Demis Hassabis, le PDG de l'organisation, avec des contributions d'équipes de recherche à travers le Royaume-Uni et les États-Unis. La famille de modèles s'appuie sur les versions précédentes Gemini 1.0 et 1.5, intégrant des avancées en efficacité d'entraînement et en techniques de raisonnement. Le processus de développement a impliqué une utilisation extensive de l'apprentissage par renforcement à partir de retours humains, une méthode qui aligne les sorties du modèle avec les préférences des utilisateurs.
L'annonce initiale du 25 mars 2025 a coïncidé avec la publication de Gemini 2.5 Pro au public via l'application Gemini et l'API. Google DeepMind a positionné cette sortie comme un changement vers des « modèles de réflexion », qui génèrent des étapes de raisonnement internes avant de répondre. La variante Flash a suivi le 16 avril 2025, et Flash-Lite a été introduit le 20 mai 2025. Un mode expérimental Deep Think a été déployé en mai 2025, permettant aux utilisateurs d'activer un raisonnement étendu pour des tâches de niveau recherche.
Applications et écosystème
Les modèles Gemini 2.5 sont intégrés dans les produits grand public de Google, y compris le chatbot Gemini et la fonctionnalité AI Overviews de Google Search. Les développeurs peuvent accéder aux modèles via l'API Gemini, avec un prix commençant à 1,25 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie pour la variante Pro à la mi-2025. Les modèles sont également disponibles sur Google Cloud Vertex AI, permettant un déploiement en entreprise avec des fonctionnalités comme l'ajustement fin et l'évaluation de modèles.
Dans l'écosystème plus large de l'IA, Gemini 2.5 concurrence les modèles d'OpenAI et d'Anthropic, tels que GPT-4.1 et Claude 3.7. Des évaluations indépendantes à la mi-2025 ont placé Gemini 2.5 Pro parmi les modèles de premier plan pour le raisonnement et le codage, bien que les classements varient selon les benchmarks. La famille de modèles a été utilisée dans des applications allant de l'assistance au développement logiciel à la recherche scientifique, Google DeepMind rapportant une adoption par des institutions académiques et des partenaires industriels. À la fin de 2025, Gemini 2.5 reste une ligne de produits active, avec des mises à jour continues et de nouvelles variantes attendues.