L'annonce de Gemini 3, faite par Google le 18 novembre 2025, a présenté la prochaine génération de sa famille de modèles de langage multimodaux à grande échelle. Développé par Google DeepMind, Gemini 3 s'appuie sur les fondations des versions précédentes, offrant des performances améliorées en matière de raisonnement, de codage et de compréhension multimodale. L'annonce a détaillé plusieurs variantes du modèle, notamment Gemini 3 Pro, Gemini 3 Flash et Gemini 3 Flash Lite, ainsi que les prix et la disponibilité via Vertex AI de Google Cloud et l'API Gemini.
Gemini 3 est positionné comme le successeur de Gemini 2.0, qui a été publié fin 2024. Les nouveaux modèles sont conçus pour gérer des tâches complexes impliquant du texte, des images, de l'audio, de la vidéo et du code, poursuivant l'approche multimodale qui a été centrale pour la famille Gemini depuis sa création. L'annonce a mis l'accent sur les avancées dans les capacités agentiques, permettant aux modèles d'interagir plus efficacement avec les outils et les environnements, et a introduit des fonctionnalités telles qu'une fenêtre de contexte de 1 million de jetons (extensible à 2 millions pour Pro), la génération d'images native et des mesures de sécurité améliorées.
Variantes du modèle et capacités
Gemini 3 Pro est le modèle phare, optimisé pour les « tâches hautement complexes » telles que le raisonnement avancé, la génération de contenu de longue forme et le codage sophistiqué. Il dispose d'une fenêtre de contexte de 1 million de jetons, extensible à 2 millions de jetons, et prend en charge des entrées multimodales, y compris le texte, les images, l'audio, la vidéo et le code. Gemini 3 Flash est conçu pour « un large éventail de tâches » avec une latence et un coût réduits, ce qui le rend adapté aux applications en temps réel. Gemini 3 Flash Lite est une variante légère pour les cas d'utilisation à volume élevé et sensibles aux coûts, offrant une fenêtre de contexte de 1 million de jetons et des temps de réponse rapides.
Tous les modèles de la famille Gemini 3 intègrent des améliorations en matière de raisonnement, le modèle Pro atteignant prétendument un score de 92,1 % sur le benchmark Massive Multitask Language Understanding (MMLU), surpassant les performances d'experts humains. Les modèles présentent également des capacités de codage améliorées, avec des performances sur HumanEval atteignant 94,3 %, et une meilleure prise en charge multilingue, couvrant plus de 100 langues.
Tarification et disponibilité
Gemini 3 Pro est proposé à 1,25 $ pour 1 million de jetons d'entrée et 5,00 $ pour 1 million de jetons de sortie, avec une fenêtre de contexte de 2 millions de jetons disponible à 2,50 $ pour 1 million de jetons d'entrée. Gemini 3 Flash coûte 0,30 $ pour 1 million de jetons d'entrée et 1,20 $ pour 1 million de jetons de sortie. Gemini 3 Flash Lite est proposé à 0,15 $ pour 1 million de jetons d'entrée et 0,60 $ pour 1 million de jetons de sortie. Tous les modèles sont disponibles immédiatement via Vertex AI de Google Cloud et l'API Gemini, avec une intégration dans les produits Google tels que Search, Ads et Workspace prévue pour début 2026.
Intégration avec l'écosystème Google
Gemini 3 est intégré dans la suite de produits Google, y compris le chatbot Gemini, qui utilise désormais Gemini 3 Pro pour les utilisateurs premium et Gemini 3 Flash pour les utilisateurs standard. Les modèles sont également disponibles dans Vertex AI de Google Cloud, permettant aux développeurs de créer des applications personnalisées. De plus, Gemini 3 alimente de nouvelles fonctionnalités dans Google Workspace, telles que la synthèse de documents assistée par IA et la rédaction d'e-mails, et est intégré aux appareils Android via Gemini Nano, qui fonctionne sur l'appareil pour les tâches sensibles à la vie privée.
Considérations de sécurité et éthiques
Google a mis l'accent sur la sécurité dans l'annonce de Gemini 3, notant que les modèles ont subi des tests approfondis, y compris des évaluations par équipe rouge et un alignement avec les principes énoncés dans le décret exécutif américain sur l'IA et la déclaration de Bletchley. La société a déclaré qu'elle partagerait les résultats des tests avec le gouvernement fédéral américain et s'engagerait avec les régulateurs internationaux pour garantir la conformité. Gemini 3 inclut également des garde-fous intégrés contre les contenus nuisibles, en mettant l'accent sur la réduction des biais et l'amélioration de la précision factuelle.
Paysage concurrentiel
L'annonce positionne Gemini 3 face à des concurrents tels que GPT-4 d'OpenAI et Claude 3 d'Anthropic. Google affirme que Gemini 3 Pro surpasse ces modèles sur plusieurs benchmarks, notamment MMLU, HumanEval et l'ensemble de données MATH. La sortie s'inscrit dans une tendance plus large de l'industrie de l'Artificial intelligence, où les Large language models deviennent de plus en plus capables et intégrés dans les produits du quotidien. L'investissement de Google dans Google DeepMind et son architecture Transformer (architecture) continue de stimuler l'innovation dans Generative AI.
Développements futurs
Google prévoit de publier Gemini 3 Ultra, une variante plus puissante, début 2026, ciblant les applications d'entreprise et de recherche. La société a également annoncé des travaux en cours sur l'amélioration des capacités multimodales, y compris la compréhension et l'interaction vidéo en temps réel, et l'extension de la fenêtre de contexte à 10 millions de jetons. Ces développements devraient faire progresser davantage le domaine du Machine learning et du Deep learning.
Impact sur l'industrie
L'annonce de Gemini 3 a des implications significatives pour l'industrie de l'IA, influençant les stratégies de prix et les capacités des modèles dans tout le secteur. Les concurrents comme OpenAI et Anthropic devraient probablement répondre avec des mises à jour de leurs propres modèles, tandis que les fournisseurs de cloud tels que Google Cloud, Amazon Web Services et Microsoft Azure devraient intégrer Gemini 3 dans leurs offres. La sortie met également en évidence l'importance croissante des architectures de Neural network et des mécanismes de Multi-Head Attention dans l'avancement des performances de l'IA.
Conclusion
Gemini 3 représente un pas en avant majeur dans les efforts d'IA de Google, offrant des performances de pointe dans une gamme d'applications. Avec ses capacités multimodales, ses prix compétitifs et son intégration dans l'écosystème Google, il est prêt à façonner l'avenir du développement de Generative AI et de Large language model.