Google Gemini 3 est une famille de modèles de langage multimodaux de grande taille développés par Google DeepMind et publiée en novembre 2025. Le lancement de l'actualité Gemini 3 fait référence à l'annonce publique de cette publication, présentée comme une avancée majeure dans l'industrie de l'intelligence artificielle et comme la prochaine génération de la gamme de modèles Gemini introduite en décembre 2023.
Gemini est le successeur des modèles antérieurs de Google, LaMDA et PaLM 2, et alimente le chatbot Gemini. Le nom provient du signe du zodiaque des Gémeaux. La famille Gemini originale comprenait Gemini Pro, Gemini Deep Think, Gemini Flash et Gemini Flash Lite, et les versions ultérieures ont été étendues avec Gemini 1.5 et Gemini 2.0. Gemini 3 a été positionné comme la version la plus performante à ce jour, s'appuyant sur l'approche multimodale qui permet au modèle de traiter du texte, des images, de l'audio, de la vidéo et du code informatique.
Contexte
Google a d'abord annoncé Gemini, un modèle de langage de grande taille développé par sa filiale Google DeepMind, lors du discours d'ouverture de Google I/O le 10 mai 2023. Il a été décrit comme un successeur plus puissant de PaLM 2, également dévoilé lors de cet événement. Le PDG de Google, Sundar Pichai, a déclaré à l'époque que Gemini en était encore à ses premiers stades de développement. Contrairement à de nombreux autres modèles de langage, Gemini a été conçu pour être multimodal dès le départ, ce qui signifie qu'il pouvait traiter simultanément plusieurs types de données, notamment du texte, des images, de l'audio, de la vidéo et du code informatique. Le projet était une collaboration entre DeepMind et Google Brain, deux branches de Google qui avaient été fusionnées dans Google DeepMind.
Dans une interview avec Wired, le PDG de DeepMind, Demis Hassabis, a déclaré que les capacités avancées de Gemini permettraient de surpasser ChatGPT d'OpenAI, qui fonctionne sur GPT-4. Hassabis a souligné les points forts du programme AlphaGo de DeepMind, qui a attiré l'attention mondiale en 2016 lorsqu'il a battu le champion de Go Lee Sedol, et a déclaré que Gemini combinerait la puissance d'AlphaGo avec d'autres modèles de langage de Google DeepMind. En août 2023, The Information a rapporté que Google visait une date de lancement fin 2023 et espérait surpasser OpenAI et d'autres concurrents en combinant les capacités de texte conversationnel avec la génération d'images alimentée par l'IA. Le cofondateur de Google, Sergey Brin, aurait été rappelé de sa retraite pour aider au développement de Gemini, avec des centaines d'ingénieurs de Google Brain et de DeepMind. Comme Gemini a été entraîné sur des transcriptions de vidéos YouTube, des avocats ont été sollicités pour filtrer les contenus potentiellement protégés par le droit d'auteur.
Développement avant le lancement
Le 6 décembre 2023, Pichai et Hassabis ont annoncé Gemini 1.0 lors d'une conférence de presse virtuelle. La version initiale comprenait trois modèles : Gemini Ultra pour les tâches très complexes, Gemini Pro pour une large gamme de tâches et Gemini Nano pour les tâches sur appareil. Au lancement, Gemini Pro et Nano ont été intégrés respectivement à Bard et au smartphone Pixel 8 Pro. Gemini Ultra devait alimenter un niveau « Bard Advanced » ultérieur et devenir disponible pour les développeurs de logiciels début 2024. Google a déclaré que Gemini ne serait pas largement disponible avant l'année suivante en raison de la nécessité de tests de sécurité approfondis. Gemini a été entraîné sur les unités de traitement tensoriel de Google, et le nom faisait également référence au projet Gemini de la NASA ainsi qu'à la fusion DeepMind-Google Brain.
Il a été rapporté que Gemini Ultra surpassait GPT-4, Claude 2 d'Anthropic, Inflection-2 d'Inflection AI, LLaMA 2 de Meta et Grok 1 de xAI sur divers critères de référence de l'industrie. C'était également le premier modèle de langage à surpasser les experts humains sur le test Massive Multitask Language Understanding portant sur 57 sujets, avec un score de 90 pour cent. Gemini Pro a été mis à disposition des clients de Google Cloud sur AI Studio et Vertex AI le 13 décembre 2023. Conformément à un décret signé par le président américain Joe Biden en octobre 2023, Google a déclaré qu'il partagerait les résultats des tests de Gemini Ultra avec le gouvernement fédéral. L'entreprise a également engagé des discussions avec le gouvernement du Royaume-Uni pour se conformer aux principes du sommet sur la sécurité de l'IA à Bletchley Park.
En janvier 2024, Google s'est associé à Samsung pour intégrer Gemini Nano et Gemini Pro dans la gamme de smartphones Galaxy S24. Le mois suivant, Bard et Duet AI ont été unifiés sous la marque Gemini, et Gemini Advanced avec Ultra 1.0 a été publié via un nouveau niveau AI Premium de Google One. En février 2024, Google a lancé Gemini 1.5, le décrivant comme plus puissant que 1.0 Ultra, avec une nouvelle architecture, une approche de mélange d'experts et une fenêtre de contexte plus grande d'un million de jetons. Le même mois, Google a dévoilé Gemma, une gamme plus petite, gratuite et open source de modèles Gemini. Lors du discours d'ouverture de Google I/O le 14 mai 2024, Google a annoncé Gemini 1.5 Flash et des plans pour intégrer une version optimisée pour ordinateur de bureau de Gemini Nano dans le navigateur Chrome via son architecture IA intégrée. Deux modèles mis à jour, Gemini-1.5-Pro-002 et Gemini-1.5-Flash-002, ont été publiés le 24 septembre 2024.
Le 11 décembre 2024, Google a annoncé Gemini 2.0 Flash Experimental. Cette version a introduit une API Live multimodale pour les interactions audio et vidéo en temps réel, une génération native d'images et de synthèse vocale contrôlable avec filigrane, et une recherche Google intégrée. En juin 2025, Google a introduit Gemini CLI, un agent IA open source qui apportait les capacités de Gemini au terminal, offrant des fonctionnalités de codage, d'automatisation et de résolution de problèmes avec des limites d'utilisation gratuites généreuses pour les développeurs individuels. Ces publications ont préparé le terrain pour le lancement de Gemini 3 plus tard cette année-là.
L'événement de lancement de novembre 2025
Le lancement de l'actualité Gemini 3 a eu lieu en novembre 2025 lors d'un événement de presse virtuel. Google DeepMind a présenté Gemini 3 comme le successeur de Gemini 2.0 et comme la dernière version majeure de la famille Gemini. L'événement a attiré l'attention dans toute l'industrie de l'IA générative, avec des comparaisons avec l'annonce originale de Gemini 1.0 en décembre 2023. Selon Google, Gemini 3 intégrait des améliorations en matière de raisonnement, de compréhension de contexte long et de sortie multimodale, s'appuyant sur des fonctionnalités introduites dans Gemini 2.0 telles que la génération native d'images et la synthèse vocale contrôlable.
Comme pour les lancements précédents de Gemini, l'entreprise a mis l'accent sur les tests de sécurité et le déploiement responsable. Google a déclaré qu'il continuerait à partager les résultats d'évaluation avec les agences gouvernementales, suivant le précédent établi avec Gemini Ultra. L'entreprise a également souligné l'intégration de Gemini 3 avec les services Google, notamment Search, Chrome et Google Cloud. Lors de l'événement, Google a annoncé que Gemini 3 serait disponible pour les développeurs via Vertex AI et AI Studio, étendant le modèle de distribution utilisé pour Gemini Pro en décembre 2023.
Famille de modèles et architecture technique
Gemini 3 a poursuivi la conception multimodale qui distinguait la famille Gemini des modèles de langage de grande taille textuels uniquement. L'architecture sous-jacente est basée sur le modèle transformer, une approche de apprentissage profond introduite en 2017 qui est devenue standard dans les modèles de langage modernes. Comme Gemini 1.5, Gemini 3 devait utiliser une conception de mélange d'experts, dans laquelle différentes parties du réseau neuronal sont activées pour différents types d'entrée. Cette approche aide le modèle à gérer de grandes quantités de données tout en maintenant des coûts de calcul gérables.
La famille Gemini a historiquement inclus plusieurs niveaux pour servir différents cas d'utilisation. La gamme originale comprenait Gemini Ultra, Pro et Nano, et les versions ultérieures ont ajouté Flash et Flash Lite. Pour Gemini 3, Google n'a pas immédiatement divulgué l'ensemble complet des variantes de modèles, mais le lancement devait inclure les niveaux Pro, Flash et Deep Think. Au moment du lancement, les spécifications techniques détaillées telles que les nombres de paramètres et les tailles de données d'entraînement n'avaient pas été entièrement publiées. Google a déclaré que Gemini 3 avait été entraîné sur ses unités de traitement tensoriel, poursuivant la stratégie matérielle utilisée pour les modèles Gemini antérieurs.
Les capacités multimodales du modèle lui permettent de traiter et de générer du texte, des images, de l'audio et de la vidéo. C'est un différenciateur clé dans le domaine du apprentissage automatique, où de nombreux modèles sont limités à une seule modalité. La capacité de Gemini 3 à combiner ces modalités dans un système unique a été présentée comme une étape vers des systèmes d'intelligence artificielle plus généraux capables d'interagir avec le monde de manières plus riches.
Contexte industriel et concurrentiel
Le lancement de Gemini 3 est survenu à une époque de concurrence intense sur le marché des modèles de langage de grande taille. OpenAI avait publié GPT-4 et continuait de mettre à jour son service ChatGPT, tandis que Anthropic avait développé la série de modèles Claude. Google a positionné Gemini 3 comme un concurrent direct de ces systèmes, s'appuyant sur les performances de référence des versions précédentes de Gemini. Gemini Ultra avait déjà surpassé GPT-4 et Claude 2 sur plusieurs critères de référence de l'industrie, et Google a affirmé que Gemini 3 prolongeait cette avance, bien que la vérification indépendante ne soit pas encore disponible au moment du lancement.
L'événement a également eu lieu dans un contexte d'investissement croissant dans les infrastructures d'IA. Les principaux fournisseurs de cloud, notamment Google Cloud, Amazon Web Services et Microsoft Azure, se disputaient l'accès aux principaux modèles. La décision de Google de rendre Gemini 3 disponible via Vertex AI et AI Studio faisait partie d'une stratégie plus large visant à attirer les développeurs et les clients d'entreprise. L'entreprise a également fait face à la pression des publications de modèles open source, ce qui a conduit aux débuts de Gemma en février 2024. Le lancement de Gemini 3 a été perçu comme une tentative de maintenir la position de Google à l'avant-garde de l'industrie de l'IA tout en répondant aux préoccupations concernant la sécurité, le droit d'auteur et l'impact environnemental de l'entraînement de modèles à grande échelle.
Disponibilité et écosystème
Gemini 3 a été rendu disponible via plusieurs canaux au lancement. Les développeurs pouvaient accéder au modèle via Vertex AI et AI Studio de Google Cloud, suivant la même voie utilisée pour Gemini Pro en décembre 2023. Google a également déclaré que Gemini 3 serait intégré au chatbot Gemini et à d'autres produits Google, notamment Search, Chrome et Workspace. Cela reflétait les plans d'intégration annoncés pour Gemini 1.0, qui comprenaient Search, Ads, Chrome, Duet AI et AlphaCode 2.
Côté consommateur, Google avait précédemment conclu un partenariat avec Samsung pour apporter Gemini Nano et Pro au Galaxy S24, et Gemini 3 devait apparaître dans les futurs appareils Android. Le CLI Gemini open source, introduit en juin 2025, a également été mis à jour pour prendre en charge Gemini 3, offrant aux développeurs une interface basée sur terminal pour les tâches de codage et d'automatisation. La stratégie d'écosystème plus large de Google impliquait de rendre Gemini disponible à la fois via des services propriétaires et via des outils ouverts, un équilibre que l'entreprise affinait depuis la publication de Gemma.
Réception et importance
Le lancement de l'actualité Gemini 3 a été largement rapporté comme un événement majeur dans l'industrie de l'IA. Les analystes ont noté que la publication intervenait moins de deux ans après l'annonce originale de Gemini 1.0, reflétant le rythme rapide du développement dans le domaine. L'événement a mis en évidence l'investissement continu de Google DeepMind dans l'IA multimodale et ses efforts pour concurrencer OpenAI et Anthropic. Au moment du lancement, les résultats de référence indépendants pour Gemini 3 n'avaient pas encore été publiés, et l'impact à long terme du modèle restait à voir. Néanmoins, la publication a renforcé la position de Google DeepMind comme l'une des principales organisations de recherche en intelligence artificielle, avec une famille de modèles qui avait évolué des premiers systèmes LaMDA et PaLM 2 vers une plateforme large pour l'IA générative.