Sortie de Google Gemini 3

Traduit de l'anglais

Google Gemini 3, publié en novembre 2025, constitue une étape majeure dans le développement de l'IA de Google, succédant à Gemini 2.0 en tant que famille de grands modèles de langage multimodaux développés par Google DeepMind.

Google Gemini 3 est une famille de grands modèles de langage (LLM) multimodaux développés par Google DeepMind, publiée en novembre 2025 comme une étape majeure dans le développement de l'IA par Google. Elle succède à la série Gemini 2.0 et poursuit l'évolution de la famille de modèles Gemini, qui a été annoncée pour la première fois le 6 décembre 2023. Gemini 3 s'appuie sur les fondations des versions précédentes, intégrant des avancées en matière d'architecture, de méthodes d'entraînement et de capacités multimodales pour traiter simultanément le texte, les images, l'audio, la vidéo et le code informatique.

La famille Gemini, nommée d'après le signe du zodiaque Gémeaux, a été développée en tant que successeur de LaMDA et PaLM 2. La première version de décembre 2023 comprenait trois modèles : Gemini Ultra pour les tâches hautement complexes, Gemini Pro pour un large éventail de tâches, et Gemini Nano pour les tâches sur appareil. Les versions suivantes ont introduit Gemini 1.5 avec une approche de mélange d'experts et une fenêtre de contexte d'un million de jetons, suivies de Gemini 2.0 Flash Experimental en décembre 2024, qui a ajouté des interactions audio et vidéo en temps réel via une API Live multimodale. Gemini 3 représente la prochaine itération majeure, publiée environ un an après Gemini 2.0.

Développement et annonce

Le développement de Gemini 3 a commencé au début de 2025, après la sortie de Gemini 2.0 Flash Experimental en décembre 2024. Google DeepMind, dirigé par le PDG Demis Hassabis, s'est concentré sur l'amélioration des capacités de raisonnement, de l'efficacité et de l'intégration multimodale. Le modèle a été entraîné sur les unités de traitement tensoriel (TPU) de Google, poursuivant l'approche infrastructurale utilisée pour les versions précédentes de Gemini. Le cofondateur de Google, Sergey Brin, qui avait été rappelé de sa retraite pour assister au développement initial de Gemini, est resté impliqué en tant que contributeur principal.

L'annonce de Gemini 3 est venue lors d'une conférence de presse virtuelle en novembre 2025, dirigée par le PDG de Google Sundar Pichai et Demis Hassabis. L'événement a mis en avant les performances de Gemini 3 sur des références industrielles, en particulier sa capacité à surpasser les modèles précédents sur le test Massive Multitask Language Understanding (MMLU) de 57 sujets, où Gemini Ultra avait déjà obtenu un score de 90 % en 2023. Gemini 3 a été décrit comme le plus grand et le plus capable modèle d'IA de Google à ce jour, conçu pour émuler le comportement humain plus que ses prédécesseurs.

Architecture et capacités

Gemini 3 utilise une architecture Transformer (architecture) avec des mécanismes de attention multi-têtes, s'appuyant sur la conception fondamentale utilisée dans les modèles Gemini précédents. Il intègre une approche de mélange d'experts, introduite dans Gemini 1.5, permettant au modèle d'activer seulement les sous-ensembles pertinents de ses paramètres pour chaque tâche, améliorant ainsi l'efficacité et la scalabilité. Le modèle utilise un encodage positionnel pour traiter des données séquentielles et une normalisation par couche pour un entraînement stable.

Une avancée clée de Gemini 3 est son traitement multimodal amélioré. Contrairement aux modèles purement textuels, Gemini 3 a été entraîné sur plusieurs types de données simultanément, notamment le texte, les images, l'audio, la vidéo et le code informatique. Cela lui permet de générer des images contextuelles, de traiter des flux audio et vidéo en temps réel, et de s'intégrer avec des outils comme Google Search. Le modèle comprend également la génération native d'images avec filigrane, une fonctionnalité introduite pour la première fois dans Gemini 2.0 Flash Experimental, et la génération textuelle de parole contrôlable.

Gemini 3 introduit des améliorations dans les techniques de apprentissage profond, y compris des planifications de taux d'apprentissage avancées et écremage de gradient pour améliorer la stabilité de l'entraînement. Le modèle bénéficie également de stratégies de augmentation de données et de élagage de modèle pour optim les performances tout en réduisant les exigence computationnelles. Ces raffinements techniques permettent à Gemini 3 d'atteindre une plus grande précision sur des tâches de raisonnement complexes tout en maintenant une latence inférieure aux versions précédentes.

Variations du modèle et intégration

Gemini 3 est disponible en plusieurs variantes pour servir différents cas d'usage, similaire à la gamme Android Gemini 1.0. Le modèle phare, Gemini 3 Ultra, est conçu pour des tâches hautement complexes telles que la recherche scientifique avancée, le raisonnement mathématique et la nuage. Gemini 3 Pro cible un évent large d'applications à usage général, tandis que Gemini 3 Flash offre des temps de réponse plus rapides pour les réactions en temps réel. Gemini 3 Flash Lite fournit une option légère pour le traitement sur périphérique, et Gemini 3 Nano est optimisé pour les appareils mobiles et périphériques.

À la rapidité du lancement, Gemini 3 a été intégré à l'écosystème de produits et services de Google. Le chatbot Gemini, qui a été rebrandé de Bard en février 2024, a reçu le nouveau modèle comme moteur par défaut. Google a également intégré Gemini dans Search, Ads, Chrome et Duet AI sur Google Workspace. Pour les développeurs, Gemini 3 a été mis à disposition via le service Vertex AI de Google Cloud et AI Studio, permettant aux entreprises de créer des applications customisées sur la base du modèle.

Dans un partenariat notable, Google a collaboré avec Samsung Electronics pour intégrer Gemini 3 à la gamme Galaxy S25, faisant suite à l'intégration précédente de Gemini Nano and Gemini Pro dans le Galaxy S24 en janvier 2024. Ce partenariat a étendu les capacités sur appareil de Gemini 3, permettant des caractéristiques telles que la traduction en temps réel, la compréhension d'images et le serveur vocal sans nécessiter de connectivité cloud.

Performances et références

Gemini 3 a démontré des améliorations significatives de performance par rapport à ses prédécesseurs sur une variété de benchmarks industriels. Dans les évaluations interne, Gemini 3 Ultra a surpassé Gemini 2.0 Flash Experimental sur les benchmark standard de modèle de langage à grande échelle, y compris MMLU, GSM8K pour le raisonnement mathématique, et HumanEval pour la génération de code. Le modèle a également montré des améliorations dans la compréhension multilingue et le traitement de longs contextes, revenant sur la fenêtre d'un million de jetons introduite dans Gemini 1.5.

Par rapport aux compétiteurs, Gemini 3 a été positionné face aux modèles de OpenAI et Anthropic. Bien que les scores benchmarks spécifiques n'aient pas totale divulgués au lancement, Google a affirmé que Gemini 3 surpassait GPT-4 d'OpenAI et Claude 2 d'Anthropic sur de several mesures clés USD, poursuivant le trend compétitif établi avec Gemini 1.0. Les capacités multimodales du modèle ont été particulièrement mises en avant, car Google a noté que Gemini 3 pouvait traiter et générer du contenu sur le texte, les images, l'audio et la vidéo plus efficacement que les systèmes rivales.

Gemini 3 a également introduit des améliorations en matière de sécurité et d'alignement. Suivant l'exécutif signé par le président américain Joe Biden en octobre 2023, Google a partagé des résultats de test de Gemini 3 Ultra avec le gouvernement fédéral des États-Unis. La société a également engagé le gouvernement du Royaume-Uni pour se conformer aux principes présentés lors du sommet sur la sécurité de l'IA à Bletchley Park en novembre 2023. Ces efforts ont reflété l'engagement de Google pour un développement responsable de l'IA, avec des tests de sécurité approfondis menés avant la publication publique du modèle.

Environnement et outils de développeur

Gemini 3 été accompagné d'une gamme d'outils et d'intégrations pour développeurs afin de faciliter l'adoption. La ligne de commande Gemini CLI, introduite en juin 2025 en tant qu'agent IA open source, a été mise à jour pour prendre en charge Gemini 3, apportant des fonctionnalues avancés de codage, d'automatisation et de résolution de problèmes directement dans le terminal. La CLI offrait une utilisation gratuite et généreuse pour les développeurs individuels, la rendant accessible pour l'expérimentation et le prototyping.

Pour les clients cloud, Gemini 3 était disponible via Google Cloud's Vertex AI, ainsi que via AI Studio pour de la prototypage rapide. Le modèle pouvait être accessible via des API pour la génération de texte, la compréhension d'image et le traitement audio / vidéo en temps réel. Google a également fourni des outils pour le fine-tuning de Gemini 3 sur des jeux de données customisés, permettant aux entreprises d'adapter le modèle à des domaines cloud spécifiques tels que la santé, le financier et le juridique.

La sortie de Gemini 3 a également suscité des développements dans l'écosystème IA global. AMD et Intel ont annoncé des optimizations pour exécuter Gemini 3 sur leurs matériels, tandis que Qualcomm se concentrait sur le déploiement pour périphérie mobile et edge, ainsi que pour Arm Holdings.

Impact et accueil

À la sortie en novembre 2025, Gemini a été largement couvert par les médias technologiques et les analyses industrielles. De nombreux observateurs ont noté que le modèle représentait un pas en avant significatif dans IA générative, notamment par sa capacité à gérer des multiples modalités de manière transparente. L'intégration avec Google Search ainsi que d'autres produits a été vue comme une étape stratégique pour distinguer Google des compétiteurs comme OpenAI and AI génératives masculines, qui ont principalement misé sur des chatbots textuels.

Cependant, des experts ont exprimé des préoccupations quant à l'impact environnemental de l'entraînement de grands modèles comme Gemini 3, ce qui nécessite des calculs massifs. Google a répondu en mettant en évidence des améliorations du efficacité d'entraînement, y compris l'utilisation de techniques avancées de normalisation par lot et de déactivation pour réduire la consommation d'énergie. L'entreprise a également souligné son engagement à utiliser des nu sources énergétiques renouvelables pour ses centres de données.

Dans la communauté de la recherche, l'architecture de Gemini 3 et ses méthodes de formation ont été étudiées par des universitaires institutions telles que MIT CSAIL, Stanford AI Lab et Berkeley AI Research. Les chercheurs ont analysé l'approche de mélange d'experts du modèle et ses implications pour la mise à l'échelle de réseaux de neurones, contribuant à des recommandations protagonistes sur l' futur du développement de l'intelligence artificielle.

Directions futures

Avec la sortie de Gemini 3, Google DeepMind a annoncé des plans pour un développement continu de la famille Gemini. Demis Hassink a indiqué que son équipe explorait des méthodes pour combiner Gemini avec la robotique afin d'interagir physiquement avec le monde, s'appuyant sur des déclarations antérieures d'intégrer l'IA avec des systèmes physiques. Cela pourrait donner lieu à des applications dans les véhicules autonomes, la fabrication et la santé, où la compréhension multimodale de Gemini 3 pourrait permettre une interaction plus intactil entre humain et machine.

Google s'est également engagé à offrir des mises à jour régulières pour Gemini 3, avec des plans pour des mises à jour saignantes, reprenant le modèle des Gemini-1.5-Pro-002 ou Gemini 1.5 Flash-002 qui devaient être présentés le 24 septembre 2024. Ces mises à jour intégreront les retours des utilisateurs, l'amélioration des performances sur des tâches spécifiques, comme traite tout problème de sécurité ou de fiabilité détecté au cours des déploiements. L'entreprise a également continué à explorer des partenariats avec d'autres entreprises, en cœur à la fois avec Apple et Amazon Web Services pour étendre l'initiative de Gemini 3 à travers différentes plateformes services.

À la date de sortie, Gemini 3 était disponible en anglais, avec des plans pour l'expansion multilingue dans les mises à jour subséquentes. Google a déclaré que le modèle serait largement disponible dans les prochains mois, après des efforts de sécurité approfondis et la conformité réglementaire. Sortie de modèles Gemini 3 marque un moment charnière dans la stratégie en matière Google, confirmant sa position de leader dans avec des absolut des grands modèles linguistiques et des systèmes'IA multimodal.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:google-deepmind·large-language-model·multimodal-ai·artificial-intelligence
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique