GPT-5.6 est un grand modèle de langage développé par OpenAI, publié le 15 septembre 2025. Il succède à GPT-5 et représente une avancée significative dans la gamme d'IA générative de l'entreprise, mettant l'accent sur un raisonnement amélioré, une compréhension multimodale et une efficacité computationnelle. Le modèle a été introduit parallèlement à des mises à jour de l'API d'OpenAI et de ses produits grand public, notamment ChatGPT.
GPT-5.6 s'appuie sur l'architecture de transformeur qui sous-tend les modèles GPT précédents, intégrant des raffinements dans la méthodologie d'entraînement et la conception du modèle. Il est disponible en plusieurs configurations, la version phare contenant prétendument 2,1 billions de paramètres, bien qu'OpenAI n'ait pas officiellement confirmé ce chiffre. Le modèle prend en charge les entrées texte, image et audio, et peut générer des sorties texte, code et données structurées.
Architecture et entraînement
GPT-5.6 utilise un cadre de apprentissage profond basé sur l'architecture de transformeur, employant des mécanismes de attention multi-têtes et des structures encodeur-décodeur lorsque cela est applicable. Le modèle a été entraîné sur un ensemble de données diversifié comprenant du texte, du code et du contenu multimédia accessibles au public, avec une puissance de calcul d'entraînement rapportée de 1,8e26 FLOPs. OpenAI a utilisé une combinaison d'apprentissage supervisé et de apprentissage par renforcement à partir de retours d'IA pour aligner le modèle sur les préférences humaines.
Le processus d'entraînement impliquait des techniques de écrêtage de gradient, de normalisation de couche et de normalisation par lots pour stabiliser l'optimisation. Le modèle exploite des réseaux résiduels pour faciliter l'entraînement de couches profondes et emploie le décrochage pour la régularisation. Des variantes de l'optimiseur Adam ont été utilisées pour les mises à jour des paramètres, avec un programme de taux d'apprentissage comprenant des phases d'échauffement et de décroissance cosinusoïdale.
Capacités et performances
GPT-5.6 démontre des performances améliorées sur les références de raisonnement par rapport à son prédécesseur. Sur le benchmark MMLU (Massive Multitask Language Understanding), il a obtenu un score de 91,2 %, contre 88,7 % pour GPT-5. Le modèle a également montré des gains sur les tâches de raisonnement mathématique, obtenant 94,5 % sur l'ensemble de données GSM8K et 82,3 % sur le benchmark MATH. Dans les évaluations de codage, GPT-5.6 a atteint un taux de réussite de 78,9 % sur HumanEval et de 71,4 % sur SWE-bench, reflétant des capacités améliorées de génération de code et de débogage.
Les capacités multimodales du modèle lui permettent de traiter et de générer des images et de l'audio. Sur le benchmark MMMU (Massive Multi-discipline Multimodal Understanding), il a obtenu 68,7 %, et sur les tâches audio, il a atteint une précision de 85,2 % sur l'ensemble de test LibriSpeech. GPT-5.6 présente également une précision factuelle améliorée, avec une réduction de 12 % des taux d'hallucination par rapport à GPT-5, selon les évaluations internes d'OpenAI.
Déploiement et disponibilité
GPT-5.6 a été rendu disponible via l'API d'OpenAI à sa date de sortie, avec un prix fixé à 15 $ par million de jetons d'entrée et 60 $ par million de jetons de sortie pour la version standard. Une variante plus petite et plus efficace, GPT-5.6-mini, a également été publiée, ciblant les applications à faible latence. Le modèle est intégré à ChatGPT, remplaçant GPT-5 comme modèle par défaut pour les niveaux gratuits et payants. OpenAI s'est associé à Microsoft Azure pour l'hébergement cloud, assurant une disponibilité mondiale également via Amazon Web Services et Google Cloud.
Un accès anticipé a été accordé à certains clients entreprises via le programme de partenariat d'OpenAI, notamment des organisations dans les secteurs de la santé, de la finance et de l'éducation. Le modèle prend en charge le réglage fin pour des tâches spécifiques à un domaine, OpenAI fournissant des outils pour une adaptation personnalisée. À la fin de 2025, GPT-5.6 est disponible dans 95 pays, avec des plans d'expansion vers d'autres régions.
Réception et impact
GPT-5.6 a reçu des avis généralement positifs de la part des chercheurs et des praticiens de l'industrie. Des évaluations indépendantes par le Stanford AI Lab et le Berkeley AI Research ont confirmé son raisonnement amélioré et son biais réduit par rapport aux modèles précédents. Cependant, certains critiques ont noté que le modèle a encore des difficultés avec le raisonnement complexe en plusieurs étapes et peut produire des sorties plausibles mais incorrectes dans des domaines de niche.
La sortie de GPT-5.6 a intensifié la concurrence sur le marché de l'IA générative, suscitant des réponses de la part d'Anthropic avec Claude 4 et de Google DeepMind avec Gemini 2.5. Les analystes ont observé que les gains d'efficacité de GPT-5.6, obtenus grâce à des techniques de élagage de modèle et de distillation des connaissances, ont établi une nouvelle norme pour le déploiement de grands modèles. L'API ouverte du modèle et sa documentation robuste ont contribué à son adoption généralisée dans les startups et les institutions de recherche.
Considérations de sécurité et éthiques
OpenAI a mis en œuvre plusieurs mesures de sécurité dans GPT-5.6, notamment des techniques d'alignement améliorées et un nouvel outil d'interprétabilité permettant aux utilisateurs de tracer les décisions du modèle jusqu'à des données d'entraînement spécifiques. L'entreprise a mené des exercices approfondis de red-teaming avec des chercheurs externes, entraînant une réduction de 25 % des sorties nuisibles par rapport à GPT-5. Cependant, des préoccupations subsistent concernant une utilisation abusive potentielle, en particulier dans la génération de désinformation et de deepfakes.
En réponse à ces préoccupations, OpenAI a introduit des politiques d'utilisation restreignant certaines applications à haut risque, telles que la prise de décision automatisée dans les secteurs de la santé et de la finance sans supervision humaine. L'entreprise s'est également engagée à la transparence en publiant une fiche modèle détaillant les capacités, les limitations et les sources de données d'entraînement de GPT-5.6. En décembre 2025, aucun incident de sécurité majeur n'a été signalé, bien que la surveillance continue se poursuive.
Développements futurs
OpenAI a annoncé des plans pour publier GPT-5.7 au début de 2026, avec des améliorations attendues dans la compréhension de contextes longs et l'interaction en temps réel. L'entreprise explore également des moyens de réduire l'impact environnemental du modèle, visant une réduction de 30 % de la consommation d'énergie d'inférence d'ici 2027. Les chercheurs d'OpenAI étudient des architectures novatrices, telles que les couches de mélange d'experts, pour améliorer davantage l'évolutivité et l'efficacité.