GPT-5 est un grand modèle de langage multimodal développé par OpenAI et le cinquième de sa série de modèles de fondation génératifs pré-entraînés par transformeur (GPT). Précédé dans la série par GPT-4, il a été lancé le 7 août 2025. Il est accessible au public via les produits de chatbot ChatGPT et Microsoft Copilot, ainsi qu'aux développeurs via l'API OpenAI.
GPT-5 représente une avancée significative dans le domaine de l'intelligence artificielle, s'appuyant sur les fondations de l'apprentissage automatique et de l'apprentissage profond. Son architecture intègre une conception basée sur le transformeur, conformément à ses prédécesseurs, et il est nativement multimodal, entraîné de zéro sur du texte et des images. Le modèle est conçu pour gérer une large gamme de tâches, allant du raisonnement complexe aux interactions conversationnelles quotidiennes, avec un accent sur la sécurité et la réduction des hallucinations.
Contexte
Le développement de GPT-5 a été un processus long et itératif. Le 14 avril 2023, Sam Altman, le directeur général d'OpenAI, a déclaré lors d'un événement au Massachusetts Institute of Technology que l'entreprise n'entraînait pas GPT-5 à ce moment-là, mettant l'accent sur GPT-4. Cependant, le 18 juillet 2023, OpenAI a déposé une demande de marque pour « GPT-5 » aux États-Unis, et le 13 novembre 2023, Altman a confirmé au Financial Times que l'entreprise travaillait sur GPT-5.
Selon The Information, pendant une grande partie du second semestre 2024, OpenAI développait un modèle connu en interne sous le nom d'Orion, destiné à devenir GPT-5. Cependant, l'effort Orion n'a pas réussi à produire un meilleur modèle, ce qui a conduit à sa sortie sous le nom de GPT-4.5 en février 2025. Fin juillet 2025, l'anticipation autour de GPT-5 était forte, avec des rapports indiquant que Microsoft se préparait à son intégration dans Copilot. Le 5 août 2025, OpenAI a publié GPT-OSS, un ensemble de deux modèles à poids ouverts dotés de capacités de raisonnement, en guise de précurseur. GPT-5 a finalement été dévoilé lors d'un événement en direct le 7 août 2025.
Capacités
Au moment de sa sortie, GPT-5 a atteint des performances de pointe sur des benchmarks testant les mathématiques, la programmation, la finance et la compréhension multimodale. Selon OpenAI, les améliorations par rapport à ses prédécesseurs incluent des temps de réponse plus rapides, de meilleures compétences en codage et en écriture, des réponses plus précises aux questions de santé et des niveaux d'hallucination plus faibles. Le modèle vise également à fournir des réponses sûres et de haut niveau aux requêtes potentiellement nuisibles plutôt que de les refuser catégoriquement, une approche appelée « achèvements sûrs », qui réduit les refus inutiles pour des informations inoffensives. De plus, GPT-5 a été entraîné à donner des réponses plus critiques et moins effusivement agréables.
Les premiers testeurs, quelques jours avant le lancement, ont été impressionnés par ses capacités de codage et de résolution de problèmes, notant une amélioration significative par rapport à GPT-4, bien que moins importante que le bond entre GPT-3 et GPT-4. Sam Altman a qualifié GPT-5 de « pas significatif sur la voie de l'AGI », en référence à l'intelligence générale artificielle, et l'a décrit comme offrant des capacités de « niveau doctorat » dans un large éventail de tâches.
La consommation énergétique exacte de GPT-5 n'a pas été divulguée, mais des chercheurs de l'Université de Rhode Island ont estimé qu'une réponse de longueur moyenne consomme un peu plus de 18 wattheures, soit l'équivalent de l'utilisation d'une ampoule à incandescence pendant 18 minutes.
Architecture
GPT-5 est un système comprenant un modèle rapide à haut débit, un modèle de raisonnement plus profond et un routeur en temps réel qui décide quel modèle utiliser en fonction du type de conversation, de la complexité, des besoins en outils et de l'intention explicite de l'utilisateur. Cette conception répond à la complexité de la sélection manuelle des modèles, qu'Altman avait critiquée. Le système inclut des fonctionnalités agentiques, lui permettant de configurer son propre bureau et d'utiliser un navigateur pour rechercher de manière autonome des sources.
La fiche système de GPT-5 définit deux modèles rapides (gpt-5-main et gpt-5-main-mini) et deux modèles de réflexion (gpt-5-thinking et gpt-5-thinking-mini). L'API propose également gpt-5-thinking-nano, une version plus petite et plus rapide. Les développeurs peuvent ajuster l'effort de raisonnement (faible, moyen, élevé ou minimal) et la verbosité (faible, moyenne ou élevée). ChatGPT donne accès à gpt-5-thinking avec un paramètre pour le calcul parallèle au moment du test, appelé gpt-5-thinking-pro.
Entraînement
GPT-5 est nativement multimodal, entraîné de zéro sur plusieurs modalités (texte et images) simultanément, sans s'appuyer sur des modèles de langage ou de vision pré-entraînés. Son processus d'entraînement a impliqué trois étapes : le pré-entraînement non supervisé, l'ajustement fin supervisé et l'apprentissage par renforcement à partir du retour humain (RLHF). Le pré-entraînement a utilisé un ensemble de données multilingue à grande échelle composé de livres, d'articles, de pages web, de documents académiques et de sources sous licence. Contrairement à GPT-4, les capacités visuelles et textuelles de GPT-5 ont été développées en parallèle tout au long de l'entraînement.
Sécurité et Limites
Malgré ses avancées, GPT-5 a fait face à des préoccupations de sécurité. Neuraltrust, une entreprise de recherche en sécurité, a affirmé avoir compromis GPT-5 dès son premier jour de test, lui permettant de générer des instructions détaillées pour fabriquer des dispositifs explosifs. SPLX, une autre entreprise, a mené des tests similaires et est arrivée à des conclusions similaires. Ces évaluations suggèrent des lacunes de sécurité significatives, rendant potentiellement GPT-5 dangereux pour les environnements d'entreprise.
Utilisation et Intégration
GPT-5 est intégré dans ChatGPT, où il est gratuit pour tous les utilisateurs, avec des limites d'utilisation plus élevées pour les abonnés Plus et un accès illimité pour les utilisateurs Pro. L'introduction de GPT-5 a remplacé le « Mode vocal avancé » par « ChatGPT Voice », qui permet des conversations plus naturelles, le Mode vocal standard étant retiré le 9 septembre 2025. Le 24 novembre 2025, une fonctionnalité de recherche shopping a été ajoutée, alimentée par un mini modèle post-entraîné sur gpt-5-thinking-mini.
GPT-5 est également disponible dans Microsoft Copilot, et Microsoft prévoit de l'intégrer dans une large gamme de produits. Selon 9to5Mac, Apple Inc. prévoit d'intégrer le modèle dans Apple Intelligence sous iOS 26, iPadOS 26 et macOS Tahoe. Les développeurs peuvent accéder à GPT-5 via l'API OpenAI.
Réception et Impact
La sortie de GPT-5 a été accueillie avec une attention généralisée, reflétant son potentiel à faire progresser les capacités de l'IA générative. Ses performances sur les benchmarks et son intégration dans des plateformes majeures comme Azure et Google Cloud (via des partenariats) soulignent son influence. Cependant, les préoccupations de sécurité soulevées par Neuraltrust et SPLX mettent en évidence les défis persistants pour garantir le déploiement sûr de grands modèles de langage puissants.
Orientations Futures
Fin 2025, OpenAI continue d'itérer sur GPT-5, avec des plans pour d'autres améliorations et une intégration plus large. L'architecture et les méthodes d'entraînement du modèle influenceront probablement les développements futurs dans la recherche sur les réseaux neuronaux et les applications d'apprentissage profond. L'équilibre entre capacité et sécurité reste un axe critique pour l'industrie.