Traduit de l'anglais

GPT-5 est un modèle de langage multimodal de grande taille développé par OpenAI, lancé le 7 août 2025, en tant que successeur de GPT-4. Il intègre des modèles rapides et de raisonnement avec des capacités agentiques, accessibles via ChatGPT, Microsoft Copilot et l'API OpenAI.

GPT-5 est un modèle de langage multimodal de grande taille développé par OpenAI et le cinquième de sa série de modèles de fondation génératifs pré-entraînés par transformeur (GPT). Précédé dans la série par GPT-4, il a été lancé le 7 août 2025. Il est accessible au public via les produits de chatbot ChatGPT et Microsoft Copilot, ainsi qu'aux développeurs via l'API OpenAI.

GPT-5 est un système qui contient un modèle rapide à haut débit, un modèle de raisonnement plus approfondi et un routeur en temps réel qui décide quel modèle utiliser en fonction du type de conversation, de la complexité, des besoins en outils et de l'intention explicite de l'utilisateur. Il inclut également des fonctionnalités agentiques grâce auxquelles il peut configurer son propre bureau et utiliser son navigateur pour rechercher de manière autonome des sources liées à sa tâche.

Contexte

Le 14 avril 2023, Sam Altman, le directeur général d'OpenAI, a pris la parole lors d'un événement au Massachusetts Institute of Technology et a déclaré que l'entreprise n'entraînait pas GPT-5 à ce moment-là. Il a affirmé qu'OpenAI « priorisait le développement de GPT-4 » et que « nous ne publierons pas GPT-5, et pas avant un certain temps ». Le 18 juillet, OpenAI a déposé une demande de marque pour « GPT-5 » aux États-Unis. Le 13 novembre, Altman a confirmé au Financial Times que l'entreprise travaillait au développement de GPT-5.

Selon The Information, « pendant une grande partie de la seconde moitié de 2024, OpenAI développait un modèle connu en interne sous le nom d'Orion et destiné à devenir GPT-5 », « mais l'effort Orion n'a pas réussi à produire un meilleur modèle, et l'entreprise l'a plutôt publié sous le nom de GPT-4.5 en février [2025] ». Fin juillet 2025, OpenAI était largement attendu pour prévoir la sortie de GPT-5 début août. Le 30 juillet, The Verge a rapporté que « Microsoft se prépare pour GPT-5 » alors que « des sources familières avec les plans d'IA de Microsoft » ont informé un éditeur que l'entreprise testait un nouveau mode pour son chatbot Copilot qui offrirait un modèle qui « réfléchit profondément ou rapidement selon la tâche ». Le 5 août, dans la perspective de la sortie de GPT-5, OpenAI a publié GPT-OSS, un ensemble de deux modèles à poids ouverts dotés de capacités de raisonnement. GPT-5 a ensuite été dévoilé lors d'un événement en direct le 7 août.

Capacités

Au moment de sa sortie, GPT-5 avait des performances de pointe sur les benchmarks testant les mathématiques, la programmation, la finance et la compréhension multimodale. Selon OpenAI, les améliorations par rapport à ses modèles précédents incluent des temps de réponse plus rapides, de meilleures compétences en codage et en écriture, des réponses plus précises aux questions de santé et des niveaux d'hallucination plus faibles. De plus, par rapport aux modèles précédents, GPT-5 vise à donner des réponses sûres et de haut niveau aux requêtes potentiellement nuisibles plutôt que de les refuser catégoriquement, une approche qu'OpenAI appelle « complétions sûres », visant à « permettre à GPT-5 de refuser plus de questions non sûres, tout en offrant moins de refus aux utilisateurs cherchant des informations inoffensives ». En outre, GPT-5 a été entraîné à donner des réponses plus critiques, « moins effusivement agréables » par rapport à ses modèles précédents.

Quelques jours avant le lancement de GPT-5, deux testeurs précoces du modèle ont déclaré qu'ils étaient « impressionnés » par sa capacité à coder et à résoudre des problèmes mathématiques et scientifiques. Ils ont suggéré que le modèle montre une grande amélioration par rapport à GPT-4, mais pas un gain aussi important que celui de GPT-3 à GPT-4. Un jour avant la sortie de GPT-5, lors d'un briefing de presse, Sam Altman a qualifié GPT-5 de « pas significatif sur le chemin de l'AGI », en référence à intelligence artificielle générale, le niveau hypothétique d'intelligence qu'OpenAI définit comme la capacité à effectuer toute tâche économiquement précieuse qu'un humain peut accomplir. Selon Altman, GPT-5 est « significativement meilleur » que ses prédécesseurs, offrant des capacités de « niveau doctorat » dans un large éventail de tâches.

La consommation énergétique exacte de l'utilisation de GPT-5 n'a pas été divulguée par OpenAI. Des chercheurs de l'Université de Rhode Island ont estimé qu'une réponse de longueur moyenne consomme un peu plus de 18 wattheures, équivalent à l'utilisation d'une ampoule à incandescence pendant 18 minutes.

Architecture

La fiche système de GPT-5 définit deux modèles rapides à haut débit - gpt-5-main et gpt-5-main-mini - et deux modèles de réflexion - gpt-5-thinking et gpt-5-thinking-mini. Dans l'API OpenAI, les développeurs peuvent accéder au modèle de réflexion, à sa version mini, et à gpt-5-thinking-nano, une version nano encore plus petite et plus rapide du modèle de réflexion. La version de GPT-5 accessible via l'API a un effort de raisonnement réglable (faible, moyen, élevé ou minimal) et une verbosité (faible, moyenne ou élevée). De plus, ChatGPT donne accès à gpt-5-thinking avec un paramètre qui utilise le calcul de test en parallèle, appelé gpt-5-thinking-pro.

Entraînement

Selon AIMultiple, GPT-5 est nativement multimodal, ce qui signifie qu'il a été entraîné de zéro sur plusieurs modalités (comme le texte et les images) en même temps sans s'appuyer sur des modèles de langage ou de vision déjà entraînés. Son processus d'entraînement a impliqué trois étapes : pré-entraînement non supervisé, ajustement fin supervisé et apprentissage par renforcement à partir de retours humains. Le pré-entraînement a utilisé un ensemble de données multilingue à grande échelle composé de livres, d'articles, de pages web, de documents académiques et de sources sous licence. Les capacités visuelles et textuelles de GPT-5 ont été décrites comme ayant été développées en parallèle tout au long de l'entraînement, contrairement à GPT-4.

Utilisation

GPT-5 est utilisé dans ChatGPT. Bien que GPT-5 soit gratuit pour tous les utilisateurs de ChatGPT, les utilisateurs Plus bénéficient de limites d'utilisation plus élevées, tandis que les utilisateurs Pro ont un accès illimité à GPT-5 ainsi qu'un accès limité à GPT-5 Pro. Des limites standard pour les utilisateurs de niveau inférieur sur les réponses par heure s'appliquent toujours. De plus, avec l'introduction de GPT-5, le « Mode vocal avancé » de ChatGPT a été remplacé par « ChatGPT Voice », qui est censé permettre des conversations plus naturelles. OpenAI a déclaré que « le Mode vocal standard prendra sa retraite le 9 septembre 2025, unifiant tous les utilisateurs sur ChatGPT Voice ». Le 24 novembre 2025, la fonctionnalité de recherche d'achats a été ajoutée à ChatGPT, prétendument un mini modèle post-entraîné sur gpt-5-thinking-mini.

GPT-5 est également disponible dans Microsoft Copilot, et Microsoft a déclaré qu'il intégrera GPT-5 dans une large gamme de ses produits. Selon 9to5Mac, Apple Inc. prévoit d'intégrer le modèle dans la fonctionnalité Apple Intelligence de ses systèmes d'exploitation iOS 26, iPadOS 26 et macOS Tahoe. Il est également accessible via l'API OpenAI.

Limites

Sécurité

Neuraltrust, une entreprise de recherche en sécurité, a affirmé avoir réussi à compromettre GPT-5 dès le premier jour de test du modèle. Selon son rapport, elle a permis à GPT-5 de générer des instructions détaillées pour fabriquer des dispositifs explosifs. SPLX, une autre entreprise, a mené des tests similaires et est arrivée à des conclusions similaires sur la sécurité de GPT-5. Leurs évaluations suggèrent que GPT-5 présente des lacunes de sécurité significatives, le rendant potentiellement non sûr pour une utilisation dans un environnement d'entreprise.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:large-language-model·openai·generative-ai·multimodal
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique