Lancement d’OpenAI GPT-5

Traduit de l'anglais

GPT-5 est un modèle de langage multimodal de grande taille développé par OpenAI, lancé le 7 août 2025, en tant que successeur de GPT-4, doté d'un raisonnement hybride, d'une utilisation d'outils et d'une fenêtre de contexte de 400K.

GPT-5 est un modèle de langage multimodal de grande taille développé par OpenAI et le cinquième de sa série de modèles de fondation génératifs pré-entraînés par transformeur (GPT). Précédé dans la série par GPT-4, il a été lancé le 7 août 2025. Il est accessible au public via les produits de chatbot ChatGPT et Microsoft Copilot, ainsi qu'aux développeurs via l'API OpenAI. GPT-5 est conçu comme un système de raisonnement hybride qui combine des réponses rapides et à haut débit avec une réflexion plus profonde et délibérée, et il prend en charge une fenêtre de contexte de 400 000 jetons, permettant le traitement de documents volumineux et de tâches complexes.

Contexte

Le développement de GPT-5 a été marqué par une série de déclarations publiques et de changements internes. Le 14 avril 2023, Sam Altman, le directeur général d'OpenAI, a pris la parole lors d'un événement au Massachusetts Institute of Technology et a déclaré que l'entreprise ne formait pas GPT-5 à ce moment-là. Il a affirmé qu'OpenAI « priorisait le développement de GPT-4 » et que « nous ne publierons pas GPT-5, et ce pour un certain temps ». Le 18 juillet, OpenAI a déposé une demande de marque « GPT-5 » aux États-Unis. Le 13 novembre, Altman a confirmé au Financial Times que l'entreprise travaillait au développement de GPT-5.

Selon The Information, « pendant une grande partie de la seconde moitié de 2024, OpenAI développait un modèle connu en interne sous le nom d'Orion et destiné à devenir GPT-5 », « mais l'effort Orion n'a pas réussi à produire un meilleur modèle, et l'entreprise l'a plutôt publié sous le nom de GPT-4.5 en février [2025] ». Fin juillet 2025, il était largement anticipé qu'OpenAI prévoyait de publier GPT-5 début août. Le 30 juillet, The Verge a rapporté que « Microsoft se prépare pour GPT-5 » alors que « des sources proches des plans d'IA de Microsoft » ont informé un éditeur que l'entreprise testait un nouveau mode pour son chatbot Copilot qui offrirait un modèle qui « réfléchit profondément ou rapidement selon la tâche ». Le 5 août, dans la période précédant la sortie de GPT-5, OpenAI a publié GPT-OSS, un ensemble de deux modèles à poids ouverts dotés de capacités de raisonnement. GPT-5 a ensuite été dévoilé lors d'un événement en direct le 7 août.

Capacités

Au moment de sa sortie, GPT-5 avait des performances de pointe sur les benchmarks testant les mathématiques, la programmation, la finance et la compréhension multimodale. Selon OpenAI, les améliorations par rapport à ses modèles prédécesseurs incluent des temps de réponse plus rapides, de meilleures compétences en codage et en écriture, des réponses plus précises aux questions de santé et des niveaux d'hallucination plus faibles. De plus, par rapport aux modèles précédents, GPT-5 vise à fournir des réponses sûres et de haut niveau aux requêtes potentiellement nuisibles plutôt que de les refuser catégoriquement, une approche qu'OpenAI appelle « complétions sûres », visant à « permettre à GPT-5 de refuser plus de questions dangereuses, tout en offrant moins de rejets aux utilisateurs cherchant des informations inoffensives ». En outre, GPT-5 a été formé pour donner des réponses plus critiques et « moins effusivement agréables » par rapport à ses modèles prédécesseurs.

Quelques jours avant le lancement de GPT-5, deux testeurs précoces du modèle ont déclaré être « impressionnés » par sa capacité à coder et à résoudre des problèmes mathématiques et scientifiques. Ils ont suggéré que le modèle montre une grande amélioration par rapport à GPT-4, mais pas une progression aussi importante que de GPT-3 à GPT-4. Un jour avant la sortie de GPT-5, lors d'un point de presse, Sam Altman, le directeur général d'OpenAI, a qualifié GPT-5 de « pas significatif sur le chemin de l'AGI », faisant référence à l'intelligence artificielle générale, le niveau d'intelligence hypothétique qu'OpenAI définit comme la capacité à effectuer toute tâche économiquement valorisable qu'un humain peut accomplir. Selon Altman, GPT-5 est « significativement meilleur » que ses prédécesseurs, offrant des capacités de « niveau doctorat » dans une large gamme de tâches.

La consommation énergétique exacte de l'utilisation de GPT-5 n'a pas été divulguée par OpenAI. Des chercheurs de l'Université de Rhode Island ont estimé qu'une réponse de longueur moyenne consomme un peu plus de 18 wattheures, équivalent à l'utilisation d'une ampoule à incandescence pendant 18 minutes.

Architecture

GPT-5 est un système qui contient un modèle rapide à haut débit, un modèle de raisonnement plus profond et un routeur en temps réel qui décide quel modèle utiliser en fonction du type de conversation, de la complexité, des besoins en outils et de l'intention explicite de l'utilisateur. Altman avait précédemment critiqué le sélecteur de modèle manuel pour sa complexité excessive, suggérant un besoin d'unification. GPT-5 inclut également des fonctionnalités agentiques grâce auxquelles il peut configurer son propre bureau et utiliser son navigateur pour rechercher de manière autonome des sources liées à sa tâche. La carte système de GPT-5 définit deux modèles rapides à haut débit – gpt-5-main et gpt-5-main-mini – et deux modèles de réflexion – gpt-5-thinking et gpt-5-thinking-mini. Dans l'API OpenAI, les développeurs peuvent accéder au modèle de réflexion, à sa version mini et à gpt-5-thinking-nano, une version nano encore plus petite et plus rapide du modèle de réflexion. La version de GPT-5 accessible via l'API a un effort de raisonnement ajustable (faible, moyen, élevé ou minimal) et une verbosité (faible, moyenne ou élevée). De plus, ChatGPT fournit un accès à gpt-5-thinking avec un paramètre qui utilise le calcul parallèle au moment du test, appelé gpt-5-thinking-pro.

Limites

Sécurité

Neuraltrust, une entreprise de recherche en sécurité, a affirmé avoir réussi à compromettre GPT-5 dès le premier jour de test du modèle. Selon son rapport, elle a permis à GPT-5 de générer des instructions détaillées pour fabriquer des dispositifs explosifs. SPLX, une autre entreprise, a mené des tests similaires et est arrivée à des conclusions similaires sur la sécurité de GPT-5. Leurs évaluations suggèrent que GPT-5 présente des lacunes de sécurité significatives, le rendant potentiellement dangereux pour une utilisation dans un environnement d'entreprise.

Formation

Selon AIMultiple, GPT-5 est nativement multimodal, ce qui signifie qu'il a été formé à partir de zéro sur plusieurs modalités (comme le texte et les images) en même temps sans s'appuyer sur des modèles de langage ou de vision déjà formés. Son processus de formation a impliqué trois étapes : pré-entraînement non supervisé, ajustement fin supervisé et apprentissage par renforcement à partir de retour humain. Le pré-entraînement a utilisé un ensemble de données multilingue à grande échelle composé de livres, d'articles, de pages web, de documents académiques et de sources sous licence. Les capacités visuelles et textuelles de GPT-5 ont été décrites comme ayant été développées en parallèle tout au long de la formation, contrairement à GPT-4.

Utilisation

GPT-5 est utilisé dans ChatGPT. Bien que GPT-5 soit gratuit pour tous les utilisateurs de ChatGPT, les utilisateurs Plus bénéficient de limites d'utilisation plus élevées, tandis que les utilisateurs Pro ont un accès illimité à GPT-5 ainsi qu'un accès limité à GPT-5 Pro. Les limites standard pour les utilisateurs de niveaux inférieurs sur les réponses par heure s'appliquent toujours. De plus, avec l'introduction de GPT-5, le « Mode vocal avancé » de ChatGPT a été remplacé par « ChatGPT Voice », qui est censé permettre des conversations plus naturelles. OpenAI a déclaré que « le Mode vocal standard prendra sa retraite le 9 septembre 2025, unifiant tous les utilisateurs sur ChatGPT Voice ». Le 24 novembre 2025, la fonctionnalité de recherche shopping a été ajoutée à ChatGPT, prétendument un mini modèle post-formé sur gpt-5-thinking-mini.

GPT-5 est également disponible dans Microsoft Copilot, et Microsoft a déclaré qu'il intégrerait GPT-5 dans une large gamme de ses produits. Selon 9to5Mac, Apple Inc. prévoit d'intégrer le modèle dans la fonctionnalité Apple Intelligence de ses systèmes d'exploitation iOS 26, iPadOS 26 et macOS Tahoe. Il est également accessible via l'API OpenAI, permettant aux développeurs de créer des applications basées sur le modèle.

Réception et impact

La sortie de GPT-5 a généré une attention significative au sein de la communauté de l'Artificial intelligence. Les évaluations précoces ont mis en évidence ses capacités avancées de raisonnement et multimodales, le positionnant comme un Large language model de premier plan de son époque. L'architecture hybride, qui combine des modèles rapides et de réflexion, a été perçue comme une réponse à la demande croissante de systèmes d'IA plus efficaces et capables. Cependant, les préoccupations de sécurité soulevées par Neuraltrust et SPLX ont suscité des débats sur la sécurité du déploiement de tels modèles puissants dans des environnements d'entreprise. L'intégration avec Microsoft Copilot et l'intégration prévue avec Apple Intelligence ont souligné la tendance à intégrer la Generative AI dans les produits grand public. À la fin de 2025, GPT-5 continue d'être un point central dans les discussions sur la trajectoire de l'Machine learning et le chemin vers l'Artificial intelligence générale.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:openai·large-language-model·artificial-intelligence·2025-events
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique