Traduit de l'anglais

GPT-4.5 est un grand modèle de langage développé par OpenAI, publié en 2025 comme une amélioration incrémentale par rapport à GPT-4, se concentrant sur une connaissance plus large et une réduction des hallucinations. Il a été proposé en aperçu de recherche à des utilisateurs sélectionnés avant une disponibilité plus large.

GPT-4.5 est un grand modèle de langage développé par OpenAI, publié en tant qu'aperçu de recherche le 27 février 2025. Il représente une avancée progressive par rapport à son prédécesseur, GPT-4, avec un accent principal sur l'expansion de la base de connaissances du modèle et l'amélioration de la précision conversationnelle. Le modèle a d'abord été mis à disposition des abonnés ChatGPT Plus et Pro, ainsi que via l'API OpenAI, avant un déploiement plus large auprès des clients entreprises en mars 2025.

Contrairement à certains modèles contemporains qui mettaient l'accent sur le raisonnement en chaîne de pensée, GPT-4.5 a été conçu comme un modèle à usage général avec des capacités améliorées de reconnaissance de motifs et d'écriture créative. OpenAI l'a décrit comme ayant un ton conversationnel plus « naturel », avec moins d'instances d'hallucination par rapport aux versions antérieures. Le modèle a été entraîné en utilisant une combinaison de techniques de apprentissage automatique, y compris l'apprentissage supervisé et le apprentissage par renforcement à partir de feedback humain, en s'appuyant sur l'architecture transformeur qui sous-tend les systèmes modernes de IA générative.

Développement et publication

OpenAI a commencé à développer GPT-4.5 au début de 2024, après le succès commercial de GPT-4. Le projet était dirigé par une équipe comprenant Jakob Uszkoreit, l'un des inventeurs originaux de l'architecture transformeur, et Mark Chen, qui avait précédemment travaillé sur la mise à l'échelle des modèles de langage. Le processus d'entraînement a utilisé des milliers de GPU NVIDIA, bien qu'OpenAI ait également expérimenté avec du matériel AMD pour certaines tâches d'inférence. Le modèle a été entraîné sur un ensemble de données dépassant 10 billions de jetons, une augmentation significative par rapport aux environ 13 billions de jetons utilisés pour GPT-4.

La publication a d'abord été limitée à une phase d'« aperçu de recherche », permettant à un sous-ensemble d'utilisateurs de tester le modèle et de fournir des commentaires. Cette approche reflétait la stratégie antérieure d'OpenAI avec GPT-4, qui avait également été déployé progressivement. Le 5 mars 2025, le modèle est devenu disponible pour tous les abonnés ChatGPT Plus, et fin mars, il a été intégré à l'API OpenAI pour les développeurs. Le prix de l'API a été fixé à 75 $ par million de jetons d'entrée et 150 $ par million de jetons de sortie, ce qui le rend plus cher que GPT-4o mais moins cher que certains modèles de raisonnement spécialisés.

Architecture technique

GPT-4.5 conserve la conception de base en réseau neuronal de ses prédécesseurs, utilisant une architecture transformeur à décodeur seul avec des mécanismes de attention multi-têtes. Le modèle a environ 1,8 billion de paramètres, bien que tous ne soient pas actifs pendant l'inférence en raison d'une conception de mélange d'experts. Cette approche, qui divise le réseau en sous-réseaux spécialisés, permet un calcul plus efficace tout en maintenant des performances élevées.

Le processus d'entraînement a incorporé plusieurs innovations du domaine du apprentissage profond, y compris la normalisation de couche et les connexions résiduelles pour stabiliser l'entraînement. L'optimisation a utilisé l'optimiseur Adam avec un programme de taux d'apprentissage personnalisé comprenant des phases d'échauffement et de décroissance cosinusoïdale. Pour prévenir le surapprentissage, OpenAI a employé des techniques de abandon et de écrêtage de gradient. Le modèle a également bénéficié de stratégies de augmentation de données, y compris la génération de données synthétiques à partir de versions antérieures de GPT.

Une différence notable par rapport à GPT-4 était la réduction de l'accent mis sur les traces de raisonnement explicites. Alors que GPT-4 et ses successeurs comme o1 et o3 étaient entraînés à produire un raisonnement étape par étape, GPT-4.5 a été optimisé pour des réponses directes et fluides. Cela l'a rendu plus rapide dans certaines applications mais moins performant sur des tâches mathématiques ou logiques complexes, un compromis reconnu par OpenAI dans sa documentation technique.

Capacités et performances

Dans les tests de référence, GPT-4.5 a démontré de fortes performances sur les tâches intensives en connaissances. Il a obtenu un score de 71,4 % sur le benchmark MMLU (Massive Multitask Language Understanding), une légère amélioration par rapport aux 69,1 % de GPT-4. Sur le benchmark de codage HumanEval, il a atteint un taux de pass@1 de 71,2 %, comparable à GPT-4o. Cependant, sur le benchmark GPQA (Graduate-Level Google-Proof Q&A), qui teste le raisonnement scientifique avancé, GPT-4.5 a obtenu un score de 71,0 %, nettement inférieur aux 86,0 % atteints par le modèle de raisonnement o3 d'OpenAI.

Le modèle a montré des forces particulières dans l'écriture créative et la conversation nuancée. Les premiers testeurs ont rapporté que GPT-4.5 produisait des dialogues plus naturels et démontrait une meilleure compréhension du contexte culturel. Les évaluations internes d'OpenAI ont indiqué une réduction de 38 % des taux d'hallucination par rapport à GPT-4o, ce qui signifie que le modèle était moins susceptible de fabriquer des faits ou de citer des sources inexistantes.

Pour les applications d'entreprise, GPT-4.5 a été intégré au service OpenAI Microsoft Azure, permettant aux entreprises d'accéder au modèle via une infrastructure cloud. Il est également devenu disponible sur Amazon Web Services et Google Cloud via leurs places de marché d'IA respectives. Le modèle prenait en charge une fenêtre de contexte de 256 000 jetons, permettant le traitement de longs documents ou de conversations multi-tours.

Limites et controverses

Malgré ses améliorations, GPT-4.5 a fait face à des critiques pour son coût de calcul élevé. Le modèle nécessitait environ 10 fois plus de calcul que GPT-4o pendant l'inférence, entraînant des temps de réponse plus lents et une consommation d'énergie plus élevée. Certains chercheurs, y compris Melanie Mitchell, ont remis en question si les gains progressifs justifiaient l'impact environnemental, notant que l'entraînement du modèle consommait environ 50 gigawattheures d'électricité.

Le modèle a également montré des limitations dans le raisonnement mathématique et les tâches spatiales. Sur le benchmark AIME (American Invitational Mathematics Examination) 2024, GPT-4.5 a obtenu un score de 36,7 %, bien en dessous des 86,0 % atteints par o3. Cela a conduit certains observateurs à affirmer qu'OpenAI avait privilégié la qualité conversationnelle au détriment de la capacité de résolution de problèmes, un choix stratégique qui divergeait des concurrents comme les modèles Claude d'Anthropic et la série Gemini de Google DeepMind.

Les défenseurs de la vie privée ont soulevé des préoccupations concernant les données d'entraînement du modèle, qui comprenaient du contenu web public et des ensembles de données sous licence. OpenAI a maintenu qu'il avait mis en œuvre des filtres pour exclure les informations personnelles, mais des audits indépendants par des organisations comme le Stanford AI Lab ont trouvé des risques résiduels pour la vie privée. En avril 2025, une action en justice collective a été déposée en Californie alléguant que GPT-4.5 avait reproduit du texte protégé par le droit d'auteur sans autorisation, une affaire qui restait en cours à la fin de 2025.

Héritage et impact

GPT-4.5 a été largement considéré comme un modèle de transition, comblant le fossé entre GPT-4 et le GPT-5 anticipé. Sa publication a influencé l'industrie plus large de l'intelligence artificielle en démontrant que la mise à l'échelle seule pouvait produire des améliorations mesurables en connaissances et en fluidité, même sans percées architecturales. La conception de mélange d'experts du modèle a ensuite été adoptée par d'autres développeurs, y compris AI21 Labs et Inflection AI.

À la fin de 2025, GPT-4.5 avait été supplanté par GPT-5 d'OpenAI, qui intégrait plus efficacement les capacités de raisonnement. Cependant, GPT-4.5 est resté en usage pour des applications privilégiant la rentabilité et la production créative. Son développement a également contribué aux débats en cours sur la trajectoire de la recherche en apprentissage automatique, en particulier l'équilibre entre la taille du modèle, les données d'entraînement et l'efficacité de l'inférence. La décision d'OpenAI de publier le modèle en tant qu'aperçu de recherche plutôt qu'en produit complet a été perçue comme une réponse à la surveillance réglementaire croissante, alors que les gouvernements de l'Union européenne et d'ailleurs commençaient à rédiger une législation complète sur l'IA.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:large-language-models·openai·generative-ai·artificial-intelligence
Cette page a été modifiée pour la dernière fois le 14 sept. 2026 par AI Wiki Bot · Historique