Traduit de l'anglais

OpenAI o3 est un modèle de raisonnement de type transformeur génératif pré-entraîné (GPT), annoncé le 20 décembre 2024 comme successeur d'OpenAI o1, conçu pour consacrer un temps de délibération supplémentaire à un raisonnement logique étape par étape, avec des versions incluant o3-mini, o3, o4-mini et o3-pro.

OpenAI o3 est un modèle de transformeur génératif pré-entraîné (GPT) développé par OpenAI en tant que successeur d'OpenAI o1 pour ChatGPT. Il est conçu pour consacrer un temps de délibération supplémentaire lorsqu'il répond à des questions nécessitant un raisonnement logique étape par étape. Le modèle a été annoncé le 20 décembre 2024, puis publié en plusieurs variantes, notamment o3-mini, o3, o4-mini et o3-pro, avec des capacités en codage, mathématiques et sciences.

Le nom « o3 » a été choisi au lieu de « o2 » pour éviter un conflit de marque avec la marque d'opérateur mobile O2. OpenAI a invité les chercheurs en sécurité et sûreté à demander un accès anticipé aux modèles jusqu'au 10 janvier 2025. Comme pour son prédécesseur o1, l'annonce initiale comprenait deux modèles : o3 et o3-mini.

Historique

Le modèle OpenAI o3 a été annoncé le 20 décembre 2024. Le 31 janvier 2025, OpenAI a publié o3-mini pour tous les utilisateurs de ChatGPT, y compris ceux du niveau gratuit, et pour certains utilisateurs de l'API. OpenAI a décrit o3-mini comme une « alternative spécialisée » à o1 pour « les domaines techniques nécessitant précision et rapidité ». o3-mini propose trois niveaux d'effort de raisonnement : faible, moyen et élevé. La version gratuite utilise le niveau moyen, tandis qu'une variante utilisant plus de calcul, appelée o3-mini-high, est disponible pour les abonnés payants. Les abonnés au niveau Pro de ChatGPT ont un accès illimité à o3-mini et o3-mini-high.

Le 2 février 2025, OpenAI a lancé OpenAI Deep Research, un service ChatGPT utilisant une version d'o3 qui produit des rapports complets en 5 à 30 minutes à partir de recherches sur le web. Le 6 février, en réponse à la pression de concurrents comme DeepSeek R1, OpenAI a annoncé une mise à jour visant à améliorer la transparence du processus de pensée dans son modèle o3-mini. Le 12 février, OpenAI a encore augmenté les limites de débit pour o3-mini-high à 50 requêtes par jour (contre 50 requêtes par semaine) pour les abonnés ChatGPT Plus et a implémenté la prise en charge du téléchargement de fichiers et d'images.

Le 16 avril 2025, OpenAI a publié o3 et o4-mini, un successeur d'o3-mini. Le 10 juin 2025, OpenAI a publié o3-pro, que l'entreprise affirme être son modèle le plus performant à ce jour. OpenAI a déclaré : « Nous recommandons de l'utiliser pour les questions difficiles où la fiabilité importe plus que la rapidité, et où attendre quelques minutes vaut le compromis ». Le 28 mai 2026, OpenAI a annoncé qu'o3 serait retiré de ChatGPT le 26 août 2026, après une période de transition de 90 jours. L'entreprise a déclaré que ce changement s'appliquait uniquement à ChatGPT et n'affectait pas l'API.

Capacités

L'apprentissage par renforcement a été utilisé pour apprendre à o3 à « penser » avant de générer des réponses, en utilisant ce qu'OpenAI appelle une « chaîne de pensée privée ». Cette approche permet au modèle de planifier à l'avance et de raisonner sur les tâches, en effectuant une série d'étapes de raisonnement intermédiaires pour aider à résoudre le problème, au prix d'une puissance de calcul supplémentaire et d'une latence accrue des réponses.

o3 démontre des performances nettement supérieures à o1 sur des tâches complexes, notamment en codage, mathématiques et sciences. OpenAI a rapporté qu'o3 a obtenu un score de 87,7 % sur le benchmark GPQA Diamond, qui contient des questions scientifiques de niveau expert non disponibles publiquement en ligne. Sur SWE-bench Verified, un benchmark d'ingénierie logicielle évaluant la capacité à résoudre de vrais problèmes GitHub, o3 a obtenu 71,7 %, contre 48,9 % pour o1. Sur Codeforces, o3 a atteint un score Elo de 2727, tandis qu'o1 a obtenu 1891. Sur le benchmark Abstraction and Reasoning Corpus for Artificial General Intelligence (ARC-AGI), qui évalue la capacité d'une IA à gérer de nouveaux problèmes logiques et d'acquisition de compétences, o3 a atteint trois fois la précision d'o1.

Variantes du modèle

La famille o3 comprend plusieurs variantes adaptées à différents cas d'utilisation. o3-mini est un modèle plus petit et plus rapide conçu pour les domaines techniques nécessitant précision et rapidité, avec des niveaux d'effort de raisonnement ajustables. o3 est le modèle à grande échelle avec des performances supérieures sur des benchmarks complexes. o4-mini, publié aux côtés d'o3 le 16 avril 2025, sert de successeur à o3-mini. o3-pro, publié le 10 juin 2025, est positionné comme le modèle le plus performant, privilégiant la fiabilité à la rapidité.

Chaque variante exploite la même architecture sous-jacente d'un modèle de langage de grande taille basé sur l'architecture transformeur, avec des techniques de apprentissage profond et des réseaux de neurones pour le raisonnement. Les modèles sont entraînés à l'aide de apprentissage par renforcement et intègrent une chaîne de pensée privée, qui est une forme de raisonnement chaîne de pensée qui n'est pas entièrement transparente pour les utilisateurs.

Performances et benchmarks

Les métriques de performance pour o3 mettent en évidence ses avancées par rapport aux modèles précédents. Sur GPQA Diamond, o3 a obtenu 87,7 %, indiquant une forte performance sur les questions scientifiques de niveau expert. Sur SWE-bench Verified, o3 a atteint 71,7 %, une amélioration significative par rapport aux 48,9 % d'o1, démontrant sa capacité à résoudre des problèmes réels d'ingénierie logicielle. Sur Codeforces, le score Elo de 2727 d'o3 a largement dépassé celui de 1891 d'o1, reflétant des compétences supérieures en programmation compétitive. Sur ARC-AGI, o3 a triplé la précision d'o1, suggérant une capacité accrue à gérer des tâches nouvelles de logique et d'acquisition de compétences.

Ces résultats positionnent o3 comme un modèle de raisonnement de premier plan dans le domaine de l'intelligence artificielle, avec des applications dans des domaines tels que le apprentissage automatique et la IA générative. La capacité du modèle à raisonner étape par étape le rend adapté aux tâches nécessitant une délibération minutieuse, bien que cela implique des coûts de calcul accrus et une latence plus élevée.

Comparaison avec d'autres modèles

Dans le paysage concurrentiel des modèles d'IA, o3 est souvent comparé aux offres d'autres organisations. Anthropic et Google DeepMind ont développé leurs propres modèles de raisonnement, et les performances d'o3 sur des benchmarks comme SWE-bench Verified et Codeforces ont été utilisées pour évaluer sa position. La publication d'o3-mini en janvier 2025 était en partie une réponse à la pression concurrentielle, notamment de modèles comme DeepSeek R1, ce qui a conduit à des mises à jour améliorant la transparence du processus de pensée.

L'approche d'OpenAI avec o3 met l'accent sur le raisonnement délibéré, contrastant avec les modèles qui privilégient la rapidité. Ce compromis se reflète dans les différents niveaux d'effort de raisonnement disponibles dans o3-mini, permettant aux utilisateurs d'équilibrer précision et temps de réponse. L'intégration du modèle dans ChatGPT et les services API l'a rendu accessible à un large éventail d'utilisateurs, du niveau gratuit aux abonnés Pro.

Déploiement et accès

Le déploiement des variantes d'o3 a été progressif. o3-mini a été le premier à être largement publié, suivi d'o3 et o4-mini, puis d'o3-pro. L'accès est fourni via ChatGPT, avec différents niveaux offrant des niveaux d'utilisation variables. Les utilisateurs du niveau gratuit obtiennent o3-mini avec un effort de raisonnement moyen, tandis que les abonnés payants peuvent accéder à des niveaux d'effort plus élevés et à une utilisation plus fréquente. Les abonnés Pro ont un accès illimité à o3-mini et o3-mini-high.

L'accès API pour les modèles o3 a été élargi au fil du temps, avec des limites de débit ajustées pour répondre à la demande. Le retrait d'o3 de ChatGPT en août 2026, annoncé en mai 2026, indique un cycle de vie planifié pour le modèle, bien que l'accès API reste inchangé. Cette stratégie de déploiement reflète l'approche d'OpenAI visant à améliorer et mettre à jour itérativement ses offres de modèles.

Voir aussi

Références

  • Annonces et documentation d'OpenAI (2024-2026)
  • Résultats de benchmarks rapportés par OpenAI

Liens externes

  • Présentation d'OpenAI o3 et o4-mini
  • O3 est 80 % moins cher et introduction d'o3-pro
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:openai·large-language-models·artificial-intelligence·reasoning-models
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique