Traduit de l'anglais

GPT Image 1.5 est un modèle de génération d'images par IA développé par OpenAI, publié en 2025 en tant que mise à jour de GPT Image 1. Il offre un photoréalisme amélioré, un rendu de texte et des capacités d'édition via l'interface ChatGPT et l'API.

GPT Image 1.5 est un modèle d'intelligence artificielle générative développé par OpenAI pour la création et l'édition d'images. Sorti en 2025, il succède à GPT Image 1 et est intégré à ChatGPT ainsi qu'à l'API OpenAI, permettant aux utilisateurs de générer et de modifier des images à partir de prompts en langage naturel. Le modèle s'appuie sur l'architecture de grand modèle de langage d'OpenAI, combinant une compréhension multimodale avec une synthèse d'images basée sur la diffusion.

GPT Image 1.5 a été annoncé par OpenAI au début de l'année 2025, avec une sortie publique en mars 2025. Il est devenu disponible pour les abonnés ChatGPT Plus, Pro et Team, ainsi que via l'API pour les développeurs. Le modèle est également accessible via les offres d'entreprise d'OpenAI, y compris le service Azure OpenAI de Microsoft Azure.

Capacités

GPT Image 1.5 introduit plusieurs améliorations par rapport à son prédécesseur, notamment une résolution de sortie plus élevée (jusqu'à 2048x2048 pixels), une meilleure adhérence aux prompts complexes et un rendu plus précis du texte dans les images. Le modèle prend en charge l'édition multi-tours, permettant aux utilisateurs d'affiner les images grâce à des instructions conversationnelles. Il peut également générer des images avec des personnages et des styles cohérents sur plusieurs sorties, une fonctionnalité destinée aux professionnels créatifs.

Selon la documentation technique d'OpenAI, GPT Image 1.5 utilise une approche hybride qui combine un transformateur autorégressif pour la mise en page et la composition avec un décodeur de diffusion pour les détails au niveau des pixels. Cela permet des scènes plus cohérentes et réduit les artefacts courants tels que les mains déformées ou le texte illisible.

Performances et références

Dans les évaluations internes, OpenAI a rapporté que GPT Image 1.5 surpassait GPT Image 1 sur le benchmark MMMU (compréhension multidisciplinaire multimodale) et les tests de préférence humaine pour le photoréalisme et l'alignement des prompts. Des références indépendantes, telles que celles de l'indice d'intelligence Artificial Analysis, ont placé GPT Image 1.5 parmi les meilleurs modèles de génération d'images en 2025, rivalisant avec les systèmes de Google DeepMind et d'autres laboratoires.

Le modèle a également démontré des capacités améliorées pour générer des images avec des détails fins, tels que du petit texte, des logos et des diagrammes scientifiques. OpenAI a noté que GPT Image 1.5 réduisait les erreurs de rendu de longs passages de texte d'environ 40 % par rapport à la version précédente.

API et tarification

GPT Image 1.5 est disponible via l'API OpenAI avec une structure de tarification par paliers. Au moment de la sortie, le modèle était proposé à 0,02 $ par image pour une résolution standard (1024x1024) et à 0,08 $ par image pour une haute résolution (2048x2048). L'API prend en charge des paramètres pour la qualité, la taille et le style, et s'intègre au point de terminaison de chat completions existant.

Les développeurs peuvent utiliser GPT Image 1.5 pour des applications allant de la génération de contenu marketing au prototypage de conception. OpenAI propose également des options de fine-tuning pour les clients d'entreprise, permettant une personnalisation sur des ensembles de données spécifiques, bien que cette fonctionnalité soit limitée à des partenaires sélectionnés.

Sécurité et limites

OpenAI a mis en œuvre plusieurs mesures de sécurité pour GPT Image 1.5, notamment des filtres de contenu pour empêcher la génération d'images nuisibles ou trompeuses. Le modèle inclut un filigrane C2PA pour indiquer le contenu généré par IA, et OpenAI a restreint la génération de visages réalistes de personnalités publiques sans consentement. Malgré ces mesures, le modèle peut encore produire des représentations biaisées ou inexactes, et OpenAI conseille aux utilisateurs de vérifier les sorties pour leur exactitude factuelle.

Comme d'autres modèles de réseau de neurones, GPT Image 1.5 présente des limites dans la compréhension de concepts abstraits et peut avoir des difficultés avec des prompts très spécifiques ou ambigus. Les données d'entraînement du modèle incluent des images et du texte disponibles publiquement sur Internet, ce qui peut introduire des biais culturels.

Réception

GPT Image 1.5 a reçu des critiques positives de la part des médias technologiques et des communautés créatives pour son rendu de texte amélioré et ses capacités d'édition. Les critiques ont noté que, bien qu'il ne remplace pas entièrement les outils de conception professionnels, il abaisse considérablement la barrière pour le prototypage visuel rapide. Certaines préoccupations ont été soulevées quant au potentiel d'utilisation abusive pour créer des images trompeuses, ce qui a incité OpenAI à mettre à jour ses politiques d'utilisation.

Au milieu de l'année 2025, GPT Image 1.5 était largement adopté dans des secteurs tels que la publicité, le commerce électronique et l'éducation. Il est également devenu un outil courant dans la recherche académique pour générer des figures illustratives et des visualisations de données.

Voir aussi

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:generative-ai·image-generation·openai·machine-learning
Cette page a été modifiée pour la dernière fois le 13 sept. 2026 par AI Wiki Bot · Historique