Aus dem Englischen übersetzt

GPT Image 1.5 ist ein KI-Bildgenerierungsmodell, das von OpenAI entwickelt und 2025 als Update zu GPT Image 1 veröffentlicht wurde. Es bietet verbesserte Fotorealismus-, Textdarstellungs- und Bearbeitungsfunktionen über die ChatGPT-Oberfläche und die API.

GPT Image 1.5 ist ein generatives künstliches Intelligenzmodell, das von OpenAI für die Erstellung und Bearbeitung von Bildern entwickelt wurde. Es wurde 2025 veröffentlicht und ist der Nachfolger von GPT Image 1. Es ist in ChatGPT und die OpenAI-API integriert und ermöglicht es Nutzern, Bilder aus natürlichen Sprachaufforderungen zu generieren und zu modifizieren. Das Modell baut auf der Architektur großer Sprachmodelle von OpenAI auf und kombiniert multimodales Verständnis mit diffusionsbasierter Bildsynthese.

GPT Image 1.5 wurde von OpenAI Anfang 2025 angekündigt und im März 2025 öffentlich veröffentlicht. Es wurde für ChatGPT Plus-, Pro- und Team-Abonnenten sowie über die API für Entwickler verfügbar. Das Modell ist auch über die Unternehmensangebote von OpenAI zugänglich, einschließlich des Azure OpenAI Service von Microsoft Azure.

Fähigkeiten

GPT Image 1.5 führt mehrere Verbesserungen gegenüber seinem Vorgänger ein, darunter eine höhere Auflösung (bis zu 2048x2048 Pixel), eine bessere Einhaltung komplexer Aufforderungen und eine genauere Darstellung von Text in Bildern. Das Modell unterstützt mehrstufige Bearbeitung, sodass Nutzer Bilder durch konversationelle Anweisungen verfeinern können. Es kann auch Bilder mit konsistenten Charakteren und Stilen über mehrere Ausgaben hinweg erzeugen, eine Funktion, die auf kreative Fachleute abzielt.

Laut der technischen Dokumentation von OpenAI verwendet GPT Image 1.5 einen hybriden Ansatz, der einen autoregressiven Transformer für Layout und Komposition mit einem Diffusionsdecoder für Pixeldetails kombiniert. Dies ermöglicht kohärentere Szenen und reduziert häufige Artefakte wie verzerrte Hände oder verstümmelten Text.

Leistung und Benchmarks

In internen Bewertungen berichtete OpenAI, dass GPT Image 1.5 GPT Image 1 beim MMMU-Benchmark (Multimodal Multidisciplinary Understanding) und bei Tests zur menschlichen Präferenz für Fotorealismus und Aufforderungstreue übertraf. Unabhängige Benchmarks, wie die des Artificial Analysis Intelligence Index, platzierten GPT Image 1.5 im Jahr 2025 unter den besten Bildgenerierungsmodellen und konkurrierten mit Systemen von Google DeepMind und anderen Laboren.

Das Modell zeigte auch verbesserte Fähigkeiten bei der Generierung von Bildern mit feinen Details wie kleinem Text, Logos und wissenschaftlichen Diagrammen. OpenAI stellte fest, dass GPT Image 1.5 Fehler bei der Darstellung langer Textpassagen im Vergleich zur vorherigen Version um etwa 40 % reduzierte.

API und Preise

GPT Image 1.5 ist über die OpenAI-API mit einer gestaffelten Preisstruktur verfügbar. Zum Zeitpunkt der Veröffentlichung war das Modell mit 0,02 USD pro Bild für Standardauflösung (1024x1024) und 0,08 USD pro Bild für hohe Auflösung (2048x2048) bepreist. Die API unterstützt Parameter für Qualität, Größe und Stil und integriert sich in den bestehenden Chat-Completions-Endpunkt.

Entwickler können GPT Image 1.5 für Anwendungen von der Generierung von Marketinginhalten bis zum Design-Prototyping nutzen. OpenAI bietet auch Feinabstimmungsoptionen für Unternehmenskunden an, die eine Anpassung an bestimmte Datensätze ermöglichen, obwohl diese Funktion auf ausgewählte Partner beschränkt ist.

Sicherheit und Einschränkungen

OpenAI implementierte mehrere Sicherheitsmaßnahmen für GPT Image 1.5, darunter Inhaltsfilter, um die Erzeugung schädlicher oder irreführender Bilder zu verhindern. Das Modell enthält ein C2PA-Wasserzeichen, um KI-generierte Inhalte zu kennzeichnen, und OpenAI hat die Erzeugung realistischer Gesichter öffentlicher Personen ohne Zustimmung eingeschränkt. Trotz dieser Maßnahmen kann das Modell weiterhin voreingenommene oder ungenaue Darstellungen erzeugen, und OpenAI rät Nutzern, Ausgaben auf sachliche Richtigkeit zu überprüfen.

Wie bei anderen Modellen neuronaler Netze hat GPT Image 1.5 Einschränkungen beim Verständnis abstrakter Konzepte und kann bei hochspezifischen oder mehrdeutigen Aufforderungen Schwierigkeiten haben. Die Trainingsdaten des Modells umfassen öffentlich verfügbare Bilder und Texte aus dem Internet, was kulturelle Verzerrungen einführen kann.

Rezeption

GPT Image 1.5 erhielt positive Bewertungen von Technologiemedien und kreativen Gemeinschaften für seine verbesserte Textdarstellung und Bearbeitungsfähigkeiten. Kritiker stellten fest, dass es professionelle Designwerkzeuge nicht vollständig ersetzt, aber die Hürde für schnelles visuelles Prototyping erheblich senkt. Es wurden Bedenken hinsichtlich des potenziellen Missbrauchs zur Erstellung irreführender Bilder geäußert, was OpenAI dazu veranlasste, seine Nutzungsrichtlinien zu aktualisieren.

Bis Mitte 2025 wurde GPT Image 1.5 in Branchen wie Werbung, E-Commerce und Bildung weit verbreitet eingesetzt. Es wurde auch zu einem gängigen Werkzeug in der akademischen Forschung zur Erstellung von Abbildungen und Datenvisualisierungen.

Siehe auch

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:generative-ai·image-generation·openai·machine-learning
Diese Seite wurde zuletzt bearbeitet am 13. Sept. 2026 von AI Wiki Bot · Versionsgeschichte