GPT-5 ist ein multimodales großes Sprachmodell, das von OpenAI entwickelt wurde und das fünfte in seiner Reihe von generativen vortrainierten Transformer-Grundlagenmodellen (GPT) ist. In der Reihe folgt es auf GPT-4 und wurde am 7. August 2025 veröffentlicht. Es ist öffentlich für Nutzer der Chatbot-Produkte ChatGPT und Microsoft Copilot sowie für Entwickler über die OpenAI-API zugänglich.
GPT-5 stellt einen bedeutenden Fortschritt auf dem Gebiet der künstlichen Intelligenz dar und baut auf den Grundlagen des maschinellen Lernens und des Deep Learning auf. Seine Architektur umfasst ein auf Transformatoren basierendes Design, das mit seinen Vorgängern konsistent ist, und es ist nativ multimodal, da es von Grund auf sowohl mit Text als auch mit Bildern trainiert wurde. Das Modell ist darauf ausgelegt, eine breite Palette von Aufgaben zu bewältigen, von komplexem Denken bis hin zu alltäglichen Konversationsinteraktionen, mit einem Fokus auf Sicherheit und reduzierter Halluzination.
Hintergrund
Die Entwicklung von GPT-5 war ein langer und iterativer Prozess. Am 14. April 2023 erklärte Sam Altman, der Chief Executive Officer von OpenAI, bei einer Veranstaltung am Massachusetts Institute of Technology, dass das Unternehmen zu diesem Zeitpunkt kein GPT-5 trainierte, und betonte den Fokus auf GPT-4. Bis zum 18. Juli 2023 reichte OpenAI jedoch eine Markenanmeldung für „GPT-5" in den Vereinigten Staaten ein, und am 13. November 2023 bestätigte Altman gegenüber der Financial Times, dass das Unternehmen an GPT-5 arbeite.
Laut The Information entwickelte OpenAI während eines Großteils der zweiten Hälfte des Jahres 2024 ein Modell, das intern als Orion bekannt war und zu GPT-5 werden sollte. Die Orion-Bemühungen führten jedoch nicht zu einem besseren Modell, was zu seiner Veröffentlichung als GPT-4.5 im Februar 2025 führte. Ende Juli 2025 war die Vorfreude auf GPT-5 groß, mit Berichten, dass Microsoft seine Integration in Copilot vorbereitete. Am 5. August 2025 veröffentlichte OpenAI GPT-OSS, eine Reihe von zwei Open-Weight-Modellen mit Denkfähigkeiten, als Vorläufer. GPT-5 wurde schließlich während einer Live-Stream-Veranstaltung am 7. August 2025 enthüllt.
Fähigkeiten
Zum Zeitpunkt seiner Veröffentlichung erreichte GPT-5 Spitzenleistungen bei Benchmarks, die Mathematik, Programmierung, Finanzen und multimodales Verständnis testen. Laut OpenAI umfassen Verbesserungen gegenüber seinen Vorgängern schnellere Antwortzeiten, bessere Programmier- und Schreibfähigkeiten, genauere Antworten auf Gesundheitsfragen und geringere Halluzinationsraten. Das Modell zielt auch darauf ab, sichere, hochwertige Antworten auf potenziell schädliche Anfragen zu geben, anstatt sie rundweg abzulehnen - ein Ansatz, der als „sichere Vervollständigungen" bezeichnet wird und unnötige Ablehnungen für harmlose Informationen reduziert. Darüber hinaus wurde GPT-5 darauf trainiert, kritischere und weniger überschwänglich zustimmende Antworten zu geben.
Frühe Tester, Tage vor dem Start, waren von seinen Programmier- und Problemlösungsfähigkeiten beeindruckt und stellten eine deutliche Verbesserung gegenüber GPT-4 fest, wenn auch keinen so großen Sprung wie von GPT-3 zu GPT-4. Sam Altman nannte GPT-5 „einen bedeutenden Schritt auf dem Weg zur AGI", womit er künstliche allgemeine Intelligenz meint, und beschrieb es als Fähigkeiten auf „PhD-Niveau" über eine breite Palette von Aufgaben hinweg.
Der genaue Energieverbrauch von GPT-5 wurde nicht offengelegt, aber Forscher der University of Rhode Island schätzten, dass eine mittellange Antwort etwas mehr als 18 Wattstunden verbraucht, was der Nutzung einer Glühbirne für 18 Minuten entspricht.
Architektur
GPT-5 ist ein System, das ein schnelles Modell mit hohem Durchsatz, ein tieferes Denkmodell und einen Echtzeit-Router umfasst, der entscheidet, welches Modell basierend auf Gesprächstyp, Komplexität, Tool-Anforderungen und expliziter Nutzerabsicht verwendet wird. Dieses Design adressiert die Komplexität der manuellen Modellauswahl, die Altman kritisiert hatte. Das System umfasst agentische Funktionalität, die es ihm ermöglicht, einen eigenen Desktop einzurichten und einen Browser zu verwenden, um autonom nach Quellen zu suchen.
Das GPT-5-Systemkarten-Dokument definiert zwei schnelle Modelle (gpt-5-main und gpt-5-main-mini) und zwei Denkmodelle (gpt-5-thinking und gpt-5-thinking-mini). Die API bietet auch gpt-5-thinking-nano, eine kleinere und schnellere Version. Entwickler können den Denkaufwand (niedrig, mittel, hoch oder minimal) und die Ausführlichkeit (niedrig, mittel oder hoch) anpassen. ChatGPT bietet Zugriff auf gpt-5-thinking mit einer Einstellung für parallele Testzeit-Berechnung, die als gpt-5-thinking-pro bezeichnet wird.
Training
GPT-5 ist nativ multimodal und wird von Grund auf gleichzeitig mit mehreren Modalitäten (Text und Bilder) trainiert, ohne auf vortrainierte Sprach- oder Bildmodelle zurückzugreifen. Sein Trainingsprozess umfasste drei Phasen: unüberwachtes Vortraining, überwachte Feinabstimmung und Reinforcement Learning aus menschlichem Feedback (RLHF). Das Vortraining verwendete einen groß angelegten mehrsprachigen Datensatz aus Büchern, Artikeln, Webseiten, akademischen Arbeiten und lizenzierten Quellen. Im Gegensatz zu GPT-4 wurden die visuellen und textuellen Fähigkeiten von GPT-5 während des gesamten Trainings parallel entwickelt.
Sicherheit und Einschränkungen
Trotz seiner Fortschritte sah sich GPT-5 Sicherheitsbedenken gegenüber. Neuraltrust, ein Sicherheitsforschungsunternehmen, behauptete, GPT-5 innerhalb des ersten Testtags kompromittiert zu haben, sodass es detaillierte Anweisungen zur Herstellung von Sprengstoffen generieren konnte. SPLX, ein weiteres Unternehmen, führte ähnliche Tests durch und kam zu ähnlichen Schlussfolgerungen. Diese Bewertungen deuten auf erhebliche Sicherheitslücken hin, die GPT-5 möglicherweise für Unternehmensumgebungen unsicher machen.
Nutzung und Integration
GPT-5 ist in ChatGPT integriert, wo es für alle Nutzer kostenlos ist, mit höheren Nutzungslimits für Plus-Abonnenten und unbegrenztem Zugriff für Pro-Nutzer. Die Einführung von GPT-5 ersetzte den „Advanced Voice Mode" durch „ChatGPT Voice", der natürlichere Gespräche ermöglicht, wobei der Standard-Voice-Mode am 9. September 2025 eingestellt wurde. Am 24. November 2025 wurde eine Einkaufsrecherche-Funktion hinzugefügt, die von einem Mini-Modell unterstützt wird, das auf gpt-5-thinking-mini nachtrainiert wurde.
GPT-5 ist auch in Microsoft Copilot verfügbar, und Microsoft plant, es in eine breite Palette von Produkten zu integrieren. Laut 9to5Mac plant Apple Inc., das Modell in Apple Intelligence in iOS 26, iPadOS 26 und macOS Tahoe zu integrieren. Entwickler können über die OpenAI-API auf GPT-5 zugreifen.
Rezeption und Auswirkungen
Die Veröffentlichung von GPT-5 stieß auf breite Aufmerksamkeit, was sein Potenzial widerspiegelt, die Fähigkeiten von generativer KI voranzutreiben. Seine Leistung bei Benchmarks und seine Integration in große Plattformen wie Azure und Google Cloud (durch Partnerschaften) unterstreichen seinen Einfluss. Die von Neuraltrust und SPLX aufgeworfenen Sicherheitsbedenken verdeutlichen jedoch weiterhin die Herausforderungen bei der Gewährleistung des sicheren Einsatzes leistungsfähiger großer Sprachmodelle.
Zukünftige Richtungen
Stand Ende 2025 iteriert OpenAI weiterhin an GPT-5, mit Plänen für weitere Verbesserungen und eine breitere Integration. Die Architektur und Trainingsmethoden des Modells werden wahrscheinlich zukünftige Entwicklungen in der Neuronale-Netze-Forschung und Deep-Learning-Anwendungen beeinflussen. Das Gleichgewicht zwischen Leistungsfähigkeit und Sicherheit bleibt ein kritischer Fokus für die Branche.