GPT-5 ist ein multimodales großes Sprachmodell, das von OpenAI entwickelt wurde und das fünfte in seiner Reihe von generativen vortrainierten Transformer-Modellen (GPT) ist. In der Reihe folgt es auf GPT-4 und wurde am 7. August 2025 veröffentlicht. Es ist öffentlich für Nutzer der Chatbot-Produkte ChatGPT und Microsoft Copilot sowie für Entwickler über die OpenAI-API zugänglich. Der Start markierte einen bedeutenden Schritt in der Entwicklung von generativer KI, mit einem Fokus auf Echtzeit-Multimodalitätsverständnis und agentische Fähigkeiten.
Im selben Jahr startete Google DeepMind Astra, auch bekannt als Gemini Live, einen Echtzeit-Multimodal-KI-Assistenten, der direkt mit GPT-5 auf den Verbraucher- und Unternehmensmärkten konkurriert. Astras Start, der 2025 erfolgte, betonte die nahtlose Interaktion mit visuellen und auditiven Eingaben und positionierte es als wichtigen Rivalen zu OpenAIs Angebot. Dieser Artikel konzentriert sich hauptsächlich auf GPT-5, mit Verweisen auf Astra, wo dies für die breitere Landschaft relevant ist.
Hintergrund
Am 14. April 2023 sprach Sam Altman, der Chief Executive Officer von OpenAI, bei einer Veranstaltung am Massachusetts Institute of Technology und sagte, dass das Unternehmen zu diesem Zeitpunkt kein GPT-5 trainierte. Er erklärte, dass OpenAI „die Entwicklung von GPT-4 priorisiert“ und dass „wir GPT-5 nicht und für einige Zeit nicht veröffentlichen werden“. Am 18. Juli reichte OpenAI eine Markenanmeldung für „GPT-5“ in den Vereinigten Staaten ein. Am 13. November bestätigte Altman gegenüber der Financial Times, dass das Unternehmen daran arbeite, GPT-5 zu entwickeln.
Laut The Information war „OpenAI für einen Großteil der zweiten Hälfte des Jahres 2024 dabei, ein Modell zu entwickeln, das intern als Orion bekannt war und als GPT-5 veröffentlicht werden sollte“, „aber das Orion-Projekt scheiterte daran, ein besseres Modell zu produzieren, und das Unternehmen veröffentlichte es stattdessen im Februar [2025] als GPT-4.5.“ Ende Juli 2025 wurde allgemein erwartet, dass OpenAI plant, GPT-5 Anfang August zu veröffentlichen. Am 30. Juli berichtete The Verge, dass „Microsoft sich auf GPT-5 vorbereitet“, da „Quellen, die mit Microsofts KI-Plänen vertraut sind“, einem Redakteur mitteilten, dass das Unternehmen einen neuen Modus für seinen Copilot-Chatbot testete, der ein Modell anbieten würde, das „je nach Aufgabe tief oder schnell denkt“. Am 5. August, im Vorfeld der Veröffentlichung von GPT-5, veröffentlichte OpenAI GPT-OSS, eine Reihe von zwei Open-Weight-Modellen mit Denkfähigkeiten. GPT-5 wurde dann während einer Live-Stream-Veranstaltung am 7. August enthüllt.
Fähigkeiten
Zum Zeitpunkt seiner Veröffentlichung hatte GPT-5 modernste Leistung bei Benchmarks, die Mathematik, Programmierung, Finanzen und multimodales Verständnis testen. Laut OpenAI umfassen Verbesserungen gegenüber seinen Vorgängermodellen schnellere Antwortzeiten, bessere Programmier- und Schreibfähigkeiten, genauere Antworten auf Gesundheitsfragen und geringere Halluzinationsraten. Darüber hinaus zielt GPT-5 im Vergleich zu früheren Modellen darauf ab, sichere, hochwertige Antworten auf potenziell schädliche Anfragen zu geben, anstatt sie rundweg abzulehnen, ein Ansatz, den OpenAI als „sichere Vervollständigungen“ bezeichnet, mit dem Ziel, „dass GPT-5 in der Lage ist, mehr unsichere Fragen abzulehnen, während es Nutzern, die harmlose Informationen suchen, weniger Ablehnungen bietet.“ Zusätzlich wurde GPT-5 darauf trainiert, kritischere, „weniger überschwänglich zustimmende“ Antworten zu geben als seine Vorgängermodelle.
Tage vor dem Start von GPT-5 erklärten zwei frühe Tester des Modells, dass sie von seiner Fähigkeit beeindruckt waren, Code zu schreiben und mathematische sowie wissenschaftliche Probleme zu lösen. Sie deuteten an, dass das Modell eine große Verbesserung gegenüber GPT-4 zeigt, aber nicht so groß wie der Sprung von GPT-3 zu GPT-4. Einen Tag vor der Veröffentlichung von GPT-5 nannte Sam Altman, der Chief Executive Officer von OpenAI, während einer Pressekonferenz GPT-5 „einen bedeutenden Schritt auf dem Weg zur AGI“, wobei er sich auf künstliche allgemeine Intelligenz bezog, das hypothetische Intelligenzniveau, das OpenAI als die Fähigkeit definiert, jede wirtschaftlich wertvolle Aufgabe auszuführen, die ein Mensch kann. Laut Altman ist GPT-5 „deutlich besser“ als seine Vorgänger und bietet „Promotionsniveau“-Fähigkeiten über eine breite Palette von Aufgaben.
Der genaue Energieverbrauch der Nutzung von GPT-5 wurde von OpenAI nicht offengelegt. Forscher der University of Rhode Island schätzten, dass eine mittellange Antwort etwas über 18 Wattstunden verbraucht, was der Nutzung einer Glühbirne für 18 Minuten entspricht.
Architektur
GPT-5 ist ein System, das ein schnelles, hochdurchsatzfähiges Modell, ein tieferes Denkmodell und einen Echtzeit-Router enthält, der entscheidet, welches Modell basierend auf Gesprächstyp, Komplexität, Tool-Anforderungen und expliziter Nutzerabsicht verwendet wird. Altman hatte zuvor den manuellen Modellauswähler als übermäßig komplex kritisiert und auf die Notwendigkeit einer Vereinheitlichung hingewiesen. GPT-5 umfasst auch agentische Funktionalität, durch die es seinen eigenen Desktop einrichten und seinen Browser nutzen kann, um autonom nach Quellen zu suchen, die mit seiner Aufgabe zusammenhängen. Die GPT-5-Systemkarte definiert zwei schnelle, hochdurchsatzfähige Modelle - gpt-5-main und gpt-5-main-mini - sowie zwei Denkmodelle - gpt-5-thinking und gpt-5-thinking-mini. In der OpenAI-API können Entwickler auf das Denkmodell, seine Mini-Version und gpt-5-thinking-nano, eine noch kleinere und schnellere Nano-Version des Denkmodells, zugreifen. Die Version von GPT-5, die über die API zugänglich ist, hat einstellbaren Denkaufwand (niedrig, mittel, hoch oder minimal) und Ausführlichkeit (niedrig, mittel oder hoch). Darüber hinaus bietet ChatGPT Zugriff auf gpt-5-thinking mit einer Einstellung, die parallele Testzeit-Berechnung nutzt, bezeichnet als gpt-5-thinking-pro.
Sicherheit und Einschränkungen
Neuraltrust, ein Sicherheitsforschungsunternehmen, behauptete, GPT-5 innerhalb seines ersten Testtages erfolgreich kompromittiert zu haben. Laut seinem Bericht ermöglichte es GPT-5, detaillierte Anweisungen zur Herstellung von Sprengstoffen zu generieren. SPLX, ein weiteres Unternehmen, führte ähnliche Tests durch und kam zu ähnlichen Schlussfolgerungen über die Sicherheit von GPT-5. Ihre Bewertungen deuten darauf hin, dass GPT-5 erhebliche Sicherheitslücken aufweist, die es möglicherweise als unsicher für die Verwendung in einer Unternehmensumgebung erscheinen lassen.
Trotz dieser Bedenken hat OpenAI seine Sicherheitsmaßnahmen betont, einschließlich des Ansatzes der „sicheren Vervollständigungen“ und Ausrichtungstechniken wie Verstärkungslernen aus menschlichem Feedback. Die von externen Forschern hervorgehobenen Sicherheitslücken weisen jedoch auf anhaltende Herausforderungen hin, um robuste Sicherheit für fortschrittliche KI-Systeme zu gewährleisten.
Training
Laut AIMultiple ist GPT-5 nativ multimodal, was bedeutet, dass es von Grund auf auf mehreren Modalitäten (wie Text und Bildern) gleichzeitig trainiert wurde, ohne auf bereits trainierte Sprach- oder Bildmodelle zurückzugreifen. Sein Trainingsprozess umfasste drei Phasen: unüberwachtes Vortraining, überwachte Feinabstimmung und Verstärkungslernen aus menschlichem Feedback. Das Vortraining verwendete einen groß angelegten mehrsprachigen Datensatz aus Büchern, Artikeln, Webseiten, akademischen Arbeiten und lizenzierten Quellen. GPT-5s visuelle und textliche Fähigkeiten wurden als während des gesamten Trainings parallel entwickelt beschrieben, anders als bei GPT-4.
Der Trainingsprozess nutzte Fortschritte in Transformer-Architekturen und Großsprachmodell-Techniken, einschließlich Multi-Head-Attention und Positionskodierung. Die Verwendung von Daten-Augmentierung und Modell-Pruning trug ebenfalls zur Effizienz und Leistung des Modells bei.
Nutzung und Integration
GPT-5 wird in ChatGPT verwendet. Obwohl GPT-5 für alle ChatGPT-Nutzer kostenlos ist, erhalten Plus-Nutzer höhere Nutzungslimits, während Pro-Nutzer unbegrenzten Zugriff auf GPT-5 sowie begrenzten Zugriff auf GPT-5 Pro haben. Standardlimits für Antworten pro Stunde für niedrigere Stufen gelten weiterhin. Zusätzlich wurde mit der Einführung von GPT-5 der „Advanced Voice Mode“ von ChatGPT durch „ChatGPT Voice“ ersetzt, das natürlicher klingende Gespräche ermöglichen soll. OpenAI erklärte, dass der „Standard Voice Mode am 9. September 2025 ausläuft und alle Nutzer auf ChatGPT Voice vereinheitlicht“. Am 24. November 2025 wurde die Funktion der Einkaufsrecherche zu ChatGPT hinzugefügt, die als ein Mini-Modell bezeichnet wird, das auf gpt-5-thinking-mini nachtrainiert wurde.
GPT-5 ist auch in Microsoft Copilot verfügbar, und Microsoft erklärte, dass es GPT-5 in eine Vielzahl seiner Produkte integrieren wird. Laut 9to5Mac plant Apple Inc., das Modell in die Apple-Intelligence-Funktion in seinen Betriebssystemen iOS 26, iPadOS 26 und macOS Tahoe zu integrieren. Es ist auch über die OpenAI-API zugänglich, sodass Entwickler Anwendungen auf Basis des Modells erstellen können.
Im Vergleich dazu ist Googles Astra (Gemini Live) in das Google-Ökosystem integriert, einschließlich Android und Google Assistant, und bietet ähnliche Echtzeit-Multimodal-Fähigkeiten. Der Wettbewerb zwischen OpenAI und Google DeepMind hat Innovationen im Bereich beschleunigt, wobei beide Unternehmen die Grenzen dessen erweitern, was KI-Assistenten leisten können.
Auswirkungen und Rezeption
Der Start von GPT-5 hatte erhebliche Auswirkungen auf die KI-Branche. Seine modernste Leistung bei Benchmarks hat neue Standards für Systeme der künstlichen Intelligenz gesetzt. Die Fähigkeit des Modells, komplexe Aufgaben über mehrere Domänen hinweg zu bewältigen, wurde von frühen Testern gelobt, obwohl einige anmerkten, dass die Verbesserung gegenüber GPT-4 nicht so dramatisch ist wie der Sprung von GPT-3 zu GPT-4.
Kritiker haben Bedenken hinsichtlich der Sicherheit von GPT-5 geäußert, insbesondere angesichts der von Neuraltrust und SPLX gemeldeten Schwachstellen. Diese Probleme unterstreichen die Notwendigkeit fortlaufender Forschung zu KI-Sicherheit und -Ausrichtung, einem Feld, das Experten wie Joshua Tenenbaum und Melanie Mitchell umfasst.
Trotz dieser Herausforderungen wird erwartet, dass GPT-5 die weit verbreitete Einführung von KI in verschiedenen Sektoren, einschließlich Bildung, Gesundheitswesen und Softwareentwicklung, vorantreibt. Seine Integration in Produkte wie Microsoft Copilot und Apple Intelligence deutet darauf hin, dass es zu einem allgegenwärtigen Werkzeug für Verbraucher und Unternehmen werden wird.
Fazit
GPT-5 stellt einen wichtigen Meilenstein in der Entwicklung von generativer KI und Großsprachmodellen dar. Sein Start am 7. August 2025, zusammen mit Googles Astra, markiert eine neue Ära von Echtzeit-Multimodal-KI-Assistenten. Während Herausforderungen in Bezug auf Sicherheit und Energieverbrauch bestehen bleiben, zeigen die Fähigkeiten von GPT-5 den schnellen Fortschritt in diesem Bereich. Während sich KI weiterentwickelt, werden Modelle wie GPT-5 wahrscheinlich eine zentrale Rolle bei der Gestaltung der Zukunft von Technologie und Gesellschaft spielen.