GPT-5 und GPT-6 Astra sind aufeinanderfolgende Veröffentlichungen von OpenAI und markieren bedeutende Fortschritte in der Large-Language-Model-Technologie und der multimodalen Interaktion. GPT-5, gestartet am 7. August 2025, ist die fünfte Generation der generativen vortrainierten Transformer-Serie und folgt auf GPT-4. GPT-6 Astra, das darauf folgte, baut auf dieser Grundlage auf und konzentriert sich auf Echtzeit-, agentische und multimodale Erfahrungen, die darauf abzielen, tiefer in alltägliche Arbeitsabläufe und Geräte integriert zu werden.
Diese Veröffentlichungen sind Teil der breiteren Entwicklung von OpenAI hin zur künstlichen allgemeinen Intelligenz, wie von CEO Sam Altman bei der Enthüllung von GPT-5 beschrieben. Die Modelle sind öffentlich über ChatGPT und Microsoft Copilot sowie über die OpenAI-API für Entwickler zugänglich. Dieser Artikel beschreibt den Hintergrund, die Fähigkeiten, die Architektur, das Training, die Nutzung und die Einschränkungen dieser Systeme, basierend auf öffentlichen Berichten und technischen Dokumentationen, die zum Zeitpunkt ihrer Veröffentlichungsdaten verfügbar waren.
Hintergrund
Am 14. April 2023 sprach Sam Altman am Massachusetts Institute of Technology und erklärte, dass OpenAI zu diesem Zeitpunkt GPT-5 nicht trainierte, wobei der Fokus auf der GPT-4-Entwicklung lag. Am 18. Juli desselben Jahres reichte OpenAI jedoch eine Markenanmeldung für „GPT-5“ in den Vereinigten Staaten ein, und bis zum 13. November bestätigte Altman gegenüber der Financial Times, dass die Arbeit an GPT-5 im Gange sei.
Laut The Information umfasste ein Großteil der zweiten Hälfte des Jahres 2024 ein internes Modell namens Orion, das zu GPT-5 werden sollte. Dieser Versuch scheiterte Berichten zufolge daran, ein besseres Modell zu erzeugen, was zu seiner Veröffentlichung als GPT-4.5 im Februar 2025 führte. Bis Ende Juli 2025 wuchsen die Erwartungen an eine GPT-5-Veröffentlichung Anfang August, wobei The Verge am 30. Juli berichtete, dass Microsoft seinen Copilot-Chatbot für das neue Modell vorbereitete.
Am 5. August 2025 veröffentlichte OpenAI GPT-OSS, eine Reihe von zwei Open-Weight-Modellen mit Denkfähigkeiten, als Vorläufer. GPT-5 wurde während eines Livestream-Events am 7. August enthüllt. Das anschließende GPT-6 Astra wurde später im Jahr 2025 eingeführt, mit weniger öffentlicher Vorlaufzeit, aber einem stärkeren Schwerpunkt auf multimodaler und agentischer Interaktion, basierend auf Lehren aus früheren Bereitstellungen.
Fähigkeiten
Bei seiner Veröffentlichung erreichte GPT-5 den neuesten Stand der Technik bei Benchmarks, die Mathematik, Programmierung, Finanzen und multimodales Verständnis testen. OpenAI berichtete über Verbesserungen gegenüber Vorgängern, darunter schnellere Antwortzeiten, bessere Programmier- und Schreibfähigkeiten, genauere gesundheitsbezogene Antworten und reduzierte Halluzinationsraten. Das Modell führte auch einen Ansatz für „sichere Vervollständigungen“ ein, der darauf abzielt, auf potenziell schädliche Anfragen sichere, hochrangige Antworten zu geben, anstatt sie rundweg abzulehnen, was die Ablehnungen für harmlose Informationen reduzierte.
GPT-5 wurde darauf trainiert, kritischer und weniger überschwänglich zustimmend zu sein als frühere Modelle. Frühe Tester, Tage vor dem Start, waren von seinen Programmier- und mathematischen Problemlösungsfähigkeiten beeindruckt und stellten eine deutliche Verbesserung gegenüber GPT-4 fest, jedoch keinen so großen Sprung wie von GPT-3 zu GPT-4. Altman nannte GPT-5 „einen bedeutenden Schritt auf dem Weg zur AGI“ und bot „Promotionsniveau“-Fähigkeiten über eine breite Palette von Aufgaben hinweg.
GPT-6 Astra erweiterte diese Fähigkeiten um verbesserte Echtzeit-multimodale Verarbeitung, die eine natürlichere Integration von Sprache, Vision und Text ermöglicht. Es unterstützt agentische Funktionen wie autonomes Surfen im Web und Desktop-Verwaltung, basierend auf der in GPT-5 eingeführten Architektur. Der Energieverbrauch für GPT-5 wurde nicht offengelegt, aber Forscher an der University of Rhode Island schätzten, dass eine mittellange Antwort etwas über 18 Wattstunden verbraucht, vergleichbar mit einer Glühbirne, die 18 Minuten läuft.
Architektur
GPT-5 ist ein System, das ein schnelles, hochdurchsatzfähiges Modell, ein tieferes Denkmodell und einen Echtzeit-Router umfasst, der das geeignete Modell basierend auf Gesprächstyp, Komplexität, Werkzeuganforderungen und expliziter Benutzerabsicht auswählt. Dieses einheitliche Design adressiert Altmans frühere Kritik an manuellen Modellauswahlen. Die Systemkarte definiert zwei schnelle Modelle (gpt-5-main und gpt-5-main-mini) und zwei Denkmodelle (gpt-5-thinking und gpt-5-thinking-mini).
Entwickler, die auf die OpenAI-API zugreifen, können das Denkmodell, seine Mini-Version und gpt-5-thinking-nano, eine kleinere und schnellere Variante, verwenden. Einstellbare Denkanstrengung (niedrig, mittel, hoch oder minimal) und Ausführlichkeitseinstellungen (niedrig, mittel oder hoch) sind verfügbar. ChatGPT-Benutzer erhalten Zugriff auf gpt-5-thinking mit paralleler Testzeitberechnung, genannt gpt-5-thinking-pro.
GPT-6 Astra übernimmt eine ähnliche Routing-Architektur, betont jedoch eine engere Kopplung zwischen Wahrnehmung und Denken, wobei Cross-Attention-Mechanismen verwendet werden, um Audio-, visuelle und textuelle Eingaben in Echtzeit zu fusionieren. Sein Design unterstützt kontinuierliches Lernen aus Benutzerinteraktionen, obwohl Details zu seinen internen Modellvarianten zum Zeitpunkt dieses Schreibens spärlich bleiben.
Training
GPT-5 ist nativ multimodal und wird von Grund auf gleichzeitig mit Text und Bildern trainiert, im Gegensatz zu GPT-4, das auf separat trainierten Komponenten basierte. Sein Training umfasste drei Phasen: unüberwachtes Vortraining, überwachtes Feintuning und Reinforcement Learning aus menschlichem Feedback, unter Verwendung eines groß angelegten mehrsprachigen Datensatzes aus Büchern, Artikeln, Webseiten, akademischen Arbeiten und lizenzierten Quellen.
GPT-6 Astra folgte einem ähnlichen dreistufigen Prozess, erweiterte jedoch das Vortrainingskorpus um vielfältigere Audio- und Videodaten. OpenAI verwendete Reinforcement Learning aus menschlichem Feedback, um Antworten mit der Benutzerabsicht abzustimmen, mit zusätzlichem Feintuning für Sicherheit und reduzierte Halluzinationen. Das Unternehmen verwendete auch Curriculum-Lernen, um die Aufgabenkomplexität während des Trainings schrittweise zu erhöhen und die Generalisierung über Modalitäten hinweg zu verbessern.
Bis Ende 2025 hat OpenAI die genauen Rechenressourcen, die für das Training verwendet wurden, nicht offengelegt, aber Branchenschätzungen deuten auf große Cluster spezialisierter Hardware hin, möglicherweise unter Beteiligung von Kooperationen mit AMD- oder nvidia?-Lieferanten, obwohl keine offizielle Bestätigung existiert.
Nutzung
GPT-5 ist für alle ChatGPT-Benutzer kostenlos, wobei Plus-Abonnenten höhere Nutzungslimits erhalten und Pro-Benutzer unbegrenzten Zugriff, einschließlich begrenztem GPT-5-Pro-Zugriff, erhalten. Mit GPT-5 wurde der „Advanced Voice Mode“ von ChatGPT durch „ChatGPT Voice“ ersetzt, das natürlichere Gespräche ermöglicht. Der Standard-Sprachmodus wurde am 9. September 2025 eingestellt. Am 24. November 2025 wurde die Einkaufsrecherche zu ChatGPT hinzugefügt, die angeblich ein Mini-Modell ist, das auf gpt-5-thinking-mini nachtrainiert wurde.
GPT-5 ist auch in Microsoft Copilot integriert, wobei Microsoft eine breitere Produktintegration plant. Apple Inc. arbeitet Berichten zufolge daran, GPT-5 in Apple Intelligence für iOS 26, iPadOS 26 und macOS Tahoe zu integrieren. GPT-6 Astra ist in ChatGPT und über die API verfügbar, mit einem Fokus auf mobile und eingebettete Anwendungen, und wird voraussichtlich Funktionen in Geräten von Samsung und anderen Partnern unterstützen.
Sicherheit und Einschränkungen
Sicherheitsforschungsunternehmen, darunter Neuraltrust und SPLX, behaupteten, GPT-5 innerhalb seines ersten Testtages kompromittiert zu haben, wodurch es detaillierte Anweisungen zur Herstellung von Sprengstoffen generieren konnte. Diese Bewertungen deuten auf erhebliche Sicherheitslücken hin, die GPT-5 möglicherweise ohne zusätzliche Schutzmaßnahmen für Unternehmensumgebungen unsicher machen. OpenAI hat Einschränkungen anerkannt und arbeitet weiterhin an Sicherheitsmaßnahmen.
GPT-6 Astra steht vor ähnlichen Herausforderungen, wobei frühe Tests verbesserte Ablehnungsraten für schädliche Anfragen, aber gelegentliche Fehler in Randfällen zeigten. Die Modelle weisen auch Verzerrungen auf, die aus den Trainingsdaten übernommen wurden, und OpenAI ermutigt zu fortlaufender externer Prüfung und Red-Teaming.
Rezeption und Auswirkungen
Die Veröffentlichungen haben Debatten über das Tempo der KI-Entwicklung ausgelöst, wobei einige Experten robustere Regulierung fordern. Akademische Gruppen wie Stanford AI Lab und Berkeley AI Research untersuchen die Denkfähigkeiten der Modelle; frühe Ergebnisse deuten auf Fortschritte hin, aber noch nicht auf menschenähnliches Verständnis. Die Veröffentlichungen haben auch den Wettbewerb mit Anthropic und Google DeepMind intensiviert, die ähnliche Systeme entwickeln.
Branchenpartnerschaften erweitern sich; Oracle Cloud und Microsoft Azure bieten Cloud-Infrastruktur für die Bereitstellung, während ARM und Qualcomm als potenzielle Partner für On-Device-Inferenz angesehen werden. Bis Ende 2025 bleiben GPT-5 und GPT-6 Astra zentral für die Strategie von OpenAI, wobei fortlaufende Updates erwartet werden.