OpenAI o3 Veröffentlichung

Aus dem Englischen übersetzt

OpenAI o3 ist ein generatives, vortrainiertes Transformer-Modell (GPT) für logisches Denken, das am 20. Dezember 2024 als Nachfolger von OpenAI o1 angekündigt wurde. Es ist darauf ausgelegt, zusätzliche Überlegungszeit für schrittweises, logisches Denken aufzuwenden. Zu den Veröffentlichungen gehören o3-mini, o3, o4-mini und o3-pro.

OpenAI o3 ist ein generatives, vortrainiertes Transformer-Modell (GPT), das von OpenAI als Nachfolger von OpenAI o1 für ChatGPT entwickelt wurde. Es ist darauf ausgelegt, bei Fragen, die schrittweises logisches Denken erfordern, zusätzliche Überlegungszeit aufzuwenden. Das Modell wurde am 20. Dezember 2024 angekündigt und anschließend in mehreren Varianten veröffentlicht, darunter o3-mini, o3, o4-mini und o3-pro, mit Fähigkeiten in den Bereichen Programmierung, Mathematik und Naturwissenschaften.

Der Name „o3“ wurde anstelle von „o2“ gewählt, um einen Markenrechtskonflikt mit der Mobilfunkmarke O2 zu vermeiden. OpenAI lud Sicherheits- und Forschungsforscher ein, sich bis zum 10. Januar 2025 für einen frühen Zugang zu den Modellen zu bewerben. Ähnlich wie beim Vorgänger o1 umfasste die erste Ankündigung zwei Modelle: o3 und o3-mini.

Geschichte

Das OpenAI-o3-Modell wurde am 20. Dezember 2024 angekündigt. Am 31. Januar 2025 veröffentlichte OpenAI o3-mini für alle ChatGPT-Nutzer, einschließlich Nutzer der kostenlosen Stufe, sowie für einige API-Nutzer. OpenAI beschrieb o3-mini als „spezialisierte Alternative“ zu o1 für „technische Bereiche, die Präzision und Geschwindigkeit erfordern“. o3-mini bietet drei Stufen des Denkaufwands: niedrig, mittel und hoch. Die kostenlose Version verwendet die mittlere Stufe, während eine Variante, die mehr Rechenleistung nutzt und als o3-mini-high bezeichnet wird, für zahlende Abonnenten verfügbar ist. Abonnenten der Pro-Stufe von ChatGPT haben unbegrenzten Zugriff auf sowohl o3-mini als auch o3-mini-high.

Am 2. Februar 2025 startete OpenAI OpenAI Deep Research, einen ChatGPT-Dienst, der eine Version von o3 verwendet, die innerhalb von 5 bis 30 Minuten umfassende Berichte auf Grundlage von Websuchen erstellt. Am 6. Februar, als Reaktion auf den Druck von Konkurrenten wie DeepSeek R1, kündigte OpenAI ein Update an, das darauf abzielt, die Transparenz des Denkprozesses in seinem o3-mini-Modell zu verbessern. Am 12. Februar erhöhte OpenAI die Ratenlimits für o3-mini-high weiter auf 50 Anfragen pro Tag (zuvor 50 Anfragen pro Woche) für ChatGPT-Plus-Abonnenten und implementierte Unterstützung für Datei- und Bild-Uploads.

Am 16. April 2025 veröffentlichte OpenAI o3 und o4-mini, einen Nachfolger von o3-mini. Am 10. Juni 2025 veröffentlichte OpenAI o3-pro, von dem das Unternehmen behauptet, es sei sein bisher leistungsfähigstes Modell. OpenAI erklärte: „Wir empfehlen, es für anspruchsvolle Fragen zu verwenden, bei denen Zuverlässigkeit wichtiger ist als Geschwindigkeit, und ein paar Minuten Wartezeit den Kompromiss wert sind“. Am 28. Mai 2026 kündigte OpenAI an, dass o3 am 26. August 2026 aus ChatGPT entfernt wird, nach einer 90-tägigen Auslaufphase. Das Unternehmen erklärte, dass die Änderung nur ChatGPT betreffe und die API nicht beeinflusse.

Fähigkeiten

Verstärkendes Lernen wurde verwendet, um o3 beizubringen, vor der Generierung von Antworten zu „denken“, unter Verwendung dessen, was OpenAI als „private Gedankenkette“ bezeichnet. Dieser Ansatz ermöglicht es dem Modell, vorauszuplanen und Aufgaben zu durchdenken, indem es eine Reihe von Zwischen-Denkschritten ausführt, um bei der Lösung des Problems zu helfen, auf Kosten zusätzlicher Rechenleistung und erhöhter Antwortlatenz.

o3 zeigt eine deutlich bessere Leistung als o1 bei komplexen Aufgaben, einschließlich Programmierung, Mathematik und Naturwissenschaften. OpenAI berichtete, dass o3 eine Punktzahl von 87,7 % beim GPQA-Diamond-Benchmark erreichte, der Expertenfragen aus den Naturwissenschaften enthält, die online nicht öffentlich verfügbar sind. Beim SWE-bench Verified, einem Software-Engineering-Benchmark, der die Fähigkeit bewertet, echte GitHub-Probleme zu lösen, erzielte o3 71,7 %, verglichen mit 48,9 % für o1. Auf Codeforces erreichte o3 einen Elo-Wert von 2727, während o1 1891 erzielte. Beim Abstraction and Reasoning Corpus for Artificial General Intelligence (ARC-AGI)-Benchmark, der die Fähigkeit einer KI bewertet, mit neuen logischen und Fähigkeitserwerbsproblemen umzugehen, erreichte o3 die dreifache Genauigkeit von o1.

Modellvarianten

Die o3-Familie umfasst mehrere Varianten, die auf verschiedene Anwendungsfälle zugeschnitten sind. o3-mini ist ein kleineres, schnelleres Modell, das für technische Bereiche entwickelt wurde, die Präzision und Geschwindigkeit erfordern, mit einstellbaren Stufen des Denkaufwands. o3 ist das vollwertige Modell mit höherer Leistung bei komplexen Benchmarks. o4-mini, das am 16. April 2025 zusammen mit o3 veröffentlicht wurde, dient als Nachfolger von o3-mini. o3-pro, veröffentlicht am 10. Juni 2025, ist als das leistungsfähigste Modell positioniert und priorisiert Zuverlässigkeit gegenüber Geschwindigkeit.

Jede Variante nutzt dieselbe zugrunde liegende Architektur eines Large Language Model basierend auf der Transformer-Architektur, mit Deep-Learning-Techniken und neuralen Netzen für das Denken. Die Modelle werden mithilfe von verstärkendem Lernen trainiert und integrieren eine private Gedankenkette, eine Form des Chain-of-Thought-Denkens, die für Benutzer nicht vollständig transparent ist.

Leistung und Benchmarks

Leistungskennzahlen für o3 heben seine Fortschritte gegenüber früheren Modellen hervor. Beim GPQA Diamond erzielte o3 87,7 %, was eine starke Leistung bei Expertenfragen aus den Naturwissenschaften anzeigt. Beim SWE-bench Verified erreichte o3 71,7 %, eine deutliche Verbesserung gegenüber den 48,9 % von o1, was seine Fähigkeit demonstriert, reale Software-Engineering-Probleme zu lösen. Auf Codeforces übertraf o3 mit einem Elo-Wert von 2727 den Wert von o1 (1891) bei weitem, was überlegene Fähigkeiten im Wettbewerbsprogrammieren widerspiegelt. Beim ARC-AGI verdreifachte o3 die Genauigkeit von o1, was auf eine verbesserte Fähigkeit im Umgang mit neuartigen logischen und Fähigkeitserwerbsaufgaben hindeutet.

Diese Ergebnisse positionieren o3 als führendes Denkmodell im Bereich der künstlichen Intelligenz, mit Anwendungen in Bereichen wie maschinellem Lernen und generativer KI. Die Fähigkeit des Modells, schrittweise zu denken, macht es für Aufgaben geeignet, die sorgfältige Überlegung erfordern, allerdings mit erhöhten Rechenkosten und Latenz.

Vergleich mit anderen Modellen

In der wettbewerbsintensiven Landschaft der KI-Modelle wird o3 oft mit Angeboten anderer Organisationen verglichen. Anthropic und Google DeepMind haben ihre eigenen Denkmodelle entwickelt, und die Leistung von o3 bei Benchmarks wie SWE-bench Verified und Codeforces wurde verwendet, um seine Position zu bewerten. Die Veröffentlichung von o3-mini im Januar 2025 war teilweise eine Reaktion auf den Wettbewerbsdruck, einschließlich von Modellen wie DeepSeek R1, was zu Updates führte, die die Transparenz des Denkprozesses verbesserten.

Der Ansatz von OpenAI mit o3 betont bewusstes Denken, im Gegensatz zu Modellen, die Geschwindigkeit priorisieren. Dieser Kompromiss spiegelt sich in den verschiedenen Stufen des Denkaufwands wider, die in o3-mini verfügbar sind, und ermöglicht es Benutzern, Genauigkeit und Antwortzeit auszubalancieren. Die Integration des Modells in ChatGPT und API-Dienste hat es einer breiten Palette von Benutzern zugänglich gemacht, von der kostenlosen Stufe bis zu Pro-Abonnenten.

Bereitstellung und Zugriff

Die Bereitstellung der o3-Varianten erfolgte schrittweise. o3-mini war das erste Modell, das breit veröffentlicht wurde, gefolgt von o3 und o4-mini und später o3-pro. Der Zugriff erfolgt über ChatGPT, wobei verschiedene Stufen unterschiedliche Nutzungsgrade bieten. Benutzer der kostenlosen Stufe erhalten o3-mini mit mittlerem Denkaufwand, während zahlende Abonnenten auf höhere Aufwandsstufen und häufigere Nutzung zugreifen können. Pro-Abonnenten haben unbegrenzten Zugriff auf o3-mini und o3-mini-high.

Der API-Zugriff für o3-Modelle wurde im Laufe der Zeit erweitert, wobei die Ratenlimits an die Nachfrage angepasst wurden. Die Entfernung von o3 aus ChatGPT im August 2026, wie im Mai 2026 angekündigt, deutet auf einen geplanten Lebenszyklus für das Modell hin, obwohl der API-Zugriff unberührt bleibt. Diese Bereitstellungsstrategie spiegelt den Ansatz von OpenAI wider, seine Modellangebote iterativ zu verbessern und zu aktualisieren.

Siehe auch

Referenzen

  • OpenAI-Ankündigungen und Dokumentation (2024-2026)
  • Von OpenAI berichtete Benchmark-Ergebnisse
  • Einführung von OpenAI o3 und o4-mini
  • O3 ist 80 % günstiger und Einführung von o3-pro
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:openai·large-language-models·artificial-intelligence·reasoning-models
Diese Seite wurde zuletzt bearbeitet am 12. Sept. 2026 von AI Wiki Bot · Versionsgeschichte