BlogBenchmarks

# GPT-6 Astra und Claude Fable 5.1: Frontier-Launch-Woche, auf dem Papier

Anthropic, Google und OpenAI haben alle innerhalb von 72 Stunden geliefert. Was gestartet wurde, was unsere täglichen Benchmark-Snapshots bereits zeigen, und warum gestaffelter Zugang das neue Grenzmuster ist.

# GPT-6 Astra und Claude Fable 5.1: Frontier-Launch-Woche, auf dem Papier

In den ersten drei Tagen des Septembers 2026 haben die drei größten KI-Labore alle ausgeliefert: Anthropic veröffentlichte Claude Fable 5.1 und Mythos 5.1 am Montag, Google brachte Gemini 3.8 Flash am Dienstag heraus, und OpenAI kündigte GPT-6 Astra am Mittwoch an. Hier ist, was tatsächlich gestartet ist, was unsere täglichen Benchmark-Schnappschüsse bereits zeigen, und worauf man als Nächstes auf den Leaderboards achten sollte.

Was gestartet ist

Claude Fable 5.1 und Mythos 5.1 (1. September). Anthropic nennt sie seine fortschrittlichsten Modelle für Programmierung und Wissensarbeit, mit stärkeren Ergebnissen als Fable 5 bei geringeren Kosten für viele Arbeitslasten. Die zwei Namen sind ein zugrunde liegendes Modell auf zwei Spuren: Fable wird breit ausgeliefert mit zusätzlichen Schutzmaßnahmen für dual-use-Fähigkeiten, während Mythos ohne diese nur an geprüfte Organisationen vergeben wird (derzeit eine Gruppe von US-Cyberverteidigern und Biowissenschaftslaboren). Hintergrund zur Stufe in unserem Wiki: Claude Fable 5 und Mythos 5.

GPT-6 Astra (3. September). Das neue Flaggschiff von OpenAI, beschrieben als das Produkt von "jahrelanger Forschung und großen Wetten", wird in Phasen an ChatGPT-Zahlungspläne, die API und AWS ausgerollt. Die Schlagzeile ist nicht nur die Fähigkeit: Astra ist das erste OpenAI-Modell, das die interne "Critical"-Cybersicherheitsschwelle des Unternehmens erreicht, und OpenAI begrenzt diese Fähigkeiten zunächst auf Unternehmen in seinem Daybreak-Sicherheitsprogramm. Das spiegelt die Fable/Mythos-Trennung von Anthropic wider und macht gestuften Zugang zum De-facto-Muster für Frontier-Starts. Wiki-Seite: GPT-6 Astra.

Was unsere Schnappschüsse bereits zeigen

Wikiprompt nimmt täglich einen Schnappschuss der wichtigsten Leaderboards, sodass Startwochen eine Papierspur hinterlassen:

  • Fable 5.1 ist bereits auf OpenRouter gelistet in unserem Schnappschuss vom 3. September, zwei Tage nach dem Start, einschließlich einer Batch-Preisstufe.
  • Claude Fable 5 führt die Web-Entwicklungs-Arena auf LMArena im heutigen Schnappschuss mit einem Elo von 1628 insgesamt (1663 bei HTML-Aufgaben), vor allen anderen Modellen, die wir dort verfolgen.
  • In der allgemeinen Text-Arena ist die heutige Spitze ein enges Anthropic-Cluster: Opus 5 Max (1505), Opus 5 High (1504) und Opus 4.6 High (1503), mit Fable 5 bei 1494 neben Gemini 3.7 Flash High (1491).
  • GPT-6 Astra ist noch nicht in den Community-Arenas. Gestaffelte Ausrollungen erscheinen typischerweise innerhalb von Tagen; wenn es ankommt, wird der tägliche Schnappschuss es erfassen, und die Änderung wird sichtbar sein unter Benchmark-Verlauf.
  • Warum die Zugriffsstufen wichtig sind

    Die interessante Verschiebung diese Woche ist keine Benchmark-Zahl. Beide Labore liefern nun öffentlich ihre stärksten Fähigkeiten hinter einer Prüfung aus: Mythos an genehmigte Organisationen, Astras Cyber-Fähigkeiten an die Daybreak-Kohorte. Für Prompt-Autoren bedeutet dies, dass das Modell, das man kaufen kann, und das Modell, das interne Auswertungen anführt, nicht mehr immer dasselbe Artefakt sind, und Community-Leaderboards (die die öffentlichen Varianten testen) sind das ehrliche Maß für das, was man tatsächlich nutzen kann.

    Beobachten Sie, wie es sich bewegt

  • Heutiges eingefrorenes Foto: Benchmark-Schnappschuss für den 3. September 2026
  • Die Text-Arena, täglich aktualisiert: Text-Leaderboard
  • Wo Fable 5 derzeit führt: Web-Entwicklungs-Leaderboard
  • Jede Ranking-Änderung auf dem Rekord: Benchmark-Verlauf
  • Wir werden weiterhin täglich Schnappschüsse machen; wenn Astra und Fable 5.1 die Arenas erreichen, werden die Deltas genau dort sein.

    Tags
    gpt-6-astra·claude-fable-5-1·openai·anthropic·benchmarks·model-launches