LLM-Benchmark-Momentaufnahme: 30. August 2026
Wöchentliches eingefrorenes Foto von sechs LLM-Bestenlisten: Opus 5 max führt die Text-Arena an, Fable 5 hält LiveBench, gpt-5 bleibt bei Aider-Coding, und die Quellen sind sich weiterhin uneinig.
LLM-Benchmark-Momentaufnahme: 30. August 2026
Jeden Sonntag friert Wikiprompt ein Foto der wichtigsten LLM-Ranglisten ein. Dies ist die Momentaufnahme für die Woche bis zum 30. August 2026 - 14.164 Einträge aus sechs Quellen, vollständig durchsuchbar unter /benchmarks/snapshot/2026-08-30.
Spitzenreiter nach Quelle
Was sich im Vergleich zur letzten Woche geändert hat
Die Text-Arena-Krone wechselte innerhalb derselben Familie den Besitzer: claude-opus-5-high (1504,2 letzte Woche) wurde von claude-opus-5-max (1504,7) knapp überholt. Statistisch gesehen ein Münzwurf, redaktionell gesehen eine Erinnerung, dass Anstrengungs-Einstellungen an der Tabellenspitze inzwischen genauso wichtig sind wie die Modellwahl.
Die Quellen sind sich weiterhin uneinig
Wie jede Woche küren keine zwei Ranglisten dasselbe Modell: LMArenas Community-Elo bevorzugt Opus 5, LiveBenchs kontaminationsfreie akademische Testsets bevorzugen Fable 5, und Aiders realistisches Coding-Geschirr gehört weiterhin gpt-5. Kreuzen Sie die Daten ab, bevor Sie wählen - genau dafür ist die Vergleichsansicht gedacht.
Durchsuchen Sie die vollständige datierte Tabelle unter /benchmarks/snapshot/2026-08-30 oder das gesamte Archiv unter /benchmarks/history.
Related Articles
- GPT-6 Astra et Claude Fable 5.1 : Semaine de lancement de la frontière, en direct
Sep 3, 2026 · 6 min read
- # GPT-6 Astra und Claude Fable 5.1: Frontier-Launch-Woche, auf dem Papier
Sep 3, 2026 · 6 min read
- GPT-6 Astra and Claude Fable 5.1: Frontier Launch Week, on the Record
Sep 3, 2026 · 6 min read
- GPT-6 Astra y Claude Fable 5.1: Semana de Lanzamiento de Frontera, en el Registro
Sep 3, 2026 · 6 min read
- # GPT-6 Astra 与 Claude Fable 5.1:前沿发布周,纪实报道
Sep 3, 2026 · 6 min read