# Instantánea de Benchmarks de LLM: 30 de agosto de 2026
Foto semanal congelada de seis tablas de clasificación de LLM: Opus 5 max lidera la arena de texto, Fable 5 mantiene LiveBench, gpt-5 sigue en Aider coding, y las fuentes aún no coinciden.
Instantánea del Benchmark de LLM: 30 de agosto de 2026
Cada domingo, Wikiprompt congela una foto de los principales rankings de LLM. Esta es la instantánea de la semana que termina el 30 de agosto de 2026 - 14,164 entradas de seis fuentes, navegables en su totalidad en /benchmarks/snapshot/2026-08-30.
Líderes por fuente
Qué cambió respecto a la semana pasada
La corona de la arena de texto cambió de manos dentro de la misma familia: claude-opus-5-high (1504.2 la semana pasada) fue superado por claude-opus-5-max (1504.7). Estadísticamente un lanzamiento de moneda, editorialmente un recordatorio de que los ajustes de esfuerzo ahora importan tanto como la elección del modelo en la cima de la tabla.
Las fuentes aún discrepan
Como cada semana, no hay dos rankings que coronen al mismo modelo: el Elo comunitario de LMArena favorece a Opus 5, los conjuntos académicos libres de contaminación de LiveBench favorecen a Fable 5, y el arnés de codificación del mundo real de Aider aún pertenece a gpt-5. Cruza referencias antes de elegir - para eso está la vista de comparación.
Navega por la tabla completa con fecha en /benchmarks/snapshot/2026-08-30, o por todo el archivo en /benchmarks/history.
Related Articles
- GPT-6 Astra et Claude Fable 5.1 : Semaine de lancement de la frontière, en direct
Sep 3, 2026 · 6 min read
- # GPT-6 Astra und Claude Fable 5.1: Frontier-Launch-Woche, auf dem Papier
Sep 3, 2026 · 6 min read
- GPT-6 Astra and Claude Fable 5.1: Frontier Launch Week, on the Record
Sep 3, 2026 · 6 min read
- GPT-6 Astra y Claude Fable 5.1: Semana de Lanzamiento de Frontera, en el Registro
Sep 3, 2026 · 6 min read
- # GPT-6 Astra 与 Claude Fable 5.1:前沿发布周,纪实报道
Sep 3, 2026 · 6 min read