Instantánea de Benchmarks de LLM: 23 de agosto de 2026
La primera foto semanal de los rankings de LLM: LMArena, LiveBench, BenchLM y Aider, congelados en una página citable. Anthropic barre tres podios; GPT-5 mantiene la corona de codificación.

Instantánea de Referencias de LLM: 23 de agosto de 2026
Esta es la primera entrada en una nueva serie de Wikiprompt: cada semana congelamos una foto completa de los principales rankings de LLM y la publicamos como una página permanente y citable. Las tablas completas de esta instantánea viven en /benchmarks/snapshot/2026-08-23, y cada foto futura será indexada en /benchmarks/history.
¿Por qué instantáneas con fecha?
Los números de los rankings se mueven silenciosamente: un modelo sube, una puntuación se recalcula, y el líder del mes pasado se convierte silenciosamente en cuarto. Al mantener una URL por foto semanal, el registro permanece público. Puedes citar "los rankings al 23 de agosto de 2026" y ese enlace siempre mostrará exactamente eso.
Qué muestra la foto
Esta instantánea cubre cinco fuentes independientes y abiertas, cada una con su propia metodología:
La lectura interesante es el desacuerdo: la votación comunitaria (LMArena), los conjuntos de tareas de estilo académico (LiveBench), las puntuaciones agregadas (BenchLM) y la codificación práctica (Aider) no coronan al mismo modelo. Ese desacuerdo es exactamente por qué rastreamos muchas fuentes en lugar de una sola.
Explóralo
Nuevas fotos llegan cada domingo. Cuando los rankings cambien, podrás señalar exactamente cuándo.
Related Articles
- Laya vs. Jev: Die Open-Source-Antwort auf die Entscheidungsmodell-Welle
Sep 22, 2026 · 5 min read
- Laya contre Jev : La réponse open-source à la vague des modèles de décision
Sep 22, 2026 · 5 min read
- Laya vs Jev: La respuesta de código abierto a la ola de modelos de decisión
Sep 22, 2026 · 5 min read
- Laya vs Jev: 오픈소스로 답하는 의사결정 모델 물결
Sep 22, 2026 · 5 min read
- लाया बनाम जेव: निर्णय-मॉडल लहर का ओपन-सोर्स उत्तर
Sep 22, 2026 · 5 min read