**Instantâneo do Benchmark de LLM: 23 de agosto de 2026**
A primeira foto semanal dos rankings de LLMs: LMArena, LiveBench, BenchLM e Aider, congelados em uma página citável. A Anthropic varre três pódios; o GPT-5 mantém a coroa de codificação.

Instantâneo de Benchmark de LLM: 23 de agosto de 2026
Esta é a primeira entrada de uma nova série do Wiki: toda semana, congelamos uma foto completa dos principais rankings de LLM e a publicamos como uma página permanente e citável. As tabelas completas deste instantâneo estão em /benchmarks/snapshot/2026-08-23, e todas as fotos futuras serão indexadas em /benchmarks/history.
Por que instantâneos com data?
Os números dos benchmarks mudam silenciosamente: um modelo sobe, uma pontuação é recalculada e o líder do mês passado se torna o quarto colocado. Ao manter um URL único para cada foto semanal, o registro permanece público. Você pode citar "os rankings de 23 de agosto de 2026" e esse link sempre mostrará exatamente isso.
O que a foto mostra
Este instantâneo abrange cinco fontes independentes e abertas, cada uma com sua própria metodologia:
A leitura interessante é o desacordo: votação da comunidade (LMArena), suítes de tarefas acadêmicas (LiveBench), pontuações agregadas (BenchLM) e codificação prática (Aider) não coroam o mesmo modelo. É exatamente por isso que acompanhamos várias fontes em vez de apenas uma.
Explore
Novas fotos chegam todo domingo. Quando os rankings mudarem, você poderá apontar exatamente para o momento da mudança.
Related Articles
- Laya vs. Jev: Die Open-Source-Antwort auf die Entscheidungsmodell-Welle
Sep 22, 2026 · 5 min read
- Laya contre Jev : La réponse open-source à la vague des modèles de décision
Sep 22, 2026 · 5 min read
- Laya vs Jev: La respuesta de código abierto a la ola de modelos de decisión
Sep 22, 2026 · 5 min read
- Laya vs Jev: 오픈소스로 답하는 의사결정 모델 물결
Sep 22, 2026 · 5 min read
- लाया बनाम जेव: निर्णय-मॉडल लहर का ओपन-सोर्स उत्तर
Sep 22, 2026 · 5 min read