Aperçu des benchmarks LLM : 30 août 2026
Photo hebdomadaire figée de six classements LLM : Opus 5 max domine l’arène textuelle, Fable 5 tient LiveBench, gpt-5 conserve Aider coding, et les sources divergent toujours.
Instantané des benchmarks LLM : 30 août 2026
Chaque dimanche, Wikiprompt fige une photo des principaux classements de LLM. Voici l'instantané pour la semaine se terminant le 30 août 2026 - 14 164 entrées provenant de six sources, consultables en intégralité sur /benchmarks/snapshot/2026-08-30.
Leaders par source
Ce qui a changé par rapport à la semaine dernière
La couronne de l'arène texte a changé de mains au sein de la même famille : claude-opus-5-high (1504,2 la semaine dernière) a été dépassé de justesse par claude-opus-5-max (1504,7). Statistiquement un pile ou face, éditorialement un rappel que les réglages d'effort comptent désormais autant que le choix du modèle en haut du tableau.
Les sources sont toujours en désaccord
Comme chaque semaine, aucun classement ne couronne le même modèle : l'Elo communautaire de LMArena favorise Opus 5, les ensembles académiques sans contamination de LiveBench favorisent Fable 5, et le harnais de codage réel d'Aider appartient toujours à gpt-5. Croisez les références avant de choisir - c'est à cela que sert la vue de comparaison.
Parcourez le tableau complet daté sur /benchmarks/snapshot/2026-08-30, ou l'archive complète sur /benchmarks/history.
Related Articles
- GPT-6 Astra et Claude Fable 5.1 : Semaine de lancement de la frontière, en direct
Sep 3, 2026 · 6 min read
- # GPT-6 Astra und Claude Fable 5.1: Frontier-Launch-Woche, auf dem Papier
Sep 3, 2026 · 6 min read
- GPT-6 Astra and Claude Fable 5.1: Frontier Launch Week, on the Record
Sep 3, 2026 · 6 min read
- GPT-6 Astra y Claude Fable 5.1: Semana de Lanzamiento de Frontera, en el Registro
Sep 3, 2026 · 6 min read
- # GPT-6 Astra 与 Claude Fable 5.1:前沿发布周,纪实报道
Sep 3, 2026 · 6 min read