Tous les benchmarks

Arene developpement web

De Wikiprompt, l’encyclopedie libre des prompts

Classement Elo communautaire, agrege chaque jour depuis les duels LMArena. L’arene generale d’abord, puis le detail par categorie.

Derniere mise a jour: 2026-08-24 · 117 modeles

RangModeleOrganisationScore Elo
1claude-opus-5-maxanthropic1,691
2kimi-k3-maxmoonshot1,674
3qwen3.8-maxalibaba1,669
4claude-opus-5-highanthropic1,663
5grok-4.6-highxai1,629
6claude-fable-5anthropic1,626
7gpt-5.6-sol-xhigh (codex-harness)openai1,619
8glm-5.3-maxzai1,599
9qwen3.8-27balibaba1,595
10gemini-3.7-flash-highgoogle1,587
11glm-5.2-maxzai1,582
12deepseek-v4-pro-high-20260813deepseek1,582
13deepseek-v4-flash-highdeepseek1,579
14claude-opus-4-8-highanthropic1,563
15claude-opus-4-7anthropic1,558
16claude-opus-4-7-highanthropic1,557
17grok-4.5xai1,556
18claude-opus-4-6-highanthropic1,546
19claude-opus-4-8anthropic1,539
20muse-spark-1.1meta1,539
21gemini-3.6-flash-highgoogle1,539
22claude-sonnet-5-highanthropic1,539
23claude-opus-4-6anthropic1,536
24muse-spark-1.2 (xHigh)meta1,534
25claude-sonnet-4-6anthropic1,522
26seed-2.1-pro-previewbytedance1,521
27gpt-5.6-terra-xhigh (codex-harness)openai1,520
28hy3tencent1,518
29gpt-5.6-luna-xhigh (codex-harness)openai1,518
30qwen3.7-max-20260517alibaba1,517
31glm-5.1zai1,509
32kimi-k2.6moonshot1,509
33gpt-5.5-xhigh (codex-harness)openai1,508
34gemini-3.5-flash-highgoogle1,499
35claude-opus-4-5-20251101-high-32kanthropic1,494
36gemini-3.5-flash-mediumgoogle1,490
37minimax-m3minimax1,488
38gpt-5.5-high (codex-harness)openai1,486
39qwen3.6-max-previewalibaba1,479
40mimo-v2.5-proxiaomi1,476
41kimi-k2.7-codemoonshot1,473
42claude-opus-4-5-20251101anthropic1,468
43deepseek-v4-pro-high-previewdeepseek1,464
44gpt-5.4-high (codex-harness)openai1,463
45qwen3.6-plusalibaba1,460
46gpt-5.5 (codex-harness)openai1,458
47gemini-3.5-flash-litegoogle1,449
48gemini-3.1-pro-previewgoogle1,446
49deepseek-v4-prodeepseek1,445
50gpt-5.4-medium (codex-harness)openai1,442
51gemini-3-flashgoogle1,438
52gemini-3-progoogle1,438
53mimo-v2.5xiaomi1,438
54kimi-k2.5-thinkingmoonshot1,436
55glm-5zai1,435
56glm-4.7zai1,434
57mimo-v2-proxiaomi1,434
58deepseek-v4-flash-high-previewdeepseek1,431
59gpt-5-mediumopenai1,419
60gpt-5.2openai1,418
62inklingthinky1,408
63kimi-k2.5-instantmoonshot1,405
64Inkling Smallthinky1,402
65glm-5v-turbozai1,400
66qwen3.5-397b-a17balibaba1,399
67minimax-m2.7minimax1,398
68gpt-5.4-mini-highopenai1,397
69claude-sonnet-4-5-20250929-high-32kanthropic1,392
70gpt-5.1-mediumopenai1,391
71gpt-5.4openai1,391
72claude-opus-4-1-20250805anthropic1,389
73minimax-m2.1-previewminimax1,387
74claude-sonnet-4-5-20250929anthropic1,386
75minimax-m2.5minimax1,384
76gemini-3-flash (thinking-minimal)google1,383
77grok-4.20-beta-0309-reasoningxai1,374
78solar-pro4upstage1,371
79gpt-5.3-codex (codex-harness)openai1,369
80gemma-4-31bgoogle1,364
81gemma-4-26b-a4bgoogle1,362
82deepseek-v3.2-thinkingdeepseek1,360
83muse-glimmermeta1,359
84qwen3.5-122b-a10balibaba1,358
85qwen3.5-27balibaba1,357
86grok-4.3xai1,357
87hunyuan-hy3-previewtencent1,356
88laguna-m.1poolside1,347
89gpt-5.1openai1,341
90glm-4.6zai1,340
91gpt-5.2-codexopenai1,338
92gpt-5.1-codexopenai1,336
93mimo-v2-flash (non-thinking)xiaomi1,330
94claude-haiku-4-5-20251001anthropic1,327
95deepseek-v3.2deepseek1,325
96kimi-k2-thinking-turbomoonshot1,323
97laguna-xs.2poolside1,302
98minimax-m2minimax1,297
99mimo-v2-flash (thinking)xiaomi1,292
100qwen3-coder-480b-a35b-instructalibaba1,273
101deepseek-v3.2-expdeepseek1,272

Par categorie

Webdev

RangModeleOrganisationScore Elo
1claude-opus-5-maxanthropic1,691
2kimi-k3-maxmoonshot1,674
3qwen3.8-maxalibaba1,669
4claude-opus-5-highanthropic1,663
5grok-4.6-highxai1,629
6claude-fable-5anthropic1,626
7gpt-5.6-sol-xhigh (codex-harness)openai1,619
8glm-5.3-maxzai1,599
9qwen3.8-27balibaba1,595
10gemini-3.7-flash-highgoogle1,587
11glm-5.2-maxzai1,582
12deepseek-v4-pro-high-20260813deepseek1,582
13deepseek-v4-flash-highdeepseek1,579
14claude-opus-4-8-highanthropic1,563
15claude-opus-4-7anthropic1,558

Webdev react

RangModeleOrganisationScore Elo
1claude-opus-5-maxanthropic1,709
2kimi-k3-maxmoonshot1,692
3claude-opus-5-highanthropic1,681
4qwen3.8-maxalibaba1,678
5grok-4.6-highxai1,638
6claude-fable-5anthropic1,630
7gpt-5.6-sol-xhigh (codex-harness)openai1,625
8glm-5.3-maxzai1,609
9qwen3.8-27balibaba1,604
10glm-5.2-maxzai1,594
11deepseek-v4-pro-high-20260813deepseek1,589
12deepseek-v4-flash-highdeepseek1,584
13gemini-3.7-flash-highgoogle1,581
14claude-opus-4-8-highanthropic1,563
15grok-4.5xai1,559

Webdev html

RangModeleOrganisationScore Elo
1claude-opus-5-maxanthropic1,685
2claude-fable-5anthropic1,666
3kimi-k3-maxmoonshot1,650
4claude-opus-5-highanthropic1,648
5grok-4.6-highxai1,631
6qwen3.8-maxalibaba1,628
7gemini-3.7-flash-highgoogle1,622
8gpt-5.6-sol-xhigh (codex-harness)openai1,618
9qwen3.8-27balibaba1,579
10glm-5.3-maxzai1,577
11grok-4.5xai1,577
12deepseek-v4-pro-high-20260813deepseek1,563
13claude-opus-4-7anthropic1,559
14claude-opus-4-6-highanthropic1,559
15claude-opus-4-7-highanthropic1,555

Image to webdev

RangModeleOrganisationScore Elo
1claude-opus-5-maxanthropic1,670
2qwen3.8-maxalibaba1,631
3claude-fable-5anthropic1,626
4gpt-5.6-sol-xhigh (codex-harness)openai1,581
5grok-4.5xai1,580
6claude-opus-4-7-thinkinganthropic1,579
7kimi-k3-maxmoonshot1,570
8claude-opus-4-7anthropic1,565
9muse-spark-1.1meta1,544
10claude-opus-4-6-thinkinganthropic1,540
11claude-sonnet-5-highanthropic1,540
12claude-opus-4-6anthropic1,538
13claude-sonnet-4-6anthropic1,530
14gemini-3.6-flashgoogle1,529
15gpt-5.5-xhigh (codex-harness)openai1,526

Voir aussi

Sources et methodologie

Les classements sont agreges depuis des evaluations communautaires ouvertes. Les scores Elo, intervalles de confiance et votes proviennent de LMArena (duels de modeles votes par la communaute, publies en dataset ouvert). Les prix et metadonnees de contexte proviennent de l’API publique OpenRouter. Wikiprompt prend un instantane quotidien et preserve l’historique ; nous ne menons aucune evaluation proprietaire.

  1. LMArena leaderboard dataset (Hugging Face)
  2. LMArena leaderboard