Wikiprompt

โ† All benchmarks

Web development arena

From Wikiprompt, the free prompt encyclopedia

Community Elo leaderboard, aggregated daily from LMArena head-to-head battles. Overall arena first, then per-category breakdowns.

Last updated: 2026-08-24 ยท 117 models

RankModelOrganizationElo score
1claude-opus-5-maxanthropic1,691
2kimi-k3-maxmoonshot1,674
3qwen3.8-maxalibaba1,669
4claude-opus-5-highanthropic1,663
5grok-4.6-highxai1,629
6claude-fable-5anthropic1,626
7gpt-5.6-sol-xhigh (codex-harness)openai1,619
8glm-5.3-maxzai1,599
9qwen3.8-27balibaba1,595
10gemini-3.7-flash-highgoogle1,587
11glm-5.2-maxzai1,582
12deepseek-v4-pro-high-20260813deepseek1,582
13deepseek-v4-flash-highdeepseek1,579
14claude-opus-4-8-highanthropic1,563
15claude-opus-4-7anthropic1,558
16claude-opus-4-7-highanthropic1,557
17grok-4.5xai1,556
18claude-opus-4-6-highanthropic1,546
19claude-opus-4-8anthropic1,539
20muse-spark-1.1meta1,539
21gemini-3.6-flash-highgoogle1,539
22claude-sonnet-5-highanthropic1,539
23claude-opus-4-6anthropic1,536
24muse-spark-1.2 (xHigh)meta1,534
25claude-sonnet-4-6anthropic1,522
26seed-2.1-pro-previewbytedance1,521
27gpt-5.6-terra-xhigh (codex-harness)openai1,520
28hy3tencent1,518
29gpt-5.6-luna-xhigh (codex-harness)openai1,518
30qwen3.7-max-20260517alibaba1,517
31glm-5.1zai1,509
32kimi-k2.6moonshot1,509
33gpt-5.5-xhigh (codex-harness)openai1,508
34gemini-3.5-flash-highgoogle1,499
35claude-opus-4-5-20251101-high-32kanthropic1,494
36gemini-3.5-flash-mediumgoogle1,490
37minimax-m3minimax1,488
38gpt-5.5-high (codex-harness)openai1,486
39qwen3.6-max-previewalibaba1,479
40mimo-v2.5-proxiaomi1,476
41kimi-k2.7-codemoonshot1,473
42claude-opus-4-5-20251101anthropic1,468
43deepseek-v4-pro-high-previewdeepseek1,464
44gpt-5.4-high (codex-harness)openai1,463
45qwen3.6-plusalibaba1,460
46gpt-5.5 (codex-harness)openai1,458
47gemini-3.5-flash-litegoogle1,449
48gemini-3.1-pro-previewgoogle1,446
49deepseek-v4-prodeepseek1,445
50gpt-5.4-medium (codex-harness)openai1,442
51gemini-3-flashgoogle1,438
52gemini-3-progoogle1,438
53mimo-v2.5xiaomi1,438
54kimi-k2.5-thinkingmoonshot1,436
55glm-5zai1,435
56glm-4.7zai1,434
57mimo-v2-proxiaomi1,434
58deepseek-v4-flash-high-previewdeepseek1,431
59gpt-5-mediumopenai1,419
60gpt-5.2openai1,418
62inklingthinky1,408
63kimi-k2.5-instantmoonshot1,405
64Inkling Smallthinky1,402
65glm-5v-turbozai1,400
66qwen3.5-397b-a17balibaba1,399
67minimax-m2.7minimax1,398
68gpt-5.4-mini-highopenai1,397
69claude-sonnet-4-5-20250929-high-32kanthropic1,392
70gpt-5.1-mediumopenai1,391
71gpt-5.4openai1,391
72claude-opus-4-1-20250805anthropic1,389
73minimax-m2.1-previewminimax1,387
74claude-sonnet-4-5-20250929anthropic1,386
75minimax-m2.5minimax1,384
76gemini-3-flash (thinking-minimal)google1,383
77grok-4.20-beta-0309-reasoningxai1,374
78solar-pro4upstage1,371
79gpt-5.3-codex (codex-harness)openai1,369
80gemma-4-31bgoogle1,364
81gemma-4-26b-a4bgoogle1,362
82deepseek-v3.2-thinkingdeepseek1,360
83muse-glimmermeta1,359
84qwen3.5-122b-a10balibaba1,358
85qwen3.5-27balibaba1,357
86grok-4.3xai1,357
87hunyuan-hy3-previewtencent1,356
88laguna-m.1poolside1,347
89gpt-5.1openai1,341
90glm-4.6zai1,340
91gpt-5.2-codexopenai1,338
92gpt-5.1-codexopenai1,336
93mimo-v2-flash (non-thinking)xiaomi1,330
94claude-haiku-4-5-20251001anthropic1,327
95deepseek-v3.2deepseek1,325
96kimi-k2-thinking-turbomoonshot1,323
97laguna-xs.2poolside1,302
98minimax-m2minimax1,297
99mimo-v2-flash (thinking)xiaomi1,292
100qwen3-coder-480b-a35b-instructalibaba1,273
101deepseek-v3.2-expdeepseek1,272

By category

Webdev

RankModelOrganizationElo score
1claude-opus-5-maxanthropic1,691
2kimi-k3-maxmoonshot1,674
3qwen3.8-maxalibaba1,669
4claude-opus-5-highanthropic1,663
5grok-4.6-highxai1,629
6claude-fable-5anthropic1,626
7gpt-5.6-sol-xhigh (codex-harness)openai1,619
8glm-5.3-maxzai1,599
9qwen3.8-27balibaba1,595
10gemini-3.7-flash-highgoogle1,587
11glm-5.2-maxzai1,582
12deepseek-v4-pro-high-20260813deepseek1,582
13deepseek-v4-flash-highdeepseek1,579
14claude-opus-4-8-highanthropic1,563
15claude-opus-4-7anthropic1,558

Webdev react

RankModelOrganizationElo score
1claude-opus-5-maxanthropic1,709
2kimi-k3-maxmoonshot1,692
3claude-opus-5-highanthropic1,681
4qwen3.8-maxalibaba1,678
5grok-4.6-highxai1,638
6claude-fable-5anthropic1,630
7gpt-5.6-sol-xhigh (codex-harness)openai1,625
8glm-5.3-maxzai1,609
9qwen3.8-27balibaba1,604
10glm-5.2-maxzai1,594
11deepseek-v4-pro-high-20260813deepseek1,589
12deepseek-v4-flash-highdeepseek1,584
13gemini-3.7-flash-highgoogle1,581
14claude-opus-4-8-highanthropic1,563
15grok-4.5xai1,559

Webdev html

RankModelOrganizationElo score
1claude-opus-5-maxanthropic1,685
2claude-fable-5anthropic1,666
3kimi-k3-maxmoonshot1,650
4claude-opus-5-highanthropic1,648
5grok-4.6-highxai1,631
6qwen3.8-maxalibaba1,628
7gemini-3.7-flash-highgoogle1,622
8gpt-5.6-sol-xhigh (codex-harness)openai1,618
9qwen3.8-27balibaba1,579
10glm-5.3-maxzai1,577
11grok-4.5xai1,577
12deepseek-v4-pro-high-20260813deepseek1,563
13claude-opus-4-7anthropic1,559
14claude-opus-4-6-highanthropic1,559
15claude-opus-4-7-highanthropic1,555

Image to webdev

RankModelOrganizationElo score
1claude-opus-5-maxanthropic1,670
2qwen3.8-maxalibaba1,631
3claude-fable-5anthropic1,626
4gpt-5.6-sol-xhigh (codex-harness)openai1,581
5grok-4.5xai1,580
6claude-opus-4-7-thinkinganthropic1,579
7kimi-k3-maxmoonshot1,570
8claude-opus-4-7anthropic1,565
9muse-spark-1.1meta1,544
10claude-opus-4-6-thinkinganthropic1,540
11claude-sonnet-5-highanthropic1,540
12claude-opus-4-6anthropic1,538
13claude-sonnet-4-6anthropic1,530
14gemini-3.6-flashgoogle1,529
15gpt-5.5-xhigh (codex-harness)openai1,526

See also

Sources and methodology

Rankings above are aggregated from open community evaluations. Elo ratings, confidence intervals and vote counts come from LMArena (crowdsourced head-to-head model battles, published as an open dataset). Model pricing and context metadata come from the public OpenRouter API. Wikiprompt snapshots these sources daily and preserves the history; we run no proprietary evaluations of our own.

  1. LMArena leaderboard dataset (Hugging Face)
  2. LMArena leaderboard