LLM बेंचमार्क
Wikiprompt से, प्रॉम्प्ट का मुक्त विश्वकोश
भाषा मॉडल और जनरेटिव AI की लाइव रैंकिंग, सामुदायिक खुली मूल्यांकन से दैनिक रूप से एकत्रित। प्रत्येक तालिका अपने स्रोत का हवाला देती है, और चूंकि Wikiprompt दैनिक स्नैपशॉट रखता है, रैंकिंग में बदलाव दर्ज किए जाते हैं।
अंतिम अपडेट: 2026-09-22 · यह लाइव रैंकिंग है; दिनांकित स्नैपशॉट प्रत्येक पिछली रैंकिंग को संरक्षित करते हैं। इतिहास →
इंटरैक्टिव एक्सप्लोरर
एरिना, संगठन या लाइसेंस द्वारा फ़िल्टर करें, मॉडल खोजें, तालिका क्रमबद्ध करें और लागत बनाम प्रदर्शन ग्राफ़ पढ़ें। नीचे दी गई तालिकाएँ उद्धरण योग्य संदर्भ बनी रहती हैं।
LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
मूल्य और संदर्भ: OpenRouter (नाम से मिलान)
मॉडल को पिन करने और केवल उनकी तुलना करने के लिए पंक्तियों या ग्राफ़ बिंदुओं पर क्लिक करें।
लागत बनाम प्रदर्शन
आउटपुट मूल्य USD में प्रति 1M टोकन (लॉग स्केल, OpenRouter से) बनाम सामुदायिक Elo (LMArena)। ऊपर बाईं ओर = सर्वोत्तम मूल्य।
एक क्यूरेटेड सबसेट दिखा रहे हैं (संगठन के अनुसार शीर्ष)। मॉडल चुनें या 'सभी दिखाएं' चिह्नित करें।
समय के साथ Elo (शीर्ष टेक्स्ट मॉडल)
| स्थान ▲ | मॉडल | संगठन | Elo स्कोर | वोट | इनपुट $/1M | आउटपुट $/1M | संदर्भ |
|---|---|---|---|---|---|---|---|
| 2 | claude-opus-5-max | anthropic | 1,505 | 20,706 | $5 | $25 | 1,000,000 |
| 3 | claude-opus-5-high | anthropic | 1,505 | 42,617 | $5 | $25 | 1,000,000 |
| 4 | claude-opus-4-6-high | anthropic | 1,503 | 71,993 | $5 | $25 | 1,000,000 |
| 5 | claude-opus-4-6 | anthropic | 1,498 | 75,878 | $5 | $25 | 1,000,000 |
| 7 | claude-fable-5 | anthropic | 1,493 | 30,057 | $10 | $50 | 1,000,000 |
| 9 | claude-opus-4-7-high | anthropic | 1,490 | 60,002 | $5 | $25 | 1,000,000 |
| 12 | claude-opus-4-7 | anthropic | 1,483 | 61,128 | $5 | $25 | 1,000,000 |
| 13 | gemini-3.5-flash-high | 1,482 | 38,257 | $1.5 | $9 | 1,048,576 | |
| 15 | muse-spark-1.1 | meta | 1,480 | 27,615 | $1.25 | $4.25 | 1,048,576 |
| 16 | gemini-3.1-pro-preview | 1,480 | 106,951 | $2 | $12 | 1,048,576 | |
| 17 | gemini-3-pro | 1,479 | 40,654 | $2 | $12 | 131,072 | |
| 18 | gemini-3.6-flash-high | 1,476 | 26,445 | $0.75 | $3.75 | 1,048,576 | |
| 19 | gemini-3.5-flash-medium | 1,476 | 36,627 | $1.5 | $9 | 1,048,576 | |
| 23 | kimi-k3-max | moonshot | 1,472 | 20,987 | $3 | $15 | 1,048,576 |
| 25 | qwen3.5-max-preview | alibaba | 1,471 | 21,476 | |||
| 26 | gpt-5.5-high | openai | 1,471 | 64,924 | $5 | $30 | 1,050,000 |
| 28 | ernie-5.1 | baidu | 1,468 | 37,058 | |||
| 29 | glm-5.2-max | zai | 1,467 | 36,798 | $0.65 | $2.04 | 1,048,576 |
| 32 | mimo-v2.5-pro | xiaomi | 1,465 | 60,919 | $0.44 | $0.87 | 1,050,000 |
| 42 | grok-4.20-beta-0309-reasoning | xai | 1,451 | 62,168 | $1.25 | $2.5 | 2,000,000 |
| 43 | deepseek-v4-pro | deepseek | 1,451 | 54,130 | $0.94 | $1.88 | 1,048,576 |
| 48 | dola-seed-2.0-pro | bytedance | 1,448 | 74,159 | |||
| 67 | inkling | thinky | 1,440 | 25,922 | $1 | $4.05 | 1,048,576 |
| 82 | minimax-m3 | minimax | 1,433 | 48,540 | $0.3 | $1.2 | 1,048,576 |
| 91 | mistral-large-3 | mistral | 1,427 | 69,028 | $0.25 | $0.75 | 262,144 |
| 92 | longcat-flash-chat-2602-exp | meituan | 1,426 | 27,962 | |||
| 120 | amazon-nova-experimental-chat-11-10 | amazon | 1,416 | 25,086 | |||
| 140 | step-3.5-flash | stepfun | 1,404 | 57,137 | $0.1 | $0.3 | 262,144 |
मूल्य सामान्यीकृत नाम द्वारा OpenRouter की निकटतम सूची से मिलाए जाते हैं; प्रयास भिन्नताएँ आधार मॉडल का मूल्य साझा करती हैं।
- • टेक्स्ट एरिना का वर्तमान नेता: claude-opus-5-max (anthropic, Elo 1505)
- • सर्वोत्तम मूल्य (प्रति डॉलर Elo, $2/1M आउटपुट से कम): mimo-v2.5-pro (Elo 1465, $0.87/1M)
- • सबसे मजबूत खुला मॉडल: kimi-k3-max (Kimi K3 license, #23)
- • कोडिंग में नेता (Aider पास दर): gpt-5 (high) (88%)
टेक्स्ट एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 2 | claude-opus-5-max | anthropic | 1,505 |
| 3 | claude-opus-5-high | anthropic | 1,505 |
| 4 | claude-opus-4-6-high | anthropic | 1,503 |
| 5 | claude-opus-4-6 | anthropic | 1,498 |
| 7 | claude-fable-5 | anthropic | 1,493 |
| 9 | claude-opus-4-7-high | anthropic | 1,490 |
| 12 | claude-opus-4-7 | anthropic | 1,483 |
| 13 | gemini-3.5-flash-high | 1,482 | |
| 15 | muse-spark-1.1 | meta | 1,480 |
| 16 | gemini-3.1-pro-preview | 1,480 | |
| 17 | gemini-3-pro | 1,479 | |
| 18 | gemini-3.6-flash-high | 1,476 | |
| 19 | gemini-3.5-flash-medium | 1,476 | |
| 23 | kimi-k3-max | moonshot | 1,472 |
| 25 | qwen3.5-max-preview | alibaba | 1,471 |
| 26 | gpt-5.5-high | openai | 1,471 |
| 27 | gpt-5.4-high | openai | 1,470 |
| 28 | ernie-5.1 | baidu | 1,468 |
| 29 | glm-5.2-max | zai | 1,467 |
| 30 | gemini-3-flash | 1,467 | |
| 31 | gpt-5.5 | openai | 1,466 |
| 32 | mimo-v2.5-pro | xiaomi | 1,465 |
| 33 | glm-5.1 | zai | 1,462 |
| 34 | claude-opus-4-8-high | anthropic | 1,461 |
| 35 | claude-sonnet-4-6 | anthropic | 1,458 |
वेब विकास एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | gpt-6-astra-max | openai | 1,800 |
| 2 | claude-fable-5.1-max | anthropic | 1,758 |
| 3 | claude-opus-5-max | anthropic | 1,687 |
| 4 | qwen3.8-max-0902 | alibaba | 1,681 |
| 5 | kimi-k3-max | moonshot | 1,674 |
| 6 | qwen3.8-max | alibaba | 1,671 |
| 7 | claude-opus-5-high | anthropic | 1,660 |
| 8 | muse-spark-1.3-max | meta | 1,652 |
| 9 | qwen3.8-flash-next | alibaba | 1,635 |
| 10 | claude-fable-5 | anthropic | 1,628 |
| 11 | hy4-preview | tencent | 1,624 |
| 12 | muse-spark-1.3 (xHigh) | meta | 1,623 |
| 13 | grok-4.6-high | xai | 1,618 |
| 14 | gpt-5.6-sol-xhigh (codex-harness) | openai | 1,617 |
| 15 | glm-5.3-max | zai | 1,614 |
| 16 | deepseek-v4.1-flash-max | deepseek | 1,614 |
| 17 | glm-5.3-flash | zai | 1,607 |
| 18 | qwen3.8-27b | alibaba | 1,593 |
| 19 | glm-5.2-max | zai | 1,592 |
| 20 | gemini-3.7-flash-high | 1,587 | |
| 21 | deepseek-v4-pro-high-20260813 | deepseek | 1,581 |
| 22 | deepseek-v4-flash-high | deepseek | 1,580 |
| 23 | gemini-3.8-flash-high | 1,568 | |
| 24 | claude-opus-4-8-high | anthropic | 1,559 |
| 25 | claude-opus-4-7 | anthropic | 1,557 |
विज़न एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | claude-fable-5 | anthropic | 1,326 |
| 2 | claude-fable-5.1-max | anthropic | 1,322 |
| 3 | claude-opus-5-high | anthropic | 1,321 |
| 4 | claude-opus-4-7 | anthropic | 1,318 |
| 5 | claude-opus-4-7-high | anthropic | 1,316 |
| 6 | qwen3.8-max | alibaba | 1,315 |
| 7 | claude-opus-4-6-high | anthropic | 1,315 |
| 8 | muse-spark-1.3-max | meta | 1,315 |
| 9 | claude-opus-4-6 | anthropic | 1,312 |
| 10 | gemini-3.5-flash-high | 1,310 | |
| 11 | gemini-3.5-flash-medium | 1,307 | |
| 12 | muse-spark | meta | 1,306 |
| 13 | gemini-3-pro | 1,304 | |
| 14 | muse-spark-1.2 (xHigh) | meta | 1,304 |
| 15 | gpt-5.4-high | openai | 1,302 |
| 16 | gemini-3.6-flash-high | 1,300 | |
| 17 | glm-5.3-flash | zai | 1,299 |
| 18 | gpt-5.5 | openai | 1,298 |
| 19 | gemini-3.1-pro-preview | 1,296 | |
| 20 | gpt-5.5-high | openai | 1,294 |
| 21 | muse-spark-1.1 | meta | 1,294 |
| 22 | gpt-5.4 | openai | 1,293 |
| 23 | claude-opus-4-8-high | anthropic | 1,292 |
| 24 | grok-4.5 | xai | 1,289 |
| 25 | claude-opus-4-8 | anthropic | 1,288 |
टेक्स्ट-से-छवि एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | gpt-image-2.5-sunburst | openai | 1,421 |
| 2 | gpt-image-2.5-flare | openai | 1,399 |
| 3 | gpt-image-2 (medium) | openai | 1,381 |
| 4 | mai-image-2.6 | microsoft-ai | 1,331 |
| 5 | grok-imagine-image-2.0 (low) | xai | 1,315 |
| 6 | reve-2.1 | reve | 1,301 |
| 7 | muse-image | meta | 1,277 |
| 8 | reve-2.0 | reve | 1,270 |
| 9 | gemini-3.1-flash-image (nano-banana-2) [web-search] | 1,261 | |
| 10 | seedream-5.0-pro | bytedance | 1,257 |
| 11 | qwen-image-3.0-pro | alibaba | 1,254 |
| 12 | mai-image-2.5 | microsoft-ai | 1,254 |
| 13 | gemini-3.1-flash-lite-image (nano-banana-2-lite) | 1,250 | |
| 14 | gemini-3-pro-image-2k (nano-banana-pro) | 1,246 | |
| 15 | gpt-image-1.5-high-fidelity | openai | 1,239 |
| 16 | gemini-3-pro-image-preview (nano-banana-pro) | 1,232 | |
| 17 | ideogram-4.0-quality | ideogram | 1,204 |
| 18 | qwen-image-2.0-pro-2026-06-22 | alibaba | 1,191 |
| 19 | uni-1.1-max | luma-ai | 1,188 |
| 20 | mai-image-2 | microsoft-ai | 1,183 |
| 21 | uni-1.1 | luma-ai | 1,181 |
| 22 | grok-imagine-image | xai | 1,171 |
| 23 | recraft-v4.1-utility-pro | recraft | 1,169 |
| 24 | Cosmos3-Super-Text2Image (Agentic) | nvidia | 1,167 |
| 25 | flux-2-max | bfl | 1,162 |
छवि संपादन एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | gpt-image-2.5-sunburst | openai | 1,520 |
| 2 | gpt-image-2.5-flare | openai | 1,491 |
| 3 | gpt-image-2 (medium) | openai | 1,461 |
| 4 | grok-imagine-image-2.0 (low) | xai | 1,439 |
| 5 | mai-image-2.6 | microsoft-ai | 1,434 |
| 6 | muse-image | meta | 1,403 |
| 7 | mai-image-2.5 | microsoft-ai | 1,400 |
| 8 | seedream-5.0-pro | bytedance | 1,394 |
| 9 | gemini-3-pro-image-2k (nano-banana-pro) | 1,390 | |
| 10 | grok-imagine-image-quality (20260519) | xai | 1,390 |
| 11 | chatgpt-image-latest-high-fidelity (20251216) | openai | 1,389 |
| 12 | gemini-3.1-flash-image (nano-banana-2) [web-search] | 1,387 | |
| 13 | gemini-3-pro-image-preview (nano-banana-pro) | 1,385 | |
| 14 | reve-2.1 | reve | 1,375 |
| 15 | gpt-image-1.5-high-fidelity | openai | 1,370 |
| 16 | reve-2.0 | reve | 1,358 |
| 17 | uni-1.1-max | luma-ai | 1,333 |
| 18 | grok-imagine-image | xai | 1,330 |
| 19 | gemini-3.1-flash-lite-image (nano-banana-2-lite) | 1,314 | |
| 20 | uni-1.1 | luma-ai | 1,314 |
| 21 | qwen-image-2.0-pro-2026-06-22 | alibaba | 1,304 |
| 22 | hunyuan-image-3.0-instruct | tencent | 1,302 |
| 23 | wan2.7-image-pro | alibaba | 1,302 |
| 24 | seedream-4.5 | bytedance | 1,302 |
| 25 | wan2.7-image | alibaba | 1,301 |
टेक्स्ट-से-वीडियो एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | gemini-omni-1.1-flash | 1,515 | |
| 2 | gemini-omni-flash | 1,511 | |
| 3 | wan3.0 | alibaba | 1,494 |
| 4 | flux-3-video | bfl | 1,494 |
| 5 | grok-imagine-video-1.5-agent | xai | 1,491 |
| 6 | dreamina-seedance-2.5-720p | bytedance | 1,482 |
| 7 | dreamina-seedance-2.0-720p | bytedance | 1,479 |
| 8 | minimax-h3 | minimax | 1,462 |
| 9 | muse-video | meta | 1,456 |
| 10 | happyhorse-1.0 | aorizon | 1,427 |
| 11 | sora-2-pro | openai | 1,367 |
| 12 | veo-3.1-audio | 1,364 | |
| 13 | veo-3.1-audio-1080p | 1,363 | |
| 14 | veo-3.1-fast-audio | 1,362 | |
| 15 | veo-3.1-fast-audio-1080p | 1,358 | |
| 16 | veo-3-fast-audio | 1,348 | |
| 17 | grok-imagine-video-720p | xai | 1,343 |
| 18 | sora-2 | openai | 1,342 |
| 19 | wan2.7-t2v | wan | 1,341 |
| 20 | veo-3-audio | 1,340 | |
| 21 | wan2.6-t2v | alibaba | 1,328 |
| 22 | seedance-v1.5-pro | bytedance | 1,256 |
| 23 | veo-3 | 1,253 | |
| 24 | veo-3-fast | 1,248 | |
| 25 | wan2.5-t2v-preview | alibaba | 1,246 |
वीडियो संपादन एरिना10 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | wan3.0 | alibaba | 1,414 |
| 2 | dreamina-seedance-2.5-720p | bytedance | 1,410 |
| 3 | minimax-h3 | minimax | 1,392 |
| 4 | gemini-omni-flash | 1,367 | |
| 5 | dreamina-seedance-2.0-720p | bytedance | 1,365 |
| 6 | happyhorse-1.0 | aorizon | 1,307 |
| 7 | grok-imagine-video | xai | 1,258 |
| 8 | kling-o3-pro | kling | 1,255 |
| 9 | kling-o1-pro | kling | 1,197 |
| 10 | runway-gen4-aleph | runway | 1,182 |
खोज एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | gpt-5.6-sol-xhigh | openai | 1,257 |
| 2 | claude-opus-4-6-search | anthropic | 1,253 |
| 3 | gpt-5.5-search | openai | 1,242 |
| 4 | claude-opus-4-7 | anthropic | 1,233 |
| 5 | claude-fable-5 | anthropic | 1,230 |
| 6 | ernie-5.1 | baidu | 1,227 |
| 7 | claude-sonnet-4-6-search | anthropic | 1,221 |
| 8 | grok-4.5 | xai | 1,213 |
| 9 | gemini-3.1-pro-grounding | 1,210 | |
| 10 | gemini-3-pro-grounding | 1,207 | |
| 11 | gpt-5.2-search | openai | 1,207 |
| 12 | claude-opus-4-8 | anthropic | 1,204 |
| 13 | grok-4.20-multi-agent-beta-0309 | xai | 1,204 |
| 14 | gpt-5.1-search | openai | 1,199 |
| 15 | gemini-3-flash-grounding | 1,198 | |
| 16 | gpt-5.4-search | openai | 1,197 |
| 17 | claude-sonnet-5-search | anthropic | 1,194 |
| 18 | grok-4.20-beta1 | xai | 1,189 |
| 19 | claude-opus-4-5-search | anthropic | 1,180 |
| 20 | gpt-5.2-search-non-reasoning | openai | 1,172 |
| 21 | grok-4-1-fast-search | xai | 1,171 |
| 22 | grok-4-fast-search | xai | 1,171 |
| 23 | grok-4.3 | xai | 1,165 |
| 24 | claude-sonnet-4-5-search | anthropic | 1,158 |
| 25 | claude-opus-4-1-search | anthropic | 1,148 |
एजेंट एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | Claude Fable 5.1 (Max) | anthropic | |
| 2 | GPT 6 Astra (Max) | openai | |
| 3 | Claude Opus 5 (High) | anthropic | |
| 4 | Claude Opus 5 (Max) | anthropic | |
| 5 | Claude Fable 5 (High) | anthropic | |
| 6 | Claude Opus 4.8 (High) | anthropic | |
| 7 | GPT 5.6 Sol (xHigh) | openai | |
| 8 | Kimi K3 (Max) | moonshot | |
| 9 | Claude Sonnet 5 (High) | anthropic | |
| 10 | GPT 5.5 (xHigh) | openai | |
| 11 | Hy4 preview | tencent | |
| 12 | Deepseek V4.1 Flash (Max) | deepseek | |
| 13 | Gemini 3.8 Flash (High) | ||
| 14 | GLM 5.2 (Max) | zai | |
| 15 | Muse Spark 1.3 (Max) | meta | |
| 16 | DeepSeek V4 Pro (High) (0813) | deepseek | |
| 17 | Qwen3.8 Max | alibaba | |
| 18 | GLM 5.3 (Max) | zai | |
| 19 | Grok 4.5 | xai | |
| 20 | GPT 5.5 | openai | |
| 21 | Grok 4.6 (xHigh) | xai | |
| 22 | Deepseek V4 Flash (High) (20260731) | deepseek | |
| 23 | GPT 5.6 Terra (xHigh) | openai | |
| 24 | GPT 5.4 (High) | openai | |
| 25 | GLM 5.3 Flash | zai |
दस्तावेज़ एरिना25 मॉडलपूर्ण लीडरबोर्ड →
स्रोत और पद्धति: LMArena · LMArena पर मतदान किए गए आमने-सामने की लड़ाइयों का सामुदायिक Elo।
| स्थान | मॉडल | संगठन | Elo स्कोर |
|---|---|---|---|
| 1 | claude-opus-5-high | anthropic | 1,516 |
| 2 | claude-fable-5.1-max | anthropic | 1,513 |
| 3 | claude-opus-4-6-high | anthropic | 1,507 |
| 4 | claude-opus-4-6 | anthropic | 1,507 |
| 5 | claude-fable-5 | anthropic | 1,496 |
| 6 | claude-opus-4-7 | anthropic | 1,495 |
| 7 | claude-opus-4-7-high | anthropic | 1,495 |
| 8 | gpt-5.5 | openai | 1,486 |
| 9 | gpt-5.5-high | openai | 1,484 |
| 10 | gpt-5.6-sol-xhigh | openai | 1,483 |
| 11 | claude-sonnet-4-6 | anthropic | 1,482 |
| 12 | claude-opus-4-8-high | anthropic | 1,475 |
| 13 | gpt-5.6-terra-xhigh | openai | 1,472 |
| 14 | gpt-5.4 | openai | 1,471 |
| 15 | muse-spark-1.3-max | meta | 1,471 |
| 16 | gpt-6-astra-max | openai | 1,468 |
| 17 | claude-sonnet-5-high | anthropic | 1,466 |
| 18 | muse-spark-1.1 | meta | 1,465 |
| 19 | claude-opus-4-8 | anthropic | 1,464 |
| 20 | gemini-3.5-flash-medium | 1,463 | |
| 21 | claude-opus-4-5-20251101 | anthropic | 1,462 |
| 22 | gemini-3.5-flash-high | 1,461 | |
| 23 | gpt-5.6-luna-xhigh | openai | 1,457 |
| 24 | gemini-3.6-flash-high | 1,456 | |
| 25 | grok-4.6-high | xai | 1,452 |
अन्य लीडरबोर्ड
LiveBench
मीट्रिक: average score (0-100) · livebench.ai
| स्थान | मॉडल | संगठन | स्कोर |
|---|---|---|---|
| 1 | claude-fable-5-1-max-effort | 83.8 | |
| 2 | claude-fable-5-max-effort | 83.4 | |
| 3 | gpt-6-astra-max | 83.1 | |
| 4 | muse-spark-1.3-xhigh | 82.4 | |
| 5 | gpt-5.6-sol-max | 81.7 | |
| 6 | deepseek-v4.1-flash-max | 81.5 | |
| 7 | gpt-5.5-xhigh | 80.8 | |
| 8 | claude-opus-5-max-effort | 80.5 | |
| 9 | gemini-3.7-flash-high | 79.9 | |
| 10 | smaug-agentic | 79.7 | |
| 11 | qwen3.8-max | 79.5 | |
| 12 | kimi-k3 | 79.5 | |
| 13 | grok-4.6 | 79 | |
| 14 | muse-spark-1.2-xhigh | 78.9 | |
| 15 | gpt-5.4-xhigh | 78.8 |
Aider polyglot (coding)
मीट्रिक: pass rate 2 (%) · aider.chat/docs/leaderboards/
| स्थान | मॉडल | संगठन | स्कोर |
|---|---|---|---|
| 1 | gpt-5 (high) | 88 | |
| 2 | gpt-5 (medium) | 86.7 | |
| 3 | o3-pro (high) | 84.9 | |
| 4 | gemini-2.5-pro-preview-06-05 (32k think) | 83.1 | |
| 5 | o3 (high) | 81.3 | |
| 6 | gpt-5 (low) | 81.3 | |
| 7 | grok-4 (high) | 79.6 | |
| 8 | gemini-2.5-pro-preview-06-05 (default think) | 79.1 | |
| 9 | o3 (high) + gpt-4.1 | 78.2 | |
| 10 | Gemini 2.5 Pro Preview 05-06 | 76.9 | |
| 11 | o3 | 76.9 | |
| 12 | DeepSeek-V3.2-Exp (Reasoner) | 74.2 | |
| 13 | Gemini 2.5 Pro Preview 03-25 | 72.9 | |
| 14 | o4-mini (high) | 72 | |
| 15 | claude-opus-4-20250514 (32k thinking) | 72 |
BenchLM
मीट्रिक: aggregated display score · benchlm.ai
| स्थान | मॉडल | संगठन | स्कोर |
|---|---|---|---|
| 1 | Claude Fable 5.1 | Anthropic | 84.6 |
| 2 | GPT-6 Astra | OpenAI | 83.8 |
| 3 | Claude Opus 5 | Anthropic | 81.9 |
| 4 | Claude Fable 5 | Anthropic | 81.7 |
| 5 | GPT-5.6 Sol | OpenAI | 80.7 |
| 6 | Gemini 3.8 Flash | 75.8 | |
| 7 | Kimi K3 | Moonshot AI | 74.4 |
| 8 | Qwen3.8 Max | Alibaba | 73.3 |
| 9 | Claude Opus 4.8 | Anthropic | 72.2 |
| 10 | GPT-5.5 | OpenAI | 71.9 |
| 11 | GPT-5.6 Terra | OpenAI | 71.4 |
| 12 | GPT-5.4 | OpenAI | 71.2 |
| 13 | Claude Opus 4.7 | Anthropic | 70.9 |
| 14 | Gemini 3.1 Pro | 70.5 | |
| 15 | Muse Spark 1.2 | Meta | 70.3 |
Artificial Analysis (Intelligence Index)
मीट्रिक: AA Intelligence Index (0-100) · artificialanalysis.ai
| स्थान | मॉडल | संगठन | स्कोर |
|---|---|---|---|
| 1 | Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) | Anthropic | 53.4 |
| 2 | Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback) | Anthropic | 53.2 |
| 3 | GPT-6 Astra (max) | OpenAI | 52.7 |
| 4 | GPT-6 Astra (xhigh) | OpenAI | 52.4 |
| 5 | Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback) | Anthropic | 51.2 |
| 6 | GPT-6 Astra (high) | OpenAI | 50.9 |
| 7 | Claude Opus 5 (Adaptive Reasoning, Max Effort) | Anthropic | 50.8 |
| 8 | Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) | Anthropic | 49.7 |
| 9 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) | Anthropic | 49.6 |
| 10 | GPT-6 Astra (medium) | OpenAI | 49.6 |
| 11 | Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) | Anthropic | 48.9 |
| 12 | Claude Opus 5 (Adaptive Reasoning, High Effort) | Anthropic | 48.1 |
| 13 | Muse Spark 1.3 (max) | Meta | 48.1 |
| 14 | GPT-5.6 Sol (max) | OpenAI | 47 |
| 15 | Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback) | Anthropic | 46.8 |
मूल्य और संदर्भ विंडो
स्रोत और पद्धति: OpenRouter
मूल्य और संदर्भ मेटाडेटा OpenRouter की सार्वजनिक API से। मूल्य USD में प्रति 1M टोकन।
| मॉडल | संगठन | संदर्भ | इनपुट $/1M | आउटपुट $/1M |
|---|---|---|---|---|
| Auto Router | openrouter | 2,000,000 | $-1,000,000 | $-1,000,000 |
| Auto Router (Beta) | openrouter | 2,000,000 | $-1,000,000 | $-1,000,000 |
| Pareto Code Router | openrouter | 2,000,000 | $-1,000,000 | $-1,000,000 |
| SpaceXAI: Grok 4.20 | x-ai | 2,000,000 | $1.25 | $2.5 |
| SpaceXAI: Grok 4.20 Multi-Agent | x-ai | 2,000,000 | $1.25 | $2.5 |
| DeepSeek: DeepSeek V4 Flash 0731 | deepseek | 1,310,720 | $0.04 | $0.64 |
| DeepSeek: DeepSeek V4 Flash Latest | ~deepseek | 1,310,720 | $0.03 | $1 |
| Meta: Llama 4 Scout | meta-llama | 1,310,720 | $0.1 | $0.3 |
| Z.ai: GLM 5.3 | z-ai | 1,310,720 | $0.65 | $2.05 |
| Z.ai: GLM 5.3 Flash | z-ai | 1,310,720 | $0.15 | $0.5 |
| Z.ai: GLM Flash Latest | ~z-ai | 1,310,720 | $0.08 | $0.25 |
| Z.ai: GLM Latest | ~z-ai | 1,310,720 | $0.65 | $2.05 |
| OpenAI: GPT Astra Latest | ~openai | 1,050,000 | $10 | $50 |
| OpenAI: GPT Luna Latest | ~openai | 1,050,000 | $0.2 | $1.2 |
| OpenAI: GPT Sol Latest | ~openai | 1,050,000 | $2 | $10 |
| OpenAI: GPT Terra Latest | ~openai | 1,050,000 | $2 | $12 |
| OpenAI: GPT-5.4 | openai | 1,050,000 | $2.5 | $15 |
| OpenAI: GPT-5.4 (batch) | openai | 1,050,000 | $1.25 | $7.5 |
| OpenAI: GPT-5.4 Pro | openai | 1,050,000 | $30 | $180 |
| OpenAI: GPT-5.4 Pro (batch) | openai | 1,050,000 | $15 | $90 |
हाल के बदलाव
बदलाव ट्रैकिंग अगले दैनिक स्नैपशॉट से शुरू होती है। स्थान और स्कोर की चाल यहाँ सूचीबद्ध होंगी।
स्रोत और पद्धति
रैंकिंग सामुदायिक खुली मूल्यांकन से एकत्रित की जाती हैं। Elo स्कोर, विश्वास अंतराल और वोट LMArena से आते हैं (सामुदायिक मतदान वाले मॉडल युद्ध, खुले डेटासेट के रूप में प्रकाशित)। मूल्य और संदर्भ मेटाडेटा OpenRouter की सार्वजनिक API से आते हैं। Wikiprompt दैनिक स्नैपशॉट लेता है और इतिहास संरक्षित करता है; हम अपना मूल्यांकन नहीं चलाते।