모든 벤치마크

문서 아레나

Wikiprompt, 무료 프롬프트 백과사전에서

커뮤니티 Elo 리더보드로, LMArena 일대일 배틀에서 매일 집계됩니다. 먼저 전체 아레나, 그 다음 카테고리별 세부 정보가 표시됩니다.

마지막 업데이트: 2026-09-04 · 38 모델

순위모델조직Elo 점수
1claude-opus-5-highanthropic1,520
2claude-opus-4-6anthropic1,510
3claude-opus-4-6-thinkinganthropic1,506
4claude-fable-5anthropic1,504
5claude-opus-4-7anthropic1,498
6claude-opus-4-7-thinkinganthropic1,497
7gpt-5.5-highopenai1,485
8claude-sonnet-4-6anthropic1,483
9gpt-5.5openai1,480
10gpt-5.6-terra-xhighopenai1,479
11gpt-5.6-sol-xhighopenai1,479
12claude-opus-4-8-thinkinganthropic1,475
13muse-spark-1.1meta1,472
14claude-sonnet-5-highanthropic1,470
15gpt-5.4openai1,470
16claude-opus-4-8anthropic1,469
17gemini-3.5-flash-mediumgoogle1,465
18gpt-5.6-luna-xhighopenai1,462
19claude-opus-4-5-20251101anthropic1,462
20grok-4.5xai1,454
21kimi-k2.6moonshot1,451
22claude-sonnet-4-5-20250929anthropic1,446
23gemini-3.1-pro-previewgoogle1,445
24muse-sparkmeta1,443
25qwen3.7-plusalibaba1,440
26minimax-m3minimax1,435
27gemini-3-progoogle1,433
28kimi-k2.5-thinkingmoonshot1,429
29gemma-4-31bgoogle1,424
30claude-haiku-4-5-20251001anthropic1,423
31gemini-2.5-progoogle1,421
32glm-5v-turbozai1,417
33grok-4.20-beta-0309-reasoningxai1,414
34gemini-3-flashgoogle1,413
35gpt-5.2-highopenai1,405
36gpt-5.5-instantopenai1,402
37gpt-5.1openai1,401
38gpt-5.2openai1,400

참고 항목

출처 및 방법론

위 순위는 오픈 커뮤니티 평가에서 집계되었습니다. Elo 등급, 신뢰 구간 및 투표 수는 LMArena(크라우드소싱된 일대일 모델 배틀, 오픈 데이터셋으로 공개)에서 제공됩니다. 모델 가격 및 컨텍스트 메타데이터는 공개 OpenRouter API에서 제공됩니다. Wikiprompt는 이러한 출처를 매일 스냅샷으로 저장하고 기록을 보존하며, 자체 독점 평가는 수행하지 않습니다.

  1. LMArena leaderboard dataset (Hugging Face)
  2. LMArena leaderboard