# AIビデオモデル、2026年9月:アリーナElo対人間評価対実際の使用状況
Gemini Omni がアリーナをリードし、Seedance 2.0 がクリップごとの人間評価で勝利し、Veo 3 が使用量で支配的です。3つのデータセット、3つの異なる勝者、、そして、その選び方。

AI動画生成は、現在他のどのモダリティよりも速いペースで進化しており、その評価は見る場所によって異なります。コミュニティアリーナはあるモデル群を支持し、個々のクリップを評価する人間のレーターは別のモデルを好み、プロンプト作成者はキーボードで第三のモデルに投票します。ここでは、2026年9月時点のAIビデオの現状を、私たちが毎日公開している2つのデータセット、テキストからビデオへのリーダーボードと、Wikiprompt自身の6,900以上のビデオプロンプトと評価結果のコーパスに基づいて紹介します。
アリーナが示すもの
今日のベンチマークスナップショットでは、コミュニティEloによるテキストからビデオへのアリーナのトップは以下の通りです。
人間のレーターがクリップごとに言うこと
私たちのコーパスは、各プロンプトの実際の出力を1〜5の「ワウ」スケールで評価します。350以上の評価済みプロンプトを持つビデオモデル全体の平均ワウは以下の通りです。
| モデル | プロンプト数 | 平均ワウ |
|---|---|---|
| Seedance 2.0 | 1,876 | 3.47 |
| Kling | 614 | 3.38 |
| Wan 2.1 | 423 | 3.26 |
| Sora | 369 | 3.14 |
| Hailuo | 937 | 3.09 |
| Seedance 2.5 | 827 | 2.94 |
| Veo 3 | 1,409 | 2.84 |
2つの点が際立っています。Seedance 2.0は、クリップごとのワウで後継モデルを上回っています。これは、新しいものが常に、人々が実際に書くプロンプトでより印象的であるとは限らないことを思い出させます。そして、Veo 3はアリーナよりもここでのランクが低いです。その強み(ネイティブオーディオ、ダイアログ)は、サイレントクリップの評価では見えません。これはまさに、ツールを選ぶ前に複数のボードを読むべき理由です。
プロンプト作成者が実際に使うもの
量では、Seedance 2.0(1,876プロンプト)とVeo 3(1,409プロンプト)がコーパスを支配しています。Wan 2.1はローカル/オープンニッチを所有し、Veo 2はGemini API経由で予算向けの主力であり続けています。Klingは、量に対して質(614プロンプトで3.38ワウ)で上回っています。
実際の選び方
上記のすべての数字は毎日更新されます:テキストからビデオへのリーダーボード・ベンチマーク履歴・評価の背後にあるクリップをプロンプトアリーナで閲覧するか、モデルごとにSeedance、Veo 3、Kling、Wan 2.1で閲覧できます。
Related Articles
- Instantánea de Evaluaciones de LLM, 22 de septiembre de 2026: Una Semana Congelada en la Cima
Sep 22, 2026 · 4 min read
- ## Instantâneo de Benchmark de LLM, 22 de setembro de 2026: Uma Semana Congelada no Topo
Sep 22, 2026 · 4 min read
- LLM基准快照,2026年9月22日:榜首冻结的一周
Sep 22, 2026 · 4 min read
- LLM Benchmark Snapshot, September 22, 2026: A Frozen Week at the Top
Sep 22, 2026 · 4 min read
- Aperçu des benchmarks LLM, 22 septembre 2026 : une semaine figée en tête
Sep 22, 2026 · 4 min read