Modelos de Vídeo com IA, Setembro de 2026: Arena Elo vs Avaliações Humanas vs Uso Real
Gemini Omni lidera a arena, Seedance 2.0 vence nas avaliações humanas por clipe, e Veo 3 domina o uso. Três conjuntos de dados, três vencedores diferentes - e como escolher.

A geração de vídeo por IA está avançando mais rápido do que qualquer outra modalidade agora, e o panorama que você obtém depende de onde você olha. A arena da comunidade coroa uma família, avaliadores humanos pontuando clipes individuais preferem outra, e escritores de prompts votam com seus teclados por uma terceira. Aqui está o estado da IA de vídeo em setembro de 2026, fundamentado em dois conjuntos de dados que publicamos diariamente: o leaderboard de texto-para-vídeo e o próprio corpus da Wikiprompt com mais de 6.900 prompts de vídeo e resultados avaliados.
O que a arena diz
No instantâneo do benchmark de hoje, o topo da arena de texto-para-vídeo por Elo da comunidade:
O que avaliadores humanos dizem, clipe por clipe
Nosso corpus pontua a saída real de cada prompt em uma escala de "uau" de 1 a 5. Média de uau entre os modelos de vídeo com 350+ prompts avaliados:
| Modelo | Prompts | Média de uau |
|---|---|---|
| Seedance 2.0 | 1.876 | 3,47 |
| Kling | 614 | 3,38 |
| Wan 2.1 | 423 | 3,26 |
| Sora | 369 | 3,14 |
| Hailuo | 937 | 3,09 |
| Seedance 2.5 | 827 | 2,94 |
| Veo 3 | 1.409 | 2,84 |
Duas coisas se destacam. Seedance 2.0 supera seu próprio sucessor em uau por clipe - um lembrete de que mais novo nem sempre é mais impressionante nos prompts que as pessoas realmente escrevem. E Veo 3 classifica-se mais baixo aqui do que em arenas: sua força (áudio nativo, diálogo) é invisível em classificações de clipes silenciosos, que é exatamente por isso que você deve ler vários quadros antes de escolher uma ferramenta.
O que escritores de prompts realmente usam
Por volume, Seedance 2.0 (1.876 prompts) e Veo 3 (1.409) dominam o corpus; Wan 2.1 possui o nicho local/aberto e Veo 2 permanece o cavalo de batalha econômico via API Gemini. Kling supera seu volume em qualidade (3,38 uau em 614 prompts).
Como escolher na prática
Cada número acima atualiza diariamente: leaderboard de texto-para-vídeo · histórico de benchmarks · navegue pelos clipes por trás das classificações na Arena de Prompts ou por modelo em Seedance, Veo 3, Kling, Wan 2.1.
Related Articles
- Instantánea de Evaluaciones de LLM, 22 de septiembre de 2026: Una Semana Congelada en la Cima
Sep 22, 2026 · 4 min read
- ## Instantâneo de Benchmark de LLM, 22 de setembro de 2026: Uma Semana Congelada no Topo
Sep 22, 2026 · 4 min read
- LLM基准快照,2026年9月22日:榜首冻结的一周
Sep 22, 2026 · 4 min read
- LLM Benchmark Snapshot, September 22, 2026: A Frozen Week at the Top
Sep 22, 2026 · 4 min read
- Aperçu des benchmarks LLM, 22 septembre 2026 : une semaine figée en tête
Sep 22, 2026 · 4 min read