Blog›Benchmarks

Modelos de Vídeo com IA, Setembro de 2026: Arena Elo vs Avaliações Humanas vs Uso Real

Gemini Omni lidera a arena, Seedance 2.0 vence nas avaliações humanas por clipe, e Veo 3 domina o uso. Três conjuntos de dados, três vencedores diferentes - e como escolher.

Modelos de Vídeo com IA, Setembro de 2026: Arena Elo vs Avaliações Humanas vs Uso Real

A geração de vídeo por IA está avançando mais rápido do que qualquer outra modalidade agora, e o panorama que você obtém depende de onde você olha. A arena da comunidade coroa uma família, avaliadores humanos pontuando clipes individuais preferem outra, e escritores de prompts votam com seus teclados por uma terceira. Aqui está o estado da IA de vídeo em setembro de 2026, fundamentado em dois conjuntos de dados que publicamos diariamente: o leaderboard de texto-para-vídeo e o próprio corpus da Wikiprompt com mais de 6.900 prompts de vídeo e resultados avaliados.

O que a arena diz

No instantâneo do benchmark de hoje, o topo da arena de texto-para-vídeo por Elo da comunidade:

  • Gemini Omni 1.1 Flash (1515) e Gemini Omni Flash (1512) - a linha omni-modal do Google conquistou a coroa de vídeo neste verão.
  • Flux 3 Video (1495) - a expansão da Black Forest Labs de imagens para movimento, a entrada aberta-adjacente mais forte.
  • Seedance 2.0 / 2.5 (1479 / 1476) - o par da ByteDance mantém a corrida frente a frente apertada.
  • MiniMax H3 (1460) - a linhagem Hailuo, consistentemente subestimada na cobertura ocidental.
  • O que avaliadores humanos dizem, clipe por clipe

    Nosso corpus pontua a saída real de cada prompt em uma escala de "uau" de 1 a 5. Média de uau entre os modelos de vídeo com 350+ prompts avaliados:

    | Modelo | Prompts | Média de uau |

    |---|---|---|

    | Seedance 2.0 | 1.876 | 3,47 |

    | Kling | 614 | 3,38 |

    | Wan 2.1 | 423 | 3,26 |

    | Sora | 369 | 3,14 |

    | Hailuo | 937 | 3,09 |

    | Seedance 2.5 | 827 | 2,94 |

    | Veo 3 | 1.409 | 2,84 |

    Duas coisas se destacam. Seedance 2.0 supera seu próprio sucessor em uau por clipe - um lembrete de que mais novo nem sempre é mais impressionante nos prompts que as pessoas realmente escrevem. E Veo 3 classifica-se mais baixo aqui do que em arenas: sua força (áudio nativo, diálogo) é invisível em classificações de clipes silenciosos, que é exatamente por isso que você deve ler vários quadros antes de escolher uma ferramenta.

    O que escritores de prompts realmente usam

    Por volume, Seedance 2.0 (1.876 prompts) e Veo 3 (1.409) dominam o corpus; Wan 2.1 possui o nicho local/aberto e Veo 2 permanece o cavalo de batalha econômico via API Gemini. Kling supera seu volume em qualidade (3,38 uau em 614 prompts).

    Como escolher na prática

  • Realismo cinematográfico com som: Veo 3 - escreva o áudio no prompt.
  • Melhor qualidade média de clipe por prompt: Seedance 2.0 - veja o guia Seedance.
  • Pesos abertos / local: Wan 2.1, com 2.2 melhorando o movimento.
  • Movimento de personagem e coreografia: Kling.
  • Assista em seguida: a liderança na arena do Gemini Omni e o Flux 3 Video - ambos são novos o suficiente para que sua cultura de prompts ainda esteja se formando, e nossos instantâneos diários mostrarão se o Elo se mantém.
  • Cada número acima atualiza diariamente: leaderboard de texto-para-vídeo · histórico de benchmarks · navegue pelos clipes por trás das classificações na Arena de Prompts ou por modelo em Seedance, Veo 3, Kling, Wan 2.1.

    Tags
    video-generation·seedance·veo-3·kling·wan·gemini·benchmarks