Toda empresa de vídeo com IA alega que seu modelo é "o melhor". Veja o que um ranking real de confronto direto diz, puxado diretamente da Video Arena da Artificial Analysis em vez das alegações do próprio fornecedor. Revisitamos esta página quando as posições de fato mudam — é um instantâneo, não um ranking permanente.
A Video Arena da Artificial Analysis funciona como uma classificação de xadrez: as pessoas veem dois clipes gerados por IA lado a lado, escolhem qual preferem, e a pontuação Elo de cada modelo sobe ou desce com base no resultado, exatamente como a classificação de um jogador de xadrez muda depois de uma partida. Elo mais alto significa que mais pessoas preferiram a saída daquele modelo em comparações diretas — é uma medida de preferência humana, não uma especificação técnica como resolução ou velocidade de geração. Texto-para-vídeo e imagem-para-vídeo são acompanhados como rankings separados, já que um modelo pode ser muito melhor em um do que no outro.
| # | Modelo | Fabricante | Elo |
|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1,238 |
| 2 | Gemini Omni Flash | 1,238 | |
| 3 | Minimax H3 Max | MiniMax (via fal) | 1,235 |
| 4 | MiniMax H3 | MiniMax | 1,227 |
| 5 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,221 |
| 6 | Wan2.7-260612 | Alibaba | 1,157 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,146 |
| 10 | Kling 3.0 1080p (Pro) | KlingAI | 1,108 |
| — | Veo 3.1 & Grok Imagine | Google / xAI | fora do top 10 |
| # | Modelo | Fabricante | Elo |
|---|---|---|---|
| 1 | Minimax H3 Max | MiniMax (via fal) | 1,201 |
| 2 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,190 |
| 3 | MiniMax H3 | MiniMax | 1,186 |
| 4 | Gemini Omni Flash | 1,180 | |
| 5 | Wan 3.0 | Alibaba | 1,175 |
| 6 | Grok Imagine 1.5 | xAI | 1,109 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,105 |
| — | Kling 3.0 1080p (Pro) & Veo 3.1 | KlingAI / Google | fora do top 10 |
Com base direta nos rankings da Video Arena da Artificial Analysis (artificialanalysis.ai/video), reverificado em 4 de setembro de 2026. Os rankings completos acompanham mais de 28 modelos cada — reduzidos aqui aos relevantes para as ferramentas cobertas neste site, mais o top 5-7 geral para contexto. Esses quadros mudaram de forma significativa nas três semanas desde nossa última verificação (o Wan 3.0 não existia nele um mês atrás) — trate cada número aqui como um instantâneo datado, não um ranking permanente.
Veja os Preços dessas Ferramentas
Relacionados: Mais notícias de vídeo com IA · Cobertura do lançamento do Wan 3.0 · Como os vídeos com IA são feitos · Por que o Sora não está nesta lista
Em setembro de 2026, o Wan 3.0 da Alibaba — lançado em 24 de agosto de 2026 — chegou ao topo do ranking de texto-para-vídeo da Artificial Analysis, essencialmente empatado com o Gemini Omni Flash do Google, com o Minimax H3 Max e o MiniMax H3 logo atrás. No ranking separado de imagem-para-vídeo, o Minimax H3 Max lidera atualmente, com o Seedance 2.0 720p, o MiniMax H3, o Gemini Omni Flash e o Wan 3.0 todos agrupados a poucos pontos de Elo uns dos outros. Esses rankings mudam com frequência conforme novos modelos e versões são lançados — o próprio Wan 3.0 não estava neste quadro um mês atrás.
O Wan 3.0 é o mais recente modelo de geração de vídeo da Alibaba, lançado em 24 de agosto de 2026 pelo Model Studio e API da Alibaba Cloud, um dia depois de a Alibaba levantar HK$ 80 bilhões (~US$ 10,2 bilhões) em uma oferta de ações de Hong Kong destinada a infraestrutura de IA. Ele gera até 30 segundos de vídeo em uma única passagem (cerca do dobro do seu antecessor, o Wan2.7) a partir de texto, imagens, documentos, slides ou páginas web, e estreou no topo ou perto do topo do ranking de texto-para-vídeo da Artificial Analysis quase imediatamente. Veja nossa cobertura dedicada do lançamento do Wan 3.0 para preços e no que ele é de fato bom.
O Gen-4.5 do Runway liderou o ranking da Artificial Analysis no lançamento no fim de 2025 com uma pontuação de 1.247 Elo, mas caiu para fora do top 10 até maio de 2026 conforme modelos mais novos (Seedance 2.0, HappyHorse, o grupo Kling 3.0 e Veo 3.1) o ultrapassaram. A força contínua do Runway é seu conjunto de ferramentas de edição sobre a geração, não a posição bruta no ranking.
Não, não pelo próprio ranking publicado da Artificial Analysis. Em agosto de 2026, o modelo de vídeo do Grok Imagine se classifica por volta do meio do quadro de texto-para-vídeo (nº 18 de 28 modelos acompanhados) e mais alto em imagem-para-vídeo especificamente para sua versão 1.5 mais nova (nº 4), mas nenhum dos dois o coloca no nº 1 de qualquer um dos rankings.
A Video Arena da Artificial Analysis usa votação de preferência humana em confrontos diretos entre pares de saídas de modelos, convertida em uma pontuação Elo — o mesmo sistema de classificação usado no xadrez. É uma medida de qual saída as pessoas preferiram quando mostradas duas opções lado a lado, não um benchmark técnico de resolução, velocidade ou qualquer métrica única.