Como ler isto

A Video Arena da Artificial Analysis funciona como uma classificação de xadrez: as pessoas veem dois clipes gerados por IA lado a lado, escolhem qual preferem, e a pontuação Elo de cada modelo sobe ou desce com base no resultado, exatamente como a classificação de um jogador de xadrez muda depois de uma partida. Elo mais alto significa que mais pessoas preferiram a saída daquele modelo em comparações diretas — é uma medida de preferência humana, não uma especificação técnica como resolução ou velocidade de geração. Texto-para-vídeo e imagem-para-vídeo são acompanhados como rankings separados, já que um modelo pode ser muito melhor em um do que no outro.

Ranking de texto-para-vídeo

#ModeloFabricanteElo
1Wan 3.0Alibaba1,238
2Gemini Omni FlashGoogle1,238
3Minimax H3 MaxMiniMax (via fal)1,235
4MiniMax H3MiniMax1,227
5Dreamina Seedance 2.0 720pByteDance Seed1,221
6Wan2.7-260612Alibaba1,157
7HappyHorse-1.1Alibaba-ATH1,146
10Kling 3.0 1080p (Pro)KlingAI1,108
Veo 3.1 & Grok ImagineGoogle / xAIfora do top 10

Ranking de imagem-para-vídeo

#ModeloFabricanteElo
1Minimax H3 MaxMiniMax (via fal)1,201
2Dreamina Seedance 2.0 720pByteDance Seed1,190
3MiniMax H3MiniMax1,186
4Gemini Omni FlashGoogle1,180
5Wan 3.0Alibaba1,175
6Grok Imagine 1.5xAI1,109
7HappyHorse-1.1Alibaba-ATH1,105
Kling 3.0 1080p (Pro) & Veo 3.1KlingAI / Googlefora do top 10

Com base direta nos rankings da Video Arena da Artificial Analysis (artificialanalysis.ai/video), reverificado em 4 de setembro de 2026. Os rankings completos acompanham mais de 28 modelos cada — reduzidos aqui aos relevantes para as ferramentas cobertas neste site, mais o top 5-7 geral para contexto. Esses quadros mudaram de forma significativa nas três semanas desde nossa última verificação (o Wan 3.0 não existia nele um mês atrás) — trate cada número aqui como um instantâneo datado, não um ranking permanente.

O que de fato se destaca

Veja os Preços dessas Ferramentas

Relacionados: Mais notícias de vídeo com IA · Cobertura do lançamento do Wan 3.0 · Como os vídeos com IA são feitos · Por que o Sora não está nesta lista

Perguntas frequentes

Qual é o modelo de vídeo com IA nº 1 agora?

Em setembro de 2026, o Wan 3.0 da Alibaba — lançado em 24 de agosto de 2026 — chegou ao topo do ranking de texto-para-vídeo da Artificial Analysis, essencialmente empatado com o Gemini Omni Flash do Google, com o Minimax H3 Max e o MiniMax H3 logo atrás. No ranking separado de imagem-para-vídeo, o Minimax H3 Max lidera atualmente, com o Seedance 2.0 720p, o MiniMax H3, o Gemini Omni Flash e o Wan 3.0 todos agrupados a poucos pontos de Elo uns dos outros. Esses rankings mudam com frequência conforme novos modelos e versões são lançados — o próprio Wan 3.0 não estava neste quadro um mês atrás.

O que é o Wan 3.0, e por que ele saltou para o nº 1?

O Wan 3.0 é o mais recente modelo de geração de vídeo da Alibaba, lançado em 24 de agosto de 2026 pelo Model Studio e API da Alibaba Cloud, um dia depois de a Alibaba levantar HK$ 80 bilhões (~US$ 10,2 bilhões) em uma oferta de ações de Hong Kong destinada a infraestrutura de IA. Ele gera até 30 segundos de vídeo em uma única passagem (cerca do dobro do seu antecessor, o Wan2.7) a partir de texto, imagens, documentos, slides ou páginas web, e estreou no topo ou perto do topo do ranking de texto-para-vídeo da Artificial Analysis quase imediatamente. Veja nossa cobertura dedicada do lançamento do Wan 3.0 para preços e no que ele é de fato bom.

Onde o Runway se classifica?

O Gen-4.5 do Runway liderou o ranking da Artificial Analysis no lançamento no fim de 2025 com uma pontuação de 1.247 Elo, mas caiu para fora do top 10 até maio de 2026 conforme modelos mais novos (Seedance 2.0, HappyHorse, o grupo Kling 3.0 e Veo 3.1) o ultrapassaram. A força contínua do Runway é seu conjunto de ferramentas de edição sobre a geração, não a posição bruta no ranking.

O Grok Imagine é de fato o modelo de vídeo com IA nº 1, como algum marketing alega?

Não, não pelo próprio ranking publicado da Artificial Analysis. Em agosto de 2026, o modelo de vídeo do Grok Imagine se classifica por volta do meio do quadro de texto-para-vídeo (nº 18 de 28 modelos acompanhados) e mais alto em imagem-para-vídeo especificamente para sua versão 1.5 mais nova (nº 4), mas nenhum dos dois o coloca no nº 1 de qualquer um dos rankings.

Como esse ranking é medido?

A Video Arena da Artificial Analysis usa votação de preferência humana em confrontos diretos entre pares de saídas de modelos, convertida em uma pontuação Elo — o mesmo sistema de classificação usado no xadrez. É uma medida de qual saída as pessoas preferiram quando mostradas duas opções lado a lado, não um benchmark técnico de resolução, velocidade ou qualquer métrica única.