Chaque entreprise de vidéo IA affirme que son modèle est « le meilleur ». Voici ce que dit un vrai classement en face-à-face, tiré directement de la Video Arena d'Artificial Analysis plutôt que des propres affirmations d'un fournisseur. Nous revoyons cette page quand les classements bougent réellement — c'est un instantané, pas un classement permanent.
La Video Arena d'Artificial Analysis fonctionne comme un classement d'échecs : on montre aux gens deux clips générés par IA côte à côte, ils choisissent celui qu'ils préfèrent, et le score Elo de chaque modèle monte ou descend selon le résultat, exactement comme le classement d'un joueur d'échecs bouge après une partie. Un Elo plus élevé signifie que plus de gens ont préféré la sortie de ce modèle dans des comparaisons en face-à-face — c'est une mesure de préférence humaine, pas une spécification technique comme la résolution ou la vitesse de génération. Le texte-vers-vidéo et l'image-vers-vidéo sont suivis comme des classements distincts, car un modèle peut être bien meilleur dans l'un que dans l'autre.
| # | Modèle | Créateur | Elo |
|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1,238 |
| 2 | Gemini Omni Flash | 1,238 | |
| 3 | Minimax H3 Max | MiniMax (via fal) | 1,235 |
| 4 | MiniMax H3 | MiniMax | 1,227 |
| 5 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,221 |
| 6 | Wan2.7-260612 | Alibaba | 1,157 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,146 |
| 10 | Kling 3.0 1080p (Pro) | KlingAI | 1,108 |
| — | Veo 3.1 & Grok Imagine | Google / xAI | hors du top 10 |
| # | Modèle | Créateur | Elo |
|---|---|---|---|
| 1 | Minimax H3 Max | MiniMax (via fal) | 1,201 |
| 2 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,190 |
| 3 | MiniMax H3 | MiniMax | 1,186 |
| 4 | Gemini Omni Flash | 1,180 | |
| 5 | Wan 3.0 | Alibaba | 1,175 |
| 6 | Grok Imagine 1.5 | xAI | 1,109 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,105 |
| — | Kling 3.0 1080p (Pro) & Veo 3.1 | KlingAI / Google | hors du top 10 |
D'après directement les classements de la Video Arena d'Artificial Analysis (artificialanalysis.ai/video), revérifié le 4 septembre 2026. Les classements complets suivent 28+ modèles chacun — réduits ici à ceux pertinents pour les outils traités sur ce site, plus le top 5-7 global pour le contexte. Ces tableaux ont bougé de façon notable au cours des trois semaines depuis notre dernière vérification (Wan 3.0 n'y existait pas il y a un mois) — considérez chaque chiffre ici comme un instantané daté, pas un classement permanent.
Connexes : Plus d'actus vidéo IA · Couverture du lancement de Wan 3.0 · Comment les vidéos IA sont faites · Pourquoi Sora n'est pas sur cette liste
En septembre 2026, le Wan 3.0 d'Alibaba — sorti le 24 août 2026 — a atteint le sommet du classement texte-vers-vidéo d'Artificial Analysis, essentiellement à égalité avec le Gemini Omni Flash de Google, avec le Minimax H3 Max et le MiniMax H3 juste derrière. Sur le classement distinct image-vers-vidéo, le Minimax H3 Max mène actuellement, avec le Seedance 2.0 720p, le MiniMax H3, le Gemini Omni Flash et le Wan 3.0 tous regroupés à quelques points d'Elo les uns des autres. Ces classements changent régulièrement à mesure que de nouveaux modèles et versions sortent — Wan 3.0 lui-même n'était pas sur ce tableau il y a un mois.
Wan 3.0 est le plus récent modèle de génération de vidéo d'Alibaba, sorti le 24 août 2026 via le Model Studio et l'API d'Alibaba Cloud, un jour après qu'Alibaba a levé 80 milliards de HK$ (~10,2 milliards de dollars) dans une offre d'actions à Hong Kong destinée à l'infrastructure d'IA. Il génère jusqu'à 30 secondes de vidéo en une seule passe (environ le double de son prédécesseur, Wan2.7) à partir de texte, d'images, de documents, de diapositives ou de pages web, et il a fait ses débuts en tête ou près de la tête du classement texte-vers-vidéo d'Artificial Analysis presque immédiatement. Voir notre couverture dédiée du lancement de Wan 3.0 pour les tarifs et ce en quoi il est vraiment bon.
Le Gen-4.5 de Runway était en tête du classement d'Artificial Analysis à son lancement fin 2025 avec un score de 1 247 Elo, mais était sorti du top 10 en mai 2026 à mesure que des modèles plus récents (Seedance 2.0, HappyHorse, le groupe Kling 3.0 et Veo 3.1) le dépassaient. La force persistante de Runway est son ensemble d'outils d'édition superposé à la génération, pas la position brute au classement.
Non, pas selon le classement publié par Artificial Analysis elle-même. En août 2026, le modèle vidéo de Grok Imagine se classe vers le milieu du tableau texte-vers-vidéo (n° 18 sur 28 modèles suivis) et plus haut en image-vers-vidéo spécifiquement pour sa version 1.5 plus récente (n° 4), mais ni l'un ni l'autre ne le place au n° 1 de l'un ou l'autre des classements.
La Video Arena d'Artificial Analysis utilise un vote de préférence humaine en face-à-face entre des paires de sorties de modèles, converti en un score Elo — le même système de notation qu'aux échecs. C'est une mesure de la sortie que les gens ont préférée quand on leur a montré deux options côte à côte, pas un benchmark technique de résolution, de vitesse ou d'une quelconque métrique unique.