どのAI動画企業も、自社のモデルが「最高」だと主張する。ここでは、いずれかのベンダー自身の主張ではなく、Artificial AnalysisのVideo Arenaから直接引き出した、実際の一対一のリーダーボードが何と言っているかを示す。順位が実際に動いたときにこのページを見直す — これはスナップショットであり、永久的なランキングではない。
Artificial AnalysisのVideo Arenaはチェスのレーティングのように機能する:人々は2つのAI生成クリップを並べて見せられ、好みの方を選び、各モデルのEloスコアは結果に基づいて上下する。ちょうどチェスプレイヤーのレーティングが対局後に動くのと同じだ。Eloが高いほど、一対一の比較でより多くの人がそのモデルの出力を好んだことを意味する — 人間の好みの尺度であり、解像度や生成速度のような技術仕様ではない。テキストから動画と画像から動画は別々のリーダーボードとして追跡される。モデルは一方が他方よりずっと得意なことがあるからだ。
| # | モデル | 開発元 | Elo |
|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1,238 |
| 2 | Gemini Omni Flash | 1,238 | |
| 3 | Minimax H3 Max | MiniMax (via fal) | 1,235 |
| 4 | MiniMax H3 | MiniMax | 1,227 |
| 5 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,221 |
| 6 | Wan2.7-260612 | Alibaba | 1,157 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,146 |
| 10 | Kling 3.0 1080p (Pro) | KlingAI | 1,108 |
| — | Veo 3.1 & Grok Imagine | Google / xAI | トップ10圏外 |
| # | モデル | 開発元 | Elo |
|---|---|---|---|
| 1 | Minimax H3 Max | MiniMax (via fal) | 1,201 |
| 2 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,190 |
| 3 | MiniMax H3 | MiniMax | 1,186 |
| 4 | Gemini Omni Flash | 1,180 | |
| 5 | Wan 3.0 | Alibaba | 1,175 |
| 6 | Grok Imagine 1.5 | xAI | 1,109 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,105 |
| — | Kling 3.0 1080p (Pro) & Veo 3.1 | KlingAI / Google | トップ10圏外 |
Artificial AnalysisのVideo Arenaリーダーボード(artificialanalysis.ai/video)から直接取得し、2026年9月4日に再確認。完全なリーダーボードはそれぞれ28以上のモデルを追跡している — ここではこのサイトで扱うツールに関連するもの、加えて文脈のための総合トップ5〜7に絞った。これらのボードは前回の確認から3週間で大きく動いた(1か月前にはWan 3.0はそこに存在しなかった)— ここの数字はいずれも日付入りのスナップショットであり、永久的なランキングではないと捉えること。
関連: その他のAI動画ニュース · Wan 3.0ローンチの報道 · AI動画の作り方 · なぜSoraはこのリストにいないのか
2026年9月時点で、AlibabaのWan 3.0 — 2026年8月24日リリース — はArtificial Analysisのテキストから動画のリーダーボードのトップに達し、GoogleのGemini Omni Flashと実質同点で、Minimax H3 MaxとMiniMax H3がすぐ後ろにつけている。別の画像から動画のリーダーボードでは、現在Minimax H3 Maxが首位で、Seedance 2.0 720p、MiniMax H3、Gemini Omni Flash、Wan 3.0がいずれも数Eloポイント以内に固まっている。これらのランキングは新しいモデルやバージョンのリリースに伴って定期的に動く — Wan 3.0自体、1か月前はこのボードに載っていなかった。
Wan 3.0はAlibabaの最新の動画生成モデルで、2026年8月24日にAlibaba CloudのModel StudioとAPIを通じてリリースされた。AlibabaがAIインフラ向けとされる香港の株式公開で800億香港ドル(約102億ドル)を調達した1日後のことだ。テキスト、画像、文書、スライド、Webページから1回のパスで最大30秒の動画を生成し(前身のWan2.7の約2倍)、ほぼ即座にArtificial Analysisのテキストから動画のリーダーボードのトップまたはその近くでデビューした。価格と実際に何が得意かは、当社のWan 3.0ローンチの専用報道をご覧いただきたい。
RunwayのGen-4.5は2025年末のローンチ時に1,247 EloのスコアでArtificial Analysisのリーダーボードを率いていたが、より新しいモデル(Seedance 2.0、HappyHorse、Kling 3.0とVeo 3.1のかたまり)が追い抜くにつれ、2026年5月までにトップ10から落ちた。Runwayの継続的な強みは、生成の上に重ねた編集ツールセットであり、生のリーダーボードの順位ではない。
いいえ、Artificial Analysis自身が公表しているリーダーボードによればそうではない。2026年8月時点で、Grok Imagineの動画モデルはテキストから動画のボードで中ほど(追跡している28モデル中18位)に位置し、画像から動画では(特に新しい1.5バージョンについて)より上位(4位)だが、どちらもどちらのリーダーボードでも1位には置いていない。
Artificial AnalysisのVideo Arenaは、モデル出力のペア間での一対一の人間の好みの投票を使い、それをEloスコアに変換する — チェスで使われるのと同じ評価システムだ。2つの選択肢を並べて見せられたときに人々がどちらの出力を好んだかの尺度であり、解像度、速度、または単一の指標の技術的なベンチマークではない。