每家 AI 影片公司都聲稱他們的模型是「最好的」。這裡是一個實際的一對一排行榜怎麼說的,直接從 Artificial Analysis 的 Video Arena 拉取,而不是任何廠商自己的說法。我們在排名真正變化時重新審視本頁 —— 它是一個快照,不是永久排名。
Artificial Analysis 的 Video Arena 的運作方式像西洋棋評分:人們並排看到兩段 AI 生成的片段,選出更偏好的一個,每個模型的 Elo 分數根據結果上下移動,就像棋手的評分在一局之後移動一樣。Elo 越高意味著在一對一比較中有更多人偏好該模型的輸出 —— 它是人類偏好的衡量,而不是像解析度或生成速度那樣的技術規格。文生影片和圖生影片作為單獨的排行榜追蹤,因為一個模型在其中一個上可能比另一個好得多。
| # | 模型 | 開發方 | Elo |
|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1,238 |
| 2 | Gemini Omni Flash | 1,238 | |
| 3 | Minimax H3 Max | MiniMax (via fal) | 1,235 |
| 4 | MiniMax H3 | MiniMax | 1,227 |
| 5 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,221 |
| 6 | Wan2.7-260612 | Alibaba | 1,157 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,146 |
| 10 | Kling 3.0 1080p (Pro) | KlingAI | 1,108 |
| — | Veo 3.1 & Grok Imagine | Google / xAI | 前 10 之外 |
| # | 模型 | 開發方 | Elo |
|---|---|---|---|
| 1 | Minimax H3 Max | MiniMax (via fal) | 1,201 |
| 2 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,190 |
| 3 | MiniMax H3 | MiniMax | 1,186 |
| 4 | Gemini Omni Flash | 1,180 | |
| 5 | Wan 3.0 | Alibaba | 1,175 |
| 6 | Grok Imagine 1.5 | xAI | 1,109 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,105 |
| — | Kling 3.0 1080p (Pro) & Veo 3.1 | KlingAI / Google | 前 10 之外 |
直接來源於 Artificial Analysis 的 Video Arena 排行榜(artificialanalysis.ai/video),於 2026 年 9 月 4 日重新核對。完整排行榜各自追蹤 28 個以上的模型 —— 這裡精簡為與本站涵蓋的工具相關的那些,外加總體前 5-7 名作為背景。自我們上次檢查以來的三週裡,這些榜單發生了有意義的變化(一個月前 Wan 3.0 還不在上面)—— 把這裡的每個數字都當作一個帶日期的快照,而不是永久排名。
相關:更多 AI 影片新聞 · Wan 3.0 發布報導 · AI 影片是怎麼做出來的 · 為什麼 Sora 不在這份列表上
截至 2026 年 9 月,阿里巴巴的 Wan 3.0 —— 2026 年 8 月 24 日發布 —— 已登上 Artificial Analysis 文生影片排行榜榜首,與 Google 的 Gemini Omni Flash 基本持平,Minimax H3 Max 和 MiniMax H3 緊隨其後。在單獨的圖生影片排行榜上,Minimax H3 Max 目前領先,Seedance 2.0 720p、MiniMax H3、Gemini Omni Flash 和 Wan 3.0 彼此都在幾個 Elo 分之內。這些排名會隨著新模型和新版本發布而經常變化 —— 一個月前 Wan 3.0 本身還不在這個榜單上。
Wan 3.0 是阿里巴巴最新的影片生成模型,於 2026 年 8 月 24 日透過阿里雲的 Model Studio 和 API 發布,就在阿里巴巴以香港的一次增發募得 800 億港元(約 102 億美元)、專項用於 AI 基礎設施後一天。它從文字、圖像、文件、簡報或網頁在單遍中生成最多 30 秒的影片(大約是其前代 Wan2.7 的兩倍),並幾乎立即以第一或接近第一的成績在 Artificial Analysis 文生影片排行榜上亮相。定價和它實際擅長什麼,見我們對 Wan 3.0 發布的專門報導。
Runway 的 Gen-4.5 在 2025 年末發布時曾以 1,247 Elo 分領跑 Artificial Analysis 的排行榜,但隨著更新的模型(Seedance 2.0、HappyHorse,以及 Kling 3.0 和 Veo 3.1 那一簇)超過它,到 2026 年 5 月已跌出前 10。Runway 持續的強項是它疊加在生成之上的編輯工具集,而不是原始的排行榜位置。
不,按 Artificial Analysis 自己公布的排行榜不是。截至 2026 年 8 月,Grok Imagine 的影片模型在文生影片榜上排在中間(28 個被追蹤模型中的第 18),而在圖生影片上(專門就其較新的 1.5 版本)更高(第 4),但兩者都沒有把它放在任何一個排行榜的第一。
Artificial Analysis 的 Video Arena 使用在成對的模型輸出之間進行的一對一人類偏好投票,轉換成 Elo 分數 —— 與西洋棋使用的評分系統相同。它衡量的是當人們並排看到兩個選項時更偏好哪個輸出,而不是對解析度、速度或任何單一指標的技術基準。