每家 AI 视频公司都声称他们的模型是「最好的」。这里是一个实际的一对一排行榜怎么说的,直接从 Artificial Analysis 的 Video Arena 拉取,而不是任何厂商自己的说法。我们在排名真正变化时重新审视本页 —— 它是一个快照,不是永久排名。
Artificial Analysis 的 Video Arena 的运作方式像国际象棋评分:人们并排看到两段 AI 生成的片段,选出更偏好的一个,每个模型的 Elo 分数根据结果上下移动,就像棋手的评分在一局之后移动一样。Elo 越高意味着在一对一比较中有更多人偏好该模型的输出 —— 它是人类偏好的衡量,而不是像分辨率或生成速度那样的技术规格。文生视频和图生视频作为单独的排行榜跟踪,因为一个模型在其中一个上可能比另一个好得多。
| # | 模型 | 开发方 | Elo |
|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1,238 |
| 2 | Gemini Omni Flash | 1,238 | |
| 3 | Minimax H3 Max | MiniMax (via fal) | 1,235 |
| 4 | MiniMax H3 | MiniMax | 1,227 |
| 5 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,221 |
| 6 | Wan2.7-260612 | Alibaba | 1,157 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,146 |
| 10 | Kling 3.0 1080p (Pro) | KlingAI | 1,108 |
| — | Veo 3.1 & Grok Imagine | Google / xAI | 前 10 之外 |
| # | 模型 | 开发方 | Elo |
|---|---|---|---|
| 1 | Minimax H3 Max | MiniMax (via fal) | 1,201 |
| 2 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1,190 |
| 3 | MiniMax H3 | MiniMax | 1,186 |
| 4 | Gemini Omni Flash | 1,180 | |
| 5 | Wan 3.0 | Alibaba | 1,175 |
| 6 | Grok Imagine 1.5 | xAI | 1,109 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1,105 |
| — | Kling 3.0 1080p (Pro) & Veo 3.1 | KlingAI / Google | 前 10 之外 |
直接来源于 Artificial Analysis 的 Video Arena 排行榜(artificialanalysis.ai/video),于 2026 年 9 月 4 日重新核对。完整排行榜各自跟踪 28 个以上的模型 —— 这里精简为与本站涵盖的工具相关的那些,外加总体前 5-7 名作为背景。自我们上次检查以来的三周里,这些榜单发生了有意义的变化(一个月前 Wan 3.0 还不在上面)—— 把这里的每个数字都当作一个带日期的快照,而不是永久排名。
相关:更多 AI 视频新闻 · Wan 3.0 发布报道 · AI 视频是怎么做出来的 · 为什么 Sora 不在这份列表上
截至 2026 年 9 月,阿里巴巴的 Wan 3.0 —— 2026 年 8 月 24 日发布 —— 已登上 Artificial Analysis 文生视频排行榜榜首,与 Google 的 Gemini Omni Flash 基本持平,Minimax H3 Max 和 MiniMax H3 紧随其后。在单独的图生视频排行榜上,Minimax H3 Max 目前领先,Seedance 2.0 720p、MiniMax H3、Gemini Omni Flash 和 Wan 3.0 彼此都在几个 Elo 分之内。这些排名会随着新模型和新版本发布而经常变化 —— 一个月前 Wan 3.0 本身还不在这个榜单上。
Wan 3.0 是阿里巴巴最新的视频生成模型,于 2026 年 8 月 24 日通过阿里云的 Model Studio 和 API 发布,就在阿里巴巴以香港的一次增发募得 800 亿港元(约 102 亿美元)、专项用于 AI 基础设施后一天。它从文本、图像、文档、幻灯片或网页在单遍中生成最多 30 秒的视频(大约是其前代 Wan2.7 的两倍),并几乎立即以第一或接近第一的成绩在 Artificial Analysis 文生视频排行榜上亮相。定价和它实际擅长什么,见我们对 Wan 3.0 发布的专门报道。
Runway 的 Gen-4.5 在 2025 年末发布时曾以 1,247 Elo 分领跑 Artificial Analysis 的排行榜,但随着更新的模型(Seedance 2.0、HappyHorse,以及 Kling 3.0 和 Veo 3.1 那一簇)超过它,到 2026 年 5 月已跌出前 10。Runway 持续的强项是它叠加在生成之上的编辑工具集,而不是原始的排行榜位置。
不,按 Artificial Analysis 自己公布的排行榜不是。截至 2026 年 8 月,Grok Imagine 的视频模型在文生视频榜上排在中间(28 个被跟踪模型中的第 18),而在图生视频上(专门就其较新的 1.5 版本)更高(第 4),但两者都没有把它放在任何一个排行榜的第一。
Artificial Analysis 的 Video Arena 使用在成对的模型输出之间进行的一对一人类偏好投票,转换成 Elo 分数 —— 与国际象棋使用的评分系统相同。它衡量的是当人们并排看到两个选项时更偏好哪个输出,而不是对分辨率、速度或任何单一指标的技术基准。