如何解读

Artificial Analysis 的 Video Arena 的运作方式像国际象棋评分:人们并排看到两段 AI 生成的片段,选出更偏好的一个,每个模型的 Elo 分数根据结果上下移动,就像棋手的评分在一局之后移动一样。Elo 越高意味着在一对一比较中有更多人偏好该模型的输出 —— 它是人类偏好的衡量,而不是像分辨率或生成速度那样的技术规格。文生视频和图生视频作为单独的排行榜跟踪,因为一个模型在其中一个上可能比另一个好得多。

文生视频排行榜

#模型开发方Elo
1Wan 3.0Alibaba1,238
2Gemini Omni FlashGoogle1,238
3Minimax H3 MaxMiniMax (via fal)1,235
4MiniMax H3MiniMax1,227
5Dreamina Seedance 2.0 720pByteDance Seed1,221
6Wan2.7-260612Alibaba1,157
7HappyHorse-1.1Alibaba-ATH1,146
10Kling 3.0 1080p (Pro)KlingAI1,108
Veo 3.1 & Grok ImagineGoogle / xAI前 10 之外

图生视频排行榜

#模型开发方Elo
1Minimax H3 MaxMiniMax (via fal)1,201
2Dreamina Seedance 2.0 720pByteDance Seed1,190
3MiniMax H3MiniMax1,186
4Gemini Omni FlashGoogle1,180
5Wan 3.0Alibaba1,175
6Grok Imagine 1.5xAI1,109
7HappyHorse-1.1Alibaba-ATH1,105
Kling 3.0 1080p (Pro) & Veo 3.1KlingAI / Google前 10 之外

直接来源于 Artificial Analysis 的 Video Arena 排行榜(artificialanalysis.ai/video),于 2026 年 9 月 4 日重新核对。完整排行榜各自跟踪 28 个以上的模型 —— 这里精简为与本站涵盖的工具相关的那些,外加总体前 5-7 名作为背景。自我们上次检查以来的三周里,这些榜单发生了有意义的变化(一个月前 Wan 3.0 还不在上面)—— 把这里的每个数字都当作一个带日期的快照,而不是永久排名。

真正值得注意的是什么

查看这些工具的价格

相关:更多 AI 视频新闻 · Wan 3.0 发布报道 · AI 视频是怎么做出来的 · 为什么 Sora 不在这份列表上

常见问题

现在排名第一的 AI 视频模型是哪个?

截至 2026 年 9 月,阿里巴巴的 Wan 3.0 —— 2026 年 8 月 24 日发布 —— 已登上 Artificial Analysis 文生视频排行榜榜首,与 Google 的 Gemini Omni Flash 基本持平,Minimax H3 Max 和 MiniMax H3 紧随其后。在单独的图生视频排行榜上,Minimax H3 Max 目前领先,Seedance 2.0 720p、MiniMax H3、Gemini Omni Flash 和 Wan 3.0 彼此都在几个 Elo 分之内。这些排名会随着新模型和新版本发布而经常变化 —— 一个月前 Wan 3.0 本身还不在这个榜单上。

Wan 3.0 是什么,它为什么跳到了第一?

Wan 3.0 是阿里巴巴最新的视频生成模型,于 2026 年 8 月 24 日通过阿里云的 Model Studio 和 API 发布,就在阿里巴巴以香港的一次增发募得 800 亿港元(约 102 亿美元)、专项用于 AI 基础设施后一天。它从文本、图像、文档、幻灯片或网页在单遍中生成最多 30 秒的视频(大约是其前代 Wan2.7 的两倍),并几乎立即以第一或接近第一的成绩在 Artificial Analysis 文生视频排行榜上亮相。定价和它实际擅长什么,见我们对 Wan 3.0 发布的专门报道。

Runway 排在哪里?

Runway 的 Gen-4.5 在 2025 年末发布时曾以 1,247 Elo 分领跑 Artificial Analysis 的排行榜,但随着更新的模型(Seedance 2.0、HappyHorse,以及 Kling 3.0 和 Veo 3.1 那一簇)超过它,到 2026 年 5 月已跌出前 10。Runway 持续的强项是它叠加在生成之上的编辑工具集,而不是原始的排行榜位置。

正如一些营销所说,Grok Imagine 真的是排名第一的 AI 视频模型吗?

不,按 Artificial Analysis 自己公布的排行榜不是。截至 2026 年 8 月,Grok Imagine 的视频模型在文生视频榜上排在中间(28 个被跟踪模型中的第 18),而在图生视频上(专门就其较新的 1.5 版本)更高(第 4),但两者都没有把它放在任何一个排行榜的第一。

这个排名是怎么衡量的?

Artificial Analysis 的 Video Arena 使用在成对的模型输出之间进行的一对一人类偏好投票,转换成 Elo 分数 —— 与国际象棋使用的评分系统相同。它衡量的是当人们并排看到两个选项时更偏好哪个输出,而不是对分辨率、速度或任何单一指标的技术基准。