Seedance 2.5 已经有第三方榜单数据,但只出现在两大公开竞技场中的一个。Arena.ai 的 Video Arena 在三个视频类目里都给了它分数:文生视频第 6、图生视频第 4、视频编辑第 2。Artificial Analysis 的 Video Arena 则完全没有 Seedance 2.5 这一行,它收录的最新字节跳动模型仍然是 Seedance 2.0 720p。VBench 从未收录过任何版本的 Seedance。这个差别很关键,因为网上流传的大部分「Seedance 2.5 跑分」说法,都在悄悄混用不同榜单的数字,而这些榜单的投票人群、测试提示词和分数刻度根本不能互换。下面整理的是今天能够核实的全部公开分数,每个数字都标明来源榜单、该榜单自己的更新日期、背后的投票量,以及这个榜单到底在测什么。原始表格能支撑的 Veo、Kling、Runway 对比结论写在这里,不能支撑的结论也一并写清楚。
最后核实时间:2026-09-17。 以下每一个分数都是当天直接从线上榜单读取的。
要点速览
- Arena.ai Video Arena 是目前唯一给 Seedance 2.5 打分的主流公开榜单:文生视频第 6(1482)、图生视频第 4(1475)、视频编辑第 2(1410)。
- 在 Arena.ai 的三个视频榜单上,Seedance 2.5 的分数都高于所有 Veo、Kling、Runway 条目。最接近的 Veo 是文生视频榜第 12 的
veo-3.1-audio(1364),最接近的 Runway 是第 27 的runway-gen-4.5(1224)。 - Artificial Analysis 的文生视频、图生视频、视频编辑三个榜单都没有 Seedance 2.5。所谓「Artificial Analysis 的 Seedance 2.5 Elo」根本不存在于榜单上。
- 在两个生成类榜单上,Seedance 2.5 与 Seedance 2.0 属于统计学上的平局:差距分别是 3 分和 1 分,而置信区间是 ±12 和 ±8。真正拉开差距的是视频编辑榜。
- Seedance 2.5 主打的能力,包括单次生成 30 秒、50 个参考素材、时间戳级编辑,都不在任何公开竞技场的投票范围内。竞技场的投票对象是默认设置下的短片段。
快速答案
在 Arena.ai 的 Video Arena 上,dreamina-seedance-2.5-720p 的成绩是:文生视频 1482 ±12(48 个模型中排第 6)、图生视频 1475 ±8(48 个模型中排第 4)、视频编辑 1410 ±26(10 个模型中排第 2)。这些是盲测人工偏好分,不是画质百分比,而且只在产生它的那个榜单内部才有意义。Seedance 2.5 没有 Artificial Analysis 分数,也没有 VBench 分数,因为这两家都还没有收录该模型。想了解模型本身能做什么,而不是它被怎么投票,可以看 Seedance 2.5 模型页 上列出的当前能力与限制。

Arena.ai 文生视频竞技场,榜单日期 2026 年 9 月 4 日,抓取时间 2026-09-17。来源:Arena.ai Text-to-Video Arena
一张表看完 Seedance 2.5 的全部公开分数
| 榜单 | 类目 | Seedance 2.5 成绩 | 榜单自身日期 | 背后投票量 |
|---|---|---|---|---|
| Arena.ai Video Arena | 文生视频 | 48 个模型中第 6,1482 ±12(名次区间 3 到 9) | 2026 年 9 月 4 日 | 4,066 |
| Arena.ai Video Arena | 图生视频 | 48 个模型中第 4,1475 ±8(名次区间 2 到 6) | 2026 年 9 月 14 日 | 12,151 |
| Arena.ai Video Arena | 视频编辑 | 10 个模型中第 2,1410 ±26(名次区间 1 到 3) | 2026 年 8 月 26 日 | 429 |
| Artificial Analysis Video Arena | 文生视频(含音频) | 未收录 | 无 | 无 |
| Artificial Analysis Video Arena | 图生视频(含音频) | 未收录 | 无 | 无 |
| Artificial Analysis Video Arena | 视频编辑 | 未收录 | 无 | 无 |
| VBench | 文生视频质量维度 | 未收录,且从未收录过任何 Seedance 版本 | 无 | 无 |
表里有两列比名次本身更有信息量。名次区间指的是把置信区间代入之后,这个分数可能落在的名次范围,所以 Seedance 2.5 文生视频的「3 到 9」其实是榜单自己表示:它无法把该模型与上方五个、下方三个模型区分开。另一列是投票量。Seedance 2.5 的文生视频票数是 4,066,而 Seedance 2.0 是 52,864,这意味着它是本页最可能在下次更新前发生变动的数字。
文生视频:Seedance 2.5 对比 Veo、Kling、Runway
| 名次 | 模型 | 实验室 | 竞技场分数 | 票数 |
|---|---|---|---|---|
| 1 | gemini-omni-1.1-flash |
1515 ±15 | 1,777 | |
| 3 | wan3.0 |
阿里巴巴 | 1494 ±19 | 1,167 |
| 6 | dreamina-seedance-2.5-720p |
字节跳动 | 1482 ±12 | 4,066 |
| 7 | dreamina-seedance-2.0-720p |
字节跳动 | 1479 ±8 | 52,864 |
| 11 | sora-2-pro |
OpenAI | 1367 ±7 | 50,415 |
| 12 | veo-3.1-audio |
1364 ±14 | 13,703 | |
| 22 | seedance-v1.5-pro |
字节跳动 | 1256 ±7 | 75,891 |
| 27 | runway-gen-4.5 |
Runway | 1224 ±9 | 43,610 |
| 28 | kling-2.5-turbo-1080p |
可灵 | 1219 ±17 | 2,100 |
| 29 | kling-2.6-pro |
可灵 | 1216 ±7 | 73,062 |
Arena.ai 文生视频竞技场,榜单日期 2026 年 9 月 4 日,读取时间 2026-09-17。以上为 48 个模型中的部分行。
能站得住脚的结论范围很窄:在盲测文本提示词投票中,Seedance 2.5 处于第一梯队,比分数最高的 Veo 条目高出约 118 分,比分数最高的 Runway 条目高出约 258 分。这张表撑不起的说法是「Seedance 2.5 在画质上比 Veo 3.1 高 118 分」。投票者比较的是单条提示词生成的完整成片,而且音频也参与其中,所以一个数字同时吸收了运动表现、声音、提示词遵循度和个人口味。想看看这些投票对应的是什么类型的任务,AI 文生视频生成器 跑的就是同一类单提示词短任务。
图生视频:投票量最大的榜单

Arena.ai 图生视频竞技场,榜单日期 2026 年 9 月 14 日,抓取时间 2026-09-17。来源:Arena.ai Image-to-Video Arena
| 名次 | 模型 | 实验室 | 竞技场分数 | 票数 |
|---|---|---|---|---|
| 1 | minimax-h3 |
MiniMax | 1494 ±5 | 49,443 |
| 2 | gemini-omni-1.1-flash |
1488 ±11 | 3,731 | |
| 3 | wan3.0 |
阿里巴巴 | 1479 ±11 | 3,444 |
| 4 | dreamina-seedance-2.5-720p |
字节跳动 | 1475 ±8 | 12,151 |
| 5 | dreamina-seedance-2.0-720p |
字节跳动 | 1474 ±7 | 118,475 |
| 13 | veo-3.1-audio |
1398 ±10 | 25,116 | |
| 19 | kling-v3-pro |
可灵 | 1355 ±6 | 199,238 |
| 26 | kling-2.6-pro |
可灵 | 1294 ±8 | 202,157 |
| 47 | runway-gen4-turbo |
Runway | 1052 ±13 | 6,801 |
Arena.ai 图生视频竞技场,榜单日期 2026 年 9 月 14 日,读取时间 2026-09-17。以上为 48 个模型中的部分行。
这个榜单的样本量是三者中最大的,全部模型合计 2,013,261 票,它也把「Seedance 2.5 与 2.0 到底差多少」回答得最干净:相差 1 分,而置信区间是 ±8 和 ±7。在通用的单图动画提示词上,两个版本无法区分,这更多说明的是榜单在测什么,而不是两个模型谁更强。把你自己的静态图放进 AI 图生视频生成器 跑一遍,得到的信息会比 1 分的差距多得多。
视频编辑:2.5 真正拉开 2.0 的地方

Arena.ai 视频编辑竞技场,榜单日期 2026 年 8 月 26 日,抓取时间 2026-09-17。来源:Arena.ai Video Edit Arena
| 名次 | 模型 | 实验室 | 竞技场分数 | 票数 |
|---|---|---|---|---|
| 1 | wan3.0 |
阿里巴巴 | 1414 ±26 | 463 |
| 2 | dreamina-seedance-2.5-720p |
字节跳动 | 1410 ±26 | 429 |
| 3 | minimax-h3 |
MiniMax | 1392 ±19 | 962 |
| 5 | dreamina-seedance-2.0-720p |
字节跳动 | 1365 ±14 | 3,852 |
| 8 | kling-o3-pro |
可灵 | 1255 ±11 | 7,540 |
| 9 | kling-o1-pro |
可灵 | 1197 ±10 | 10,542 |
| 10 | runway-gen4-aleph |
Runway | 1182 ±9 | 9,818 |
Arena.ai 视频编辑竞技场,榜单日期 2026 年 8 月 26 日,读取时间 2026-09-17。这是完整的 10 个模型榜单,该类目没有 Veo 模型参赛。
视频编辑是最新也最小的类目,共 10 个模型、27,930 票,也是唯一一个 Seedance 2.5 对前代拉开的差距能扛过置信区间的地方:领先 Seedance 2.0 共 45 分,领先榜尾 Runway Gen-4 Aleph 共 228 分。不过绝对名次要更谨慎地看。429 票对应的区间宽达 ±26,榜单给出的名次区间是 1 到 3。「视频编辑偏好度前三」今天站得住脚,「最强视频编辑模型」站不住。
为什么 Artificial Analysis 上没有 Seedance 2.5 分数

Artificial Analysis 文生视频榜单(含音频),抓取时间 2026-09-17。来源:Artificial Analysis Text to Video Leaderboard
Artificial Analysis 运营着自己的 Video Arena,有自己的投票人群、自己的 Elo 刻度,收录模型也按自己的节奏。在 2026-09-17,它文生视频榜上的字节跳动 Seed 条目是排名第 5 的 Dreamina Seedance 2.0 720p,1210 Elo,20,345 个样本,以及正好 1000 分的 Seedance 1.5 pro,那是该榜的锚点值。图生视频榜情况相同,Seedance 2.0 720p 以 1174 Elo 排第 5。视频编辑榜上 Seedance 2.0 720p 以 1035 排第 6,略高于 Runway Aleph 2.0 的 1011 和 Kling 3.0 Omni 1080p(Pro)的 1000。
由此有两点结论。如果某篇对比文章引用了 Artificial Analysis 的 Seedance 2.5 分数,那个分数并不在它声称的榜单上。另外,两套刻度本身就对不上:Seedance 2.0 在 Artificial Analysis 是 1210,在 Arena.ai 是 1479。两者不能求平均、不能相减,也不能当成同一单位放进同一列。
VBench 是第三个常被搬出来的来源,但它在这里帮不上忙。它的公开榜单从未收录过 Seedance 模型,最近一批由 VBench 团队认证的条目日期还停留在 2025 年。作为面向它确实覆盖的开源模型的 16 维自动化质量拆解,VBench 依然有价值,但它回答不了 2026 年的 Seedance 对比 Veo 这个问题。
每个榜单到底在测什么
| 来源 | 方法 | 能告诉你什么 | 不能告诉你什么 |
|---|---|---|---|
| Arena.ai Video Arena | 对用户自带提示词的盲测两两投票,按 Elo 方式计分,附带置信区间和名次区间 | 在短小、通用的提示词上,人们当下更偏好哪个模型 | 长片工作、具体创作简报、非默认参数下的表现 |
| Artificial Analysis Video Arena | 同样是盲测两两投票,但投票人群和提示词组合独立,分为含音频与无音频两个榜 | 在它自己的体系内部的偏好排序,以及一栏每分钟成本 | 今天关于 Seedance 2.5 的任何信息;它的分数也无法换算到 Arena.ai 的刻度 |
| VBench | 按 16 个既定质量维度自动打分,提交制并带分级认证 | 对提交过的模型给出可复现的分维度细节 | 任何 Seedance 版本,以及它最近一次更新之后发布的模型 |
实用原则是:用这些榜单把模型放进某个梯队,而不是用来比较相隔两名的对手。任何小于两个置信区间之和的差距都是噪声,在文生视频榜上这个门槛大约是 20 分,比前十名中四个模型之间的距离还宽。
榜单覆盖不到的部分
Seedance 2.5 主打的三项能力,恰好是所有公开竞技场都不投票的三项。单次生成 30 秒片段、单次最多 50 个参考素材、时间戳级编辑,全都在竞技场那种默认设置短片对比之外。一个在 6 秒提示词上与前代打平的模型,在 30 秒叙事上完全可能表现迥异。
所以场景化对比仍然值得和分数表一起看。我们关于 Seedance 2.5 对比 Kling 2.5 的角色与动作一致性 的实测,以及 Seedance 2.5 对比 Veo 3.1 的提示词遵循度与音频表现 的拆解,用的都是更长、有明确要求的镜头,而不是单提示词投票,竞技场被抹平的差异往往就出现在那里。
成本是偏好榜单基本跳过的另一条轴。Artificial Analysis 在 Elo 旁边列出了每分钟成本,Arena.ai 没有,两家都不会按价格调整分数。AI 视频工具价格对比 把每秒成本并排放在一起,各套餐的当前价格则在 SeedVideo AI 价格页。
如何自己核对这些数字
- 打开你关心的那个 Arena.ai 类目榜单,文生视频、图生视频或视频编辑都行,注意标题下方印的日期。每个类目按自己的节奏更新。
- 读分数时一定带上 ± 区间和名次区间,不要只看名次。
- 看票数。低于大约 5,000 票时,把名次当作临时结果。
- 单独打开 Artificial Analysis 榜单,把它的分数放在自己的一列里。
- 每月复核一次。Seedance 2.5 上线以来,它在视频编辑榜上相对 Wan 3.0 的位置已经变过。
常见问题
Seedance 2.5 的跑分是多少?
在 Arena.ai 的 Video Arena 上,2026-09-17 核实的数据是:文生视频 1482 ±12(48 个模型中第 6)、图生视频 1475 ±8(48 个模型中第 4)、视频编辑 1410 ±26(10 个模型中第 2)。这些只是该榜单刻度上的盲测人工偏好分。Seedance 2.5 没有 Artificial Analysis 分数,也没有 VBench 分数。
按榜单看,Seedance 2.5 比 Veo 3.1 更强吗?
在 Arena.ai 的榜单上,它的分数高于所有 Veo 条目:文生视频 1482 对 veo-3.1-audio 的 1364,图生视频 1475 对 1398。这反映的是在开启音频的短通用提示词上的盲测偏好,不涉及提示词遵循度、分辨率上限或长片一致性,而且视频编辑类目里根本没有 Veo 模型参赛。
为什么 Artificial Analysis 榜单上找不到 Seedance 2.5?
Artificial Analysis 按自己的节奏往 Video Arena 添加模型,截至 2026-09-17,它的三个视频榜单都还没有加入 Seedance 2.5,最新的字节跳动 Seed 条目仍是 Dreamina Seedance 2.0 720p。任何标注为 Artificial Analysis 的 Seedance 2.5 数字都不是来自线上榜单。
Seedance 2.5 的名次高于 Kling 和 Runway 吗?
截至 2026-09-17,在 Arena.ai 的三个视频榜单上都是。Kling 最强的条目分别是文生视频 1219 的 kling-2.5-turbo-1080p、图生视频 1355 的 kling-v3-pro、视频编辑 1255 的 kling-o3-pro。Runway 最强的条目分别是同三个类目里的 1224 runway-gen-4.5、1052 runway-gen4-turbo、1182 runway-gen4-aleph。Runway 的旗舰 Gen-4.5 只参加了文生视频类目。
按跑分看,Seedance 2.5 比 Seedance 2.0 强多少?
在三个榜单中的两个上,差距比标题党写得小。文生视频是 1482 对 1479,3 分的差距对应 ±12 的区间。图生视频是 1475 对 1474,1 分的差距对应 ±8。两者都是统计学平局。视频编辑是例外,1410 对 1365,45 分的差距站得住。真正把两个版本区分开的能力,比如单次生成 30 秒和 50 个参考素材输入,都不在这些榜单的测试范围内。
这些分数多久变一次?
Arena.ai 的每个类目独立刷新。2026-09-17 当天,三个视频榜单标注的日期分别是 2026 年 9 月 4 日、9 月 14 日和 8 月 26 日。票数越少的模型波动越大。本页每月复核一次,并在每次复核时更新最后核实时间。
接下来该看什么
如果你只想要一个数字,诚实的版本是:Seedance 2.5 目前在一个公开视频竞技场里位居第一梯队,在另一个竞技场完全没有收录,而它相对 Seedance 2.0 的可测量领先只存在于视频编辑。任何没有标明榜单名称、日期和票数的分数都不能用。
想看竞技场从来不测的那部分能力,包括片段时长、参考素材上限和编辑控制,可以从 Seedance 2.5 模型总览 开始,然后把你自己的创作要求放进 SeedVideo AI 跑一遍,按你真正需要的镜头去判断结果。



