Seedance 2.5 には第三者によるベンチマークデータが存在しますが、主要な公開アリーナ 2 つのうち片方にしか掲載されていません。Arena.ai の Video Arena は 3 つの動画カテゴリすべてでスコアを付けており、テキストから動画で 6 位、画像から動画で 4 位、動画編集で 2 位です。一方 Artificial Analysis の Video Arena には Seedance 2.5 の行そのものがなく、掲載されている ByteDance 製モデルは今も Seedance 2.0 720p が最新です。VBench はどのバージョンの Seedance も一度も掲載していません。この差は重要です。ネット上で流れている「Seedance 2.5 ベンチマーク」の多くが、投票者も評価用プロンプトもスコアの尺度も異なる複数のボードの数字を、断りなく混ぜて使っているからです。以下では今日時点で検証できた公開スコアをすべて、出典ボード、そのボード自身の更新日、各数字の裏にある投票数、そしてそのリーダーボードが実際に何を測っているのかとあわせて整理します。生の表から言える Veo、Kling、Runway との比較も、言えない比較も、どちらも明記します。
最終確認日:2026-09-17。 以下のスコアはすべて同日にライブのリーダーボードから直接読み取ったものです。
要点まとめ
- Seedance 2.5 にスコアを付けている主要な公開ボードは現時点で Arena.ai Video Arena だけです。テキストから動画 6 位(1482)、画像から動画 4 位(1475)、動画編集 2 位(1410)。
- Arena.ai の動画系 3 ボードすべてで、Seedance 2.5 は Veo、Kling、Runway のどのエントリーよりも高いスコアです。最も近い Veo はテキストから動画 12 位の
veo-3.1-audio(1364)、最も近い Runway は 27 位のrunway-gen-4.5(1224)です。 - Artificial Analysis のテキストから動画、画像から動画、動画編集のいずれのボードにも Seedance 2.5 の行はありません。「Artificial Analysis の Seedance 2.5 Elo」という数字はボード上に存在しません。
- 生成系の 2 ボードでは Seedance 2.5 と Seedance 2.0 は統計的に同着です。差は 3 点と 1 点で、信頼区間は ±12 と ±8 です。明確に差が付くのは動画編集ボードです。
- Seedance 2.5 が売りにしている機能、つまり 1 回の生成で 30 秒、参照素材 50 点、タイムスタンプ単位の編集は、どの公開アリーナの投票対象にもなっていません。アリーナの投票はデフォルト設定の短いクリップに対して行われます。
クイックアンサー
Arena.ai の Video Arena における dreamina-seedance-2.5-720p のスコアは、テキストから動画が 1482 ±12(48 モデル中 6 位)、画像から動画が 1475 ±8(48 モデル中 4 位)、動画編集が 1410 ±26(10 モデル中 2 位)です。これらは画質のパーセンテージではなくブラインドの人間による選好スコアであり、そのスコアを出したボードの中でしか意味を持ちません。Seedance 2.5 には Artificial Analysis のスコアも VBench のスコアもありません。どちらもまだこのモデルを追加していないためです。投票のされ方ではなくモデル自体の性能を知りたい場合は、Seedance 2.5 モデルページ に現在の機能と制限が一覧されています。

Arena.ai テキストから動画アリーナ、ボード日付 2026 年 9 月 4 日、取得日 2026-09-17。出典:Arena.ai Text-to-Video Arena
公開されている Seedance 2.5 のスコア一覧
| リーダーボード | カテゴリ | Seedance 2.5 の結果 | ボード自身の日付 | 裏にある投票数 |
|---|---|---|---|---|
| Arena.ai Video Arena | テキストから動画 | 48 モデル中 6 位、1482 ±12(順位レンジ 3 から 9) | 2026 年 9 月 4 日 | 4,066 |
| Arena.ai Video Arena | 画像から動画 | 48 モデル中 4 位、1475 ±8(順位レンジ 2 から 6) | 2026 年 9 月 14 日 | 12,151 |
| Arena.ai Video Arena | 動画編集 | 10 モデル中 2 位、1410 ±26(順位レンジ 1 から 3) | 2026 年 8 月 26 日 | 429 |
| Artificial Analysis Video Arena | テキストから動画(音声あり) | 未掲載 | なし | なし |
| Artificial Analysis Video Arena | 画像から動画(音声あり) | 未掲載 | なし | なし |
| Artificial Analysis Video Arena | 動画編集 | 未掲載 | なし | なし |
| VBench | テキストから動画の品質ディメンション | 未掲載。Seedance はどのバージョンも掲載歴なし | なし | なし |
この表では、順位そのものより重要な列が 2 つあります。順位レンジは信頼区間を当てはめたときにそのスコアが取りうる順位の幅で、Seedance 2.5 のテキストから動画の「3 から 9」は、上の 5 モデルと下の 3 モデルとの区別をボード自身が付けられないという意味です。もう 1 つは投票数です。Seedance 2.5 のテキストから動画は 4,066 票、Seedance 2.0 は 52,864 票なので、このページの中で次の更新までに最も動きやすい数字はこれです。
テキストから動画:Seedance 2.5 と Veo、Kling、Runway
| 順位 | モデル | 開発元 | アリーナスコア | 投票数 |
|---|---|---|---|---|
| 1 | gemini-omni-1.1-flash |
1515 ±15 | 1,777 | |
| 3 | wan3.0 |
Alibaba | 1494 ±19 | 1,167 |
| 6 | dreamina-seedance-2.5-720p |
ByteDance | 1482 ±12 | 4,066 |
| 7 | dreamina-seedance-2.0-720p |
ByteDance | 1479 ±8 | 52,864 |
| 11 | sora-2-pro |
OpenAI | 1367 ±7 | 50,415 |
| 12 | veo-3.1-audio |
1364 ±14 | 13,703 | |
| 22 | seedance-v1.5-pro |
ByteDance | 1256 ±7 | 75,891 |
| 27 | runway-gen-4.5 |
Runway | 1224 ±9 | 43,610 |
| 28 | kling-2.5-turbo-1080p |
KlingAI | 1219 ±17 | 2,100 |
| 29 | kling-2.6-pro |
KlingAI | 1216 ±7 | 73,062 |
Arena.ai テキストから動画アリーナ、ボード日付 2026 年 9 月 4 日、読み取り日 2026-09-17。48 モデルのボードからの抜粋です。
裏付けの取れる読み方は限定的です。ブラインドのテキストプロンプト投票において、Seedance 2.5 は先頭集団に位置し、最高スコアの Veo エントリーより約 118 点、最高スコアの Runway エントリーより約 258 点上にいます。この表が支えられないのは「Seedance 2.5 は画質で Veo 3.1 より 118 点優れている」といった文です。投票者が比べたのは 1 本のプロンプトから生成された完成クリップ全体で、音声も込みです。つまり 1 つの数字が、動きと音とプロンプト追従性と個人の好みを同時に吸収しています。この投票がどんな種類のジョブに対して行われたのかを確かめたいなら、AI テキストから動画ジェネレーター が同じ種類の短い単発プロンプト処理を実行します。
画像から動画:最も投票数が多いボード

Arena.ai 画像から動画アリーナ、ボード日付 2026 年 9 月 14 日、取得日 2026-09-17。出典:Arena.ai Image-to-Video Arena
| 順位 | モデル | 開発元 | アリーナスコア | 投票数 |
|---|---|---|---|---|
| 1 | minimax-h3 |
MiniMax | 1494 ±5 | 49,443 |
| 2 | gemini-omni-1.1-flash |
1488 ±11 | 3,731 | |
| 3 | wan3.0 |
Alibaba | 1479 ±11 | 3,444 |
| 4 | dreamina-seedance-2.5-720p |
ByteDance | 1475 ±8 | 12,151 |
| 5 | dreamina-seedance-2.0-720p |
ByteDance | 1474 ±7 | 118,475 |
| 13 | veo-3.1-audio |
1398 ±10 | 25,116 | |
| 19 | kling-v3-pro |
KlingAI | 1355 ±6 | 199,238 |
| 26 | kling-2.6-pro |
KlingAI | 1294 ±8 | 202,157 |
| 47 | runway-gen4-turbo |
Runway | 1052 ±13 | 6,801 |
Arena.ai 画像から動画アリーナ、ボード日付 2026 年 9 月 14 日、読み取り日 2026-09-17。48 モデルのボードからの抜粋です。
このボードは 3 つの中で最もサンプルが大きく、全モデル合計で 2,013,261 票あります。そして「Seedance 2.5 と 2.0 はどれだけ違うのか」に最もきれいに答えてくれます。差は 1 点、信頼区間は ±8 と ±7 です。汎用的な 1 枚画像アニメーションのプロンプトでは、2 つのバージョンは区別できません。これはどちらのモデルが優れているかより、このボードが何を測っているかを物語っています。手元の静止画を AI 画像から動画ジェネレーター に通してみるほうが、1 点差よりもはるかに多くのことが分かります。
動画編集:2.5 が 2.0 から明確に離れる領域

Arena.ai 動画編集アリーナ、ボード日付 2026 年 8 月 26 日、取得日 2026-09-17。出典:Arena.ai Video Edit Arena
| 順位 | モデル | 開発元 | アリーナスコア | 投票数 |
|---|---|---|---|---|
| 1 | wan3.0 |
Alibaba | 1414 ±26 | 463 |
| 2 | dreamina-seedance-2.5-720p |
ByteDance | 1410 ±26 | 429 |
| 3 | minimax-h3 |
MiniMax | 1392 ±19 | 962 |
| 5 | dreamina-seedance-2.0-720p |
ByteDance | 1365 ±14 | 3,852 |
| 8 | kling-o3-pro |
KlingAI | 1255 ±11 | 7,540 |
| 9 | kling-o1-pro |
KlingAI | 1197 ±10 | 10,542 |
| 10 | runway-gen4-aleph |
Runway | 1182 ±9 | 9,818 |
Arena.ai 動画編集アリーナ、ボード日付 2026 年 8 月 26 日、読み取り日 2026-09-17。10 モデルの全リストです。このカテゴリに Veo モデルのエントリーはありません。
動画編集は最も新しく最も規模の小さいカテゴリで、10 モデル、合計 27,930 票です。そして Seedance 2.5 が前世代に対して信頼区間を超える差を付けている唯一の場所でもあります。Seedance 2.0 に対して 45 点、最下位の Runway Gen-4 Aleph に対して 228 点の差です。ただし絶対的な順位はより慎重に見る必要があります。429 票では区間が ±26 まで広がり、ボードが示す順位レンジは 1 から 3 です。「動画編集の選好で上位 3 位」は今日の時点で妥当ですが、「最高の動画編集モデル」は妥当ではありません。
Artificial Analysis に Seedance 2.5 のスコアがない理由

Artificial Analysis テキストから動画リーダーボード(音声あり)、取得日 2026-09-17。出典:Artificial Analysis Text to Video Leaderboard
Artificial Analysis は独自の Video Arena を運営しており、投票者層も Elo の尺度も独自で、モデルの追加も自社のスケジュールで行います。2026-09-17 時点で、同社のテキストから動画ボードにある ByteDance Seed のエントリーは、5 位の Dreamina Seedance 2.0 720p(1210 Elo、20,345 サンプル)と、ちょうど 1000 点に置かれた Seedance 1.5 pro(このボードのアンカー値)です。画像から動画ボードも同様で、Seedance 2.0 720p が 1174 Elo で 5 位です。動画編集ボードでは Seedance 2.0 720p が 1035 で 6 位に入り、Runway Aleph 2.0 の 1011 と Kling 3.0 Omni 1080p(Pro)の 1000 をわずかに上回っています。
ここから 2 つのことが言えます。比較記事が Artificial Analysis の Seedance 2.5 スコアを引用していた場合、その数字は出典とされたボードには載っていません。さらに、2 つの尺度はそもそも噛み合いません。Seedance 2.0 は Artificial Analysis で 1210、Arena.ai で 1479 です。平均を取ることも、引き算することも、同じ単位として同じ列に並べることもできません。
3 つ目の情報源としてよく持ち出される VBench は、この件では役に立ちません。公開リーダーボードに Seedance モデルが載ったことは一度もなく、VBench チーム認定の最新エントリーは 2025 年で止まっています。実際に対象としているオープンソースモデルについて 16 の品質ディメンションを自動で分解する道具としては今も有用ですが、2026 年の Seedance 対 Veo という問いには答えられません。
各リーダーボードが実際に測っているもの
| 出典 | 手法 | 分かること | 分からないこと |
|---|---|---|---|
| Arena.ai Video Arena | ユーザー提供のプロンプトに対するブラインドの一対比較投票を Elo 方式で集計し、信頼区間と順位レンジを併記 | 短く汎用的なプロンプトで今どのモデルが好まれているか | 長尺の制作、具体的な発注条件、デフォルト以外の設定での挙動 |
| Artificial Analysis Video Arena | 同じくブラインドの一対比較投票。投票者層とプロンプト構成は独立し、音声ありと音声なしの 2 ボードに分かれる | 同社エコシステム内での選好順、および 1 分あたりのコスト列 | 今日の Seedance 2.5 について何も。スコアを Arena.ai の尺度に換算することもできない |
| VBench | 16 の定義済み品質ディメンションによる自動採点。投稿制で認定ランクあり | 投稿されたモデルについて再現可能なディメンション別の詳細 | あらゆる Seedance バージョン、および最終更新後にリリースされたモデル |
実務上のルールはこうです。これらのボードはモデルをティアに分類するために使い、2 つ順位が違う相手との優劣判定には使わないこと。2 つの信頼区間の合計より小さい差はノイズであり、テキストから動画ボードではその閾値がおよそ 20 点、上位 10 モデルのうち 4 つの間隔よりも広い値になります。
ボードが扱っていない領域
Seedance 2.5 が中心に据えた 3 つの機能は、どの公開アリーナも投票対象にしていない 3 つでもあります。1 回の生成で 30 秒のクリップ、1 回あたり最大 50 点の参照素材、タイムスタンプ単位の編集は、いずれもアリーナが実施するデフォルト設定の短尺比較の外側にあります。6 秒のプロンプトで前世代と同着になるモデルでも、30 秒のストーリーでは全く違う挙動を見せることがあります。
だからこそ、シナリオ単位の比較はスコア表と並べて読む価値があります。Seedance 2.5 と Kling 2.5 のキャラクターおよびモーションの一貫性比較 と、Seedance 2.5 と Veo 3.1 のプロンプト追従性および音声の検証 は、いずれも単発プロンプト投票ではなく、条件を指定した長めのショットで検証しています。アリーナが均してしまう差は、そこに現れやすいのです。
コストは選好ボードがほぼ扱わないもう 1 つの軸です。Artificial Analysis は Elo の隣に 1 分あたりコストの列を出していますが、Arena.ai は出しておらず、どちらも価格でスコアを補正しません。AI 動画ツールの料金比較 では 1 秒あたりの経済性を並べて示しており、プラン別の現行価格は SeedVideo AI の料金ページ にあります。
数字を自分で確かめる手順
- 気になるカテゴリの Arena.ai ボードを開きます。テキストから動画、画像から動画、動画編集のいずれでも構いません。タイトル下に表示される日付を確認してください。カテゴリごとに更新タイミングが異なります。
- スコアは必ず ± 区間と順位レンジとセットで読みます。順位だけを見ないこと。
- 投票数を確認します。おおよそ 5,000 票を下回る場合は暫定順位として扱います。
- Artificial Analysis のボードは別途開き、そのスコアは独立した列に保ちます。
- 月次で再確認します。Seedance 2.5 の動画編集の位置は、登場以来すでに Wan 3.0 との相対関係が変わっています。
よくある質問
Seedance 2.5 のベンチマークスコアは?
Arena.ai の Video Arena で 2026-09-17 に確認した値は、テキストから動画 1482 ±12(48 モデル中 6 位)、画像から動画 1475 ±8(48 モデル中 4 位)、動画編集 1410 ±26(10 モデル中 2 位)です。これらはそのボードの尺度上のブラインド選好スコアにすぎません。Seedance 2.5 に Artificial Analysis のスコアと VBench のスコアはありません。
ベンチマーク上、Seedance 2.5 は Veo 3.1 より優れていますか?
Arena.ai のボードでは、すべての Veo エントリーより高いスコアです。テキストから動画は 1482 対 veo-3.1-audio の 1364、画像から動画は 1475 対 1398 です。これは音声を有効にした短い汎用プロンプトでのブラインド選好を反映した数字で、プロンプト追従性、解像度の上限、長尺の一貫性については何も語りません。また動画編集カテゴリには Veo モデルのエントリー自体がありません。
なぜ Artificial Analysis のリーダーボードに Seedance 2.5 がないのですか?
Artificial Analysis は独自のスケジュールで Video Arena にモデルを追加しており、2026-09-17 時点で 3 つの動画ボードのいずれにも Seedance 2.5 を追加していません。ByteDance Seed の最新エントリーは引き続き Dreamina Seedance 2.0 720p です。Artificial Analysis 由来とされる Seedance 2.5 の数値は、ライブのボードから来たものではありません。
Seedance 2.5 は Kling や Runway より上位ですか?
2026-09-17 時点で、Arena.ai の動画系 3 ボードすべてで上位です。Kling の最上位エントリーはテキストから動画が kling-2.5-turbo-1080p の 1219、画像から動画が kling-v3-pro の 1355、動画編集が kling-o3-pro の 1255 です。Runway の最上位エントリーは同じ 3 カテゴリで runway-gen-4.5 の 1224、runway-gen4-turbo の 1052、runway-gen4-aleph の 1182 です。Runway の旗艦 Gen-4.5 はテキストから動画にのみエントリーしています。
ベンチマーク上、Seedance 2.5 は Seedance 2.0 よりどれだけ優れていますか?
3 つのボードのうち 2 つでは、見出しが示すほどの差はありません。テキストから動画は 1482 対 1479 で、3 点差に対して区間は ±12 です。画像から動画は 1475 対 1474 で、1 点差に対して ±8 です。どちらも統計的には同着です。例外は動画編集で、1410 対 1365 の 45 点差は有意に残ります。実務で 2 つのバージョンを分ける要素、たとえば 1 回の生成で 30 秒や参照素材 50 点の入力は、これらのボードの測定対象外です。
これらのスコアはどのくらいの頻度で変わりますか?
Arena.ai のカテゴリはそれぞれ独立して更新されます。2026-09-17 時点で、3 つの動画ボードの日付は 2026 年 9 月 4 日、9 月 14 日、8 月 26 日でした。投票数の少ないモデルほど大きく動きます。本ページは月次で再確認し、そのたびに最終確認日を更新します。
次に見るべきもの
数字を 1 つだけ知りたいなら、正直な答えはこうです。Seedance 2.5 は現在、一方の公開動画アリーナでは最上位ティアに位置し、もう一方には掲載されておらず、Seedance 2.0 に対する測定可能な優位は動画編集にのみ存在します。ボード名、日付、投票数のいずれかが欠けたスコアは使えません。
アリーナが決して測らない領域、つまりクリップ長、参照素材の上限、編集コントロールについては、Seedance 2.5 の概要 から確認し、そのうえで自分の制作条件を SeedVideo AI に通し、実際に必要なショットと照らして出力を判断してください。



