Seedance 2.5에는 제3자 벤치마크 데이터가 존재하지만, 주요 공개 아레나 두 곳 중 한 곳에만 올라 있습니다. Arena.ai의 Video Arena는 세 가지 영상 카테고리 모두에서 점수를 매겨 텍스트-투-비디오 6위, 이미지-투-비디오 4위, 비디오 편집 2위로 기록하고 있습니다. 반면 Artificial Analysis의 Video Arena에는 Seedance 2.5 항목 자체가 없고, 등재된 ByteDance 모델은 여전히 Seedance 2.0 720p가 최신입니다. VBench는 어떤 버전의 Seedance도 한 번도 등재한 적이 없습니다. 이 차이는 중요합니다. 온라인에 도는 "Seedance 2.5 벤치마크" 주장 대부분이 투표자도, 평가 프롬프트도, 점수 척도도 서로 호환되지 않는 보드의 숫자를 아무 설명 없이 섞어 쓰기 때문입니다. 아래에는 오늘 검증 가능한 모든 공개 점수를 출처 보드, 해당 보드 자체의 갱신 날짜, 각 숫자를 뒷받침하는 투표 수, 그리고 그 리더보드가 실제로 무엇을 측정하는지와 함께 정리했습니다. 원자료 표가 뒷받침하는 Veo, Kling, Runway 비교와 뒷받침하지 않는 비교를 모두 밝힙니다.
최종 확인: 2026-09-17. 아래 모든 점수는 해당 날짜에 라이브 리더보드에서 직접 읽은 값입니다.
핵심 요약
- 현재 Seedance 2.5에 점수를 매기는 주요 공개 보드는 Arena.ai Video Arena뿐입니다. 텍스트-투-비디오 6위(1482), 이미지-투-비디오 4위(1475), 비디오 편집 2위(1410)입니다.
- Arena.ai의 영상 보드 세 곳 모두에서 Seedance 2.5는 Veo, Kling, Runway의 모든 항목보다 높은 점수를 받았습니다. 가장 가까운 Veo는 텍스트-투-비디오 12위의
veo-3.1-audio(1364), 가장 가까운 Runway는 27위의runway-gen-4.5(1224)입니다. - Artificial Analysis의 텍스트-투-비디오, 이미지-투-비디오, 비디오 편집 보드 어디에도 Seedance 2.5 항목이 없습니다. "Artificial Analysis의 Seedance 2.5 Elo"는 보드에 존재하지 않는 숫자입니다.
- 두 생성 보드에서 Seedance 2.5와 Seedance 2.0은 통계적으로 동률입니다. 차이는 각각 3점과 1점인데 신뢰구간은 ±12와 ±8입니다. 확실히 격차가 벌어지는 곳은 비디오 편집 보드입니다.
- Seedance 2.5가 내세운 기능, 즉 한 번의 생성으로 30초, 참조 소재 50개, 타임스탬프 단위 편집은 어느 공개 아레나의 투표 대상도 아닙니다. 아레나 투표는 기본 설정에서 만든 짧은 클립을 대상으로 합니다.
빠른 답변
Arena.ai의 Video Arena에서 dreamina-seedance-2.5-720p의 점수는 텍스트-투-비디오 1482 ±12(48개 모델 중 6위), 이미지-투-비디오 1475 ±8(48개 모델 중 4위), 비디오 편집 1410 ±26(10개 모델 중 2위)입니다. 이는 화질 백분율이 아니라 블라인드 인간 선호 점수이며, 그 점수를 만든 보드 안에서만 의미가 있습니다. Seedance 2.5에는 Artificial Analysis 점수도 VBench 점수도 없습니다. 두 곳 모두 아직 이 모델을 추가하지 않았기 때문입니다. 투표 결과가 아니라 모델 자체의 성능이 궁금하다면 Seedance 2.5 모델 페이지에 현재 기능과 제한이 정리되어 있습니다.

Arena.ai 텍스트-투-비디오 아레나, 보드 날짜 2026년 9월 4일, 캡처 2026-09-17. 출처: Arena.ai Text-to-Video Arena
공개된 Seedance 2.5 점수 한눈에 보기
| 리더보드 | 카테고리 | Seedance 2.5 결과 | 보드 자체 날짜 | 뒷받침 투표 수 |
|---|---|---|---|---|
| Arena.ai Video Arena | 텍스트-투-비디오 | 48개 모델 중 6위, 1482 ±12(순위 범위 3에서 9) | 2026년 9월 4일 | 4,066 |
| Arena.ai Video Arena | 이미지-투-비디오 | 48개 모델 중 4위, 1475 ±8(순위 범위 2에서 6) | 2026년 9월 14일 | 12,151 |
| Arena.ai Video Arena | 비디오 편집 | 10개 모델 중 2위, 1410 ±26(순위 범위 1에서 3) | 2026년 8월 26일 | 429 |
| Artificial Analysis Video Arena | 텍스트-투-비디오(오디오 포함) | 미등재 | 없음 | 없음 |
| Artificial Analysis Video Arena | 이미지-투-비디오(오디오 포함) | 미등재 | 없음 | 없음 |
| Artificial Analysis Video Arena | 비디오 편집 | 미등재 | 없음 | 없음 |
| VBench | 텍스트-투-비디오 품질 항목 | 미등재이며 Seedance는 어떤 버전도 등재된 적 없음 | 없음 | 없음 |
이 표에서 순위 자체보다 더 많은 정보를 담은 열이 둘 있습니다. 순위 범위는 신뢰구간을 적용했을 때 그 점수가 차지할 수 있는 순위의 폭이며, Seedance 2.5 텍스트-투-비디오의 "3에서 9"는 위쪽 다섯 모델과 아래쪽 세 모델을 보드 스스로 구분하지 못한다는 뜻입니다. 다른 하나는 투표 수입니다. Seedance 2.5의 텍스트-투-비디오 투표는 4,066표인 데 비해 Seedance 2.0은 52,864표여서, 이 페이지에서 다음 갱신 전에 가장 크게 움직일 숫자입니다.
텍스트-투-비디오: Seedance 2.5와 Veo, Kling, Runway
| 순위 | 모델 | 개발사 | 아레나 점수 | 투표 수 |
|---|---|---|---|---|
| 1 | gemini-omni-1.1-flash |
1515 ±15 | 1,777 | |
| 3 | wan3.0 |
Alibaba | 1494 ±19 | 1,167 |
| 6 | dreamina-seedance-2.5-720p |
ByteDance | 1482 ±12 | 4,066 |
| 7 | dreamina-seedance-2.0-720p |
ByteDance | 1479 ±8 | 52,864 |
| 11 | sora-2-pro |
OpenAI | 1367 ±7 | 50,415 |
| 12 | veo-3.1-audio |
1364 ±14 | 13,703 | |
| 22 | seedance-v1.5-pro |
ByteDance | 1256 ±7 | 75,891 |
| 27 | runway-gen-4.5 |
Runway | 1224 ±9 | 43,610 |
| 28 | kling-2.5-turbo-1080p |
KlingAI | 1219 ±17 | 2,100 |
| 29 | kling-2.6-pro |
KlingAI | 1216 ±7 | 73,062 |
Arena.ai 텍스트-투-비디오 아레나, 보드 날짜 2026년 9월 4일, 확인 2026-09-17. 48개 모델 보드에서 발췌한 항목입니다.
근거를 갖춘 해석은 범위가 좁습니다. 블라인드 텍스트 프롬프트 투표에서 Seedance 2.5는 선두 그룹에 있고, 최고 점수의 Veo 항목보다 약 118점, 최고 점수의 Runway 항목보다 약 258점 위에 있습니다. 이 표가 뒷받침하지 못하는 문장은 "Seedance 2.5가 화질에서 Veo 3.1보다 118점 낫다" 같은 표현입니다. 투표자들은 단일 프롬프트로 생성된 완성 클립 전체를 오디오까지 포함해 비교했으므로, 하나의 숫자가 움직임과 소리와 프롬프트 반영도와 개인 취향을 한꺼번에 흡수합니다. 이 투표가 어떤 종류의 작업을 대상으로 했는지 확인하려면 AI 텍스트-투-비디오 생성기가 같은 종류의 짧은 단일 프롬프트 작업을 실행합니다.
이미지-투-비디오: 투표가 가장 많은 보드

Arena.ai 이미지-투-비디오 아레나, 보드 날짜 2026년 9월 14일, 캡처 2026-09-17. 출처: Arena.ai Image-to-Video Arena
| 순위 | 모델 | 개발사 | 아레나 점수 | 투표 수 |
|---|---|---|---|---|
| 1 | minimax-h3 |
MiniMax | 1494 ±5 | 49,443 |
| 2 | gemini-omni-1.1-flash |
1488 ±11 | 3,731 | |
| 3 | wan3.0 |
Alibaba | 1479 ±11 | 3,444 |
| 4 | dreamina-seedance-2.5-720p |
ByteDance | 1475 ±8 | 12,151 |
| 5 | dreamina-seedance-2.0-720p |
ByteDance | 1474 ±7 | 118,475 |
| 13 | veo-3.1-audio |
1398 ±10 | 25,116 | |
| 19 | kling-v3-pro |
KlingAI | 1355 ±6 | 199,238 |
| 26 | kling-2.6-pro |
KlingAI | 1294 ±8 | 202,157 |
| 47 | runway-gen4-turbo |
Runway | 1052 ±13 | 6,801 |
Arena.ai 이미지-투-비디오 아레나, 보드 날짜 2026년 9월 14일, 확인 2026-09-17. 48개 모델 보드에서 발췌한 항목입니다.
이 보드는 세 곳 중 표본이 가장 커서 전체 모델 합계 2,013,261표를 담고 있고, "Seedance 2.5와 2.0의 차이"에 가장 깔끔한 답을 줍니다. 1점 차이, 신뢰구간은 ±8과 ±7입니다. 일반적인 단일 이미지 애니메이션 프롬프트에서 두 버전은 구분되지 않는데, 이는 어느 모델이 낫냐보다 이 보드가 무엇을 측정하는지를 말해 줍니다. 직접 찍은 정지 이미지를 AI 이미지-투-비디오 생성기에 넣어 보면 1점 차이보다 훨씬 많은 것을 알 수 있습니다.
비디오 편집: 2.5가 2.0과 실제로 벌어지는 지점

Arena.ai 비디오 편집 아레나, 보드 날짜 2026년 8월 26일, 캡처 2026-09-17. 출처: Arena.ai Video Edit Arena
| 순위 | 모델 | 개발사 | 아레나 점수 | 투표 수 |
|---|---|---|---|---|
| 1 | wan3.0 |
Alibaba | 1414 ±26 | 463 |
| 2 | dreamina-seedance-2.5-720p |
ByteDance | 1410 ±26 | 429 |
| 3 | minimax-h3 |
MiniMax | 1392 ±19 | 962 |
| 5 | dreamina-seedance-2.0-720p |
ByteDance | 1365 ±14 | 3,852 |
| 8 | kling-o3-pro |
KlingAI | 1255 ±11 | 7,540 |
| 9 | kling-o1-pro |
KlingAI | 1197 ±10 | 10,542 |
| 10 | runway-gen4-aleph |
Runway | 1182 ±9 | 9,818 |
Arena.ai 비디오 편집 아레나, 보드 날짜 2026년 8월 26일, 확인 2026-09-17. 10개 모델 전체 보드이며 이 카테고리에는 Veo 모델이 참가하지 않았습니다.
비디오 편집은 가장 새롭고 가장 작은 카테고리로 모델 10개, 총 27,930표입니다. 그리고 Seedance 2.5가 이전 세대와 벌린 격차가 신뢰구간을 넘어서는 유일한 자리이기도 합니다. Seedance 2.0보다 45점, 보드 최하위 Runway Gen-4 Aleph보다 228점 앞섭니다. 다만 절대 순위는 더 조심해서 봐야 합니다. 429표에서는 구간이 ±26까지 넓어지고, 보드가 제시한 순위 범위는 1에서 3입니다. "비디오 편집 선호도 상위 3위"는 오늘 기준으로 타당하지만 "최고의 비디오 편집 모델"은 그렇지 않습니다.
Artificial Analysis에 Seedance 2.5 점수가 없는 이유

Artificial Analysis 텍스트-투-비디오 리더보드(오디오 포함), 캡처 2026-09-17. 출처: Artificial Analysis Text to Video Leaderboard
Artificial Analysis는 자체 투표자 풀과 자체 Elo 척도로 별도의 Video Arena를 운영하며, 모델 추가도 자체 일정에 따릅니다. 2026-09-17 기준 이 회사의 텍스트-투-비디오 보드에 오른 ByteDance Seed 항목은 5위의 Dreamina Seedance 2.0 720p(1210 Elo, 샘플 20,345개), 그리고 정확히 1000점에 놓인 Seedance 1.5 pro입니다. 후자는 이 보드의 기준값입니다. 이미지-투-비디오 보드도 같은 모습으로 Seedance 2.0 720p가 1174 Elo로 5위입니다. 비디오 편집 보드에서는 Seedance 2.0 720p가 1035로 6위에 올라 Runway Aleph 2.0의 1011과 Kling 3.0 Omni 1080p(Pro)의 1000을 근소하게 앞섭니다.
여기서 두 가지가 따라 나옵니다. 어떤 비교 기사가 Artificial Analysis의 Seedance 2.5 점수를 인용했다면, 그 점수는 출처라고 밝힌 보드에 없습니다. 그리고 두 척도는 애초에 맞물리지 않습니다. Seedance 2.0은 Artificial Analysis에서 1210, Arena.ai에서 1479입니다. 평균을 내거나 빼거나 같은 단위처럼 한 열에 넣을 수 없습니다.
사람들이 세 번째로 찾는 VBench는 이 질문에 도움이 되지 않습니다. 공개 리더보드에 Seedance 모델이 오른 적이 한 번도 없고, VBench 팀이 인증한 최신 항목의 날짜는 2025년에 멈춰 있습니다. 실제로 다루는 오픈소스 모델에 대해 16개 품질 항목을 자동으로 분해해 주는 도구로서는 여전히 유용하지만, 2026년의 Seedance 대 Veo 질문에는 답하지 못합니다.
각 리더보드가 실제로 측정하는 것
| 출처 | 방식 | 알 수 있는 것 | 알 수 없는 것 |
|---|---|---|---|
| Arena.ai Video Arena | 사용자가 제출한 프롬프트에 대한 블라인드 1대1 투표를 Elo 방식으로 집계하고 신뢰구간과 순위 범위를 함께 표시 | 짧고 일반적인 프롬프트에서 지금 어떤 모델이 선호되는지 | 장편 작업, 구체적인 제작 요구, 기본값이 아닌 설정에서의 동작 |
| Artificial Analysis Video Arena | 역시 블라인드 1대1 투표이지만 투표자 풀과 프롬프트 구성이 별개이며 오디오 포함과 미포함 두 보드로 나뉨 | 자체 생태계 안에서의 선호 순서와 분당 비용 열 | 오늘 기준 Seedance 2.5에 관한 정보. 점수를 Arena.ai 척도로 환산할 수도 없음 |
| VBench | 정의된 16개 품질 항목에 대한 자동 채점, 제출제이며 등급 인증 부여 | 제출된 모델에 대한 재현 가능한 항목별 세부 정보 | 모든 Seedance 버전, 그리고 마지막 갱신 이후 출시된 모델 |
실무 원칙은 이렇습니다. 이 보드들은 모델을 등급으로 묶는 데 쓰고, 두 계단 떨어진 상대와의 우열을 가리는 데 쓰지 마십시오. 두 신뢰구간의 합보다 작은 격차는 잡음이며, 텍스트-투-비디오 보드에서 그 기준은 약 20점으로 상위 10개 모델 중 네 개 사이의 간격보다 넓습니다.
보드가 다루지 않는 영역
Seedance 2.5가 중심에 둔 세 가지 기능은 공개 아레나가 투표하지 않는 세 가지이기도 합니다. 한 번에 30초 클립, 한 번에 최대 50개 참조 소재, 타임스탬프 단위 편집은 모두 아레나가 진행하는 기본 설정 단편 비교의 바깥에 있습니다. 6초 프롬프트에서 이전 세대와 동률인 모델도 30초 서사에서는 전혀 다르게 움직일 수 있습니다.
그래서 시나리오 단위 비교는 점수표와 나란히 읽을 가치가 있습니다. Seedance 2.5와 Kling 2.5의 캐릭터 및 모션 일관성 비교와 Seedance 2.5와 Veo 3.1의 프롬프트 반영도 및 오디오 분석은 단일 프롬프트 투표가 아니라 조건을 지정한 더 긴 숏으로 검증했고, 아레나가 평탄하게 만들어 버리는 차이는 대개 그쪽에서 드러납니다.
비용은 선호 보드가 대체로 건너뛰는 또 하나의 축입니다. Artificial Analysis는 Elo 옆에 분당 비용 열을 두지만 Arena.ai에는 없고, 어느 쪽도 가격으로 점수를 보정하지 않습니다. AI 영상 도구 가격 비교에서 초당 경제성을 나란히 정리했고, 요금제별 현재 가격은 SeedVideo AI 요금 페이지에 있습니다.
직접 숫자를 확인하는 방법
- 관심 있는 카테고리의 Arena.ai 보드를 엽니다. 텍스트-투-비디오, 이미지-투-비디오, 비디오 편집 중 어느 것이든 좋습니다. 제목 아래 표시된 날짜를 확인하십시오. 카테고리마다 갱신 주기가 다릅니다.
- 점수는 반드시 ± 구간과 순위 범위를 함께 읽습니다. 순위만 보지 마십시오.
- 투표 수를 확인합니다. 대략 5,000표 미만이면 순위를 잠정치로 다루십시오.
- Artificial Analysis 보드는 따로 열고 그 점수는 별도 열에 둡니다.
- 매달 다시 확인합니다. Seedance 2.5가 등장한 이후 비디오 편집에서의 위치는 Wan 3.0 대비 이미 한 번 바뀌었습니다.
자주 묻는 질문
Seedance 2.5의 벤치마크 점수는 얼마인가요?
Arena.ai의 Video Arena에서 2026-09-17에 확인한 값은 텍스트-투-비디오 1482 ±12(48개 모델 중 6위), 이미지-투-비디오 1475 ±8(48개 모델 중 4위), 비디오 편집 1410 ±26(10개 모델 중 2위)입니다. 이는 해당 보드 척도에서의 블라인드 인간 선호 점수일 뿐입니다. Seedance 2.5에는 Artificial Analysis 점수도 VBench 점수도 없습니다.
벤치마크 기준으로 Seedance 2.5가 Veo 3.1보다 나은가요?
Arena.ai 보드에서는 모든 Veo 항목보다 높은 점수입니다. 텍스트-투-비디오는 1482 대 veo-3.1-audio의 1364, 이미지-투-비디오는 1475 대 1398입니다. 이는 오디오를 켠 짧은 일반 프롬프트에서의 블라인드 선호를 반영한 값이며 프롬프트 반영도, 해상도 상한, 장편 일관성에 대해서는 아무것도 말해 주지 않습니다. 또한 비디오 편집 카테고리에는 Veo 모델이 아예 참가하지 않았습니다.
왜 Artificial Analysis 리더보드에 Seedance 2.5가 없나요?
Artificial Analysis는 자체 일정으로 Video Arena에 모델을 추가하며, 2026-09-17 기준 세 개 영상 보드 어디에도 Seedance 2.5를 추가하지 않았습니다. ByteDance Seed의 최신 항목은 여전히 Dreamina Seedance 2.0 720p입니다. Artificial Analysis 출처로 표기된 Seedance 2.5 수치는 라이브 보드에서 나온 값이 아닙니다.
Seedance 2.5가 Kling과 Runway보다 상위인가요?
2026-09-17 기준으로 Arena.ai의 영상 보드 세 곳 모두에서 그렇습니다. Kling의 최상위 항목은 텍스트-투-비디오 kling-2.5-turbo-1080p 1219, 이미지-투-비디오 kling-v3-pro 1355, 비디오 편집 kling-o3-pro 1255입니다. Runway의 최상위 항목은 같은 세 카테고리에서 runway-gen-4.5 1224, runway-gen4-turbo 1052, runway-gen4-aleph 1182입니다. Runway의 플래그십 Gen-4.5는 텍스트-투-비디오에만 참가했습니다.
벤치마크로 볼 때 Seedance 2.5는 Seedance 2.0보다 얼마나 나은가요?
세 보드 중 두 곳에서는 제목이 시사하는 것보다 차이가 작습니다. 텍스트-투-비디오는 1482 대 1479로 3점 차이인데 구간은 ±12입니다. 이미지-투-비디오는 1475 대 1474로 1점 차이에 ±8입니다. 둘 다 통계적 동률입니다. 예외는 비디오 편집으로 1410 대 1365, 45점 차이가 유지됩니다. 실제로 두 버전을 가르는 요소, 예컨대 한 번의 생성으로 30초와 참조 소재 50개 입력은 이 보드들의 측정 대상이 아닙니다.
이 점수들은 얼마나 자주 바뀌나요?
Arena.ai의 각 카테고리는 독립적으로 갱신됩니다. 2026-09-17 기준 세 영상 보드의 날짜는 각각 2026년 9월 4일, 9월 14일, 8월 26일이었습니다. 투표 수가 적은 모델일수록 많이 움직입니다. 이 페이지는 매달 다시 확인하고 그때마다 최종 확인 날짜를 갱신합니다.
다음으로 볼 것
숫자 하나만 원한다면 정직한 답은 이렇습니다. Seedance 2.5는 현재 한쪽 공개 영상 아레나에서는 최상위 그룹에 있고 다른 한쪽에는 등재되어 있지 않으며, Seedance 2.0 대비 측정 가능한 우위는 비디오 편집에서만 존재합니다. 보드 이름, 날짜, 투표 수가 빠진 점수는 쓸 수 없습니다.
아레나가 결코 다루지 않는 영역, 즉 클립 길이와 참조 소재 상한과 편집 제어는 Seedance 2.5 개요에서 확인한 다음, 직접 만든 제작 조건을 SeedVideo AI에 넣고 실제로 필요한 숏과 대조해 결과를 판단해 보십시오.



