Seedance 2.5 参考生视频:R2V 工作流指南
Seedance 2.5 参考生视频(R2V)是一种由参考素材驱动的视频生成方式。你可以用图片、视频、音频或它们的组合,分别约束角色身份、产品外观、动作、运镜、环境、风格与节奏。模型会据此生成新镜头,不是简单复制源视频。
实际操作的重点不是上传越多越好,而是让每份素材只负责一件事。先用最小素材包说明镜头,再在提示词中写清每份参考的角色;发生冲突时,优先删减。2026 年 8 月 6 日实测的 SeedVideo AI 网页入口位于 Seedance 2.5 的「视频转视频」,API 文档则提供更完整的多模态参考能力。下文会明确区分实测、文档记录与未测试项目。

少量职责清晰的图片、动作、音频和文字参考,可以分别控制同一镜头的不同部分。
要点速览
- 当一个起始图无法讲清角色、动作、环境与节奏时,用 R2V。
- 每份素材只承担一个主要角色,例如身份、动作、运镜或音频。
- 第一次先放 2 至 4 份参考;只有能说清新增素材补充了什么,才继续添加。
- 两份参考相互冲突时,在提示词中指定优先级,或直接删除较弱的一份。
- 验收时分别检查身份、动作、空间、运镜、音频和素材授权。
快速答案
R2V 适合需要多种参考共同约束的镜头。一套精简的产品广告素材包,可以只放一张产品图、一张环境图、一段运镜或动作视频,再按需加入音频。提示词要明确每份素材控制什么。结果跑偏时,先精简素材包,不要急着继续加长提示词。
什么是参考生视频?
R2V 会根据一组参考素材生成新视频。例如,产品图负责外观,场景图负责空间,短视频负责动作或运镜,音频负责节奏;提示词把这些素材的职责连接起来。
它和普通视频转视频不同。视频转视频通常把一段已有视频作为主要时间结构,再进行换风格、替换或编辑。R2V 可以把视频当作多份参考中的一份,不要求输出逐帧复刻源视频。
「参考」也不等于「复现」。素材能影响外形、动作、构图或节奏,但模型仍会生成新画面。即使上传了参考,也要检查角色身份、产品结构和动作是否准确,不能把参考素材当作绝对保证。
R2V、图生视频、首尾帧和视频转视频对比
| 模式 | 主要输入 | 最适合控制 | 适合场景 | 不适合场景 |
|---|---|---|---|---|
| 参考生视频(R2V) | 多张图片、视频、音频或混合素材 | 身份、动作、环境、运镜、风格与节奏等独立角色 | 一份素材无法描述完整需求的复杂镜头 | 单张图就能说明清楚的简单镜头 |
| 图生视频(I2V) | 一张起始图 | 开场构图、主体外观和初始位置 | 让静态画面动起来,同时保留起始视觉 | 需要分别借用动作、运镜和音频的镜头 |
| 首尾帧 | 一张首帧和一张尾帧 | 开始、结束及二者之间的过渡 | 揭示、变形、已知终点的运镜 | 没有明确尾帧的开放式镜头 |
| 视频转视频(V2V) | 一段已有视频 | 时间结构、表演、运镜和剪辑节奏 | 保留原动作结构进行改造或换风格 | 用多份独立参考创建全新场景 |

R2V 组合多份职责不同的参考;图生、首尾帧和视频转视频则各有一份更强的主导视觉输入。
能力状态与已核验上限
上限属于具体平台,不能把一个平台的界面或文档当成所有 Seedance 产品的统一限制。
| 使用入口 | 状态 | 核验结果 | 核验日期 |
|---|---|---|---|
| SeedVideo AI 网页生成器,Seedance 2.5,视频转视频 | Tested / 已实测 | 登录后的界面显示最多 9 张参考图,并可选 1 个 2 至 15 秒的 MP4/MOV 参考视频;页面还提供提示词、比例、时长、画质与音频输出设置。 | 2026-08-06 |
| SeedVideo AI 公开 API 文档 | Documented / 文档记录 | Seedance 2.5 参考生成支持最多 30 张图片、10 个视频、10 段音频;输出为 4 至 30 秒,480p 或 720p。 | 2026-08-06 |
| Dreamina Seedance 2.5 页面 | Documented / 文档记录 | Dreamina 介绍了多模态 R2V,以及动作、绿幕和白模参考;其产品页在自身入口中标注最多 50 份参考和 30 秒生成。 | 2026-08-06 |
| SeedVideo AI 多参考 R2V 完整成片 | Not tested / 未测试 | 本文不对多模态成片的身份准确度、动作还原度、音频遵循度或成功率作实测结论。 | 2026-08-06 |
网页和 API 的数字不同,是因为它们描述的是不同入口。实际操作时,以当前界面为准。API 文档还列出格式要求:图片为 JPEG、PNG 或 WebP,视频为 MP4 或 MOV,音频为 MP3 或 WAV。准备较大素材包前,先查看最新的 SeedVideo AI 模型文档。
Reference Role Map:参考素材角色表
每份素材都应该回答一个问题。说不清它控制什么,就先不要放进第一版。
| 角色 | 参考素材需要表达什么 | 合适素材 | 常见冲突 |
|---|---|---|---|
| Identity / 身份 | 谁或什么必须保持可识别 | 干净的角色设定图或产品图 | 两张图里的脸、服装或产品版本不同 |
| Product / 产品 | 形状、标签位置、材质和颜色 | 中性光线下的正面、侧面或细节图 | 风格图改变比例或挡住关键结构 |
| Environment / 环境 | 布局、尺度、光线方向和背景 | 广角场景图或简单置景概念图 | 透视、光线与主体参考不一致 |
| Motion / 动作 | 身体动作、物体路径或物理节拍 | 简短、清楚的动作视频 | 动作需要的姿态或道具在身份图里不存在 |
| Camera / 运镜 | 构图、镜头感、路径和速度 | 预演视频或简单运镜动画 | 运镜与走位冲突,或拍到未设计的空间 |
| Style / 风格 | 色彩、质感、对比度和渲染方式 | 一组统一的情绪板或效果帧 | 多张风格图指向完全不同的视觉语言 |
| Audio / 音频 | 音乐、台词、环境声或音效提示 | 节奏清楚的干净音轨 | 音频节拍与动作时长不匹配 |
| Timing / 节奏 | 事件顺序与持续时间 | 节拍表、分镜或带时间点的提示词 | 选定时长里塞入太多事件 |

把身份、产品、环境、动作、运镜、风格、音频与节奏拆开后,冲突会更容易定位。
组建小而不冲突的参考素材包
从镜头需求开始,不要从上传上限开始。先用一句话写清镜头,再找出哪些细节只靠文字很难稳定表达,这些细节才需要参考素材。
按这个顺序准备:
- 选择锚点。产品广告通常以产品图为锚点;表演镜头则可能以角色身份或动作视频为锚点。
- 为最难的次要要求增加一份参考,通常是动作、运镜或环境。
- 只有当节拍、台词、环境声或音效会影响画面时,才加入音频。
- 界面支持时,在提示词中使用
@image1、@video1、@audio1等明确标签分配职责。 - 从每份素材的角度重读一次提示词。两份素材如果在争夺同一个属性,就删除一份,或写清谁优先。
很多镜头第一次用 2 至 4 份素材就够了。文档上限是容量,不是目标。
SeedVideo AI 的 R2V 操作步骤
下面的步骤对应 2026 年 8 月 6 日可见的 SeedVideo AI 网页界面。
- 打开 SeedVideo AI,进入视频生成器。
- 选择「视频转视频」,再从模型菜单选择「Seedance 2.5」。
- 加入身份、产品、风格或环境所需的最少参考图。实测网页控件最多允许 9 张。
- 如果动作或运镜需要视觉来源,再加一个参考视频。实测控件接受 2 至 15 秒的 MP4/MOV。
- 在提示词里写清每份输入的职责,并说明主体、动作、空间、运镜、节奏,以及素材重叠时谁优先。
- 按发布渠道选择当前界面提供的比例、时长、画质和音频输出设置。
- 生成草稿后,对照角色表逐项验收,不要只看画面是否「好看」。
- 每次只改一个变量。先删除冲突素材、缩短动作或明确一项职责,再考虑继续加素材。
第一次使用模型,可以先看 Seedance 2.5 上手指南。如果一张图已经够用,Seedance 2.5 图生视频指南 会更简单。旧的 Seedance 2.0 视频参考指南 讲的是另一条产品路径。
三套完整参考素材包

每套素材只保留锚点、最难的次要要求和必要节奏信息。
产品广告素材包
| 素材 | 角色 | 提示词要写什么 |
|---|---|---|
@image1:干净产品图 |
产品锚点 | 保留瓶身轮廓、瓶盖位置、材质和标签位置 |
@image2:黄昏石质台面 |
环境 | 使用台面、背景纵深和侧光方向 |
@video1:慢速桌面环绕 |
运镜与节奏 | 跟随环绕速度,最后停在正面标签 |
@audio1:可选的六秒节拍 |
音频节奏 | 在最后一个节拍完成产品转正 |
提示词范式:「用 @image1 控制产品形状和标签位置,把产品放进 @image2 的台面环境。参考 @video1 的慢速环绕和最后正面停住。产品结构优先级高于动作视频里出现的任何物体形状。」
角色动作素材包
| 素材 | 角色 | 提示词要写什么 |
|---|---|---|
@image1:角色正面与四分之三侧面设定图 |
身份 | 保留脸、发型、服装和身体比例 |
@video1:干净动作视频 |
动作 | 参考起跳、转身、落地和大致速度 |
@image2:场景图 |
环境 | 把动作放到图中的屋顶,不复制视频里的其他人物 |
动作视频越干净越容易读。绿幕或简单背景可以减少干扰,但仍要检查手部、接触点、服装和面部一致性。
白模预演转成片素材包
| 素材 | 角色 | 提示词要写什么 |
|---|---|---|
@video1:白模或灰盒预演 |
走位、运镜与节奏 | 保留镜头顺序、相机路径和主要位置 |
@image1:最终场景概念图 |
环境与风格 | 用目标建筑、材质和光线替换灰模场景 |
@image2:角色或产品参考 |
身份 | 用审核通过的主体替换占位几何体 |
白模是空间计划,不是成片风格参考。提示词要明确这一点,否则输出可能把只用于控制走位的灰色材质和占位形状也继承下来。
音频与节奏参考
音频可能负责三件不同的事:听到什么、事件何时发生、剪辑呈现什么节奏。提示词要说清哪一项最重要。「使用这段音频」太模糊;「第一个节拍开始推镜,第四个节拍揭示产品」才给了音频明确职责。
条件允许时,把台词、音乐和音效分开。混合音轨会让模型更难判断该跟随哪个提示。如果当前界面没有音频参考上传控件,就在提示词中描述节拍结构,或使用文档记录的 API 能力,不要假设网页一定提供同样的入口。
识别并处理冲突参考
冲突通常表现为漂移、折中或不稳定。主体可能混合两张身份图的特征;运镜视频可能要求场景图里不存在的空间;过快的音频节拍也可能压缩本来需要更多时间的动作。
按这个顺序修复:
- 指出失败属性:身份、结构、动作、空间、运镜、风格、音频或节奏。
- 找出所有试图控制这一属性的参考。
- 保留最清楚的一份,删除其余素材。
- 用一句话写明优先级。
- 再次生成,暂时不要改其他变量。
更长的提示词解决不了相互矛盾的证据。明确职责才有用。
验收清单
| 检查项 | 通过标准 |
|---|---|
| 身份 | 脸、服装、产品形状、标签位置和显著特征保持可识别 |
| 动作 | 动作顺序、接触、重量感和物体路径合理 |
| 空间 | 主体处在目标位置,没有无原因的布局变化 |
| 运镜 | 构图与移动符合需求,没有意外跳切 |
| 音频 | 台词、音乐、音效和画面节拍符合指定职责 |
| 授权 | 所有图片、视频、声音、肖像、Logo 和音乐都已获得使用许可 |
常见问题
Seedance 2.5 中的 R2V 是什么意思?
R2V 是 Reference to Video,即参考生视频。模型生成新视频,同时用提供的素材控制身份、动作、运镜、风格或节奏等指定属性。
白模和风格参考是一回事吗?
不是。白模或灰盒预演主要表达布局、走位、相机路径和节奏。成片材质、光线与色彩需要单独的效果图。
绿幕能提升动作参考效果吗?
简单背景能让人物轮廓和动作更容易辨认,但不会保证手部、接触点、服装、身份或物理效果一定正确。
R2V 能完全复制动作吗?
应把它当作动作指导,不是动作捕捉。验收时要检查顺序、节奏、姿态、接触点和物体路径。需要精确复现时,应使用传统动捕或合成工具。
可以把音频作为参考吗?
SeedVideo AI 的 API 文档列出了 Seedance 2.5 音频参考。实测的网页「视频转视频」界面没有显示音频参考上传控件,因此应先确认当前入口,再决定工作流。
应该使用多少份参考?
以覆盖需求的最少数量为准。很多镜头第一次用 2 至 4 份即可。只有新素材具备现有素材没有的明确职责时,才继续增加。
参考素材冲突时怎么办?
先确认失败的是哪个属性,删除控制同一属性的重复来源,再明确剩余素材的优先级。先测试精简后的素材包,不要一次改完所有内容。
R2V 能保证角色一致性吗?
不能。清楚的身份参考和不冲突的素材包能提高可控性,但每个镜头仍要检查脸、发型、服装、比例和前后连续性。
使用参考素材需要哪些授权?
只使用自己拥有或已获许可的素材。人物、声音、音乐、视频、产品、商标和场地都可能涉及权利限制。生成结果不会自动消除源素材的授权要求。
来源与方法
平台能力与限制核验于 2026 年 8 月 6 日。主要来源包括 SeedVideo AI 模型文档、Dreamina 的 Seedance 2.5 R2V 说明、动作参考指南 和 Seedance 2.5 产品页。产品上限可能变化,实际操作请以当前界面和账号文档为准。
开始制作第一套 R2V 素材包
打开 SeedVideo AI 的 Seedance 2.5,先选一份锚点参考,再为最难的次要要求增加一份素材,并让每份素材只负责一个角色。素材包越小,第一次结果越容易诊断,第二次也越容易改准。



