如何在 CapCut 中使用 Seedance 2.0 视频参考功能
目前,Seedance 2.0 的视频参考入口可以在 CapCut 旗下的 Dreamina 网页端找到。我们在
2026 年 7 月 23 日检查公开界面时,看到的实际路径是
AI Video → Dreamina Seedance 2.0 → Omni reference。上传一段短视频后,
要在提示词里写清楚希望模型参考什么,例如动作顺序、运镜路径、节奏或视觉风格。
不要让同一段素材同时负责人物、场景、动作、镜头和风格,否则生成结果偏了以后很难判断
问题出在哪里。参考视频只会参与引导,并不会逐帧复制动作,也不能自动保证人物身份始终
一致。更稳妥的做法是先用一个主体、一段动作和一个明确的验收点做测试,再根据输出结果
调整参考素材或文字指令。下文会把 ByteDance 公布的模型能力与当前
CapCut/Dreamina 界面中实际可见的限制分开说明。

参考视频只负责动作、运镜、节奏或风格中的一项,提示词负责定义新画面中要保留和改变的内容。
要点速览
- 打开 CapCut 旗下 Dreamina,选择
AI Video、Dreamina Seedance 2.0和
Omni reference。 - 参考视频尽量只保留一个清晰主体和一段可读动作或运镜,并确认你拥有使用权。
- 在提示词中给参考视频分配一个职责:动作、运镜、节奏或风格。
- 用可观察的细节判断参考是否生效,不要只凭“看起来有点像”。
- ByteDance 公布的模型上限不等于当前消费端界面上限,实际提交前要以自己账号里的控件为准。
快速答案
先用下面这个提示词结构:
视频 1 只负责人物的行走节奏和手臂摆动。人物身份、服装、地点、光线和镜头构图以
下方文字为准。不要复制参考视频中的人脸和背景。生成一个中远景:快递员在傍晚的雨中
穿过车站站台,镜头以步行速度从侧面跟拍。
这段写法把参考素材和文字指令的职责分开了。如果只写“参考这个视频”,模型无法判断你
想借用的是动作、运镜、剪辑节奏、人物还是整体画面。
Seedance 2.0 视频参考究竟参考什么
ByteDance Seed 的 Seedance 2.0 页面
说明,该模型可以接收文字、图片、音频和视频输入。
官方发布公告
进一步写明,这些输入可以为构图、动作、运镜、视觉效果和音频提供参考。
一段参考视频通常可以承担四类工作:
- 动作参考:动作的先后顺序、方向和速度。
- 运镜参考:推进、环绕、摇移、跟拍或手持感。
- 节奏参考:动作何时开始、停顿、加速或切换。
- 风格参考:色彩、光线、质感或剪辑处理。
每种用途都需要不同的指令。video-to-video 通常指对现有视频进行转换或编辑;
motion reference 主要借用动作;style reference 主要借用视觉处理;
First and last frames 和 Multiframes 则是本次检查中看到的另外两种模式。普通
输入视频也可能只是源素材,并不等于动作参考。应先看当前界面里的模式名称,再在提示词中
明确素材职责。
模型会重新理解输入。ByteDance 自己的评测也提到,细节稳定性、多主体一致性、文字渲染
和复杂编辑效果仍有改进空间。参考视频提供方向,无法替代逐帧动作捕捉。
模型能力与当前 CapCut 产品限制
模型规格回答“底层能力支持什么”,产品界面回答“当前账号现在能提交什么”。这两件事不能
混写。
| 项目 | ByteDance 模型说明 | 2026 年 7 月 23 日检查到的 Dreamina 公开界面 | 实际采用方式 |
|---|---|---|---|
| 输入类型 | 文字、图片、视频片段和音频片段 | 文件选择器列出了常见图片格式、MP4/MOV 和 MP3/WAV | 格式是否可选,以当前文件选择器为准 |
| 参考数量 | 最多 9 张图片、3 个视频片段、3 个音频片段 | 未登录上传,因此没有实测消费端数量上限 | 不承诺当前账号一定支持模型上限 |
| 参考模式 | 模型层支持多模态参考 | 界面可见 Omni reference、First and last frames、Multiframes |
按目标选择模式,不把三者都叫作视频参考 |
| 画幅 | 不是 CapCut 界面规格 | 可见 21:9、16:9、4:3、1:1、3:4、9:16 | 以当前账号显示为准 |
| 清晰度 | 不是 CapCut 界面规格 | 可见 720P、1080P、4K | 部分选项可能受账号或额度影响 |
| 时长 | 官方公告称模型支持 15 秒输出 | 本次可见控件范围是 4 至 15 秒 | 选择后仍要检查生成结果 |
| 登录与地区 | 模型页面没有列出地区范围 | 公开工具显示 Sign in,未看到官方地区清单 |
先登录,再确认所在地区和账号是否开放 |
Dreamina 的 Seedance 2.0 落地页
本身也存在冲突:功能介绍和 FAQ 写的是 9 图、3 视频、3 音频,但教程步骤又写“最多
9 个视频”。同一页面写的是 5 至 12 秒、720P 至 1080P,而本次实看界面显示的是
4 至 15 秒,并出现 4K 选项。落地页文案与实时控件不一致时,应以自己账号中可见的控件
为准,不要拿未经验证的最大值安排正式制作。
参考视频准备清单

素材越容易读懂,越容易判断模型到底参考了什么。上传前先去掉互相竞争的动作和镜头。
上传前逐项检查:
- 使用权:只使用自己拍摄、已经授权或明确许可的素材。ByteDance 提到,真人肖像参考
可能需要身份验证或事先获得合法授权。 - 单一动作:走路、转身、倒水、打开、举起等单一动作,比一连串无关动作更容易诊断。
- 单一主体:背景人物不参与目标动作时,尽量裁掉。
- 轮廓清晰:手、脚、道具和身体方向不要长期被前景遮挡。
- 时长紧凑:保留有效动作,并在前后留一点上下文,删除无意义的停顿。
- 镜头简单:想参考动作时,避免过强运镜;想参考运镜时,让主体动作尽量简单。
- 剪辑干净:除非你要参考的就是转场,否则应去掉字幕、贴纸、叠加层和快速切换。
- 音频明确:不需要声音时就静音。只有当节奏或声音属于目标时才保留,并确认当前账号接受该音频。
本次检查中,浏览器文件选择器列出了 JPG/JPEG、PNG、WebP、BMP、HEIC/HEIF、GIF、
TIFF、MP4、MOV、MP3 和 WAV。这只能证明当时选择器允许选择这些扩展名,不能证明
每一种编码、文件大小、帧率或组合都能成功上传。如果界面报错,应先按错误信息处理;
只有错误指向格式时,才尝试导出一段较短、采用常见 H.264 视频轨的 MP4。
在 CapCut 和 Dreamina 中逐步操作
1. 找到当前入口
CapCut 的
官方通用教程
给出的路径是 CapCut Desktop or Browser → Video studio → Create new。
2026 年 7 月 23 日实看时,更明确的网页入口是
Dreamina 的 Seedance 2.0 工作区。
准备生成前需要登录。菜单名称可能随地区、账号、客户端版本或灰度范围变化。如果界面里
没有 Seedance 2.0,不要照着旧截图猜隐藏按钮,应重新查看模型菜单和当前账号的官方开放
情况。
2. 选择模型和参考模式
先选择 AI Video,再选择 Dreamina Seedance 2.0。本次检查中,下一级菜单出现了:
Omni reference:用于混合参考素材和提示词驱动的生成。First and last frames:用于首尾画面控制。Multiframes:用于多个图像节点。
如果只有一个参考视频,并希望它引导动作、运镜、节奏或风格,可以先从
Omni reference 开始。
3. 在 Reference 中添加视频
通过 Reference 控件选择视频。本指南没有完成登录后的上传,因此不把上传数量、文件
大小、消耗额度或上传后的标签写成已验证事实。素材上传后如果出现角色选择或引用名称,
提示词应使用界面给出的准确名称。
4. 给参考视频一个明确职责
可以套用下面的结构:
视频 1 负责:[动作、运镜路径、节奏或视觉处理]。
以提示词为准:[主体、身份、服装、场景、光线]。
不要参考视频 1 中的:[人脸、背景、文字、音频或多余动作]。
生成:[包含明确动作、构图、时长和结束状态的新镜头]。
不要写“完全复制这个视频”。这种要求既不明确,也容易和新场景产生冲突,还可能带来
版权或身份问题。应直接描述想看到的可观察结果。
5. 设置画幅、清晰度和时长
本次可见画幅从 21:9 到 9:16,清晰度从 720P 到 4K,时长范围是 4 至 15 秒。
这些选项可能发生变化,也不保证每个账号都一样。
时长要跟着动作走,不要机械套用。一次转身和亮相可能只需 5 秒;走路、停顿和交接道具
可能需要 10 秒。要给动作留出完成空间。
6. 生成并复核
先生成一个版本,再用书面清单逐项比较。本指南没有进行付费生成,因此不会给出生成速度、
费用、成功率或“参考强度”控制等未经实测的数据。每次只改一个变量:素材、参考职责、
文字指令或时长。
参考素材与提示词如何分工

先分清参考素材负责什么、文字负责什么,失败以后才有明确的修改方向。
| 希望参考控制的内容 | 参考视频中应包含什么 | 提示词中应写什么 | 不能默认得到什么 |
|---|---|---|---|
| 动作 | 一段关节和道具都清楚的动作 | 新主体、场景、方向和结束状态 | 每一帧姿势都相同 |
| 运镜 | 清晰的推进、环绕、摇移或跟拍 | 主体动作、构图、速度和最终画面 | 自动复制背景 |
| 风格 | 稳定的光线、质感、色彩或效果 | 内容、主体身份和排除项 | Logo 或文字保持准确 |
| 节奏 | 明确的开始、停顿、节拍和结束 | 每个节拍对应什么事件 | 音画一定完全同步 |
一个更清楚的提示词会直接划分归属:
视频 1 负责缓慢顺时针环绕运镜,并在后侧四分之三角度停留两秒。产品、房间、光线和
最终构图以文字为准。不要复制参考背景、品牌标记、人物和音频。结尾回到正面居中画面,
产品标签保持可读。
如果结果跟了运镜却丢了主体,应加强主体限制;如果主体保住了但运镜没跟上,可以简化
主体动作,或换一段镜头路径更干净的参考视频。
动作、运镜、风格与节奏示例
下面是提示词设计示例,不是生成效果实测。
| 场景 | 参考素材 | 提示词目标 | 观察点 |
|---|---|---|---|
| 行走节奏 | 一个人走四步、停顿、再转身 | 只把步频和转身时机用到新地点中的快递员身上 | 脚步接触、手臂摆动、转身顺序、停顿是否保留 |
| 产品环绕 | 镜头缓慢绕无品牌物体一周 | 将环绕路径应用到新产品,固定棚拍环境 | 环绕方向、速度、距离、标签稳定性、结束角度 |
| 手部动作 | 近景拍摄双手折叠一次布料 | 用不同物体复现动作顺序,背景保持中性 | 手指数、抓握、接触、物体形变、动作顺序 |
| 光线风格 | 固定镜头中暖色窗光逐渐转入阴影 | 借用光线变化,主体动作和镜头以提示词为准 | 阴影方向、色温、曝光、皮肤或材质纹理 |
| 音乐节奏 | 一段拥有合法使用权、含三个清晰节拍的视频 | 让三个场景事件沿用相同节拍间隔 | 事件时机、切换点、音画漂移、最后事件是否完成 |
| 手持跟拍 | 一段克制的手持跟拍镜头 | 只把镜头动感用到新的行走主体 | 地平线漂移、主体构图、眩晕感、多余身体抖动 |
每次测试前先写一个通过条件。“镜头完成一次顺时针环绕并正面收尾”可以检查;
“更有电影感”不能。
常见失败与修复

每次只改一个输入,否则无法判断究竟是哪一项修改解决了问题。
| 现象 | 可能原因 | 建议修改 | 证据来源或是否实测 |
|---|---|---|---|
| 动作做到一半偏离 | 素材包含多个动作,或关节长期被遮挡 | 剪成单一动作,并写清结束状态 | 工作流建议,本指南未生成实测 |
| 人物身份漂移 | 动作视频中人脸和服装特征过强,与目标人物冲突 | 明确不复制参考人物;如果产品允许,可另用有授权的身份图片 | 模型支持多参考,身份结果未实测 |
| 运镜被忽略 | 主体动作太复杂,或镜头提示不够清楚 | 简化主体动作,换用更纯粹的运镜参考 | 官方确认模型可参考运镜,修复方法为诊断建议 |
| 运镜与人物动作打架 | 参考视频和提示词给了相反镜头方向 | 只让一个来源负责运镜 | 提示词结构建议 |
| 节奏太赶 | 要求的事件数量超过所选时长 | 删除一个事件,或增加时长 | 时长控件已核验,输出未实测 |
| 风格压过内容 | 参考视频包含强特效、文字或快速剪辑 | 换更平静的素材,并列出不应参考的元素 | 官方确认可参考风格和特效,修复未实测 |
| 手、脸或道具变形 | 多主体接触超出稳定细节能力 | 减少主体、简化接触、缩短动作 | ByteDance 承认细节和多主体仍有限制 |
| 上传被拒绝 | 编码、文件大小、账号规则或地区规则不符合 | 先按界面错误处理;只有错误指向格式时才尝试标准短 MP4 | 文件选择器格式已核验,大小和账号限制未核验 |
如何判断参考是否真正生效
先用正常速度播放,再在最难的动作附近逐帧检查。
动作
- 动作是否按正确顺序开始、推进和结束?
- 手脚接触是否合理?
- 道具的形状和位置是否稳定?
主体
- 目标人物或物体是否持续可辨认?
- 服装、颜色和比例是否稳定?
- 是否意外复制了参考素材中的人脸、背景或标记?
镜头
- 镜头方向是否正确?
- 距离和地平线是否可用?
- 结尾是否到达要求的构图?
节奏与音频
- 停顿和节拍是否出现在预期位置?
- 最后一个动作是否在视频结束前完成?
- 如果音频重要,是否出现错位或失真?
伪影与安全
- 检查手、牙齿、眼睛、文字、Logo、反射和物体穿插。
- 确认所有参考素材都拥有合法使用权。
- 不要绕过身份验证、地区限制或平台安全控制。
把这份清单和版本名称一起保存。下一版只改一个原因,再用同一个通过条件比较。
常见问题
CapCut 里的 Seedance 2.0 视频参考入口在哪里?
2026 年 7 月 23 日实看时,最明确的网页入口是 CapCut 旗下 Dreamina。依次选择
AI Video、Dreamina Seedance 2.0、Omni reference。CapCut 的通用资源页
还给出 Video studio → Create new 的路径。不同账号和灰度范围可能显示不同名称。
视频参考和 video-to-video 是一回事吗?
不是。视频参考可以只引导动作、运镜、节奏或风格,提示词仍会创建新镜头;
video-to-video 通常指对已有视频进行转换。最终要按当前界面里的模式说明判断。
最多能上传几个参考视频?
ByteDance 公布的模型层能力是最多 3 个视频片段,并可同时加入 9 张图片和 3 个音频片段。
本指南没有实测登录后的消费端数量上限,而且 Dreamina 落地页存在互相矛盾的文案,因此
应以自己账号显示的上限为准。
Dreamina 接受哪些视频格式?
本次文件选择器列出了 MP4 和 MOV,同时也列出多种图片格式与 MP3/WAV 音频。编码、
文件大小、帧率和账号限制没有实测。
参考视频能精确复制动作吗?
不能把它当成逐帧复制。Seedance 会结合提示词和其他参考重新理解素材。涉及快速运动、
遮挡、接触或多个主体时,更应设定一个可检查的通过条件。
可以使用真人视频吗?
只能使用自己拥有或已经获得许可的素材。ByteDance 表示,真人肖像参考可能需要身份验证
或事先获得合法授权。不要绕过这些控制。
应该把动作、运镜和风格放在同一个参考视频里吗?
只有当三者本来就配合良好,而且你确实想保留这个组合时才这样做。为了排错,一段素材只
负责一件事更清楚。
结果不对时先改什么?
改与故障直接相关的变量。动作偏移就剪短素材;运镜冲突就删掉一个来源的镜头指令;
节奏太赶就减少事件或增加时长。其他输入先保持不变。
来源与方法
本文将官方模型说明与 2026 年 7 月 23 日的公开产品界面检查分开记录。本次没有进行付费
生成或登录后的素材上传,因此不会把上传数量、文件大小、价格、额度消耗、生成耗时和
输出质量写成已实测事实。
- ByteDance Seed:Seedance 2.0,
访问日期:2026 年 7 月 23 日。 - ByteDance Seed:Seedance 2.0 Official Launch,
发布日期:2026 年 2 月 12 日;访问日期:2026 年 7 月 23 日。 - Dreamina by CapCut:Seedance 2.0,
访问日期:2026 年 7 月 23 日。 - Dreamina Seedance 2.0 工作区,
界面检查日期:2026 年 7 月 23 日。 - CapCut:How to Use Seedance 2.0 for AI Video Generation,
访问日期:2026 年 7 月 23 日。
准备好干净的参考素材和明确提示词后,可以在
SeedVideo AI 图生视频工具
中测试同样的动作优先工作流。需要补充基础设置时,先读
Seedance 2.0 指南,
再结合
Seedance 提示词指南和
AI 视频提示词示例
收紧文字指令。还在比较工具时,可以查看
2026 年最佳 AI 视频生成器。



