要点速览
- Seedance 2.5 没有独立的时间戳参数。时间点是写在提示词正文里的,形式就是
[0s]、[2s]、[4s]这样的方括号节拍,模型把它们当作顺序和节奏语言来读。 - 所以它是分镜指令,不是剪辑时间线。某个节拍可能提前或推后零点几秒,没有任何机制强制卡点。
- 一个节拍只放一个动作。多写一个动词,模型通常只会挑它理解得最透的那个执行。
- 按每个可见动作两到三秒的屏幕时间来分配预算:5 秒片段两三个节拍,10 秒四五个,满 30 秒六个左右。
- 人物特征、镜头规格、色调和排除项要放在节拍之外,写成一段统管全片的全局描述。
快速答案
Seedance 2.5 的时间戳提示词,就是在普通文字提示词里写进时间标记,让一次生成读起来像一小段有节拍的镜头,而不是一整团分不出层次的运动。做法是打开生成器,停在 Text to Video,先把时长设成你真正要的秒数,再把镜头写成 [0s] 第一个动作、[3s] 第二个动作、[6s] 收尾,每个节拍只交代一个主体动作、一句镜头指令和一句光线提示。所有必须保持不变的东西,比如人物长相、模拟的镜头焦段、色调、不想要的元素,全部写在节拍上方或下方的全局段落里。模型对顺序的执行相当可靠,对具体秒数则是近似执行,这个精度足够控制节奏,但远达不到逐帧剪辑。图生视频同样适用,只是 [0s] 应该描述第一个动作,而不是重复描述你上传的那张图。

视频提示词:夜市小吃摊,晚上九点。穿藏青围裙的师傅用长筷把一团冒着热气的碱水面从铜锅里高高提起。[0s] 筷子伸进锅里,蒸汽贴着水面低而平。[2s] 他稳稳向上提,面条被拉长,蒸汽穿过灯笼光向上翻涌。[4s] 提到最高处停住,低头看向碗。35mm 变形宽银幕镜头缓慢推进,f/2.0,头顶灯笼打出暖琥珀主光,街道方向溢进冷蓝补光,浅景深,人群与霓虹虚化成光斑,胶片颗粒。
Seedance 2.5 到底怎么处理时间戳
这一点值得说清楚,因为"时间戳提示词"这个说法听起来像是某个带开关的功能。它不是。
打开创作面板,你拿到的控件只有三个模式标签、一个提示词输入框,以及下面那排比例、时长、清晰度和声音。这排控件里没有任何一项接收时间码。没有关键帧面板,没有节拍编辑器,也没有哪个输入框会把 [0s] 解析成参数。你打出 [0s] 的时候,它是和其他描述一起作为同一串文本送进模型的。
那模型拿它做什么?它把这些标记当成排序语言来读,性质接近"然后""接着""最后",只是额外附带了节奏信息。它从你的标记里大致学到每个动作该占多少片长。实际效果里有三件事是稳的:事件的先后顺序、每个事件大致占多少比例,以及把原本会糊在一起的动作干净地分开。
它不提供的是承诺。你写 [4s],动作可能从 3.6 秒开始,也可能 4.4 秒。如果时长只有 5 秒,你却要求五个不同事件,模型会压缩或者干脆丢掉其中几个。把这些标记当剪辑时间线看,是大多数人对这套方法失望的根源;把它当导演的节拍表看,才是出片的地方。
这个区分也决定了它在制作流程里的位置。节拍塑造的是一个连续镜头内部发生了什么。镜头之间的切换、卡到精确帧、混音,仍然属于后面剪辑软件的活。想控制一个镜头里的运动,就从文生视频生成器开始写节拍;想拼一整条片子,就把每个带节拍的镜头分开生成,再去后期接起来。
真正能经受住生成的写法
官方没有给出必须遵守的语法,这既让人自由,也稍微有点危险。下面这些是实测站得住的约定。
用方括号包整秒。 [0s]、[3s]、[6s]。方括号在视觉上把节拍标记和描述文字分开,整秒则避免你去要求一个模型给不了的精度。区间写法比如 0–3s、3–6s 也可以,对那种你更在意持续跨度而不是触发时刻的慢速连续运动,读起来还更顺。
从零开始。 [0s] 是片子开场时的状态。跳过它直接从 [1s] 写,第一秒就是未定义的,模型会拿一段很泛的画面把它填上。
一个节拍只放一个动作。 这是最要紧的一条。"[3s] 她转向镜头并举起杯子,同时雨停了"是三件事共用一个标记,你最后只会拿到其中一件。要么拆开,要么把片长拉长。
每个节拍按主体、动作、镜头、光线的顺序写。 不是每个节拍都得四样齐全,但这个顺序能防止模型把镜头运动挂到错误的主体上。比如"[3s] 师傅把面条提离锅面,镜头缓慢推进,蒸汽接住灯笼主光"。
不变量写在节拍之外。 凡是整条片子都成立的东西,人物长相、镜头焦段、画幅感觉、色调、你不想要的元素,统一放进节拍前面或后面的一段里。在每个节拍里重复描述人物,是脸部走形最常见的单一原因,因为每重复一次就等于邀请模型重新理解一次。
这些节拍所依附的更完整的提示词语法,可以看 Seedance 2.5 提示词指南,里面关于主体段落、风格锚点和否定式写法讲得比这里细。
一个片段装得下几个节拍
| 片长 | 站得住的节拍数 | 好用的标记组合 | 超过之后的失败形态 |
|---|---|---|---|
| 4–5 秒 | 2–3 | [0s] [2s] [4s] |
动作糊成一团运动 |
| 6–8 秒 | 3–4 | [0s] [2s] [4s] [6s] |
最后一个节拍被截断 |
| 9–12 秒 | 4–5 | [0s] [3s] [6s] [9s] |
节奏漂移,中段赶时间 |
| 15–20 秒 | 5–6 | [0s] [4s] [8s] [12s] [16s] |
主体特征开始跑偏 |
| 21–30 秒 | 6–7 | [0s] [5s] [10s] [15s] [20s] [25s] |
场景连贯性撑不到结尾 |
这张表背后的算术很简单:一个能被看清、看懂的动作大约需要两到三秒屏幕时间。低于两秒,观众只感知到有东西在动,但不知道发生了什么。所以真正的约束不是提示词能装多少标记,而是在你买下的这段片长里,观众能吸收多少件不同的事。
写节拍之前要先设好的东西

创作面板:三个模式标签在提示词输入框上方,下面那排是比例、时长、清晰度和声音。时间点是打进提示词输入框本身的。
有三项设置决定了你的节拍有没有喘气的空间。
| 控件 | 可选值 | 对节拍的影响 |
|---|---|---|
| 时长 | 4 到 30 秒,默认 5 秒 | 硬预算。节拍是这个数字的切分,所以要先设它再动笔 |
| 画面比例 | 16:9、9:16、1:1、4:3、3:4、21:9、自适应 | 上传首帧图后锁定为自适应 |
| 清晰度 | 480p、720p、1080p,默认 720p | 短节拍里的细节在更高清晰度下更容易保住 |
| 声音 | 开或关,与画面同步生成 | 默认开启,值得刻意安排时间点 |
| 提示词长度 | 最长 10000 字符 | 足够长,完全不需要为省字数而缩写节拍 |
这个先后顺序比看上去重要。写好六个节拍才发现时长还停在默认的 5 秒,出来的片子就是所有事挤在一起发生,而这正是最多人得出"Seedance 2.5 的时间戳没用"这个结论的路径。
五套可以直接抄的时间戳模板
每套都是按特定时长写的。主体可以随便换,但节拍数要跟片长对上。
1. 美食与产品主镜头:5 秒,3 个节拍
夜市小吃摊,晚上九点,单镜头一镜到底。
[0s] 长筷伸进铜锅,蒸汽贴着汤面低而平。
[2s] 师傅稳稳把碱水面向上提起,蒸汽翻涌进灯笼光里。
[4s] 提到最高处停住,低头看向等着的碗。
镜头:缓慢推进,35mm 变形宽银幕,f/2.0,浅景深。
光线:头顶纸灯笼的暖琥珀主光,街道方向溢进的冷蓝补光。
风格:胶片颗粒,青橙色调,人群虚化成光斑。
排除:切镜、文字叠加、镜头突然跳动。
好用的原因:五秒里放三个节拍,每个动作能分到 1.5 到 2 秒,而整条片子其实是一个完整的肢体动作,被拆成了起、中、停三段。
2. 产品广告推镜:8 秒,3 个节拍

视频提示词:晨光里一只放在浅色橡木台面上的哑光陶瓷咖啡杯。[0s] 台面全景,蒸汽是一条笔直上升的细线,百叶窗投下的条纹阴影静静横在木面上。[3s] 镜头缓慢向杯子推进,那条蒸汽开始盘绕并向左飘移。[6s] 镜头停在杯子的近景四分之三角度,杯口一道柔和高光,蒸汽变稀。偏微距视角,浅景深,暖中性色调,干净的高端广告布光,画面内不出现手。
浅色橡木台面上的哑光陶瓷咖啡杯,清晨,单镜头一镜到底。
[0s] 台面全景,一条笔直上升的细蒸汽,百叶窗条纹阴影静静横在木面上。
[3s] 镜头缓慢推进,蒸汽开始盘绕并向左飘移。
[6s] 镜头停在近景四分之三角度,一道柔和高光沿杯口游走。
镜头:单一连续推进,等效 50mm,f/2.8。
光线:百叶窗透进的硬质直射阳光,暖中性色调,不加偏色。
排除:手入画、切镜、文字、品牌标识。
好用的原因:镜头运动只在全局说了一次,每个节拍只交代此刻运动进行到哪里。这比给每个节拍各配一个镜头动词稳定得多,后者会被读成三段互不相干的运动。
3. 人物回头看镜头:10 秒,4 个节拍

视频提示词:一名穿猩红色雨衣的女子背对镜头走在雨夜的湿滑街道上。[0s] 她稳步远离镜头,霓虹在她前方的湿沥青上荡开倒影。[3s] 她放慢脚步,肩膀松下来,雨仍在逆光里落着。[6s] 她把头转回来看向镜头,湿发接住轮廓光。[8s] 她保持这个眼神,平静而直接,雨继续下。长焦压缩,浅景深,青与品红霓虹,情绪化电影色调,全片是同一个人。
雨夜湿滑街道上穿猩红色雨衣的女子,单镜头一镜到底。
人物(全片不变):二十五岁上下,深色头发被雨打湿松散垂着,猩红色连帽雨衣,神情平静。
[0s] 她稳步背向镜头走远,霓虹在她前方的湿沥青上荡开倒影。
[3s] 她放慢脚步,肩膀松下来,雨仍在逆光里落着。
[6s] 她把头转回来看向镜头,头发接住轮廓光。
[8s] 她保持这个眼神,平静而直接,雨继续下。
镜头:固定长焦,轻微压缩感,浅景深。
光线:青与品红的霓虹招牌,身后打来的湿润轮廓光。
排除:雨衣变色、切镜、前景多出路人。
好用的原因:人物描述只在最上面出现一次,后面没有任何节拍重新描述她。就是这一个决定,让她的脸在十秒里保持稳定。如果想把身份锁得更死,可以改成从一张真人静态图出发,用图生视频生成器让它动起来,上传的那一帧会锚定长相,[0s] 只需要交代第一个动作。
4. 室内空间揭示:12 秒,4 个节拍
午后阳光下的现代客厅,一个连续的镜头运动。
[0s] 从靠窗的亚麻扶手椅特写起幅,光柱里能看见浮尘。
[3s] 镜头开始向右缓慢横移,露出低矮的橡木茶几。
[6s] 横移继续掠过一个开放式书架,暖光洒在地板上。
[9s] 镜头停在远处的窗前,玻璃外的城市天际线柔和虚化。
镜头:一次不间断的向右横移,24mm,f/4,视平高度,不切镜。
光线:傍晚前的日光,浅色墙面的暖反射,不加人工补光。
排除:画面里出现人、镜头抖动、急推急拉。
好用的原因:每个节拍点的是一个新物件进入画面,而不是一个新动作,这正是"揭示"这件事的本质。想把镜头语言再往前推一步,AI 视频运镜提示词指南拆解了哪些运动扛得住、哪些容易垮成漂移。
5. 三幕式叙事:30 秒,6 个节拍
日出时分独自穿越高山山脊的徒步者,一段连续影像。
人物(全片不变):穿焦橙色冲锋衣、背灰色背包的徒步者,脸大部分背向镜头。
[0s] 在灰白的黎明前天空下形成剪影,沿着山脊线缓慢行走。
[5s] 第一缕阳光打上山脊,冲锋衣的颜色在山谷蓝色阴影里被点燃。
[10s] 徒步者停下,呼出的白气可见,望向下方山谷。
[15s] 镜头缓缓拉开,露出身后整条山脉的体量。
[20s] 徒步者继续走,在画面里变得更小。
[25s] 画面保持不动,他翻上脊线,太阳完全越过山峰。
镜头:从中景缓慢连续拉到全景,35mm,f/5.6,不切镜。
光线:日出,全片由冷蓝过渡到暖金。
声音:风声、碎石上的脚步声,无配乐。
排除:对白、文字叠加、多余的徒步者。
好用的原因:三十秒足够撑起一条真正的弧线,但前提是每个节拍分到五秒,而且变化是渐进的。注意这里没有任何一个节拍要求换场景,场景始终不变,变的只有光线、景别和位置。关于最长片长能做到什么、做不到什么,Seedance 2.5 三十秒视频指南是这篇的姊妹篇。
让动作、镜头、光线和声音一起对拍
大多数节拍表失败不是因为某个节拍写错了,而是因为四个层次在争同一秒。按层次先决定:这一层是随节拍变化,还是在底下连续运行。
| 层次 | 最好的写法 | 原因 |
|---|---|---|
| 主体动作 | 逐节拍,每个一个动词 | 标记存在的意义就是它 |
| 镜头 | 全局写一个运动,节拍只交代此刻的位置 | 多个镜头动词会被读成多个镜头 |
| 光线 | 全局,除非光本身就是事件 | 每个节拍都换光,看起来像闪烁 |
| 声音 | 一两个音效,挂在有物理接触的节拍上 | 声音与画面同步生成,需要锚点 |
| 风格与色调 | 全局,只写一次 | 逐节拍重申等于邀请模型重新理解 |
实用规则:每个节拍只允许一层发生变化。主体在 [3s] 动,就让镜头继续做它本来在做的事;镜头在 [6s] 到位,就让主体保持不动。同一个标记上同时发生两种变化,是让两者都落不了地的最快方式。
声音值得单独提一句,因为它是同步生成的,不是事后加上去的。把"靴子踩上碎石"这类音效挂在真正发生物理接触的节拍上,音频就有了实在的锚点。二十秒的片子完全不写声音,通常会得到一段跟画面动作毫无关系的环境音。
当一个镜头确实装不下整个想法时,就该拆成几次生成了,Seedance 2.5 多镜头叙事讲的正是怎么在分开的片段之间保住连贯性,而不是硬塞进同一个镜头。
节拍跑偏时怎么排查
| 症状 | 多半的原因 | 处理 |
|---|---|---|
| 某个节拍被整个跳过 | 两个动作共用一个标记 | 拆成两个标记,或删掉较弱的那个动作 |
| 所有事都挤在前两秒 | 节拍数超出片长预算 | 加长时长,或减到三个节拍 |
| 人物脸或衣服中途变了 | 人物在多个节拍里被重复描述 | 把描述收回到唯一的全局段落 |
| 最后一个节拍显得仓促或被切断 | 最后的标记离结尾太近 | 把最后一个标记提前到距结尾至少三秒 |
| 镜头是跳的而不是移动的 | 每个节拍各带了一个镜头动词 | 全局写一个连续运动,节拍只写位置 |
| 动作明显提前或滞后 | 标记本身的正常误差 | 拉开标记间距,不要去追精确秒数 |
| 节拍都对了但片子很机械 | 节拍之间没有衔接运动 | 在节拍之间加"逐渐""继续""不停顿" |
最常绊住人的是最后一个节拍的问题。10 秒片子里把标记放在 [9s],最后那个动作只有一秒可用,而一秒低于几乎所有动作的可辨识下限。把它提到 [7s],结尾就收得住了。
按下生成前的 30 秒自检
拿这六个问题对一遍自己的提示词,大概花半分钟,多数时候能省掉一次重生成。
- 时长和节拍数对得上吗? 每五秒片长两到三个节拍,不要更多。
- 每个节拍是不是只有一个动作动词? 搜一下"并""同时",它们通常标出了需要拆分的节拍。
- 人物或产品是不是只描述了一次? 凡是出现第二次的地方,删掉一处。
- 镜头是一个运动还是好几个? 如果是好几个,改写成一个运动加上逐节拍的位置。
- 最后一个标记距结尾至少三秒吗? 不够就往前提。
- 有哪个节拍值得挂一个声音? 在发生物理接触的地方加一句音效。
如果试了两次还是不对,最快的诊断办法是把节拍数砍一半再生成。三个节拍能成、五个就崩,说明这是预算问题,不是措辞问题。
常见问题
Seedance 2.5 有专门的时间戳参数吗?
没有。生成器提供的是画面比例、时长、清晰度和声音,没有任何一项接收时间码。[0s] 这类标记是写在提示词正文里的,模型把它们当作顺序和节奏语言来读。
时间点有多准?
准到足以控制节奏,但不足以拿来对剪辑。节拍的先后顺序执行得相当可靠;某个动作具体从第几秒开始,可能会有零点几秒的前后偏移。要按容差来规划,不要按精确来规划。
5 秒片段能装几个节拍?
两到三个。一个能看清的动作大约要两秒屏幕时间,所以三个节拍已经很紧。五秒塞四个节拍,通常得到的是一团模糊运动,而不是三个分明的动作。
时间戳提示词在图生视频里管用吗?
管用,但要改一处。上传的图已经把画面定下来了,所以 [0s] 应该描述第一个动作,而不是重述画面里已有的东西。另外上传首帧图之后,画面比例会锁定为自适应。
该用方括号还是区间?
[3s] 这类方括号适合在某一刻触发的离散动作;3–6s 这类区间适合跨度比触发时刻更重要的连续运动。同一条提示词里混用也没问题,只要顺序不乱。
如果需要的节拍数超过了片长允许的范围怎么办?
把想法拆成几次生成,再到剪辑软件里接起来。一条 30 秒片子塞十二个节拍一定会失败;三条 10 秒片子各四个节拍则不会。
现在就去写节拍
时间戳提示词大概是 AI 视频里最便宜的一次升级,因为它的成本只是把你本来就要打的那段文字重写一遍。挑一套上面的模板,先设时长,一个节拍一个动作,把所有不变的东西收进一个段落。
准备好动手时,打开视频生成器写一条带时间点的提示词,把时长调到跟节拍数匹配,然后生成。SeedVideo AI 把 Seedance 2.5 和其他模型放在同一个工作台里,你可以拿同一份节拍表在不同模型上都跑一遍,留下卡拍最稳的那个版本。



