MiniMax H3 参考视频:案例、技巧与 Seedance 对比
当动作很难只靠文字说清时,MiniMax H3 参考视频最有价值。一段短片可以交代身体发力、物体运动、镜头速度、构图变化和节奏。参考视频负责说明动作怎样发生,提示词则要明确新主体、新场景、需要借鉴的部分,以及必须保持稳定的细节。素材越简单,控制越清楚。建议从一段只有一个完整动作、版权清晰的短片开始,再把主体、动作、镜头和环境分开写。SeedVideo AI 当前的 H3 工作流可生成 5 到 15 秒的 2K 视频,也支持文本与图像、视频、音频参考组合。下面重点讲参考视频的准备、提示词写法、问题排查和实际案例,并对比 MiniMax H3 与 Seedance 2.5 的适用场景。

视频提示词:真人电影感单镜头。身穿深红外套的虚构成年舞者,在被雨水打湿的剧院舞台上完成一次受控的旋转腾跃。镜头从低机位匀速横向跟拍。保持人物面部、外套、运动方向和舞台布局稳定。暖色钨丝侧光,冷蓝色逆光,布料运动自然,克制的 35mm 胶片颗粒,不切镜,不加文字。
要点速览
- 适合用参考视频控制动作、运镜、节奏和时间点,尤其是文字很难描述清楚的运动。
- 选择主体无遮挡、动作单一、镜头运动可命名的短素材。
- 在提示词里明确“只参考什么”,不要让一段视频同时负责人物、场景、动作和风格。
- 出现漂移时,先精简素材和冲突指令,每轮只改一个变量。
- MiniMax H3 更适合紧凑的 2K 视听短片;Seedance 2.5 更适合长镜头、大型参考素材包和局部编辑。
快速答案
可直接套用这套 MiniMax H3 参考视频结构:
在[新场景]中生成[新主体]。Video 1 只用于控制[身体动作或镜头路径]。保持[身份固定特征]。动作从[起始状态]开始,经过[关键节点],结束于[最终状态]。镜头:[单一运镜、速度和景别]。光线:[光源与方向]。声音:[对白、音效、环境声或音乐]。
“只用于”能缩小参考视频的职责。生成前可在 MiniMax H3 模型页 查看当前输入限制、时长、分辨率和积分报价。
参考视频能控制什么
参考片段是一条时间指令。它能表达静态图片无法表达的变化,比如舞者顺时针转身、瓶身旋转半圈、手持镜头从腰部升到视线高度,或者三秒后完成产品揭示。
| 控制项 | 素材能表达什么 | 提示词还要补什么 |
|---|---|---|
| 身体动作 | 姿态顺序、重心变化、速度和方向 | 新主体、服装、场景和必须保留的动作节点 |
| 物体运动 | 旋转、坠落、弹跳、开启或变化节奏 | 物体形状、材质、颜色和最终状态 |
| 镜头路径 | 跟拍、环绕、推进、拉远、摇镜或升降 | 景别、速度、跟随目标和起止构图 |
| 节奏 | 停顿、加速、减速和揭示时机 | 哪些节点必须保留,哪些可以省略 |
| 剪辑节拍 | 切镜顺序和大致节奏 | 新场景内容与每次切镜的目的 |
参考影响不是逐帧复刻。H3 会生成新的画面,也可能重新理解姿态、时间、空间和镜头距离。更实用的做法是让素材提供方向,再用固定清单检查结果。
动作借鉴与人物身份分开处理
动作片段能说明怎样跳跃,却不一定能定义由谁来跳。如果人物必须保持一致,请补充清晰的身份参考图,并写明它的职责。比如:Image 1 控制面部和服装;Video 1 控制跳跃节奏和横向跟拍;提示词控制地点、光线和落地姿势。
如果动作视频里有不同的演员、服装和背景,别只写“完全照着做,但换成我的人物”。应该列出可迁移的动作:助跑三步,右脚起跳,空中收腿,双脚落地,镜头由左向右跟随。
怎样选择合适的动作参考
好素材不一定精致,但一定容易看懂。白墙前用手机拍的一次完整动作,常常比包含快速切镜、烟雾、移动灯光和多名演员的音乐视频更容易控制。

视频提示词:写实运动电影单镜头。身穿深灰服装的虚构成年跑酷运动员助跑两步,从左向右越过一面低矮水泥墙。镜头在腰部高度横向跟拍,始终拍到完整身体。清晨硬光和长阴影,只有衣角带轻微运动模糊,极简粗野主义广场,一镜到底。
轮廓要清晰
手、脚、道具和主要动作线尽量保持可见。四肢长时间重叠时,动作更难识别。跑步、舞蹈、搬举和产品运动通常适合侧面或四分之三视角,因为运动路径更清楚。
素材要短而集中
删除动作前后的空白,只保留一个完整运动。当前 SeedVideo AI H3 的参考限制为最多 3 段视频,每段 2 到 15 秒,视频总时长不超过 15 秒。只有当每个文件都提供不同信息时,多素材才有意义。
曝光稳定,接触点可见
闪烁灯光可能被当成风格指令,过重的动态模糊会遮住肢体位置。拍摄身体动作时,要看清发力脚、触碰物体的手或车轮落地的位置。这些接触点也应该写进提示词。
使用权要明确
优先使用自己拍摄、委托拍摄或授权范围包含生成用途的素材。涉及可识别表演、品牌资产或私人肖像时,先确认使用权限。
把主体、动作、镜头和场景拆开
很多失败任务都有隐藏冲突:身份图是棚拍肖像,动作视频里是蒙面运动员,提示词要求拥挤夜市,同时又写了固定机位和高速环绕。把职责列成表,冲突会更容易发现。
| 层级 | 上传前先决定 | 示例写法 |
|---|---|---|
| 主体 | 面部、服装、产品形状和固定道具 | “Image 1 定义人物面部、短卷发和姜黄色西装。” |
| 动作 | 一个主要运动及关键节点 | “Video 1 定义步速和摆臂。” |
| 镜头 | 一种主要运镜、速度和跟随目标 | “平稳向后移动,保持膝上景别。” |
| 场景 | 地点、空间深度、光线和可移动元素 | “浅色石材长廊、顶部天窗、通道无人。” |
| 声音 | 物理音效、环境声、对白或音乐 | “安静脚步和室内底噪,无对白。” |
每一层先写一句。如果两个参考文件都想控制同一层,就删掉一个,或明确谁优先。MiniMax H3 提示词指南 也采用这种拆分方式,适合继续完善文字指令。
一条紧凑的参考视频提示词
在浅色石材画廊里,生成 Image 1 中女性的电影感时装镜头。Video 1 只用于她稳定的步速和自然摆臂,不采用原视频的地点和服装。镜头按相同步速平稳后移,保持膝上景别。固定她的面部、短卷发、姜黄色西装和向前运动方向。使用柔和天窗光,保留轻微脚步声,不切镜。
使用当前 MiniMax H3 工作台
SeedVideo AI 当前的 Reference Video 入口会显示必填的视频输入、提示词、画幅、2K 输出、时长、模型选择和积分报价。下面截图中已选择 MiniMax H3,默认设置是 16:9、5 秒和 2K。上传素材或调整时长后,报价可能变化,应在提交前重新查看。

2026 年 9 月 9 日的 SeedVideo AI MiniMax H3 参考视频工作台。
打开 AI 视频转视频生成器,选择 MiniMax H3,再上传能说明核心动作的最短片段。如果人物身份主要依赖静态图,可先在 AI 图像转视频生成器 准备起始画面。完全不需要参考动作时,可改用 AI 文本转视频生成器。
五步完成参考视频工作流
1. 先写目标镜头,再找素材
用一句话写清主体、动作、地点和镜头。这样可以避免选到很精彩、却解决不了当前需求的素材。
2. 只给视频分配一个主要职责
在身体动作、物体运动、镜头路径、节奏和剪辑节拍中选一个。如果确实需要两个控制项,先确认它们在素材里并不冲突。
3. 裁短并检查素材
保留有效动作,删掉无关片段。记录运动方向、接触点、停顿、遮挡和镜头变化,这些观察会直接变成提示词。
4. 分层写提示词
先写新主体和环境,再指定参考视频职责。补充动作顺序、一种运镜、光线、声音和固定项。第一轮只保留足够验证核心想法的内容。
5. 用固定清单验收
依次检查身份、动作顺序、镜头路径、空间逻辑、背景稳定和声音。每次只记录一个主要问题,只改一个提示层,其他设置保持不变。
排查漂移和素材冲突

视频提示词:高级时装电影单镜头。短卷发、姜黄色西装的虚构成年女性走过浅色石材画廊。镜头平稳后移并让人物居中。保持面部、西装、运动方向、重复立柱和柔和天窗光稳定。自然脚步声、真实地面反射,不切镜。
| 现象 | 常见冲突 | 集中修改 |
|---|---|---|
| 面部或服装变化 | 动作素材也被当成身份参考 | 增加清晰身份图,并写明 Video 1 只控制动作 |
| 动作变得普通 | 素材有切镜、遮挡或多个动作 | 只保留一个完整动作,并写出关键节点 |
| 镜头不跟随参考 | 提示词要求了另一种运镜 | 只保留一种运镜,明确素材或文字谁优先 |
| 背景像原素材 | 没有明确替换环境 | 写清新场景,并说明 Video 1 不控制地点 |
| 人物滑动或接触失真 | 手脚或物体接触点看不清 | 换用更宽的素材,写明起跳、接触和落地 |
| 动作过早结束 | 当前时长塞入太多节点 | 删除次要动作,或选择更长的支持时长 |
| 风格中途变化 | 多个参考文件采用不同画面语言 | 只留一个风格来源,用物理光线描述画面 |
背景总在复制原素材
用空间结构、光线和深度定义替代场景。“现代画廊”太模糊,“没有家具的浅色石材长廊,重复立柱,顶部天窗”更具体。同时把视频职责缩小到步速和摆臂。
动作准确,但人物在漂移
把身份固定特征移到提示词前面,只重复必须保留的面部、发型、衣服颜色、产品轮廓或道具。如果有高质量静态图,让它负责身份,让视频负责时间。需要更完整的检查表,可参考 AI 视频角色一致性方法。
镜头和动作互相打架
减小运镜幅度,或简化动作。高速环绕跳跃主体,会在最复杂的时刻产生更多遮挡和深度变化。横向跟拍或固定全景往往更容易保住动作。动作稳定后,再单独增加镜头复杂度。
MiniMax H3 参考视频案例
把舞蹈动作放到新场景
在空旷、湿润的剧院舞台上,生成 Image 1 中虚构舞者的电影感单镜头。Video 1 只控制顺时针旋转、腾跃时间和落地姿势。镜头从低机位中全景由左向右跟拍。保持面部、深红外套、舞台布局和运动方向稳定。暖色侧光,冷蓝色逆光,布料运动自然,一镜到底。
用替换人物完成跑酷动作
在安静的粗野主义广场中,生成 Image 1 里虚构运动员的写实运动镜头。Video 1 只控制助跑两步、右脚起跳、越过障碍和双脚落地。镜头在腰部高度横向跟拍,始终拍到完整身体。保持深灰服装。清晨硬光,长阴影,不切镜。
只借用镜头,不借用原动作
生成一段五秒的空旷圆形图书馆建筑镜头。Video 1 只控制缓慢顺时针环绕和加速曲线。把原人物替换为画面中央的红色椅子。保持椅子形状和图书馆结构。柔和窗光,安静室内环境声,无人物,不切镜。
MiniMax H3 与 Seedance 2.5 怎么选
两种模型都需要明确的参考职责,但当前 SeedVideo AI 模型页展示的使用范围不同。
| 判断项 | MiniMax H3 | Seedance 2.5 |
|---|---|---|
| 当前最长时长 | 15 秒 | 最长 30 秒 |
| 当前输出重点 | 原生 2K 短片 | 更长的制作型片段,并提供可选输出设置 |
| 参考容量 | 最多 12 个混合文件:9 图、3 视频、3 音频 | 最多 50 个参考:30 图、10 视频、10 音频 |
| 更适合 | 紧凑的视听镜头,强调动作、运镜、首尾帧和声音控制 | 长广告、完整情节、大型参考包和局部编辑 |
| 不太适合 | 一段很长的连续叙事,或大型制作素材库 | 不需要大上下文的简单短动作迁移 |
如果成片目标是 5 到 15 秒的 2K 聚焦镜头,而且动作或镜头语言可以被清楚拆分,MiniMax H3 更合适。参考视频、声音方向和紧凑时间线可以放在同一份任务书里。
需要更长时间、更多素材或局部修改时,可选择 Seedance 2.5。Seedance 2.5 参考视频指南 详细说明了大型素材包的职责分配。无论选择哪种模型,都要完整查看成片,并按原始需求检查连续性。
常见问题
MiniMax H3 参考视频是什么?
它是用来指导时间变化的源片段,可以控制身体动作、物体运动、镜头路径、节奏或切镜。提示词负责定义新主体、新场景、优先级和固定细节。
参考视频应该多长?
选择包含一个完整有效动作的最短片段。SeedVideo AI 当前的 H3 工作流允许每段参考视频为 2 到 15 秒,参考视频总时长不超过 15 秒。
参考视频能保持人物身份吗?
它会影响人物外观,但清晰身份图配合明确的面部、发型、服装和运动方向描述,目标更清楚。让视频负责动作,让图片负责身份。
为什么 H3 会带入原视频背景?
通常是视频职责太宽,或替代场景写得太模糊。用布局、光线和空间深度描述新环境,并明确视频只控制动作或运镜。
MiniMax H3 最多能使用多少参考文件?
当前模型页列出最多 12 个混合文件,上限分别为 9 张图片、3 段视频和 3 段音频。视频与音频各自的总时长上限是 15 秒,参考模式必须包含图片或视频。
应该选 MiniMax H3 还是 Seedance 2.5?
需要最长 15 秒的紧凑 2K 参考镜头,可选 MiniMax H3。需要最长 30 秒、更大的参考包或局部编辑,可选 Seedance 2.5。按交付目标选择,不要只看笼统的质量标签。
开始制作参考驱动镜头
先用一句话写清目标镜头,再选择只有一个明确动作的片段,并给它分配一个职责。打开 SeedVideo AI 的 MiniMax H3,核对实时控件和积分报价,再生成能回答核心创意问题的最小版本。



