SeedVideo AI

Hailuo 3 · 原生 2K

MiniMax H3 免费体验:画面与声音一次生成

MiniMax H3 支持 5–15 秒原生 2K 输出、原生立体声、首尾帧控制,以及图片、视频、音频多模态参考。 立即免费在线试用 MiniMax H3!

  • 原生 2K
  • 5–15 秒
  • 首尾帧
  • 多模态参考

模型概览

什么是 MiniMax H3?

MiniMax H3 是 MiniMax 于 2026 年 7 月 31 日发布的通用多模态视频模型。它可以统一理解文本、图片、视频和音频,并在一次生成中输出带原生立体声的短视频。

多模态视频创作的视觉概览

一个模型统一理解文本、图片、视频和音频

MiniMax H3 会把提示词和参考素材放在同一个创作上下文中理解。图片可以提供主体或视觉方向,视频可以提供动作和镜头语言,音频可以提供声音、节奏或氛围参考。

画面与原生立体声联合生成

画面和声音在同一次生成中完成,不需要生成后再拼接。在本站,三个 H3 工作流都会输出 5–15 秒 2K MP4,并保留模型生成的音轨,目前没有单独的音频开关。

核心能力

MiniMax H3 AI 视频生成器的核心能力

MiniMax H3 把直接镜头控制和多模态参考放在同一个模型里。下面五项能力可以把创意简报、关键帧或现有素材变成方向更明确的短视频。

多模态上下文01

工作流示例 · 多模态参考

用图片、视频和音频共同引导一条视频

参考模式可以在图片、视频和音频的分类限制内,按顺序添加合计最多 12 个文件。在提示词中写清素材编号,让 H3 知道每个文件用于约束主体、动作、镜头、风格、声音还是节奏。

视觉延续02

视觉示例 · 主体与风格延续

在单条视频中保持主体或风格可识别

使用清晰的参考图片或视频,可以帮助角色、商品、配色或视觉风格在生成镜头中保持可识别。提示词越具体、参考素材越干净,模型目标越明确。

动作参考03

视觉示例 · 快速动作与镜头运动

把动作和镜头语言带入新场景

参考视频可以引导动作、节奏、镜头路径和剪辑韵律。当一个动作很难逐帧写清时,直接给出参考通常更直观。

关键帧控制04

工作流示例 · 首尾帧控制

指定首帧、尾帧或同时指定两者

上传首帧、尾帧或同时上传两张图片,先确定构图起点和画面终点。MiniMax H3 会补全中间运动,提示词负责说明动作和镜头方向。

音画输出05

开启声音 · 对白、环境声与画面同步呈现

生成带原生立体声的 2K 视频

本站当前集成输出 5–15 秒整数时长的 2K 视频。声音与画面联合生成,因此同一条视频中可以包含对白、环境声、音效或音乐。

三个步骤

如何在 SeedVideo AI 使用 MiniMax H3

无需写 API 代码,直接在浏览器中选择控制方式、添加真正有用的参考素材,并在提交前确认准确报价。

  1. 步骤 1

    选择 MiniMax H3 工作流

    只有提示词时选文生视频;需要控制转场起点和终点时选首尾帧;需要图片、视频或音频共同引导时选多模态参考。

  2. 步骤 2

    写提示词并添加参考素材

    写清主体、动作、环境、镜头路径、视觉风格和声音。使用参考模式时,按上传顺序提到素材编号,并说明每个素材的用途。

  3. 步骤 3

    确认积分报价并生成

    选择时长;文生视频和多模态参考模式还要选择画幅。等待素材上传完成并查看积分报价,提交后可以跟踪状态,再从作品库保存结果。

常见场景

MiniMax H3 可以创作什么

MiniMax H3 适合动作、参考素材和声音需要服从同一创作方向的短视频。每次生成聚焦一个明确成品,通常更容易控制结果。

商品广告与品牌短片

把商品图、活动视觉和品牌参考素材变成新品发布、商品展示或视觉广告,并统一控制动作和声音方向。

角色短片与风格化动画

用角色、服装和风格参考制作真人、插画、动漫、3D 或混合媒介的小场景。

动态图形、字体与 UI 演示

让标题、界面概念、游戏菜单、海报和品牌图形系统成为视频主体,快速验证动态设计方向。

游戏概念与视觉特效

在进入完整制作流程前,快速尝试环境、技能、变形、动作段落和特效镜头。

社交短片与短篇叙事

生成横版或竖版故事段落、活动变体、氛围测试和适合社交平台的短视频。

AI 视频模型对比

MiniMax H3、Seedance 2.5 与 Kling 3.0 有什么区别?

MiniMax H3、Seedance 2.5 和 Kling 3.0 采用不同的多模态视频创作路线。选择模型前,可以直接对比官方公开的定位、输入方式、时长、分辨率、音频和适用场景。

模型定位

MiniMax H3
开放通用多模态视频模型,强调参考素材与首尾帧控制
Seedance 2.5
面向生产的多模态视频系统,强调长镜头一致性与局部编辑
Kling 3.0
全模态一体化视频创作,强调电影级多镜头叙事与主体一致性

输入方式

MiniMax H3
文本、首帧/尾帧、图片/视频/音频参考;混合最多 12 项
Seedance 2.5
文本、脚本、图片、视频、音频、音乐和风格指南;多模态输入最多 50 项
Kling 3.0
文本、图片、音频和视频;支持参考生成、首尾帧和视频内编辑

最长时长

MiniMax H3
最长 15 秒;官方支持 4–15 秒,本站提供 5–15 秒
Seedance 2.5
标准模式 30 秒;Beta 长视频模式最长 180 秒
Kling 3.0
最长 15 秒,可选 3–15 秒

最高视频分辨率

MiniMax H3
最高 2K
Seedance 2.5
最高 4K 输出
Kling 3.0
最高 1080p

音频能力

MiniMax H3
原生立体声音频;支持音频参考与声画联合生成、编辑
Seedance 2.5
支持音频和音乐参考,并可同步输出音频
Kling 3.0
原生音画同步;支持多语言、多角色对白

适用场景

MiniMax H3
多模态参考驱动的 2K 影视、广告、电商、游戏和风格化短片
Seedance 2.5
广告、社交媒体、电商视频、长镜头和多角色叙事
Kling 3.0
电影感多镜头短片、角色一致性、多语言对白、广告和故事板

表格依据各模型官方公开资料整理。实际可用功能、时长和输出设置可能因产品、地区与 API 而变化。

模型选择

应该选择哪个模型?

根据现有素材、需要的控制方式、输出时长和制作目标选择。三款模型分别强调创作流程中的不同环节。

需要 2K 多模态参考创作时选择 MiniMax H3

MiniMax H3 适合用有顺序的图片、视频或音频参考引导 2K 短片,尤其适合需要首尾帧控制的任务。

需要更长生产工作流时选择 Seedance 2.5

Seedance 2.5 更适合长镜头、高分辨率营销素材,以及需要大量参考输入或局部编辑的生产任务。

需要多镜头叙事与对白时选择 Kling 3.0

Kling 3.0 适合电影感多镜头、稳定角色或商品,以及依赖多语言或多角色对白的场景。

价格与限制

MiniMax H3 价格:生成视频需要多少积分?

MiniMax H3 按积分计费。5 秒文生视频或首尾帧视频的基础报价是 23 积分。参考视频秒数和超过前 5 张的参考图片会增加基础报价,提交前会显示最终积分。

查看积分套餐

积分报价如何计算

  1. 01输出时长是主要计费单位。
  2. 02参考视频时长和超出基础数量的参考图片可能增加报价。
  3. 03任务提交时预留积分;上游返回终态失败时自动退回。

生成设置

MiniMax H3 生成限制

生成器会在提交任务前检查这些限制。

输出

原生 2K

MiniMax H3 当前使用 2K 画质设置。

时长

5–15 秒

仅支持整数秒。

文本/参考模式画幅

21:9、16:9、4:3、1:1、3:4、9:16

图生视频模式跟随输入图片。

参考图片

最多 9 张

本站支持 JPG、JPEG、PNG、WEBP,每张最大 30 MB。

参考视频

最多 3 个

单个 2–15 秒,累计不超过 15 秒,每个最大 50 MB。

参考音频

最多 3 个

MP3 或 WAV,单个 2–15 秒,累计不超过 15 秒,每个最大 15 MB。

参考文件总数

合计最多 12 个

同一次请求中的图片、视频和音频需要合并计算。

参考素材要求

必须包含图片或视频

音频不能作为唯一参考素材提交。

结果有效期

上游保留 24 小时

上游下载链接 24 小时后失效;转存成功的文件会保留在作品库。

在 SeedVideo AI 生成

在 SeedVideo AI 生成 MiniMax H3 视频

用一个账户在纯提示词、首尾帧和有顺序的多模态参考之间切换。每种工作流都会在提交前显示实际限制和准确积分报价。

minimax-h3-text-to-video

文生视频

在提示词中描述主体、动作、环境、镜头运动和视觉风格。

  • 支持六种画幅
  • 5–15 秒整数时长
  • 原生 2K 输出

minimax-h3-image-to-video

首尾帧图生视频

上传首帧、尾帧或同时上传两张图片,输出画面比例会跟随输入图片。

  • 支持首帧、尾帧或两者同时上传
  • 每张图片最大 30 MB
  • 用提示词控制运动和转场

minimax-h3-reference-to-video

多模态参考生成

按顺序添加图片、视频和音频参考素材,并在提示词中说明每份素材的用途。

  • 合计最多 12 个文件:9 张图片、3 个视频和 3 个音频
  • 视频和音频参考各自累计不超过 15 秒
  • 至少需要图片或视频参考

生成工作流

用 MiniMax H3 开始创作

在三种 MiniMax H3 工作流之间切换,提交前查看参数限制和积分报价,并在同一工作区完成项目。

一个生成器覆盖三种 MiniMax H3 工作流

可以在纯提示词、首尾帧和多模态参考之间切换,不需要把同一个项目搬到不同工具中重新配置。

提交前查看准确积分报价

生成器会根据输出时长和需要计费的参考素材计算报价,确认积分消耗后再提交任务。

在同一工作区保留其他 AI 视频模型

MiniMax H3 可以和 Seedance、Kling、Veo 等本站支持的模型搭配使用;当需求需要不同工作流或输出规格时,无需离开当前工作区即可切换。

精选视频素材

MiniMax H3 项目视频灵感

每次刷新会从 10 条项目视频素材中随机展示 8 条,覆盖动态图形、对白、角色动画、镜头运动和电影感叙事。

创意案例 03

3D 角色动画与世界构建

风格化角色穿过不同环境,体量、配色和动画电影质感保持连贯。

创意案例 08

多模态创作流程概览

快速视觉概览把参考素材、生成画面、运动和声音串联成一套多模态创作流程。

创意案例 07

第一视角魔法空间变换

发光精灵把日常洗衣房变成霓虹线框世界,第一视角镜头让整段空间变化保持连贯。

创意案例 04

史诗奇幻世界与空间尺度

宏大环境、远景人物和受控镜头运动,让奇幻段落呈现清晰的空间尺度。

创意案例 05

快速动作与镜头运动

高速角色动作、不断变化的镜头距离和霓虹环境,检验复杂动作段落是否依然清晰易读。

创意案例 02

对白与镜头连续性

克制的对话场景通过交替近景、稳定面孔和一致光线保持叙事清晰。

创意案例 10

参考素材驱动的产品运动

参考素材稳定质感和主体细节,再用镜头运动把简单产品概念变成完整短片。

创意案例 09

首尾帧场景控制

明确的开场帧和结束帧为短场景设定清晰终点,同时保留中间运动的生成空间。

生成前常见问题

关于 MiniMax H3 的常见问题

MiniMax H3 是 MiniMax 于 2026 年 7 月 31 日发布的通用多模态视频模型。它可以使用文本、图片、视频和音频,生成带原生立体声的短视频。

MiniMax 官方 API 中的模型标识是 MiniMax-H3。本站分别通过 minimax-h3-text-to-video、minimax-h3-image-to-video 和 minimax-h3-reference-to-video 路由文生视频、首尾帧和多模态参考工作流。

当前集成生成原生 2K 视频,支持 5–15 秒整数时长。

会。MiniMax H3 会联合生成视频和原生立体声音频。本站没有单独的音频开关;参考模式还可以在搭配图片或视频时上传音频素材。

合计最多添加 12 个文件,其中图片不超过 9 张、视频不超过 3 个、音频不超过 3 个。参考视频累计不超过 15 秒,参考音频累计不超过 15 秒。

生成视频会消耗积分。新账户注册后附带免费积分,每次提交前都会显示准确积分报价。

报价主要按输出秒数计算,参考视频时长和额外参考图片可能增加费用。提交前会显示准确报价。

上游下载链接会在 24 小时后失效。转存成功的文件会保留在作品库,长期备份仍建议保存一份本地副本。

不可以。上游服务不支持提交后取消。只有上游返回终态失败时才会退回预留积分。

Hailuo 3 · 原生 2K

一键制作电影级视频

选择工作流,确认准确的积分报价,然后提交原生 2K 视频。

MiniMax H3 免费:AI 视频生成器 | 2K、无水印