叙事镜头
控制场景如何开始、发展并落在最终构图。
MiniMax 多模态视频
从文字、首尾帧或图像、视频、音频参考生成 4–15 秒 768P 或 2K 视频。
上传首帧、末帧或两者,定义镜头从哪里开始、落在哪里。
告诉 H3 帧之间发生什么变化,包括主体动作、运镜、节奏与声音。
“The car revs through the desert.”
H3 构建连续片段,同时保留预期的开场与结束构图。
控制场景如何开始、发展并落在最终构图。
用参考图引导反复出现的主体与视觉识别。
用视频与音频参考塑造运动、镜头语言、语音与节奏。
让开场图动起来、落在最终图,或两者并用定义镜头弧线,H3 在中间构建运动。
“The car revs through the desert.”
图像指定角色或风格,视频指定运动或镜头语言,音频指定语音或剪辑节奏。H3 最多接受 9 张图、3 段视频、3 段音频。
768P 探索节奏,选定方向后 2K 渲染。时长 4–15 秒可选,生成前可查看积分估算。
先写清主体,再补充光影、风格,以及必须保持不变的内容。需要更可控的编辑时,上传参考图。
说明参考控制的是角色、运动、镜头、风格、声音还是节奏。
选择兼容的首末帧,再描述两者之间的过渡。
以更低成本验证运动与构图,再生成最终 2K 版本。
使用其他聚焦型视频工具继续完成工作流。
在前沿多模态控制、高保真生成与更快量产变体之间选择。
| 功能 | MiniMax H3当前 | ||||||
|---|---|---|---|---|---|---|---|
| 最适合 | 多模态电影感导演 | 快速、参考引导制作 | 极速迭代 | MiniMax 高保真视频模型,适合真实人体动作、电影感特效与富有表现力的角色表演。 | 更快的低配 Hailuo 2.3 变体,适合图生视频迭代与批量生产。 | MiniMax 高效视频模型,支持文生视频、图像动画及可选的首尾帧控制。 | 低成本 512p Hailuo 02 变体,适合快速概念验证及可选首尾帧引导。 |
| 输入 | 文字、图像、视频或音频参考 | 文字、帧、图像、视频或音频参考 | 文字或首尾帧 | 文生视频 · 图生视频 | 图生视频 | 文生视频 · 图生视频 | 文生视频 · 图生视频 |
| 分辨率 | 768P 或 2K | 480P、768P 或 1080P | 480P、768P 或 1080P | 768p / 1080p | 768p / 1080p | 512p / 768p / 1080p | 512p |
| 帧控制 | 首尾帧 | 首尾帧 | 首尾帧 | 首帧 | 首帧 | 首帧 / 尾帧 | 首帧 / 尾帧 |
| 速度 | 旗舰 | 快于实时 | 最快 | 标准 | 快速 | 标准 | 快速 |