MiniMax H3 多模态创作简报框架

MiniMax H3 提示词指南:
示例、工作流与最佳实践

为 MiniMax H3 编写实用创作简报。学习文生视频、图生视频身份保持、原生立体声音频提示和镜头运动描述。

使用交互式生成器 选择工作流模式 查看可复制示例
01 / 工作流模式

先选择输入模式

文生视频

从场景开始

需求: 生成一名骑车人穿过湿滑街道。
原始提示词: “骑车人穿过一条湿滑的街道。”
H3 简报: 主体 → 动作 → 镜头 → 音频。
原因: 不需要参考输入。

首帧 / 尾帧

控制转场

需求: 从完整玻璃过渡到破碎状态。
原始提示词: “让玻璃在镜头前破碎。”
H3 简报: 首帧 → 尾帧 → 转场节拍。
原因: 明确的端点更容易判断连续性。

参考生视频

为每个参考素材分配角色

需求: 保留图像 1 的身份,并采用视频 1 的运动。
原始提示词: “保留这个人,但使用另一段视频的运动。”
H3 简报: 参考素材 → 每个输入的作用 → 镜头动作。
原因: 明确角色更容易控制多模态输入。

对白 + 原生音频

把声音写进镜头

需求: 角色在房间环境声和音乐上方说话。
原始提示词: “一个角色在安静的房间里说话。”
H3 简报: 对白 → 声音环境 → 立体声定位 → 时间。
原因: 声音提示与视觉动作保持关联。

02 / 交互式提示词生成器

构建你的 MiniMax H3 简报

格式化的 MiniMax H3 简报

            
03 / 提示词结构

实用简报的结构

MiniMax H3 在统一上下文窗口中理解文本、图像、视频和音频信号。明确分配角色,可以更容易评估参考素材和连续性要求。

01 / 主体

定义不变元素

指出帧间必须稳定的服装、面部结构、皮肤纹理、材质表面或 Logo 位置。

02 / 动作与镜头

拆解镜头

将主体的物理运动与镜头运动分开描述(例如“主体向右转头,同时镜头向左摇摄”)。

03 / 音频与立体声

空间声音提示

H3 生成原生立体声。指定左右空间位置、环境声和音乐节奏提示。

04 / 参考素材

分配参考素材角色

提供图像或视频文件时,明确写出:“图像 1 提供面部身份;视频 1 提供镜头速度”。

05 / 保持

稳定性规则

说明运动过程中绝不能改变的特征,例如品牌 Logo、眼睛颜色和背景建筑。

06 / 避免

可选的规避说明

描述希望避免的瑕疵,例如灯光闪烁、多余手指、身份变形或镜头突然跳动。

04 / 可复制示例

MiniMax H3 提示词模板示例

文生视频 / 科幻电影感

赛博朋克霓虹雨巷

SUBJECT: Cyberpunk detective in dark trench coat standing under rain. ACTION: Pulls glowing neon lit holographic visor down over eyes. ENVIRONMENT: Wet asphalt street reflecting pink and cyan neon signs, heavy rain drops. CAMERA: Low angle close-up pan forward with anamorphic lens glare. AUDIO: Heavy raindrops splashing, ambient synth soundscape, crisp visor click. PRESERVE: Trench coat color, facial silhouette, rain density. AVOID: Face distortion, blurry neon reflections, sudden lighting jump.
图生视频 / 身份保持

角色面部运动迁移

SUBJECT: Character identity defined by Image 1 reference input. ACTION: Subject slowly smiles, turns head 45 degrees to the left, blinks naturally. ENVIRONMENT: Studio lighting with soft rim light matching Image 1 color temperature. CAMERA: Static medium portrait shot at 50mm f/1.8 depth of field. AUDIO: Soft ambient breath sound, warm gentle acoustic melody. REFERENCES: Image 1 provides exact facial identity, hair texture, and outfit. PRESERVE: Face structure, eye color, skin tone, clothing pattern from Image 1. AVOID: Morphing nose, flickering eyes, floating hair artifacts.
产品广告 / 商业动态

哑光香水瓶展示

SUBJECT: Frosted glass perfume bottle with engraved gold logo. ACTION: Condensation water drops bead and slide down cold glass surface smoothly. ENVIRONMENT: Dark dramatic studio backdrop with golden spotlight rising from behind. CAMERA: Slow macro zoom tracking from bottle base up to golden cap reveal. AUDIO: Soft glass clink sound, ambient ocean breeze soundscape, warm chime beat. PRESERVE: Gold logo typography alignment, glass transparency, drop physics. AVOID: Logo blurring, glass distortion, unnatural liquid jump.
音频同步 / 原生立体声简报

沙漠日落地平线飞越

SUBJECT: Endless red sand dunes stretching toward glowing sun. ACTION: Heat waves shimmer gently off sand ridges as wind sweeps dust clouds across dunes. ENVIRONMENT: Golden hour sunset sky with deep orange and purple gradient clouds. CAMERA: Smooth drone flyover moving forward at steady speed 2 meters above dunes. AUDIO: Wind howling in stereo left-to-right, low cinematic bass rumble, subtle sand rustle. PRESERVE: Sand dune ridge geometry, sun position on horizon, cloud gradient. AVOID: Camera shaking, dune flickering, sudden color shifts.
05 / 常见问题

常见问题

MiniMax H3 最佳提示词结构是什么?

本指南将指令拆分为清晰的标签区块:SUBJECT、ACTION、ENVIRONMENT、CAMERA、TIMING、AUDIO、REFERENCES、PRESERVE 和 AVOID。这是实用的编辑模板,不是保证有效的 schema,也不能替代对所选 H3 工作流的测试。

如何减少 MiniMax H3 图生视频中的脸部变形?

写明参考图像及其角色(例如“图像 1 提供面部身份”),再描述希望保持的特征。将结果视为提示词辅助,而不是保证解决脸部变形的方法。

MiniMax H3 原生立体声音频生成如何工作?

不同于只生成无声视频的模型,H3 支持在同一上下文窗口中生成原生立体声。你可以在 AUDIO 区块中描述空间声音位置(例如“脚步声从左向右移动,伴随低沉合成器低音”)。

MiniMax H3 提示词语法兼容 Hailuo 01 吗?

MiniMax 将 Hailuo 01 和 Hailuo 02 描述为早期产品,而 H3 被介绍为新的通用多模态模型。不要假设 Hailuo 01 的提示词语法完全兼容;请在目标工作流中测试。