独立模型资料 / 与 MiniMax 无关联 更新时间:2026 年 8 月 4 日

MiniMax H3:一个模型,承载每种信号。

MiniMax H3 将文本、图像、视频和音频参考整合到同一创作上下文中。了解经过核验的提示词结构、ComfyUI 工作流和本地部署要求。

滚动查看
H3_blueprint_spec.json● 已核验规格
// MiniMax H3 Prompt Blueprint
{
  "model": "MiniMax-H3""modalities": ["text""image""video""audio"],
  "resolution": "768p base / up to 2K regenerate""workflow": "ComfyUI / API-assisted""blueprint": {
    "SUBJECT": "[character / identity / product]""ACTION": "[camera movement / beat]""AUDIO": "[dialogue + stereo ambience]""PRESERVE": "[face / lighting / style]"
  }
}
最后核验:2026 年 8 月 4 日768p 本地 · 2K 混合 · 立体声
官方权重已提供
Hugging Face可用
ModelScope可用
ComfyUIT2V / I2V / R2V
本地基础模型768p
完整 2K混合 / API
官方 GGUF未列出
[01]4同一上下文中的输入模态
[02]2K已公布的视频输出分辨率
[03]15s已公布的最长片段时长
[04]2.0原生立体声音频生成
文生视频 图生视频 提示词指南 API 与工作流 原生立体声音频
01 / 能力地图

从分散输入到统一方向。

01 — 上下文

统一的多模态理解

官方介绍中,H3 能将文本、图像、视频和音频作为共享上下文理解——当创作简报同时依赖身份、运动、声音和导演意图时尤其有用。

02 — 输出

带原生声音的视频

发布信息描述了最长约 15 秒、最高 2K 且在同一结果中生成立体声音频的片段。不同服务商的设置可能有所不同。

03 — 控制

以参考素材驱动导演意图

为参考素材分配角色:用图像定义主体,用视频提供运动,用音频提供声音,用文本给出最终指令。清晰的角色分配可以减少歧义。

04 — 迭代

上下文内重生成

MiniMax 将 H3 描述为支持在同一模型中完成生成和定向编辑。实际使用时,同时说明要改变的内容和必须保持稳定的元素。

模型名称 / 获取入口

从正确的 MiniMax H3 入口开始。

01

名称与拼写变体

MiniMax H3 也常被搜索为 minimaxh3、minimax-h3、minmax h3、minmaxh3、mini max h3 和 h3 minimax。这些是同一模型名称的常见拼写变体,不是不同模型。

02

开源权重与模型入口

MiniMax H3 开源权重的官方入口是模型仓库。本地指南区分 Hugging Face / ModelScope 权重、ComfyUI 文件和 GitHub 工作流模板,请按运行时下载匹配的软件包。

03

Hailuo H3 / 海螺 H3

搜索中也会把 MiniMax H3 与 Hailuo H3、海螺 H3、海螺h3开源联系在一起。这里仅说明搜索关联;下载前请以官方模型卡和许可证核对模型身份。

04

在线体验与官方身份

如果你搜索“minimax h3官网”,请把本页视为独立指南而不是官方入口;本页提供 MiniMax H3 在线提示词体验,不是官方推理服务。

02 / 创作方向

指导最终结果,而不只是画面。

01

品牌影片

围绕一个活动方向协调产品外观、字体、镜头运动、音乐和人声。

02

产品故事

用图像参考保持产品身份,并用明确的镜头时间安排控制展示、演示和转场。

03

运动迁移

说明应如何应用视频参考中的运动,再指出必须保持一致的主体和背景元素。

04

UI 与游戏概念

在投入完整制作流程前,先原型化界面动效、世界转场、VFX 节奏和视听 pacing。

03 / 工作流

像导演一样写创作简报。

H3 的价值不只是“更多输入”,而是为每种输入分配任务,再描述这些信号如何在最终镜头中汇合。

定义不可变元素

指出帧与帧之间不能漂移的身份、产品、Logo、色板或空间关系。

为每个参考素材分配角色

说明要从每张图像、每段视频或每个音频文件中借用什么。不要让参考素材之间的关系隐含不明。

按时间拆解镜头

写出开场、中段节拍和结尾,并按顺序加入镜头运动、主体动作、转场和声音提示。

一次只修改一个变量

迭代时明确一个目标变化,并重复保留约束。这样更容易评估每次修改。

04 / 提示词蓝图

搭建镜头。

把这个与具体制作工具无关的结构作为起点。替换方括号字段,并根据所使用的界面或 API 服务商调整措辞。

最佳实践: 说明什么会改变、什么在运动、什么会发声,以及什么必须保持不变。

H3_director_brief.txt
SUBJECT: [identity, clothing, product details]
ACTION: [one clear physical action]
ENVIRONMENT: [location, lighting, weather, atmosphere]

CAMERA: [shot size, lens feel, movement]
TIMING: [opening → middle beat → final frame]
AUDIO: [dialogue, ambience, music, stereo position]

REFERENCES:
- Image 1 provides [identity / product / style]
- Video 1 provides [motion / camera / timing]
- Audio 1 provides [voice / rhythm / ambience]

PRESERVE: [face, logo, colors, layout, background]
AVOID: [unwanted changes or artifacts]
界面语法和参考素材限制可能有所不同。请把它当作创作简报框架,而不是特定服务商的 API schema。
05 / 常见问题

大家都在问什么。

MiniMax H3 是什么?

MiniMax 将 H3 描述为通用多模态生成模型,能在统一上下文中理解文本、图像、视频和音频,面向创意视频工作流中的生成、参考和编辑。

MiniMax H3 能生成什么?

发布公告描述了最高 2K、最长 15 秒并带原生立体声音频的视频生成。公告还强调指令遵循、文本与品牌渲染,以及 video-to-video 动作迁移。具体模式和限制可能因服务商而异。

MiniMax H3 是开放权重模型吗?

是的。MiniMax 已根据 MiniMax H3 Community License 发布 H3-Base FL2VA 和 Ref2VA 检查点。托管式 H3-Context-IR 系统与 H3-Regenerate-2K 模块不包含在首批开放权重发布中。

有 MiniMax H3 API 吗?

第三方模型平台已公布托管式 H3 接口。本独立指南不提供 API,也不保证任何服务商的可用性、价格、地区访问或参数支持。请以服务商当前文档为准。

应该如何给 MiniMax H3 写提示词?

使用结构化简报:主体、动作、环境、镜头、时间、音频、参考角色、保留约束和不希望出现的变化。多参考素材工作流中,要明确每个文件提供什么。

MiniMax H3 能本地运行吗?

可以,已发布的 H3-Base FL2VA 和 Ref2VA 路径支持本地运行。H3-Base 本地输出文档规格为 768p;完整 2K 输出使用 H3-Regenerate-2K/API 辅助工作流,不属于首批开放权重发布。

来源规范

在构建之前先核验。

H3 仍是新模型,供给情况变化很快。本页产品信息仅依据发布公告、官方模型卡、原生 ComfyUI 文档和明确标注的服务商信息。

让每个参考素材都发挥作用。

使用提示词生成器