MiniMax H3:一个模型,承载每种信号。
MiniMax H3 将文本、图像、视频和音频参考整合到同一创作上下文中。了解经过核验的提示词结构、ComfyUI 工作流和本地部署要求。
// MiniMax H3 Prompt Blueprint
{
"model": "MiniMax-H3"、
"modalities": ["text"、 "image"、 "video"、 "audio"],
"resolution": "768p base / up to 2K regenerate"、
"workflow": "ComfyUI / API-assisted"、
"blueprint": {
"SUBJECT": "[character / identity / product]"、
"ACTION": "[camera movement / beat]"、
"AUDIO": "[dialogue + stereo ambience]"、
"PRESERVE": "[face / lighting / style]"
}
}
从分散输入到统一方向。
统一的多模态理解
官方介绍中,H3 能将文本、图像、视频和音频作为共享上下文理解——当创作简报同时依赖身份、运动、声音和导演意图时尤其有用。
带原生声音的视频
发布信息描述了最长约 15 秒、最高 2K 且在同一结果中生成立体声音频的片段。不同服务商的设置可能有所不同。
以参考素材驱动导演意图
为参考素材分配角色:用图像定义主体,用视频提供运动,用音频提供声音,用文本给出最终指令。清晰的角色分配可以减少歧义。
上下文内重生成
MiniMax 将 H3 描述为支持在同一模型中完成生成和定向编辑。实际使用时,同时说明要改变的内容和必须保持稳定的元素。
从正确的 MiniMax H3 入口开始。
名称与拼写变体
MiniMax H3 也常被搜索为 minimaxh3、minimax-h3、minmax h3、minmaxh3、mini max h3 和 h3 minimax。这些是同一模型名称的常见拼写变体,不是不同模型。
开源权重与模型入口
MiniMax H3 开源权重的官方入口是模型仓库。本地指南区分 Hugging Face / ModelScope 权重、ComfyUI 文件和 GitHub 工作流模板,请按运行时下载匹配的软件包。
Hailuo H3 / 海螺 H3
搜索中也会把 MiniMax H3 与 Hailuo H3、海螺 H3、海螺h3开源联系在一起。这里仅说明搜索关联;下载前请以官方模型卡和许可证核对模型身份。
在线体验与官方身份
如果你搜索“minimax h3官网”,请把本页视为独立指南而不是官方入口;本页提供 MiniMax H3 在线提示词体验,不是官方推理服务。
指导最终结果,而不只是画面。
品牌影片
围绕一个活动方向协调产品外观、字体、镜头运动、音乐和人声。
产品故事
用图像参考保持产品身份,并用明确的镜头时间安排控制展示、演示和转场。
运动迁移
说明应如何应用视频参考中的运动,再指出必须保持一致的主体和背景元素。
UI 与游戏概念
在投入完整制作流程前,先原型化界面动效、世界转场、VFX 节奏和视听 pacing。
像导演一样写创作简报。
H3 的价值不只是“更多输入”,而是为每种输入分配任务,再描述这些信号如何在最终镜头中汇合。
定义不可变元素
指出帧与帧之间不能漂移的身份、产品、Logo、色板或空间关系。
为每个参考素材分配角色
说明要从每张图像、每段视频或每个音频文件中借用什么。不要让参考素材之间的关系隐含不明。
按时间拆解镜头
写出开场、中段节拍和结尾,并按顺序加入镜头运动、主体动作、转场和声音提示。
一次只修改一个变量
迭代时明确一个目标变化,并重复保留约束。这样更容易评估每次修改。
搭建镜头。
把这个与具体制作工具无关的结构作为起点。替换方括号字段,并根据所使用的界面或 API 服务商调整措辞。
最佳实践: 说明什么会改变、什么在运动、什么会发声,以及什么必须保持不变。
SUBJECT: [identity, clothing, product details] ACTION: [one clear physical action] ENVIRONMENT: [location, lighting, weather, atmosphere] CAMERA: [shot size, lens feel, movement] TIMING: [opening → middle beat → final frame] AUDIO: [dialogue, ambience, music, stereo position] REFERENCES: - Image 1 provides [identity / product / style] - Video 1 provides [motion / camera / timing] - Audio 1 provides [voice / rhythm / ambience] PRESERVE: [face, logo, colors, layout, background] AVOID: [unwanted changes or artifacts]
大家都在问什么。
MiniMax H3 是什么?
MiniMax 将 H3 描述为通用多模态生成模型,能在统一上下文中理解文本、图像、视频和音频,面向创意视频工作流中的生成、参考和编辑。
MiniMax H3 能生成什么?
发布公告描述了最高 2K、最长 15 秒并带原生立体声音频的视频生成。公告还强调指令遵循、文本与品牌渲染,以及 video-to-video 动作迁移。具体模式和限制可能因服务商而异。
MiniMax H3 是开放权重模型吗?
是的。MiniMax 已根据 MiniMax H3 Community License 发布 H3-Base FL2VA 和 Ref2VA 检查点。托管式 H3-Context-IR 系统与 H3-Regenerate-2K 模块不包含在首批开放权重发布中。
有 MiniMax H3 API 吗?
第三方模型平台已公布托管式 H3 接口。本独立指南不提供 API,也不保证任何服务商的可用性、价格、地区访问或参数支持。请以服务商当前文档为准。
应该如何给 MiniMax H3 写提示词?
使用结构化简报:主体、动作、环境、镜头、时间、音频、参考角色、保留约束和不希望出现的变化。多参考素材工作流中,要明确每个文件提供什么。
MiniMax H3 能本地运行吗?
可以,已发布的 H3-Base FL2VA 和 Ref2VA 路径支持本地运行。H3-Base 本地输出文档规格为 768p;完整 2K 输出使用 H3-Regenerate-2K/API 辅助工作流,不属于首批开放权重发布。
在构建之前先核验。
H3 仍是新模型,供给情况变化很快。本页产品信息仅依据发布公告、官方模型卡、原生 ComfyUI 文档和明确标注的服务商信息。