MiniMax 正式发布全模态视频模型 H3,模型权重将于近日开源

新闻摘要
MiniMax 已将 H3 从预告推进到正式落地,在上海 WAIC 2026 大会上以"即将推出"标牌首次展示大约两周后,正式发布了这款下一代全模态视频模型。该模型现已通过 MiniMax 的 API 和 MiniMax Hub 平台上线,公司表示计划在未来几天内公开发布 H3 的模型权重,延续其在语言模型 M3 上采用的开源权重策略。
从预告到正式发布
MiniMax 在 2026 年 7 月 17 日于 WAIC 展台展示 H3 时,公司代表只表示这款模型"即将推出",当时并未确认公开发布日期。如今这一空白已经填补:H3 已作为正式上线模型出现在 MiniMax 官方平台上,开发者可以通过 API 访问,也可以通过 MiniMax Hub 直接试用。
发布时确认的功能
正式上线的模型与 MiniMax 在 WAIC 上预告的规格一致。H3 能以每秒 24 帧的速度生成原生 2K 视频,片段长度从 5 秒到 15 秒不等,支持文本转视频、图像转视频、首尾帧生成以及多模态参考生成模式。
其最突出的功能仍是"全参考"支持:创作者可以在单个请求中提供最多 9 张参考图像、3 个参考视频片段和 3 个参考音频片段,用来引导风格、角色一致性、动作或声音特征,而不强制它们作为僵硬的关键帧。H3 还支持多镜头叙事,可实现更具电影感的多场景序列,以及基于自然语言指令的编辑。对话、音效和环境音频与视频本身在同一流程中生成,并与画面动作同步,使许多短篇项目无需单独的音频制作步骤。
模型权重将于近日开源
MiniMax 表示计划在发布后的几天内开源 H3 的模型权重,延续其在 M3 上采用的模式:这款语言模型于 2026 年 6 月 1 日发布,权重已于 6 月 7 日发布到 Hugging Face。与 M3 一样,H3 开源权重后将可用于自托管和微调,但 MiniMax 是否会像 M3 一样,同时公开完整的训练代码或推理算子,目前还有待观察——该公司在 M3 上并未这样做。
在 MiniMax 更广泛产品矩阵中的位置
H3 的正式发布,补齐了 MiniMax 在 WAIC 上一同预告的组合:具备强大推理和编程能力的语言模型 M3,以及能力日益增强的生成式多媒体对应模型 H3。两者共同将 MiniMax 定位为语言和多模态生成领域的全面竞争者,而非单一产品的专家,也印证了今年以来中国 AI 实验室在黄仁勋公开力挺开源权重 AI 之后愈发倾向的开源权重策略。
接下来值得关注什么
随着 H3 正式上线,独立基准测试和更广泛的创作者反馈现在才能真正展开——这在模型还只是 WAIC 展台预览时是无法做到的。接下来值得关注的里程碑是 MiniMax 承诺的、将于近日发布的模型权重,以及随着使用规模超出早期访问阶段,更完整的定价和技术文档。