MiniMax 正式發布全模態影片模型 H3,模型權重將於近日開源

新聞摘要
MiniMax 已將 H3 從預告推進到正式上線,在上海 WAIC 2026 大會上以「即將推出」看板首次展示約兩週後,正式發布了這款次世代全模態影片模型。該模型現已透過 MiniMax 的 API 與 MiniMax Hub 平台上線,公司表示計劃於未來幾天內公開發布 H3 的模型權重,延續其在語言模型 M3 上採用的開源權重策略。
從預告到正式發布
MiniMax 於 2026 年 7 月 17 日在 WAIC 展位展示 H3 時,公司代表僅表示這款模型「即將推出」,當時尚未確認公開發布日期。如今這項空白已經填補:H3 已作為正式上線模型出現在 MiniMax 官方平台上,開發者可透過 API 存取,也能透過 MiniMax Hub 直接試用。
發布時確認的功能
正式上線的模型與 MiniMax 在 WAIC 上預告的規格一致。H3 能以每秒 24 幀的速度生成原生 2K 影片,片段長度介於 5 秒至 15 秒之間,支援文字轉影片、圖像轉影片、首尾幀生成,以及多模態參考生成模式。
其最突出的功能仍是「全參考」支援:創作者能在單一請求中提供最多 9 張參考圖像、3 個參考影片片段與 3 個參考音訊片段,用以引導風格、角色一致性、動態或聲音特徵,而不會強制將它們作為僵硬的關鍵幀。H3 亦支援多鏡頭敘事,可實現更具電影感的多場景序列,以及基於自然語言指令的編輯。對話、音效與環境音訊會與影片本身在同一流程中生成,並與畫面動作同步,使許多短篇專案無需獨立的音訊製作步驟。
模型權重將於近日開源
MiniMax 表示計劃於發布後數天內開源 H3 的模型權重,延續其在 M3 上採用的模式:這款語言模型於 2026 年 6 月 1 日發布,權重已於 6 月 7 日發布至 Hugging Face。與 M3 相同,H3 開源權重後將可用於自行架設與微調,但 MiniMax 是否會如同 M3 一樣,同時公開完整的訓練程式碼或推論運算子,目前仍有待觀察——該公司在 M3 上並未這麼做。
在 MiniMax 更廣泛產品陣容中的定位
H3 的正式發布,補齊了 MiniMax 在 WAIC 上一同預告的組合:具備強大推理與程式撰寫能力的語言模型 M3,以及能力日益增強的生成式多媒體對應模型 H3。兩者共同將 MiniMax 定位為語言與多模態生成領域的全方位競爭者,而非單一產品的專家,也印證了今年以來中國 AI 實驗室在黃仁勳公開力挺開源權重 AI 之後日益傾向的開源權重策略。
接下來值得關注什麼
隨著 H3 正式上線,獨立基準測試與更廣泛的創作者回饋如今才真正得以展開——這在模型仍只是 WAIC 展場預覽時是無法做到的。接下來值得關注的里程碑,是 MiniMax 承諾將於近日發布的模型權重,以及隨著使用規模超出早期存取階段,更完整的定價與技術文件。