MiniMax, 옴니모달 비디오 모델 H3 정식 출시…모델 가중치는 수일 내 공개 예정

뉴스 요약
MiniMax는 상하이에서 열린 WAIC 2026에서 '출시 예정' 안내판과 함께 처음 공개한 지 약 2주 만에, 차세대 옴니모달 비디오 모델 H3를 미리보기 단계에서 정식 출시로 전환했다. 이 모델은 현재 MiniMax의 API와 MiniMax Hub 플랫폼을 통해 이용 가능하며, 회사는 언어 모델 M3에서 채택한 오픈 웨이트 전략을 이어가며 H3의 모델 가중치를 수일 내에 공개할 계획이라고 밝혔다.
예고에서 정식 출시로
MiniMax가 2026년 7월 17일 WAIC 부스에서 H3를 선보였을 당시, 회사 관계자들은 이 모델을 '출시 예정'이라고만 설명했으며, 당시에는 공개 출시일이 확정되지 않았다. 이제 그 공백이 채워졌다. H3는 MiniMax 공식 플랫폼에 정식 출시된 모델로 등재되어 있으며, 개발자는 API를 통해 접근하거나 MiniMax Hub를 통해 직접 체험해 볼 수 있다.
출시 시점에 확인된 기능
출시된 모델은 MiniMax가 WAIC에서 예고했던 사양과 일치한다. H3는 초당 24프레임으로 네이티브 2K 비디오를 생성하며, 클립 길이는 5초에서 15초까지이며, 텍스트-투-비디오, 이미지-투-비디오, 첫-마지막 프레임 지정, 멀티모달 참조 생성 모드를 지원한다.
가장 두드러진 기능은 여전히 '옴니 참조' 지원이다. 창작자는 단일 요청 내에서 최대 9개의 참조 이미지, 3개의 참조 비디오 클립, 3개의 참조 오디오 클립을 제공하여 스타일, 캐릭터 일관성, 움직임 또는 음성 특성을 안내할 수 있으며, 이를 엄격한 키프레임으로 강제하지 않는다. H3는 또한 더욱 영화적인 다중 장면 시퀀스를 위한 멀티샷 스토리텔링과 자연어 명령을 통한 편집도 지원한다. 대사, 음향 효과, 주변 소리는 비디오 자체와 동일한 과정에서 생성되어 화면 속 동작과 동기화되므로, 많은 단편 프로젝트에서 별도의 오디오 제작 단계가 필요하지 않다.
모델 가중치, 수일 내 공개 예정
MiniMax는 출시 후 수일 내에 H3의 모델 가중치를 오픈소스로 공개할 계획이라고 밝혔으며, 이는 M3에서 확립한 패턴을 따르는 것이다. 이 언어 모델은 2026년 6월 1일에 발표되었으며, 가중치는 6월 7일까지 Hugging Face에 게시되었다. M3와 마찬가지로, H3의 오픈 웨이트 공개가 이루어지면 모델을 자체 호스팅하거나 파인튜닝하는 데 사용할 수 있게 되지만, MiniMax가 M3에서는 하지 않았던 전체 학습 코드나 추론 연산자까지 함께 공개할지는 아직 지켜봐야 한다.
MiniMax의 더 넓은 라인업에서의 위치
H3의 출시로, MiniMax가 WAIC에서 함께 예고했던 조합이 완성되었다. 강력한 추론 및 코딩 능력을 갖춘 언어 모델 M3와, 점점 더 강력해지는 생성형 멀티미디어 대응 모델 H3다. 두 모델은 MiniMax를 단일 제품 전문 기업이 아닌 언어 및 멀티모달 생성 전반에 걸친 폭넓은 경쟁자로 자리매김하게 하며, 7월 젠슨 황이 오픈 웨이트 AI를 공개적으로 지지한 이후 중국 AI 연구소들이 점점 더 기울고 있는 오픈 웨이트 전략을 다시 한번 뒷받침한다.
앞으로 주목할 점
H3가 정식으로 출시되면서, 모델이 아직 WAIC 전시장의 프리뷰에 불과했을 때는 불가능했던 독립적인 벤치마크 테스트와 더 폭넓은 창작자 피드백이 본격적으로 시작될 수 있게 되었다. 다음으로 주목할 이정표는 MiniMax가 수일 내에 공개하겠다고 약속한 실제 모델 가중치, 그리고 이용이 얼리 액세스 단계를 넘어 확대됨에 따라 공개될 더 완전한 가격 정책과 기술 문서다.