Free credits for new users
모델
0/7000
4s
잔액:0
100%
MiniMax H3

예시

매개변수를 설정한 후 ‘생성’을 클릭하세요

Cinematic Motion

A cinematic shot with smooth camera movement and realistic lighting.

Dynamic Product Scene

A product-focused video with polished motion and detailed textures.

Creative Story Beat

A short visual story with expressive motion and atmospheric composition.

Pro Narrative Shot

A refined cinematic sequence with stable framing and rich scene detail.

Audio-Ready Scene

A polished video scene designed for expressive motion and audio support.

Studio Composition

A controlled scene with deliberate movement and professional lighting.

MiniMax H3 — 멀티모달 영상 모델 완전 정리

MiniMax H3는 MiniMax가 개발한 범용 멀티모달 영상 생성 모델로, 2026년 7월 31일 MiniMax API와 하이루 앱을 통해 공개되었으며 하이루 앱에서는 하이루 3.0이라고도 불립니다. 텍스트, 이미지, 영상, 오디오를 입력으로 받아 네이티브 스테레오 오디오가 포함된 영상을 생성합니다. 최대 2K 해상도, 24fps, 클립당 4~15초를 지원합니다.

MiniMax H3에 대해 알아야 할 모든 것을 한곳에.

MiniMax H3와 ComfyUI

MiniMax H3 텍스트 투 비디오가 위 생성기에서 정식으로 제공됩니다. 프롬프트를 입력하고 768P 또는 2K, 4~15초 길이, 여섯 가지 화면 비율 중 하나를 선택하세요. 이미지 투 비디오와 R2V 멀티모달 참조 생성은 아직 스튜디오에 도입되지 않았으며, 이미지 투 비디오 탭은 현재 하이루 02로 동작합니다.

MiniMax H3란

MiniMax H3란 무엇인가요?

MiniMax H3는 MiniMax가 개발한 범용 멀티모달 영상 생성 모델입니다. 프롬프트만 받거나 이미지 한 장만 받는 모델과 달리, MiniMax H3는 텍스트·이미지·영상·오디오 입력을 하나의 모델 안에서 통합하며, 스테레오 사운드트랙이 이미 포함된 완성 클립을 출력합니다. 소비자용 하이루 앱은 같은 모델을 하이루 3.0, 하이루 H3, 하이루 03이라는 이름으로 제공하는데, 모두 MiniMax H3를 가리킵니다.

통합된 멀티모달 입력

텍스트, 이미지, 영상 클립, 오디오가 모두 같은 모델로 들어갑니다. 이미지 투 비디오만 지원하는 도구와의 핵심적인 차이로, 한 번의 생성을 텍스트 프롬프트·참조 이미지·참조 영상·참조 오디오로 동시에 조건화할 수 있습니다.

네이티브 스테레오 오디오 출력

MiniMax H3는 모델 자체가 만들어낸 스테레오 오디오와 함께 영상을 생성하므로, 이후에 별도의 사운드 작업을 거칠 필요가 없습니다. 11개 언어의 더빙을 지원합니다.

2K, 24fps, 4~15초

출력은 최대 2K 해상도, 24fps이며 클립 길이는 4초에서 15초까지 정수 초 단위로 지정할 수 있습니다. 모델 규모는 약 33B 파라미터입니다.

모델 계보

하이루 2.3에서 MiniMax H3로

MiniMax H3는 하이루 2.3의 뒤를 잇는 MiniMax 영상 모델 계열의 현재 세대입니다. 둘 사이의 차이는 단순한 품질 향상이 아닙니다. H3는 모델이 받아들이는 입력과 만들어내는 출력 자체를 바꿨습니다.

하이루 2.3

이전 버전

하이루 영상 모델 계열의 이전 세대입니다. 텍스트 투 비디오와 이미지 투 비디오 생성을 지원했으며, 2026년 중반 이전에 공개된 대부분의 하이루 튜토리얼과 워크플로는 여전히 이 버전을 기준으로 합니다.

MiniMax H3

현재 버전

2026년 7월 31일 MiniMax API와 하이루 앱에 출시된 현재 버전입니다. 텍스트·이미지·영상·오디오 입력을 하나의 모델로 통합하고 네이티브 스테레오 오디오를 출력하며, 2K·24fps에 4~15초 클립을 지원합니다. H3-Base의 오픈 웨이트는 2026년 8월 3일에 공개되었습니다.

생성 모드

MiniMax H3의 세 가지 생성 모드

MiniMax H3는 생성을 제어하는 세 가지 방식을 제공합니다. 멀티모달 설계가 실제로 드러나는 것은 세 번째인 R2V로, 단일 입력 영상 모델에는 직접 대응하는 기능이 없습니다.

T2V

텍스트 투 비디오

원하는 장면을 글로 설명하면 MiniMax H3가 클립을 생성합니다. 피사체, 카메라 움직임, 장면은 물론 네이티브 스테레오 오디오 트랙까지 함께 만들어집니다. 원본 이미지는 필요하지 않습니다.

MiniMax H3로 생성하기
I2V

이미지 투 비디오 및 첫·마지막 프레임

한 장의 이미지에서 시작해 움직임을 더하거나, 첫 프레임과 마지막 프레임을 함께 제공해 그 사이의 전환을 MiniMax H3가 생성하도록 할 수 있습니다. 특정 마지막 장면으로 마무리해야 할 때 유용합니다.

스튜디오 지원 예정
R2V — 멀티모달 참조

참조 투 비디오

한 번의 생성에 최대 9장의 참조 이미지, 최대 3개의 참조 영상 클립(각 2~15초, 전체 합계 15초 이내), 최대 3개의 참조 오디오를 조건으로 지정할 수 있습니다. 내가 가진 소재의 캐릭터, 스타일, 움직임, 목소리를 새로운 장면으로 옮겨오는 것이 바로 이 모드입니다.

스튜디오 지원 예정
가격

Wowovid의 MiniMax H3 가격

Wowovid는 플랫폼의 모든 영상·이미지 모델에서 공통으로 사용하는 단일 크레딧 잔액으로 운영됩니다. 별도의 MiniMax 구독을 구매하거나 모델별 요금제를 관리할 필요가 없습니다. MiniMax H3 4초 텍스트 투 비디오는 768P에서 93크레딧, 2K에서 151크레딧이며 생성 전에 정확한 총액이 표시됩니다. 연간 플랜은 월 $10부터, 1회성 팩은 $39부터입니다.

비교하기

MiniMax H3와 다른 영상 모델

MiniMax H3를 검토할 때 가장 많이 검색되는 두 가지 비교입니다.

MiniMax H3와 Kling AI 비교

완성도 높은 텍스트 투 비디오·이미지 투 비디오와 물리적으로 자연스러운 움직임 면에서는 Kling AI가 더 검증된 선택지입니다. MiniMax H3의 차별점은 참조 이미지·영상·오디오를 한 번의 생성에 함께 넣을 수 있는 통합 멀티모달 입력과, 결과물에 포함되는 네이티브 스테레오 오디오입니다.

MiniMax H3와 Seedance 2.5 비교

둘 다 크리에이터들이 나란히 놓고 비교하는 현세대 영상 모델입니다. MiniMax H3를 구분 짓는 것은 R2V 멀티모달 참조 기능, 네이티브 스테레오 오디오, 그리고 베이스 모델이 오픈 웨이트로 공개되었다는 점입니다. Seedance 2.5는 구성이 다른 호스팅형 모델입니다.

자주 묻는 질문

MiniMax H3 — 자주 묻는 질문

MiniMax H3의 기능, 오픈소스 범위, 다른 영상 모델과의 비교에 대해 자주 나오는 질문입니다.

MiniMax H3는 MiniMax의 범용 멀티모달 영상 생성 모델입니다. 텍스트, 이미지, 영상, 오디오 입력을 통합적으로 받아 네이티브 스테레오 오디오가 포함된 영상을 최대 2K 해상도, 24fps로 출력합니다. 클립 길이는 4초에서 15초까지 정수 초 단위로 지정할 수 있고, 11개 언어 더빙을 지원하며 규모는 약 33B 파라미터입니다.

네. "MiniMax H3"가 공식 모델명입니다. 소비자용 하이루 앱과 커뮤니티 상당수는 같은 모델을 하이루 3.0, 하이루 H3, 하이루 03으로 부릅니다. 모두 동일한 모델이며 2026년 7월 31일 MiniMax API와 하이루 앱에 출시되었습니다.

일부만 공개되어 있으며, 이 구분이 중요합니다. MiniMax는 2026년 8월 3일 FL2VA와 Ref2VA 체크포인트를 포함한 H3-Base의 오픈 웨이트를 MiniMax H3 Community License로 공개했습니다. 다만 두 가지 구성 요소는 공개 대상에서 빠져 있습니다. 프롬프트 전처리 및 향상 시스템인 H3-Context-IR와 2K 업스케일 모듈인 H3-Regenerate-2K이며, 둘 다 호스팅 전용으로 남아 있습니다. 따라서 오픈 웨이트를 로컬에 배포해도 호스팅 파이프라인 전체를 재현할 수는 없습니다. 자세한 기술적 내용은 MiniMax H3 ComfyUI 페이지를 참고하세요.

T2V(텍스트 투 비디오)는 텍스트 프롬프트만으로 생성합니다. I2V(이미지 투 비디오)는 한 장의 이미지에 움직임을 더하거나, 첫 프레임과 마지막 프레임을 함께 제공하면 그 사이의 전환을 생성합니다. R2V(참조 투 비디오)는 멀티모달 모드로, 한 번의 생성에 최대 9장의 참조 이미지, 각 2~15초이면서 합계 15초를 넘지 않는 참조 영상 최대 3개, 참조 오디오 최대 3개를 사용할 수 있습니다.

네. MiniMax H3 텍스트 투 비디오는 Wowovid 스튜디오 생성기에서 이미 사용할 수 있습니다. 프롬프트를 작성하고 768P 또는 2K를 선택한 뒤, 4초에서 15초 사이로 길이를 정하고 21:9부터 9:16까지 여섯 가지 화면 비율 중 하나를 고르면 됩니다. 이미지 투 비디오와 R2V 멀티모달 참조 생성은 아직 스튜디오에서 제공되지 않으며, 이미지 투 비디오 탭은 이전 모델인 하이루 02로 동작합니다.

Kling AI는 사실적인 움직임과 물리적으로 자연스러운 이미지 투 비디오에서 이미 자리 잡은 선택지이며, 현재 Wowovid에서 가장 많은 영상 생성에 사용되는 모델입니다. MiniMax H3가 빛을 발하는 경우는 멀티모달 참조가 필요할 때 — 내가 가진 이미지, 클립, 오디오에서 캐릭터·스타일·움직임·목소리를 새 장면으로 가져오고 싶을 때 — 그리고 오디오를 나중에 얹는 대신 처음부터 스테레오 사운드가 포함된 결과물을 원할 때입니다.

둘 다 현세대 AI 영상 모델에 속합니다. MiniMax H3를 구분 짓는 요소는 R2V 멀티모달 참조 모드, 11개 언어 더빙을 지원하는 네이티브 스테레오 오디오 출력, 그리고 베이스 모델 가중치가 공개되었다는 점입니다. Seedance 2.5는 자체적인 기능 구성을 갖춘 호스팅형 모델로 오픈 웨이트 공개가 없습니다.

Wowovid에서는 필요 없습니다. 오픈 웨이트가 공개되어 있어 MiniMax H3를 로컬에서 실행할 수는 있지만, 그러려면 성능 좋은 GPU와 수십 기가바이트의 모델 다운로드, 그리고 제대로 동작하는 ComfyUI 환경이 필요합니다. Wowovid는 호스팅형 플랫폼으로 생성이 저희 인프라에서 실행되므로 브라우저만 있으면 됩니다. 로컬 배포를 알아보고 계신다면 MiniMax H3 ComfyUI 페이지에서 하드웨어 요구 사항과 양자화 빌드를 다루고 있습니다.

Wowovid는 모든 모델이 공유하는 단일 크레딧 잔액을 사용하므로 MiniMax H3 전용 구독은 없습니다. 4초 클립은 768P에서 93크레딧, 2K에서 151크레딧이며 제출 전에 정확한 총액이 표시됩니다. 연간 플랜은 월 $10부터, 월간 플랜은 $29부터, 1회성 팩은 $39부터입니다.

무료 미리보기에는 워터마크가 포함될 수 있습니다. 유료 크레딧 플랜으로 내보낸 영상은 워터마크 없이 HD로 출력되므로 클라이언트 작업, 광고, 소셜 콘텐츠에 바로 사용할 수 있습니다.

독립 플랫폼입니다

"MiniMax H3", "MiniMax", "하이루(Hailuo)"는 MiniMax의 상표이며 여기서는 설명 목적으로만 사용됩니다. Wowovid는 수십 가지 이미지·영상 생성 모델을 제공하는 독립 플랫폼으로, MiniMax와 제휴, 보증, 후원 관계가 없습니다.

Wowovid에서 영상 생성하기

MiniMax H3 텍스트 투 비디오가 정식으로 제공됩니다. 프롬프트를 작성해 브라우저에서 바로 생성해 보세요. GPU도, 설치도, 모델 다운로드도 필요 없습니다. 유료 플랜에서는 워터마크 없이 HD로 내보낼 수 있습니다.

요금 보기