MiniMax H3 w ComfyUI: otwarte wagi, wymagania i ograniczenia
MiniMax H3 działa w ComfyUI natywnie — wsparcie zostało scalone tego samego dnia, w którym pojawiły się otwarte wagi, czyli 3 sierpnia 2026 roku. Określenie „open source” ma tu jednak konkretny zakres: model H3-Base jest otwarty na licencji MiniMax H3 Community License, natomiast dwa elementy procesu hostowanego nie zostały udostępnione w ogóle. Ta strona wyjaśnia, co faktycznie dostajesz lokalnie, jakiego sprzętu to wymaga i skąd pochodzą wersje społecznościowe.
Otwarte wagi, VRAM, GGUF, LoRA — praktyczny obraz sytuacji.
MiniMax H3, ComfyUI i wdrożenie lokalne
To nie jest instrukcja instalacji krok po kroku — dedykowane serwisy z dokumentacją ComfyUI opisują instalację lepiej niż my. Poniżej znajdziesz rzetelny stan każdej z kwestii, których ludzie szukają przed rozpoczęciem.
Czy MiniMax H3 działa w ComfyUI?
Tak, natywnie. MiniMax H3 zadebiutował 31 lipca 2026 roku w API MiniMax i aplikacji Hailuo jako model wyłącznie hostowany. 3 sierpnia 2026 roku MiniMax udostępnił otwarte wagi H3-Base wraz z punktami kontrolnymi FL2VA i Ref2VA na licencji MiniMax H3 Community License — a natywne wsparcie w ComfyUI zostało scalone tego samego dnia poprzez pull request. Do wczytania modelu bazowego nie jest potrzebny zewnętrzny pakiet własnych węzłów.
Co jest otwarte, a co nie
Otwarte: wagi modelu H3-Base wraz z punktami kontrolnymi FL2VA i Ref2VA, około 33 mld parametrów, na licencji MiniMax H3 Community License. Nieotwarte: H3-Context-IR, czyli system wstępnego przetwarzania i wzbogacania promptów, oraz H3-Regenerate-2K, moduł skalowania do 2K. Oba pozostają funkcjami dostępnymi wyłącznie w wersji hostowanej. Lokalna instalacja ComfyUI uruchamiająca otwarte wagi nie odtwarza więc pełnego procesu — w szczególności ścieżka wyjścia w 2K i warstwa wzbogacania promptów nie są częścią tego, co pobierasz.
Ile VRAM potrzebuje MiniMax H3?
MiniMax nie opublikował oficjalnych wymagań VRAM dla poszczególnych precyzji, więc wszystkie krążące liczby pochodzą od społeczności i należy je traktować jako szacunki, a nie specyfikację. Przy około 33 mld parametrów wnioskowanie w pełnej precyzji to zdecydowanie domena kart z najwyższej półki. Poniżej tego poziomu społeczność przygotowała wersje INT8 i przycięte INT4, kwantyzacje GGUF od Q2 do Q5 oraz wersje NF4 w 4 bitach — według doniesień NF4 uruchamia się na około 8 GB VRAM. Ta wartość 8 GB pochodzi z raportów społeczności, a nie od MiniMax, a niższe poziomy kwantyzacji zmniejszają zapotrzebowanie kosztem jakości i szybkości.
Czy istnieje oficjalny GGUF MiniMax H3?
Nie. Otwarta publikacja MiniMax obejmuje H3-Base i jego punkty kontrolne — nie zawiera plików GGUF. Wszystkie krążące wersje GGUF MiniMax H3, podobnie jak przycięte warianty INT4/INT8 i wersje NF4, powstały w społeczności już po publikacji z 3 sierpnia. Oznacza to, że jakość, nazewnictwo i poprawność różnią się między poszczególnymi wydaniami, a nie istnieje wzorcowa wersja firmowana przez producenta, z którą można by je porównać. Jeśli wybierasz tę drogę, sprawdź, kto opublikował daną kwantyzację i w jaki sposób powstała.
MiniMax H3 LoRA i H3 Turbo
MiniMax H3 Turbo to wariant destylowany generujący w 4 krokach, według doniesień około 3,5 razy szybszy od modelu standardowego, z odpowiadającą mu LoRA Turbo. Poza tym obowiązuje typowa dynamika ekosystemu LoRA: ponieważ wagi bazowe są otwarte, z czasem pojawiają się trenowane przez społeczność LoRA do konkretnych stylów i tematów — z tym samym zastrzeżeniem co do wiarygodności źródła, co przy wersjach skwantyzowanych.
Czy mogę używać MiniMax H3 bez ComfyUI?
Tak — model jest dostępny również jako usługa hostowana przez API MiniMax i aplikację Hailuo, gdzie działa pełny proces obejmujący Context-IR i skalowanie do 2K. Jeśli twoim celem jest generowanie wideo, a nie uruchamianie modeli lokalnie, platforma hostowana całkowicie eliminuje kartę graficzną, pobieranie plików i konfigurację środowiska. W Wowovid generowanie wideo z tekstu w MiniMax H3 jest już dostępne w 768P lub 2K i długości od 4 do 15 sekund, prosto z przeglądarki.
Ile naprawdę kosztuje każde z tych podejść
Uruchamianie otwartych wag lokalnie jest właściwym wyborem przy części zadań — pełna kontrola, praca offline, trenowanie własnych LoRA. Jest wyborem błędnym, jeśli po prostu potrzebujesz gotowego klipu. Oto uczciwe zestawienie.
Uruchamianie MiniMax H3 w ComfyUI
- Karta graficzna z ilością VRAM wystarczającą dla wybranej precyzji — pełna precyzja wymaga sprzętu z najwyższej półki, a rozwiązania oszczędzające VRAM oznaczają społecznościowe wersje skwantyzowane z kompromisami jakościowymi.
- Dziesiątki gigabajtów do pobrania dla modelu o około 33 mld parametrów, plus punkty kontrolne i ewentualne LoRA.
- Działająca instalacja ComfyUI, właściwe wersje węzłów i graf procesu, który utrzymujesz samodzielnie.
- Brak wzbogacania promptów przez H3-Context-IR i brak skalowania przez H3-Regenerate-2K — oba dostępne wyłącznie w wersji hostowanej i nieobjęte otwartą publikacją.
- Rozwiązywanie problemów spoczywa na tobie: wersje sterowników, błędy braku VRAM i społecznościowe wersje o różnym pochodzeniu.
Generowanie w Wowovid
- Otwierasz stronę w przeglądarce. Bez karty graficznej, bez sterowników, bez planowania budżetu VRAM.
- Nic do pobrania i nic do aktualizowania — żadnych punktów kontrolnych, pakietów węzłów ani wersji skwantyzowanych do weryfikacji.
- Generowanie wideo z tekstu w MiniMax H3 jest już dostępne: napisz prompt, wybierz 768P albo 2K i długość od 4 do 15 sekund, a wynik zapisze się na twoim koncie.
- Jedno saldo kredytów dla wszystkich modeli wideo i obrazu na platformie, zamiast konfiguracji dla każdego modelu osobno.
- Eksport w HD bez znaku wodnego w planach płatnych.
Lokalne wdrożenie MiniMax H3 — FAQ
Pytania, które pojawiają się najczęściej przy sprawdzaniu możliwości uruchomienia MiniMax H3 na własnym sprzęcie.
MiniMax nie opublikował oficjalnych wymagań VRAM, więc każdą znalezioną liczbę warto traktować jako szacunek społeczności. MiniMax H3 to model o około 33 mld parametrów, co plasuje wnioskowanie w pełnej precyzji wśród kart z najwyższej półki. Przygotowane przez społeczność wersje INT8, przycięte INT4, GGUF Q2–Q5 i NF4 znacząco obniżają te wymagania — według doniesień NF4 w 4 bitach działa na około 8 GB VRAM — kosztem jakości wyniku. Ponieważ są to wydania społecznościowe, a nie oficjalne, należy liczyć się z różnicami między nimi.
Konfiguracje inne niż NVIDIA są przy dużych modelach wideo konsekwentnie trudniejsze: narzędzia wokół ComfyUI, formaty kwantyzacji i jądra mechanizmu uwagi powstają przede wszystkim z myślą o CUDA, a ścieżki dla Apple Silicon i AMD opierają się na wsparciu społeczności, które pozostaje w tyle i bywa różnie dopracowane. MiniMax nie wypowiadał się na temat wsparcia platform poza samą publikacją otwartych wag, więc nie podamy tu jednoznacznej odpowiedzi. Jeśli twój sprzęt to nie karta NVIDIA z dużą ilością VRAM, generowanie na platformie hostowanej będzie zwykle krótszą drogą.
MiniMax udostępnił otwarte wagi H3-Base 3 sierpnia 2026 roku wraz z punktami kontrolnymi FL2VA i Ref2VA na licencji MiniMax H3 Community License, dystrybuowane oficjalnymi kanałami MiniMax. Zawsze zaczynaj od repozytorium lub strony modelu należącej do MiniMax, a nie od kopii: krążące wersje skwantyzowane i GGUF to społecznościowe ponowne publikacje, a nie oficjalne wydania, i różnią się jakością oraz pochodzeniem. Przypominamy też, że H3-Context-IR i H3-Regenerate-2K nie są dołączone do żadnego pobrania — istnieją wyłącznie w usłudze hostowanej.
MiniMax H3 ma około 33 mld parametrów. Na dysku oznacza to dziesiątki gigabajtów w pełnej precyzji i właśnie dlatego społeczność szybko przeszła na formaty skwantyzowane — GGUF od Q2 do Q5, INT8 i przycięty INT4 oraz NF4 — z których każdy zmniejsza rozmiar pobierania i zużycie VRAM, oddając część jakości wyniku.
MiniMax H3 Turbo to destylowany, 4-krokowy wariant modelu, według doniesień około 3,5 razy szybszy od standardowej ścieżki generowania, z odpowiadającą mu LoRA Turbo. Celuje w skrócenie czasu generowania, czyli główną bolączkę lokalnego uruchamiania modelu tej wielkości.
Tak. MiniMax udostępnia model przez własne API i aplikację Hailuo, a platformy hostowane pozwalają generować wideo w przeglądarce zupełnie bez lokalnej konfiguracji. W Wowovid generowanie wideo z tekstu w MiniMax H3 jest dostępne już teraz — bez karty graficznej, bez pobierania plików i bez środowiska ComfyUI — w 768P lub 2K i przy długości od 4 do 15 sekund na klip. Na naszej stronie MiniMax H3 opisujemy, co potrafi ten model i jak wypada na tle Kling AI oraz Seedance 2.5.
Niezależna platforma
„MiniMax H3”, „MiniMax” i „Hailuo” są znakami towarowymi MiniMax i są tu używane wyłącznie w celach opisowych. Wowovid to niezależna platforma oferująca dziesiątki modeli generowania obrazu i wideo, niezwiązana z MiniMax ani przez tę firmę nierekomendowana czy sponsorowana. ComfyUI jest niezależnym projektem open source, również niepowiązanym z Wowovid.
Pomiń konfigurację
Jeśli zależy ci na filmie, a nie na środowisku, generuj po prostu w przeglądarce — generowanie wideo z tekstu w MiniMax H3 działa już w Wowovid, bez karty graficznej, bez pobierania i bez grafu procesu do debugowania.