MiniMax H3 dans ComfyUI : poids ouverts, prérequis et limites
MiniMax H3 fonctionne nativement dans ComfyUI : la prise en charge a été intégrée le jour même de la publication des poids ouverts, le 3 août 2026. Mais « open source » recouvre ici un périmètre précis : le modèle H3-Base est ouvert sous la MiniMax H3 Community License, tandis que deux éléments du pipeline hébergé ne sont pas publiés du tout. Cette page explique ce que vous obtenez réellement en local, le matériel nécessaire, et d'où viennent les versions communautaires.
Poids ouverts, VRAM, GGUF, LoRA — la vue d'ensemble pratique.
MiniMax H3, ComfyUI et le déploiement local
Ceci n'est pas un guide d'installation pas à pas : les sites de documentation dédiés à ComfyUI couvrent l'installation mieux que nous. Ce qui suit, c'est l'état exact de chacun des points que l'on cherche avant de se lancer.
MiniMax H3 fonctionne-t-il dans ComfyUI ?
Oui, nativement. MiniMax H3 est sorti le 31 juillet 2026 sur l'API MiniMax et l'application Hailuo, uniquement en mode hébergé. Le 3 août 2026, MiniMax a publié les poids ouverts de H3-Base, checkpoints FL2VA et Ref2VA compris, sous la MiniMax H3 Community License — et la prise en charge native dans ComfyUI a été intégrée le même jour via une pull request. Aucun pack de nœuds personnalisés tiers n'est nécessaire pour charger le modèle de base.
Ce qui est ouvert et ce qui ne l'est pas
Ouvert : les poids du modèle H3-Base avec les checkpoints FL2VA et Ref2VA, environ 33 milliards de paramètres, sous la MiniMax H3 Community License. Non ouvert : H3-Context-IR, le système de prétraitement et d'enrichissement des consignes, et H3-Regenerate-2K, le module d'agrandissement en 2K. Tous deux restent des fonctionnalités réservées au service hébergé. Une installation locale de ComfyUI exécutant les poids ouverts ne reproduit donc pas l'intégralité du pipeline : en particulier, la chaîne de sortie en 2K et la couche d'enrichissement des consignes ne font pas partie de ce que vous téléchargez.
Quelle quantité de VRAM faut-il pour MiniMax H3 ?
MiniMax n'a pas publié de besoins officiels en VRAM par précision : tous les chiffres qui circulent proviennent donc de la communauté et doivent être considérés comme des estimations, non comme des spécifications. Avec environ 33 milliards de paramètres, l'inférence en pleine précision relève clairement des GPU haut de gamme. En dessous, la communauté a produit des versions INT8 et INT4 élaguées, des quantifications GGUF de Q2 à Q5 et des versions NF4 en 4 bits — NF4 fonctionnerait, d'après les retours, avec environ 8 Go de VRAM. Ce chiffre de 8 Go émane de la communauté et non de MiniMax, et plus la quantification est agressive, plus la qualité et la vitesse sont sacrifiées au profit de l'empreinte mémoire.
Existe-t-il un GGUF officiel de MiniMax H3 ?
Non. La publication ouverte de MiniMax porte sur H3-Base et ses checkpoints, sans inclure de fichiers GGUF. Toutes les versions GGUF de MiniMax H3 en circulation, tout comme les versions élaguées INT4/INT8 et les versions NF4, ont été produites par la communauté après la publication du 3 août. La qualité, la nomenclature et l'exactitude varient donc d'un dépôt à l'autre, et il n'existe aucune version de référence validée par l'éditeur à laquelle se fier. Si vous empruntez cette voie, examinez qui a publié une quantification donnée et comment elle a été produite.
Les LoRA MiniMax H3 et H3 Turbo
MiniMax H3 Turbo est une variante distillée qui génère en 4 étapes, avec une accélération d'environ 3,5x par rapport au modèle standard d'après les retours, accompagnée d'un LoRA Turbo dédié. Au-delà, la dynamique habituelle de l'écosystème LoRA s'applique : les poids de base étant ouverts, des LoRA entraînés par la communauté apparaissent au fil du temps pour des styles et des sujets précis, avec la même réserve sur la fiabilité des sources que pour les versions quantifiées.
Peut-on utiliser MiniMax H3 sans ComfyUI ?
Oui : le modèle est aussi disponible en service hébergé via l’API MiniMax et l’application Hailuo, où se trouve le pipeline complet, Context-IR et agrandissement 2K compris. Si votre objectif est de générer des vidéos plutôt que de faire tourner des modèles en local, une plateforme hébergée supprime entièrement le GPU, les téléchargements et l’environnement à configurer. Sur Wowovid, la génération texte vers vidéo avec MiniMax H3 est déjà active, en 768P ou 2K et de 4 à 15 secondes, directement depuis le navigateur.
Ce que chaque approche coûte vraiment
Exécuter des poids ouverts en local est le bon choix pour certains usages : contrôle total, utilisation hors ligne, entraînement de LoRA personnalisés. C'est le mauvais choix si vous voulez simplement le clip. Voici la comparaison honnête.
Faire tourner MiniMax H3 dans ComfyUI
- Un GPU disposant d'assez de VRAM pour la précision retenue : la pleine précision exige du matériel haut de gamme, et les options moins gourmandes impliquent des versions quantifiées communautaires, au prix de la qualité.
- Des dizaines de gigaoctets de téléchargements pour un modèle d'environ 33 milliards de paramètres, plus les checkpoints et les éventuels LoRA.
- Une installation ComfyUI fonctionnelle, les bonnes versions de nœuds et un graphe de workflow que vous maintenez vous-même.
- Ni enrichissement des consignes par H3-Context-IR, ni agrandissement par H3-Regenerate-2K : réservés au service hébergé, ils ne font pas partie de la publication ouverte.
- Le dépannage vous incombe : versions de pilotes, erreurs de VRAM et versions communautaires d'origines très variables.
Générer sur Wowovid
- Ouvrez la page dans un navigateur. Pas de GPU, pas de pilotes, aucun budget VRAM à anticiper.
- Rien à télécharger ni à maintenir à jour : ni checkpoints, ni packs de nœuds, ni versions quantifiées à vérifier.
- La génération texte vers vidéo avec MiniMax H3 est active : rédigez une consigne, choisissez 768P ou 2K et une durée de 4 à 15 secondes ; le résultat est enregistré sur votre compte.
- Un solde de crédits unique pour tous les modèles vidéo et image de la plateforme, au lieu d'une configuration par modèle.
- Export HD sans filigrane sur les formules payantes.
Déploiement local de MiniMax H3 — FAQ
Les questions qui reviennent le plus souvent lorsqu'on se renseigne sur l'exécution de MiniMax H3 sur son propre matériel.
MiniMax n'a pas publié de prérequis officiels en VRAM : considérez donc tout chiffre trouvé comme une estimation communautaire. MiniMax H3 compte environ 33 milliards de paramètres, ce qui place l'inférence en pleine précision sur des GPU haut de gamme. Les versions INT8, INT4 élaguées, GGUF Q2–Q5 et NF4 produites par la communauté abaissent nettement ce seuil — NF4 en 4 bits fonctionnerait avec environ 8 Go de VRAM — au prix de la qualité de sortie. Comme ces versions sont communautaires et non officielles, attendez-vous à des écarts entre elles.
Les configurations non NVIDIA sont systématiquement plus délicates avec les gros modèles vidéo : l'outillage autour de ComfyUI, les formats de quantification et les noyaux d'attention sont conçus avant tout pour CUDA, et les chemins Apple Silicon et AMD dépendent d'un support communautaire en retrait et de maturité inégale. MiniMax n'a fait aucune déclaration sur la compatibilité des plateformes au-delà de la publication des poids ouverts : nous ne donnerons donc pas de réponse catégorique ici. Si votre matériel n'est pas un GPU NVIDIA doté d'une VRAM confortable, passer par une plateforme hébergée sera généralement le chemin le plus court.
MiniMax a publié les poids ouverts de H3-Base le 3 août 2026, checkpoints FL2VA et Ref2VA compris, sous la MiniMax H3 Community License, via ses canaux officiels. Partez toujours du dépôt ou de la page de modèle de MiniMax plutôt que d'un miroir : les versions quantifiées et GGUF qui circulent sont des remises en ligne communautaires, pas des publications officielles, et leur qualité comme leur provenance diffèrent. Rappelons aussi que H3-Context-IR et H3-Regenerate-2K ne figurent dans aucun téléchargement : ils n'existent que dans le service hébergé.
MiniMax H3 compte environ 33 milliards de paramètres. Sur disque, cela représente des dizaines de gigaoctets en pleine précision, ce qui explique le passage rapide de la communauté aux formats quantifiés : GGUF de Q2 à Q5, INT8 et INT4 élagué, ainsi que NF4, chacun réduisant le téléchargement et l'empreinte VRAM au prix d'une part de qualité.
MiniMax H3 Turbo est une variante distillée du modèle en 4 étapes, avec une accélération d'environ 3,5x par rapport à la génération standard d'après les retours, accompagnée d'un LoRA Turbo correspondant. Elle vise à réduire le temps de génération, principal point de friction lorsqu'on fait tourner un modèle de cette taille en local.
Oui. MiniMax propose le modèle via sa propre API et l’application Hailuo, et les plateformes hébergées permettent de générer des vidéos dans le navigateur sans aucune configuration locale. Sur Wowovid, la génération texte vers vidéo avec MiniMax H3 est disponible dès maintenant — sans GPU, sans téléchargement et sans environnement ComfyUI — en 768P ou 2K et de 4 à 15 secondes par clip. Voir notre page MiniMax H3 pour ce que fait le modèle et sa comparaison avec Kling AI et Seedance 2.5.
Plateforme indépendante
« MiniMax H3 », « MiniMax » et « Hailuo » sont des marques de MiniMax, utilisées ici à des fins purement descriptives. Wowovid est une plateforme indépendante proposant des dizaines de modèles de génération d'images et de vidéos ; elle n'est ni affiliée à MiniMax, ni approuvée ou sponsorisée par MiniMax. ComfyUI est un projet open source indépendant, lui aussi sans lien avec Wowovid.
Passez l'étape configuration
Si c’est la vidéo qui vous intéresse et non l’environnement, générez directement dans votre navigateur : la génération texte vers vidéo avec MiniMax H3 est active sur Wowovid, sans GPU, sans téléchargements et sans graphe de workflow à déboguer.