MiniMax H3 en ComfyUI: pesos abiertos, requisitos y límites
MiniMax H3 funciona en ComfyUI de forma nativa: la compatibilidad se integró el mismo día en que se publicaron los pesos abiertos, el 3 de agosto de 2026. Pero aquí «código abierto» tiene un alcance concreto: el modelo H3-Base es abierto bajo la MiniMax H3 Community License, mientras que dos piezas del pipeline alojado no se han publicado en absoluto. Esta página explica qué obtienes realmente en local, qué hardware hace falta y de dónde salen las versiones de la comunidad.
Pesos abiertos, VRAM, GGUF, LoRA: el panorama práctico.
MiniMax H3, ComfyUI y el despliegue local
Esto no es una guía de instalación paso a paso: los sitios de documentación especializados en ComfyUI cubren la instalación mejor que nosotros. Lo que sigue es el estado real de cada cosa que la gente busca antes de empezar.
¿MiniMax H3 funciona en ComfyUI?
Sí, de forma nativa. MiniMax H3 se lanzó el 31 de julio de 2026 en la API de MiniMax y en la app Hailuo como modelo exclusivamente alojado. El 3 de agosto de 2026, MiniMax publicó los pesos abiertos de H3-Base, incluidos los checkpoints FL2VA y Ref2VA, bajo la MiniMax H3 Community License, y ese mismo día se integró la compatibilidad nativa con ComfyUI mediante una pull request. No necesitas un pack de nodos personalizados de terceros para cargar el modelo base.
Qué es abierto y qué no
Abierto: los pesos del modelo H3-Base con los checkpoints FL2VA y Ref2VA, aproximadamente 33B de parámetros, bajo la MiniMax H3 Community License. No abierto: H3-Context-IR, el sistema de preprocesado y mejora de prompts, y H3-Regenerate-2K, el módulo de escalado a 2K. Ambos siguen siendo funciones exclusivas del servicio alojado. Por tanto, una instalación local de ComfyUI que ejecute los pesos abiertos no reproduce el pipeline completo: en particular, la ruta de salida a 2K y la capa de mejora de prompts no forman parte de lo que descargas.
¿Cuánta VRAM necesita MiniMax H3?
MiniMax no ha publicado requisitos oficiales de VRAM por precisión, así que todas las cifras que circulan proceden de la comunidad y deben tomarse como estimaciones, no como especificaciones. Con unos 33B de parámetros, la inferencia a precisión completa está claramente en el terreno de las GPU de gama alta. Por debajo, la comunidad ha producido versiones INT8 e INT4 podadas, cuantizaciones GGUF de Q2 a Q5 y versiones NF4 de 4 bits, y se ha informado de que NF4 llega a funcionar con unos 8 GB de VRAM. Esa cifra de 8 GB procede de informes de la comunidad, no de MiniMax, y los niveles de cuantización más bajos sacrifican calidad y velocidad a cambio de menos consumo.
¿Existe un GGUF oficial de MiniMax H3?
No. La publicación abierta de MiniMax cubre H3-Base y sus checkpoints, pero no incluye archivos GGUF. Todas las versiones GGUF de MiniMax H3 en circulación, junto con las podadas INT4/INT8 y las NF4, las ha producido la comunidad después del lanzamiento del 3 de agosto. Eso significa que la calidad, la nomenclatura y la corrección varían entre subidas, y que no hay una versión de referencia avalada por el fabricante con la que contrastar. Si eliges este camino, valora quién ha publicado cada cuantización y cómo se ha generado.
LoRA de MiniMax H3 y H3 Turbo
MiniMax H3 Turbo es una variante destilada que genera en 4 pasos, con una aceleración de aproximadamente 3,5x sobre el modelo estándar según lo informado, y cuenta con su correspondiente LoRA Turbo. Más allá de eso, se aplica la dinámica habitual del ecosistema LoRA: como los pesos base son abiertos, con el tiempo aparecen LoRA entrenados por la comunidad para estilos y sujetos concretos, con la misma advertencia sobre la fiabilidad del origen que las versiones cuantizadas.
¿Puedo usar MiniMax H3 sin ComfyUI?
Sí: el modelo también está disponible como servicio alojado a través de la API de MiniMax y de la app Hailuo, que es donde reside el pipeline completo, incluidos Context-IR y el escalado a 2K. Si tu objetivo es generar vídeo y no ejecutar modelos en local, una plataforma alojada elimina por completo la GPU, las descargas y el entorno. En Wowovid, la generación de texto a vídeo con MiniMax H3 ya está activa a 768P o 2K y de 4 a 15 segundos, directamente desde el navegador.
Lo que cuesta realmente cada camino
Ejecutar pesos abiertos en local es la opción correcta para ciertos trabajos: control total, uso sin conexión, entrenamiento de LoRA propios. Es la opción equivocada si solo quieres el clip. Esta es la comparación honesta.
Ejecutar MiniMax H3 en ComfyUI
- Una GPU con suficiente VRAM para la precisión que elijas: la precisión completa exige hardware de gama alta, y las opciones con menos VRAM implican versiones cuantizadas de la comunidad con pérdidas de calidad.
- Decenas de gigabytes de descargas para un modelo de unos 33B de parámetros, más los checkpoints y los LoRA que uses.
- Una instalación de ComfyUI funcionando, versiones de nodos correctas y un grafo de flujo de trabajo que mantienes tú.
- Sin la mejora de prompts de H3-Context-IR y sin el escalado de H3-Regenerate-2K: son exclusivos del servicio alojado y no forman parte de la publicación abierta.
- La resolución de problemas corre de tu cuenta: versiones de controladores, errores de VRAM y versiones de la comunidad de procedencia desigual.
Generar en Wowovid
- Abre la página en un navegador. Sin GPU, sin controladores y sin presupuesto de VRAM que planificar.
- Nada que descargar y nada que mantener actualizado: ni checkpoints, ni packs de nodos, ni versiones cuantizadas que revisar.
- La generación de texto a vídeo con MiniMax H3 ya está activa: escribe un prompt, elige 768P o 2K y una duración de 4 a 15 segundos; el resultado se guarda en tu cuenta.
- Un único saldo de créditos para todos los modelos de vídeo e imagen de la plataforma, en lugar de una configuración por modelo.
- Exportación en HD y sin marca de agua en los planes de pago.
Despliegue local de MiniMax H3: preguntas frecuentes
Las dudas que más surgen al investigar cómo ejecutar MiniMax H3 en hardware propio.
MiniMax no ha publicado requisitos oficiales de VRAM, así que conviene tratar cualquier cifra que encuentres como una estimación de la comunidad. MiniMax H3 es un modelo de unos 33B de parámetros, lo que sitúa la inferencia a precisión completa en GPU de gama alta. Las versiones INT8, INT4 podadas, GGUF Q2–Q5 y NF4 creadas por la comunidad reducen mucho el requisito —se ha informado de que NF4 de 4 bits funciona con unos 8 GB de VRAM— a costa de la calidad de salida. Como estas versiones son de la comunidad y no oficiales, es normal que haya variaciones entre ellas.
Las configuraciones que no son NVIDIA resultan sistemáticamente más difíciles con modelos de vídeo grandes: el ecosistema en torno a ComfyUI, los formatos de cuantización y los kernels de atención están pensados sobre todo para CUDA, y las rutas para Apple Silicon y AMD dependen de un soporte comunitario que va por detrás y cuya madurez varía. MiniMax no ha hecho afirmaciones sobre compatibilidad de plataformas más allá de la propia publicación de pesos abiertos, así que no daremos aquí una respuesta categórica. Si tu hardware no es una GPU NVIDIA con bastante VRAM, generar en una plataforma alojada suele ser el camino más corto.
MiniMax publicó los pesos abiertos de H3-Base el 3 de agosto de 2026, incluidos los checkpoints FL2VA y Ref2VA, bajo la MiniMax H3 Community License, distribuidos a través de los canales oficiales de MiniMax. Empieza siempre por el repositorio o la página de modelo de la propia MiniMax en lugar de por un mirror: las versiones cuantizadas y GGUF que circulan son resubidas de la comunidad, no publicaciones oficiales, y su calidad y procedencia difieren. Recuerda también que H3-Context-IR y H3-Regenerate-2K no se incluyen en ninguna descarga: solo existen en el servicio alojado.
MiniMax H3 tiene aproximadamente 33B de parámetros. En disco, eso supone decenas de gigabytes a precisión completa, y por eso la comunidad se movió rápidamente hacia formatos cuantizados: GGUF de Q2 a Q5, INT8 e INT4 podado, y NF4, cada uno reduciendo la descarga y el consumo de VRAM a cambio de algo de calidad de salida.
MiniMax H3 Turbo es una variante destilada del modelo en 4 pasos, con una aceleración de aproximadamente 3,5x sobre la ruta de generación estándar según lo informado, y con un LoRA Turbo correspondiente. Está pensada para recortar el tiempo de generación, que es el principal punto débil de ejecutar en local un modelo de este tamaño.
Sí. MiniMax ofrece el modelo a través de su propia API y de la app Hailuo, y las plataformas alojadas permiten generar vídeo en el navegador sin ninguna configuración local. En Wowovid, la generación de texto a vídeo con MiniMax H3 está disponible ahora mismo —sin GPU, sin descargas y sin entorno de ComfyUI— a 768P o 2K y de 4 a 15 segundos por clip. Consulta nuestra página de MiniMax H3 para ver qué hace el modelo y cómo se compara con Kling AI y Seedance 2.5.
Plataforma independiente
«MiniMax H3», «MiniMax» y «Hailuo» son marcas de MiniMax y se utilizan aquí únicamente con fines descriptivos. Wowovid es una plataforma independiente que ofrece decenas de modelos de generación de imagen y vídeo, y no está afiliada, respaldada ni patrocinada por MiniMax. ComfyUI es un proyecto de código abierto independiente, igualmente sin vinculación con Wowovid.
Sáltate la instalación
Si lo que buscas es el vídeo y no el entorno, genera desde el navegador: la generación de texto a vídeo con MiniMax H3 ya está activa en Wowovid, sin GPU, sin descargas y sin un grafo de flujo de trabajo que depurar.