Experimental
Referencia práctica8–12 GB de VRAM
Solo es posible con flujos de poca VRAM, pesos cuantizados, salidas más pequeñas y mucho offloading a CPU.
Guía de hardware MiniMax H3 · Actualizado el 8 de agosto de 2026
MiniMax H3 puede ejecutarse en local, pero no hay una cifra oficial única de VRAM mínima. Lo que necesitas depende de si usas archivos INT8 compactos, un build GGUF o los checkpoints BF16 originales.
Respuesta rápida: 16 GB es viable con cuantización y offloading; 24–32 GB resulta más cómodo; 8–12 GB es experimental.
Comprueba tu equipo antes de descargar 42,5 GB o más.
Comprobador de hardware
Elige tu hardware y el flujo que quieres usar. Estimamos la compatibilidad real con los archivos compactos actuales de ComfyUI y los despliegues publicados.
Sirve para un flujo compacto de ComfyUI con offloading a CPU. Empieza con resolución de vista previa y clips cortos antes de subir la carga.
Solo una referencia práctica: no es una certificación oficial de hardware de MiniMax.
Respuesta rápida
No hay un mínimo oficial único de VRAM. El objetivo práctico cambia con el formato de pesos, el flujo, la resolución y cuánto offloading a CPU uses.
Para la mayoría de usuarios de escritorio, 16 GB de VRAM con 64 GB de RAM es un punto de partida viable solo si usas pesos cuantizados y offloading a CPU. Una GPU de 24 GB resulta más cómoda; 32 GB da más margen para flujos de referencia y salidas más grandes.
Las rutas con 8–12 GB de VRAM son experimentales. Pueden exigir pesos GGUF, menos resolución, offloading agresivo y tiempos de generación mucho más largos.
«El modelo carga» y «se usa con holgura» no son el mismo requisito.
Experimental
Referencia prácticaSolo es posible con flujos de poca VRAM, pesos cuantizados, salidas más pequeñas y mucho offloading a CPU.
Viable
Referencia prácticaUn punto de partida práctico para flujos compactos INT8 o GGUF, mejor con al menos 64 GB de RAM.
Práctico
Referencia prácticaEncaja mejor con generación local, clips más largos y resoluciones de trabajo más altas, aunque sigas gestionando memoria.
Recomendado
Referencia prácticaMás margen para Ref2VA, salidas más grandes y menos compromisos agresivos de offloading.
Rutas de despliegue
El requisito de hardware cambia mucho según los archivos y el runtime que elijas.
| Ruta de despliegue | Ideal para | GPU local | Tamaño de archivos | Rasgo clave |
|---|---|---|---|---|
| Generador en el navegador | Probar y crear rápido | No hace falta | 0 GB | Arranque más rápido |
| ComfyUI INT8 | Creadores en local | 16–32 GB en la práctica | 42.5–63.5 GB | Nodos y flujos nativos |
| GGUF de la comunidad | Experimentos de poca VRAM | 8–16 GB | Según la cuantización | Más lento o con merma de calidad |
| BF16 original / SGLang | Despliegue profesional | Varias GPU | Grande | Servidor y producción |
Evidencia publicada
Solo aparecen especificaciones de primera mano y configuraciones con resultados publicados. Los campos no publicados se marcan con claridad, no se estiman.
| GPU | VRAM | RAM del sistema | Flujo | Resolución | Clip | Pasos | Resultado / tiempo | Evidencia |
|---|---|---|---|---|---|---|---|---|
| No publicado | No publicado | No publicado | ComfyUI nativo T2V / I2V / Ref2VA | Base 768p | 4–15 sec | No publicado | Disponible en ComfyUI 0.30+ | Especificación oficial Documentación ComfyUI H3 |
| 2× RTX 5090 | 2× 32 GB | 377 GiB detectados | BF16 lossless / SGLang | 1344×768 | 5 sec | 50 | 559,67 s de generación | Despliegue verificado Guía de despliegue SGLang |
Omitimos tiempos de benchmarks comunitarios hasta poder revisar hardware, flujo, ajustes, salida, fuente y fecha de la prueba.
La licencia comunitaria actual excluye de su territorio estándar de pesos abiertos a Estados Unidos, la Unión Europea, el Reino Unido y Corea del Sur. Las organizaciones de esas regiones pueden solicitar autorización; la API alojada se rige por otra política.
Archivos del modelo
El espacio en disco no es la VRAM de ejecución: un archivo de 21 GB no significa que 21 GB de VRAM basten.
| Componente | Archivo | Tamaño | Destino |
|---|---|---|---|
| Difusión FL2VA | minimax_h3_fl2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
| Codificador de texto | qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors | 15.7 GB | models/text_encoders/ |
| VAE de vídeo | minimax_h3_video_vae_fp16.safetensors | 5.21 GB | models/vae/ |
| VAE de audio | minimax_h3_audio_vae_fp32.safetensors | 0.61 GB | models/vae/ |
| Difusión Ref2VA | minimax_h3_ref2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
Desglose de almacenamiento
Estructura de carpetas
Coloca los archivos en las carpetas de modelo correspondientes de ComfyUI. Deja al menos 55–60 GB libres para T2V/I2V, o 80 GB si añades Ref2VA, para que el runtime tenga sitio para cachés y vídeo generado.
ComfyUI/models/ ├── diffusion_models/ (21–42 GB) ├── text_encoders/ (15,7 GB) └── vae/ (5,82 GB)
Plataformas
NVIDIA CUDA es hoy la ruta de consumo más práctica. La RAM del sistema gana importancia a medida que partes del modelo salen de la VRAM.
RAM según el flujo
Para un flujo compacto, 64 GB es un arranque más realista que 32 GB. 96–128 GB dan más aire al offloading a CPU.
La mejor compatibilidad de consumo ahora mismo. Archivos cuantizados y offloading a CPU pueden hacer viables tarjetas con menos VRAM; la velocidad y la estabilidad dependen del flujo.
La validación de SGLang cubre AMD Instinct MI300X y MI355X. No lo leas como soporte confirmado de Radeon de consumo.
El ComfyUI nativo actual y las rutas de despliegue publicadas no deben presentarse como un flujo verificado para Apple Silicon.
Salida local
El checkpoint descargable H3-Base genera 768p. El flujo 2K documentado por MiniMax añade H3-Context-IR y H3-Regenerate-2K alrededor de la generación base.
Checkpoint base descargable
Context IR + regeneración 2K
Especificación de salida alojada
ComfyUI
Las plantillas nativas conectan carga del modelo, condicionamiento de texto, muestreo, decodificación VAE y exportación de vídeo en un solo grafo.
FL2VA INT8 compacto
Qwen3-VL
Vídeo + audio
Salida MP4
Ejemplos de salida
Ejemplos creativos de MiniMax H3 de la biblioteca de producto. Muestran la salida del modelo, no el rendimiento de una GPU local.
Un retrato de moda cinematográfico junto a un coche clásico, de noche. La luz cálida del fuego recorre el cuero negro brillante mientras la cámara se acerca con contención al sujeto.
Un espadachín solitario cruza al amanecer un puerto de montaña cubierto de niebla. Cimas superpuestas se deslizan entre nubes pálidas mientras la cámara le sigue en un travelling lento y cinematográfico.
Ejemplo generado online con MiniMax H3. Muestra la salida del modelo, no el rendimiento de una GPU local.
Prueba antes de instalar
No hace falta descargar 42,5 GB de modelo solo para probar un prompt. Empieza en el navegador y decide después si el flujo local merece el montaje.
Sin instalar ComfyUI · Sin GPU local
FAQ
Respuestas prácticas sobre flujos locales de ComfyUI, experimentos de poca VRAM, almacenamiento y generación alojada.
MiniMax no ha publicado una cifra universal de VRAM mínima. El requisito cambia con el runtime y el formato de pesos. Para flujos compactos de ComfyUI, 16 GB de VRAM y 64 GB de RAM es un punto de partida viable; 24–32 GB de VRAM dan una experiencia local más cómoda.
Flujos experimentales de poca VRAM pueden arrancar en tarjetas de 8 GB con pesos cuantizados, menos resolución y offloading agresivo a CPU. No es el valor por defecto recomendado y puede ser muy lento.
Dieciséis gigabytes pueden ser viables para flujos compactos INT8 o GGUF con offloading a CPU. Empieza con clips cortos y resolución de vista previa, y usa al menos 64 GB de RAM si puedes.
El paquete compacto T2V/I2V de ComfyUI ocupa unos 42,5 GB. Si añades el modelo de difusión Ref2VA, los archivos del modelo suman unos 63,5 GB. Hace falta espacio extra para cachés y vídeos generados.
Treinta y dos gigabytes es un punto de partida experimental. Sesenta y cuatro son más prácticos para flujos cuantizados; 96–128 GB dan más margen al offloading a CPU.
Hoy no debería presentarse un flujo estable de Apple Silicon como oficialmente verificado. Las rutas publicadas de ComfyUI y de servidor se centran sobre todo en CUDA y hardware de centro de datos validado.
El checkpoint descargable H3-Base produce 768p. El flujo 2K documentado añade H3-Regenerate-2K y componentes de orquestación alojada alrededor de la generación base.
La guía oficial del flujo MiniMax H3 exige ahora ComfyUI 0.30.0 o posterior.
Sí. Un generador alojado de MiniMax H3 ejecuta el modelo en remoto: solo necesitas un navegador actual y conexión a internet.
Fuentes y política de actualización
El ecosistema local de MiniMax H3 evoluciona rápido. Tamaños de archivo, soporte de runtime, builds cuantizados y el comportamiento del hardware pueden cambiar. Esta página separa las especificaciones oficiales de las estimaciones prácticas de despliegue.
Última revisión: 8 de agosto de 2026
Sáltate el montaje local
Conservas el prompt, el modo de generación, la imagen, la relación de aspecto, la duración y el modelo MiniMax H3 al pasar al generador online.