Expérimental
Repère pratique8–12 Go de VRAM
Possible uniquement via des workflows faible VRAM, des poids quantifiés, des sorties réduites et un fort déchargement CPU.
Guide matériel MiniMax H3 · Mis à jour le 8 août 2026
MiniMax H3 peut tourner en local, mais il n’existe pas de chiffre officiel unique de VRAM minimale. Le besoin réel dépend des fichiers INT8 allégés, d’un build GGUF ou des checkpoints BF16 d’origine.
En bref : 16 Go suffisent pour démarrer avec quantification et déchargement CPU ; 24–32 Go sont plus confortables ; 8–12 Go restent expérimentaux.
Vérifiez votre machine avant de télécharger 42,5 Go ou plus.
Vérificateur matériel
Choisissez votre matériel et le workflow visé. Nous estimons la compatibilité réelle à partir des fichiers ComfyUI allégés actuels et des déploiements publiés.
Convient à un workflow ComfyUI allégé avec déchargement CPU. Commencez en résolution d’aperçu et avec des clips courts avant d’augmenter la charge.
Repère pratique uniquement — pas une certification matérielle officielle MiniMax.
Réponse rapide
Il n’existe pas de minimum officiel unique. Le besoin pratique change selon le format de poids, le workflow, la résolution et le volume de déchargement CPU.
Pour la plupart des utilisateurs desktop, 16 Go de VRAM avec 64 Go de RAM n’est un point de départ utilisable qu’avec des poids quantifiés et du déchargement CPU. Un GPU 24 Go est plus confortable ; 32 Go laisse davantage de marge pour les workflows de référence et les sorties plus grandes.
Les chemins en 8–12 Go de VRAM sont expérimentaux. Ils peuvent exiger des poids GGUF, une résolution plus basse, un déchargement agressif, et des temps de génération nettement plus longs.
« Le modèle se charge » et « c’est confortable à utiliser » ne sont pas la même exigence.
Expérimental
Repère pratiquePossible uniquement via des workflows faible VRAM, des poids quantifiés, des sorties réduites et un fort déchargement CPU.
Utilisable
Repère pratiqueUn point de départ réaliste pour des workflows INT8 ou GGUF allégés, de préférence avec au moins 64 Go de RAM.
Confortable
Repère pratiqueMieux adapté à la génération locale, aux clips plus longs et aux résolutions de travail plus élevées, tout en gérant encore la mémoire.
Recommandé
Repère pratiquePlus de marge pour Ref2VA, les sorties plus grandes, et moins de compromis agressifs de déchargement.
Chemins de déploiement
Le besoin matériel change fortement selon les fichiers et le runtime que vous prenez.
| Chemin | Idéal pour | GPU local | Taille des fichiers | Trait distinctif |
|---|---|---|---|---|
| Générateur navigateur | Tester et créer vite | Non requis | 0 GB | Démarrage le plus rapide |
| ComfyUI INT8 | Créateurs locaux | 16–32 Go en pratique | 42.5–63.5 GB | Nœuds et workflows natifs |
| GGUF communautaire | Expériences faible VRAM | 8–16 Go | Selon la quantification | Plus lent ou perte de qualité |
| BF16 d’origine / SGLang | Déploiement professionnel | Multi-GPU | Volumineux | Serveur et production |
Preuves publiées
Seules les spécifications de première main et les configurations aux résultats publiés figurent ici. Les champs non publiés restent explicitement marqués, sans estimation.
| GPU | VRAM | RAM système | Workflow | Résolution | Clip | Étapes | Résultat / temps | Preuve |
|---|---|---|---|---|---|---|---|---|
| Non publié | Non publié | Non publié | ComfyUI natif T2V / I2V / Ref2VA | Base 768p | 4–15 sec | Non publié | Disponible dans ComfyUI 0.30+ | Spécification officielle Documentation ComfyUI H3 |
| 2× RTX 5090 | 2× 32 GB | 377 Gio détectés | BF16 lossless / SGLang | 1344×768 | 5 sec | 50 | 559,67 s de génération | Déploiement vérifié Guide de déploiement SGLang |
Les timings de benchmarks communautaires sont omis tant que le matériel, le workflow, les réglages, la sortie, la source et la date de test ne sont pas tous vérifiables.
La licence communautaire actuelle exclut les États-Unis, l’Union européenne, le Royaume-Uni et la Corée du Sud de son territoire open-weight standard. Les organisations de ces régions peuvent demander une autorisation ; la disponibilité de l’API hébergée suit une autre politique.
Fichiers du modèle
L’espace disque n’est pas la VRAM d’exécution : un fichier de 21 Go ne veut pas dire que 21 Go de VRAM suffisent.
| Composant | Fichier | Taille | Emplacement |
|---|---|---|---|
| Diffusion FL2VA | minimax_h3_fl2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
| Encodeur de texte | qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors | 15.7 GB | models/text_encoders/ |
| VAE vidéo | minimax_h3_video_vae_fp16.safetensors | 5.21 GB | models/vae/ |
| VAE audio | minimax_h3_audio_vae_fp32.safetensors | 0.61 GB | models/vae/ |
| Diffusion Ref2VA | minimax_h3_ref2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
Détail du stockage
Arborescence
Placez les fichiers dans les dossiers modèle correspondants de ComfyUI. Gardez au moins 55–60 Go libres pour T2V/I2V, ou 80 Go avec Ref2VA, pour laisser de la place aux caches et aux vidéos générées.
ComfyUI/models/ ├── diffusion_models/ (21–42 Go) ├── text_encoders/ (15,7 Go) └── vae/ (5,82 Go)
Plateformes
NVIDIA CUDA est aujourd’hui le chemin grand public le plus réaliste. La RAM système devient d’autant plus importante que des composants du modèle quittent la VRAM.
RAM selon le workflow
Pour un workflow allégé, 64 Go est un meilleur point de départ que 32 Go. 96–128 Go laissent davantage d’air au déchargement CPU.
Meilleure compatibilité grand public actuelle. Fichiers quantifiés et déchargement CPU peuvent rendre possibles des cartes plus modestes — vitesse et stabilité dépendent du workflow.
La validation SGLang couvre AMD Instinct MI300X et MI355X. Ce n’est pas une confirmation pour les cartes Radeon grand public.
Le ComfyUI natif actuel et les chemins de déploiement publiés ne doivent pas être présentés comme un workflow Apple Silicon vérifié.
Sortie locale
Le checkpoint téléchargeable H3-Base génère du 768p. Le workflow 2K documenté par MiniMax ajoute H3-Context-IR et H3-Regenerate-2K autour de la génération de base.
Checkpoint de base téléchargeable
Context IR + régénération 2K
Spécification de sortie hébergée
ComfyUI
Les modèles natifs relient chargement du modèle, conditionnement texte, sampling, décodage VAE et export vidéo dans un seul graphe.
Poids FL2VA INT8
Qwen3-VL
Vidéo + audio
Sortie MP4
Exemples de sortie
Exemples créatifs MiniMax H3 issus de la bibliothèque produit. Ils montrent la sortie du modèle, pas les performances d’un GPU local.
Un portrait de mode cinématographique à côté d’une voiture classique, la nuit. Une lumière de feu chaude glisse sur le cuir noir brillant, tandis que la caméra s’avance avec retenue vers le sujet.
Un épéiste solitaire traverse à l’aube un col de montagne noyé de brume. Des crêtes superposées glissent dans des nuages pâles, la caméra le suit en travelling lent et cinématographique.
Exemple généré en ligne avec MiniMax H3. Il montre la sortie du modèle, pas les performances d’un GPU local.
Tester avant d’installer
Inutile de télécharger 42,5 Go de fichiers juste pour essayer un prompt. Commencez dans le navigateur, puis décidez si un workflow local vaut l’installation.
Pas d’installation ComfyUI · Pas de GPU local requis
FAQ
Réponses concrètes sur les workflows ComfyUI locaux, les essais en faible VRAM, le stockage et la génération hébergée.
MiniMax n’a pas publié de chiffre de VRAM minimale universel. L’exigence change selon le runtime et le format de poids. Pour des workflows ComfyUI allégés, 16 Go de VRAM et 64 Go de RAM constituent un point de départ utilisable ; 24–32 Go de VRAM offrent une expérience locale plus confortable.
Des workflows expérimentaux faible VRAM peuvent démarrer sur des cartes 8 Go avec des poids quantifiés, une résolution plus basse et un déchargement CPU agressif. Ce n’est pas le réglage recommandé, et ce peut être très lent.
Seize gigaoctets peuvent suffire pour des workflows INT8 ou GGUF allégés avec déchargement CPU. Commencez par des clips courts et une résolution d’aperçu, et visez au moins 64 Go de RAM si possible.
Le jeu de fichiers ComfyUI T2V/I2V allégé pèse environ 42,5 Go. En ajoutant le modèle de diffusion Ref2VA, les fichiers du modèle montent à environ 63,5 Go. Il faut encore de l’espace libre pour les caches et les vidéos générées.
Trente-deux gigaoctets sont un point de départ expérimental. Soixante-quatre gigaoctets sont plus réalistes pour les workflows quantifiés ; 96–128 Go laissent davantage de marge au déchargement CPU.
Un workflow Apple Silicon stable ne devrait pas, aujourd’hui, être présenté comme officiellement vérifié. Les chemins ComfyUI et serveur publiés visent surtout CUDA et du matériel datacenter validé.
Le checkpoint téléchargeable H3-Base produit du 768p. Le workflow 2K documenté ajoute H3-Regenerate-2K et une orchestration hébergée autour de la génération de base.
Le guide officiel du workflow MiniMax H3 exige actuellement ComfyUI 0.30.0 ou plus récent.
Oui. Un générateur MiniMax H3 hébergé exécute le modèle à distance : un navigateur récent et une connexion internet suffisent.
Sources et politique de mise à jour
L’écosystème local de MiniMax H3 évolue vite. Tailles de fichiers, support runtime, builds quantifiés et comportement matériel peuvent changer. Cette page sépare les spécifications officielles des repères pratiques de déploiement.
Dernière vérification : 8 août 2026
Éviter l’installation locale
Votre prompt, le mode de génération, l’image, le format, la durée et le modèle MiniMax H3 sont conservés lorsque vous poursuivez vers le générateur en ligne.