Sperimentale
Riferimento pratico8–12 GB di VRAM
Possibile solo con workflow a bassa VRAM, pesi quantizzati, output ridotti e molto offload su CPU.
Guida hardware MiniMax H3 · Aggiornata l’8 agosto 2026
MiniMax H3 può girare in locale, ma non esiste una cifra ufficiale unica di VRAM minima. Il fabbisogno reale dipende dai file INT8 compatti, da un build GGUF o dai checkpoint BF16 originali.
In sintesi: 16 GB sono fattibili con quantizzazione e offload; 24–32 GB risultano più comodi; 8–12 GB restano sperimentali.
Controlla l’hardware prima di scaricare 42,5 GB o più.
Controllo hardware
Scegli hardware e workflow previsto. Stimiamo la compatibilità reale con i file ComfyUI compatti attuali e i deployment pubblicati.
Adatta a un workflow ComfyUI compatto con offload su CPU. Parti da risoluzione di anteprima e clip brevi prima di alzare il carico.
Solo un riferimento pratico — non è una certificazione hardware ufficiale MiniMax.
Risposta rapida
Non esiste un minimo ufficiale unico di VRAM. L’obiettivo pratico cambia con formato dei pesi, workflow, risoluzione e quantità di offload su CPU.
Per la maggior parte degli utenti desktop, 16 GB di VRAM con 64 GB di RAM sono un punto di partenza fattibile solo con pesi quantizzati e offload su CPU. Una GPU da 24 GB è più comoda; 32 GB lasciano più margine per i workflow di riferimento e output più grandi.
I percorsi con 8–12 GB di VRAM sono sperimentali. Possono richiedere pesi GGUF, risoluzioni più basse, offload aggressivo e tempi di generazione nettamente più lunghi.
«Il modello si carica» e «si usa con agio» non sono lo stesso requisito.
Sperimentale
Riferimento praticoPossibile solo con workflow a bassa VRAM, pesi quantizzati, output ridotti e molto offload su CPU.
Fattibile
Riferimento praticoUn punto di partenza realistico per workflow INT8 o GGUF compatti, meglio con almeno 64 GB di RAM.
Pratico
Riferimento praticoPiù adatta alla generazione locale, clip più lunghi e risoluzioni di lavoro più alte, pur gestendo ancora la memoria.
Consigliato
Riferimento praticoPiù margine per Ref2VA, output più grandi e meno compromessi aggressivi di offload.
Percorsi di deployment
Il fabbisogno hardware cambia moltissimo a seconda dei file e del runtime che scegli.
| Percorso | Ideale per | GPU locale | Dimensione file | Tratto distintivo |
|---|---|---|---|---|
| Generatore nel browser | Test e creazione rapidi | Non richiesta | 0 GB | Avvio più veloce |
| ComfyUI INT8 | Creator in locale | 16–32 GB in pratica | 42.5–63.5 GB | Nodi e workflow nativi |
| GGUF della community | Esperimenti a bassa VRAM | 8–16 GB | Dipende dalla quantizzazione | Più lento o calo di qualità |
| BF16 originale / SGLang | Deployment professionale | Multi-GPU | Grande | Server e produzione |
Evidenze pubblicate
Qui compaiono solo specifiche di prima mano e configurazioni con risultati pubblicati. I campi non pubblicati restano esplicitamente segnalati, senza stime.
| GPU | VRAM | RAM di sistema | Workflow | Risoluzione | Clip | Passaggi | Risultato / tempo | Evidenza |
|---|---|---|---|---|---|---|---|---|
| Non pubblicato | Non pubblicato | Non pubblicato | ComfyUI nativo T2V / I2V / Ref2VA | Base 768p | 4–15 sec | Non pubblicato | Disponibile in ComfyUI 0.30+ | Specifica ufficiale Documentazione ComfyUI H3 |
| 2× RTX 5090 | 2× 32 GB | 377 GiB rilevati | BF16 lossless / SGLang | 1344×768 | 5 sec | 50 | 559,67 s di generazione | Deployment verificato Guida al deployment SGLang |
Omettiamo i tempi dei benchmark della community finché hardware, workflow, impostazioni, output, fonte e data del test non sono tutti verificabili.
La licenza community attuale esclude Stati Uniti, Unione europea, Regno Unito e Corea del Sud dal territorio open-weight standard. Le organizzazioni di quelle regioni possono chiedere un’autorizzazione; la disponibilità dell’API hosted segue un’altra policy.
File del modello
Lo spazio su disco non è la VRAM di runtime: un file da 21 GB non significa che 21 GB di VRAM bastino.
| Componente | File | Dimensione | Destinazione |
|---|---|---|---|
| Diffusione FL2VA | minimax_h3_fl2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
| Codificatore di testo | qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors | 15.7 GB | models/text_encoders/ |
| VAE video | minimax_h3_video_vae_fp16.safetensors | 5.21 GB | models/vae/ |
| VAE audio | minimax_h3_audio_vae_fp32.safetensors | 0.61 GB | models/vae/ |
| Diffusione Ref2VA | minimax_h3_ref2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
Dettaglio spazio
Struttura delle cartelle
Metti i file nelle cartelle modello corrispondenti di ComfyUI. Tieni almeno 55–60 GB liberi per T2V/I2V, o 80 GB con Ref2VA, così runtime, cache e video generati hanno spazio.
ComfyUI/models/ ├── diffusion_models/ (21–42 GB) ├── text_encoders/ (15,7 GB) └── vae/ (5,82 GB)
Piattaforme
NVIDIA CUDA è oggi il percorso consumer più realistico. La RAM di sistema diventa più importante man mano che parti del modello escono dalla VRAM.
RAM per workflow
Per un workflow compatto, 64 GB sono un avvio più realistico di 32 GB. 96–128 GB danno più aria all’offload su CPU.
La migliore compatibilità consumer attuale. File quantizzati e offload su CPU possono rendere possibili schede con meno VRAM; velocità e stabilità dipendono dal workflow.
La validazione SGLang copre AMD Instinct MI300X e MI355X. Non interpretarlo come supporto confermato per le Radeon consumer.
Il ComfyUI nativo attuale e i percorsi di deployment pubblicati non vanno presentati come un workflow Apple Silicon verificato.
Output locale
Il checkpoint scaricabile H3-Base genera 768p. Il workflow 2K documentato da MiniMax aggiunge H3-Context-IR e H3-Regenerate-2K intorno alla generazione di base.
Checkpoint base scaricabile
Context IR + rigenerazione 2K
Specifica di output hosted
ComfyUI
I template nativi collegano caricamento del modello, condizionamento del testo, sampling, decodifica VAE ed export video in un unico grafo.
Pesi FL2VA INT8
Qwen3-VL
Video + audio
Output MP4
Esempi di output
Esempi creativi MiniMax H3 dalla libreria prodotto esistente. Mostrano l’output del modello, non le prestazioni di una GPU locale.
Un ritratto di moda cinematografico accanto a un’auto d’epoca, di notte. La luce calda del fuoco scorre sulla pelle nera lucida mentre la camera si avvicina con misura al soggetto.
Uno spadaccino solitario attraversa all’alba un valico avvolto nella nebbia. Cime sovrapposte scivolano tra nubi pallide, la camera lo segue in un carrello lento e cinematografico.
Esempio generato online con MiniMax H3. Mostra l’output del modello, non le prestazioni di una GPU locale.
Prova prima di installare
Non serve scaricare 42,5 GB di modello solo per testare un prompt. Parti dal browser e poi decidi se il workflow locale vale l’installazione.
Nessuna installazione ComfyUI · GPU locale non richiesta
FAQ
Risposte pratiche su workflow ComfyUI locali, esperimenti a bassa VRAM, spazio su disco e generazione hosted.
MiniMax non ha pubblicato una cifra universale di VRAM minima. Il requisito cambia con runtime e formato dei pesi. Per workflow ComfyUI compatti, 16 GB di VRAM e 64 GB di RAM sono un punto di partenza fattibile; 24–32 GB di VRAM danno un’esperienza locale più comoda.
Workflow sperimentali a bassa VRAM possono partire su schede da 8 GB con pesi quantizzati, risoluzione più bassa e offload aggressivo su CPU. Non è l’impostazione consigliata e può essere molto lento.
Sedici gigabyte possono essere fattibili per workflow INT8 o GGUF compatti con offload su CPU. Parti da clip più corti e risoluzione di anteprima, e usa almeno 64 GB di RAM se puoi.
Il pacchetto ComfyUI T2V/I2V compatto occupa circa 42,5 GB. Aggiungendo il modello di diffusione Ref2VA, i file del modello arrivano a circa 63,5 GB. Serve altro spazio libero per cache e video generati.
Trentadue gigabyte sono un punto di partenza sperimentale. Sessantaquattro sono più pratici per i workflow quantizzati; 96–128 GB danno più margine all’offload su CPU.
Un workflow Apple Silicon stabile non dovrebbe, al momento, essere presentato come ufficialmente verificato. I percorsi ComfyUI e server pubblicati puntano soprattutto a CUDA e hardware da datacenter validato.
Il checkpoint scaricabile H3-Base produce 768p. Il workflow 2K documentato aggiunge H3-Regenerate-2K e un’orchestrazione hosted intorno alla generazione di base.
La guida ufficiale al workflow MiniMax H3 richiede attualmente ComfyUI 0.30.0 o successivo.
Sì. Un generatore MiniMax H3 hosted esegue il modello in remoto: ti servono solo un browser recente e una connessione internet.
Fonti e aggiornamento
L’ecosistema locale di MiniMax H3 evolve in fretta. Dimensioni dei file, supporto runtime, build quantizzati e comportamento hardware possono cambiare. Questa pagina separa le specifiche ufficiali dai riferimenti pratici di deployment.
Ultima verifica: 8 agosto 2026
Salta l’installazione locale
Prompt, modalità di generazione, immagine, formato, durata e scelta del modello MiniMax H3 restano salvati quando passi al generatore online.