Experimental
Referência prática8–12 GB de VRAM
Só é possível com fluxos de pouca VRAM, pesos quantizados, saídas menores e bastante offload para CPU.
Guia de hardware MiniMax H3 · Atualizado em 8 de agosto de 2026
O MiniMax H3 pode rodar localmente, mas não existe um número oficial único de VRAM mínima. O que você precisa depende de arquivos INT8 compactos, de um build GGUF ou dos checkpoints BF16 originais.
Resposta rápida: 16 GB é viável com quantização e offload; 24–32 GB fica mais confortável; 8–12 GB continua experimental.
Confira o hardware antes de baixar 42,5 GB ou mais.
Checagem de hardware
Escolha o hardware e o fluxo que pretende usar. Estimamos a compatibilidade real com os arquivos compactos atuais do ComfyUI e as implantações publicadas.
Serve para um fluxo compacto de ComfyUI com offload para CPU. Comece com resolução de preview e clipes curtos antes de aumentar a carga.
Apenas uma referência prática — não é uma certificação oficial de hardware da MiniMax.
Resposta rápida
Não há um mínimo oficial único de VRAM. O alvo prático muda com o formato dos pesos, o fluxo, a resolução e o quanto de offload para CPU você usa.
Para a maioria das pessoas no desktop, 16 GB de VRAM com 64 GB de RAM só é um ponto de partida viável com pesos quantizados e offload para CPU. Uma GPU de 24 GB fica mais confortável; 32 GB dá mais folga para fluxos de referência e saídas maiores.
Caminhos com 8–12 GB de VRAM são experimentais. Podem exigir pesos GGUF, resoluções menores, offload agressivo e tempos de geração bem mais longos.
“O modelo carrega” e “dá para usar com folga” não são o mesmo requisito.
Experimental
Referência práticaSó é possível com fluxos de pouca VRAM, pesos quantizados, saídas menores e bastante offload para CPU.
Viável
Referência práticaUm ponto de partida realista para fluxos compactos INT8 ou GGUF, de preferência com pelo menos 64 GB de RAM.
Prático
Referência práticaEncaixa melhor em geração local, clipes mais longos e resoluções de trabalho mais altas, ainda gerenciando memória.
Recomendado
Referência práticaMais folga para Ref2VA, saídas maiores e menos concessões agressivas de offload.
Caminhos de implantação
O requisito de hardware muda bastante conforme os arquivos e o runtime que você escolhe.
| Caminho | Melhor para | GPU local | Tamanho dos arquivos | Traço principal |
|---|---|---|---|---|
| Gerador no navegador | Testar e criar rápido | Não é necessário | 0 GB | Começo mais rápido |
| ComfyUI INT8 | Criadores que trabalham localmente | 16–32 GB na prática | 42.5–63.5 GB | Nós e fluxos nativos |
| GGUF da comunidade | Experimentos de pouca VRAM | 8–16 GB | Depende da quantização | Mais lento ou perda de qualidade |
| BF16 original / SGLang | Implantação profissional | Várias GPUs | Grande | Servidor e produção |
Evidência publicada
Só entram especificações de primeira mão e configurações com resultados publicados. Campos não publicados ficam marcados com clareza, sem estimativa.
| GPU | VRAM | RAM do sistema | Fluxo | Resolução | Clipe | Etapas | Resultado / tempo | Evidência |
|---|---|---|---|---|---|---|---|---|
| Não publicado | Não publicado | Não publicado | ComfyUI nativo T2V / I2V / Ref2VA | Base 768p | 4–15 sec | Não publicado | Disponível no ComfyUI 0.30+ | Especificação oficial Documentação ComfyUI H3 |
| 2× RTX 5090 | 2× 32 GB | 377 GiB detectados | BF16 lossless / SGLang | 1344×768 | 5 sec | 50 | 559,67 s de geração | Implantação verificada Guia de implantação SGLang |
Tempos de benchmark da comunidade ficam de fora até hardware, fluxo, ajustes, saída, fonte e data do teste poderem ser conferidos juntos.
A licença comunitária atual exclui Estados Unidos, União Europeia, Reino Unido e Coreia do Sul do território padrão de pesos abertos. Organizações dessas regiões podem pedir autorização; a disponibilidade da API hospedada segue outra política.
Arquivos do modelo
Espaço em disco não é VRAM de execução: um arquivo de 21 GB não significa que 21 GB de VRAM bastem.
| Componente | Arquivo | Tamanho | Destino |
|---|---|---|---|
| Difusão FL2VA | minimax_h3_fl2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
| Codificador de texto | qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors | 15.7 GB | models/text_encoders/ |
| VAE de vídeo | minimax_h3_video_vae_fp16.safetensors | 5.21 GB | models/vae/ |
| VAE de áudio | minimax_h3_audio_vae_fp32.safetensors | 0.61 GB | models/vae/ |
| Difusão Ref2VA | minimax_h3_ref2va_pruned_int8_convrot.safetensors | 21 GB | models/diffusion_models/ |
Detalhamento de armazenamento
Estrutura de pastas
Coloque os arquivos nas pastas de modelo correspondentes do ComfyUI. Deixe pelo menos 55–60 GB livres para T2V/I2V, ou 80 GB com Ref2VA, para o runtime ter espaço de cache e vídeo gerado.
ComfyUI/models/ ├── diffusion_models/ (21–42 GB) ├── text_encoders/ (15,7 GB) └── vae/ (5,82 GB)
Plataformas
NVIDIA CUDA é hoje o caminho de consumo mais realista. A RAM do sistema ganha importância à medida que partes do modelo saem da VRAM.
RAM por fluxo
Para um fluxo compacto, 64 GB é um começo mais realista do que 32 GB. 96–128 GB dão mais folga ao offload para CPU.
Melhor compatibilidade de consumo no momento. Arquivos quantizados e offload para CPU podem viabilizar placas com menos VRAM; velocidade e estabilidade dependem do fluxo.
A validação do SGLang cobre AMD Instinct MI300X e MI355X. Não leia isso como suporte confirmado a Radeon de consumo.
O ComfyUI nativo atual e os caminhos de implantação publicados não devem ser apresentados como um fluxo verificado para Apple Silicon.
Saída local
O checkpoint baixável H3-Base gera 768p. O fluxo 2K documentado pela MiniMax acrescenta H3-Context-IR e H3-Regenerate-2K em volta da geração base.
Checkpoint base para download
Context IR + regeneração 2K
Especificação de saída hospedada
ComfyUI
Os templates nativos ligam carregamento do modelo, condicionamento de texto, sampling, decodificação VAE e exportação de vídeo num único grafo.
Pesos FL2VA INT8
Qwen3-VL
Vídeo + áudio
Saída MP4
Exemplos de saída
Exemplos criativos do MiniMax H3 da biblioteca de produto. Mostram a saída do modelo, não o desempenho de uma GPU local.
Um retrato de moda cinematográfico ao lado de um clássico, à noite. A luz quente do fogo atravessa o couro preto brilhante enquanto a câmera se aproxima com contenção do sujeito.
Um espadachim solitário atravessa ao amanhecer um desfiladeiro coberto de névoa. Picos em camadas deslizam por nuvens pálidas enquanto a câmera o segue num travelling lento e cinematográfico.
Exemplo gerado online com MiniMax H3. Mostra a saída do modelo, não o desempenho de uma GPU local.
Teste antes de instalar
Você não precisa baixar 42,5 GB de modelo só para testar um prompt. Comece no navegador e depois decida se o fluxo local vale a instalação.
Sem instalar ComfyUI · Sem GPU local
FAQ
Respostas práticas sobre fluxos locais de ComfyUI, experimentos de pouca VRAM, armazenamento e geração hospedada.
A MiniMax não publicou um número universal de VRAM mínima. O requisito muda com o runtime e o formato dos pesos. Para fluxos compactos de ComfyUI, 16 GB de VRAM e 64 GB de RAM são um ponto de partida viável; 24–32 GB de VRAM deixam a experiência local mais confortável.
Fluxos experimentais de pouca VRAM podem subir em placas de 8 GB com pesos quantizados, resolução menor e offload agressivo para CPU. Não é o padrão recomendado e pode ficar bem lento.
Dezesseis gigabytes podem ser viáveis para fluxos compactos INT8 ou GGUF com offload para CPU. Comece com clipes mais curtos e resolução de preview, e use pelo menos 64 GB de RAM quando possível.
O pacote compacto T2V/I2V do ComfyUI tem cerca de 42,5 GB. Somando o modelo de difusão Ref2VA, os arquivos do modelo chegam a cerca de 63,5 GB. Ainda é preciso espaço livre para caches e vídeos gerados.
Trinta e dois gigabytes são um ponto de partida experimental. Sessenta e quatro são mais práticos para fluxos quantizados; 96–128 GB dão mais folga ao offload para CPU.
Um fluxo estável de Apple Silicon não deve, no momento, ser apresentado como oficialmente verificado. Os caminhos publicados de ComfyUI e de servidor focam principalmente em CUDA e hardware de datacenter validado.
O checkpoint baixável H3-Base produz 768p. O fluxo 2K documentado acrescenta H3-Regenerate-2K e orquestração hospedada em volta da geração base.
O guia oficial do fluxo MiniMax H3 exige atualmente ComfyUI 0.30.0 ou posterior.
Sim. Um gerador hospedado do MiniMax H3 executa o modelo remotamente: basta um navegador atual e conexão com a internet.
Fontes e política de atualização
O ecossistema local do MiniMax H3 muda rápido. Tamanhos de arquivo, suporte de runtime, builds quantizados e o comportamento do hardware podem se alterar. Esta página separa especificações oficiais de referências práticas de implantação.
Última revisão: 8 de agosto de 2026
Pule a instalação local
Prompt, modo de geração, imagem, proporção, duração e a escolha do modelo MiniMax H3 seguem com você ao continuar no gerador online.