MiniMax H3 local ou na nuvem: o requisito que ninguém cita é um número de minutos
Tabelas de requisitos dizem quanta memória carrega. O que trava é o mesmo trabalho em 480p levar 182 segundos numa máquina e 90 minutos em outra.

Rodar por conta própria ou não se resume a três números: quanta memória você tem, quantos minutos um clipe te custa, e se a licença cobre onde você mora.
Nenhuma especificação mínima única cobre toda instalação: os requisitos se movem com o checkpoint, com a tela e com quanto transborda para a memória do host. O que é fixo: o menor download tem 42,47 GB, você recebe o H3-Base, ou seja, saída da classe 768 e nada de 2K, e a licença exclui os EUA, a UE, o Reino Unido e a Coreia do Sul. A saída hospedada custa $0.08 por segundo.
A RAM do host aperta mais vezes que a VRAM: os arquivos passam de qualquer placa de consumo, então alguma coisa transborda, e duas pessoas com 32 GB relataram resultados opostos. Uma vez que você sabe a sua faixa, isso deixa de ser uma pergunta de hardware e vira aritmética.
Medido em minutos por clipe, não em gigabytes
Gigabytes te dizem se carrega. Minutos te dizem se você vai usar.
O mesmo trabalho em 480p já rodou em 182 segundos numa placa de notebook de 16 GB com SageAttention, e em 90 minutos num Mac Studio de 128 GB — uma diferença de trinta vezes entre máquinas que toda tabela de requisitos chama de adequadas. A geração hospedada leva de 30 a 90 segundos.
Cada número aqui é um resultado publicado por outra pessoa, com link para a fonte. Catorze configurações com fonte estão na página do ComfyUI.
Leia o número oficial à parte: 559,67 segundos são duas placas a cinquenta passos em outro runtime, não uma linha de base de placa única no ComfyUI. Esse registro teve pico de 26,3 GiB por placa num host que por acaso tinha 377 GiB — a origem do boato dos «384 GB», e a configuração da máquina de teste, não um requisito.
Onde você está resolve a questão antes do custo
Para boa parte do mercado de língua inglesa, a aritmética nem começa.
A licença comunitária da MiniMax exclui os EUA, a UE, o Reino Unido e a Coreia
do Sul, e a exclusão acompanha as saídas, não só os pesos: renderize num país
permitido, publique num excluído, e você segue fora da concessão. Os pedidos
passam por platform.minimax.io/h3-license. A cláusula cobre os pesos, não a
API hospedada, que a MiniMax declara estar disponível globalmente — embora essa
API tenha os próprios termos e não seja uma resposta automática de
conformidade. A licença, cláusula por cláusula
tem o resto. Um resumo, não aconselhamento jurídico.
Se você está excluído e rodar por conta própria é o que você de fato precisa, a resposta honesta não somos nós: existe um modelo de pesos abertos sem exclusão de território, e ele roda em 16 GB.
Os dois requisitos que GPU nenhuma satisfaz
O H3 roda em três estágios e o download é o do meio. O H3-Context-IR reescreve o seu prompt e as suas referências numa descrição de tomada estruturada. O H3-Base gera a imagem da classe 768 e o áudio dela numa passagem só. O H3-Regenerate-2K devolve esse resultado ao modelo junto do contexto original, que é por que o texto pequeno sobrevive. Só o H3-Base foi publicado.
Placa nenhuma conserta isso: um rack de H200 ainda para em 768. Então o comparador honesto é $0.08 por segundo de saída, não $0.13 — citar a tarifa de 2K contra um render local infla o lado hospedado em 62%. A falta do Context-IR você contorna em parte escrevendo o prompt estruturado à mão; a falta do 2K, não.
No custo, quem traça a linha é a utilização
Dois clipes por semana e duzentos não são a mesma pergunta, e não é a tarifa por hora que separa os dois.
A rubrica que toda tabela de local contra hospedado deixa de fora é o armazenamento persistente. O pacote compacto tem 42,47 GB, o repositório completo uns 498,5 GB, e um volume na nuvem cobra por mês, você gerando ou não.
| Pilha compacta | Repositório completo | |
|---|---|---|
| Tamanho | 42,47 GB | ~498,5 GB |
| Armazenamento a $0.07 por GB-mês | ~$3 / mês | ~$35 / mês |
| Diluído em 30 clipes por mês | ~$0.10 por clipe | ~$1.17 por clipe |
Essa segunda coluna é mais do que hospedar o clipe direto. É por isso que a decisão gira em torno da utilização e não da tarifa por hora, e por que uma calculadora sem essa linha favorece a opção local.
Outros dois números são seus, não nossos. As tarifas de GPU na nuvem mudam toda semana e por região, então consulte a de hoje em vez de confiar numa cotação guardada. E tentativas por clipe aproveitável: quem cria costuma relatar três ou quatro, o que multiplica tudo acima.
Sobre privacidade: o que de fato sai da sua máquina
«Local quer dizer privado» é verdade sob uma condição que ninguém escreve.
O H3-Base na sua própria GPU é genuinamente offline depois que os pesos baixaram. Recorra ao Context-IR para melhorar um prompt, ou ao Regenerate-2K para uma resolução entregável, e o seu material sobe — os dois estágios são hospedados, e chamar eles de uma interface local não deixa eles locais.
Então a configuração offline é a que abre mão da compreensão do prompt e do 2K. Uma troca de verdade, não um ganho de graça. E que fique dito: gerar aqui também sobe o seu material.
Qual linha é a sua
Rodar por conta própria é o certo se o seu material não pode sair da sua rede, se você quer fazer fine-tune, ou se você tem uma placa rápida e gera todo dia. Melhor saber disso aqui do que depois de pagar a gente.
O fine-tune é a única vantagem que dinheiro não aluga. A MiniMax publicou os pesos completos para sustentar isso, e interface hospedada nenhuma, a nossa inclusive, consegue. Para o que o acesso hospedado serve é a outra metade: sem download, sem drivers, com 2K, e com os dois estágios que nunca saíram.
O que as pessoas perguntam antes de baixar
Quais são os requisitos mínimos? Nenhum mínimo universal foi publicado, então a resposta é uma faixa e não um número só. Existe uma execução concluída em 12 GB com 32 GB de RAM de host e muito offloading; 16 GB tem um resultado de 182 segundos; acima disso, nenhuma linha de base controlada. A RAM do host aperta mais vezes que a VRAM.
Sai mais barato rodar localmente? Normalmente não, a menos que as suas GPUs fiquem ocupadas. Computação alugada pode ficar abaixo de $0.08 por segundo, mas o armazenamento persistente é um custo mensal fixo que ignora a sua produção, e em volume baixo ele domina.
Consigo 2K localmente? Não, com orçamento nenhum de hardware. Os pesos abertos são o H3-Base, que para na classe 768. O 2K oficial é um estágio hospedado.
Roda num Mac? Roda, devagar. Nada é validado oficialmente, mas execuções da comunidade terminam: 90 minutos para um clipe de 15 segundos em 480p num M4 Max de 128 GB, uma hora para nove segundos num M5 Pro de 64 GB. O áudio sai do modelo local também. Viável por curiosidade, não para iterar.
Funciona em AMD? As MI300X e MI355X de datacenter são validadas pelos runtimes de servidor. Isso não é evidência para placas Radeon de consumo, e nenhum resultado concluído em Radeon de desktop foi publicado.
Quanto tempo leva um clipe? De três minutos a uma hora e meia, dependendo da sua máquina e da sua tela. A geração hospedada é relatada entre 30 e 90 segundos.
Preciso de 384 GB de RAM de sistema? Não. Esse número lê errado um benchmark oficial de servidor: 377 GiB é o que a máquina de teste tinha, não o que o modelo precisa. A mesma execução teve pico de 26,3 GiB por placa, e instalações de consumo terminam com 32 GB.
Quanto eu tenho de baixar? 42,47 GB para o conjunto compacto de texto e imagem, 63,44 GB com o checkpoint de referência. Deixe folga além disso para caches e saídas.
Posso rodar onde eu moro? Só fora dos territórios excluídos: os EUA, a UE, o Reino Unido e a Coreia do Sul. A restrição alcança as saídas também. O acesso hospedado não é afetado por essa cláusula. Um resumo, não aconselhamento jurídico.
O que pode mudar. A atenção esparsa nativa não está na primeira versão aberta, então todo tempo aqui é de atenção completa. Se o H3-Regenerate-2K for publicado algum dia, a frase «nada de 2K localmente» deixa de valer. As tarifas de GPU na nuvem mudam toda semana. Última verificação em 2026-08-14.
Dois minutos no gerador de vídeo com IA MiniMax H3 custam menos que uma tarde e 42,47 GB. Tenha dado o que tenha dado a sua conta, você pode ouvir o que o H3 faz — a partir de uma linha de texto — antes de se comprometer com qualquer um dos dois caminhos.
Escrito por
Redação
minimax-h3ai.video
Publicado no gerador de vídeo com IA MiniMax H3, uma interface independente, de terceiros, construída sobre o MiniMax H3.


