O MiniMax H3 Max não é o H3 maior — a entrada dele no ranking chama ele de Turbo
O MiniMax H3 Max renderiza um clipe de 5 segundos em uns 3 e para em 768p. Que tomadas isso serve, o que custa em silêncio, e como escolher antes.

Eu li «Max» e presumi que era o maior. Não é.
O MiniMax H3 Max é um MiniMax H3 mais rápido com um teto mais baixo. A fal Research pós-treinou ele em cima dos pesos publicados do H3, afinou bastante para velocidade e aderência ao prompt, e ele para em 768p, onde o H3 padrão chega a 2K. Ele roda dois endpoints; o H3 padrão fica com esses dois e acrescenta referência para vídeo e edição por cima. A entrada dele no ranking da Artificial Analysis entrega o jogo — a fal lista ele lá como MiniMax H3 Turbo (768p). Turbo é a palavra honesta.
Nada disso faz dele um modelo pior. Gerar mais rápido do que o clipe leva para tocar é uma mudança real em como uma tarde transcorre. Mas o nome aponta para um teto maior, a ficha técnica aponta para um mais baixo, e existe um fluxo de trabalho que a distância entre os dois quebra em silêncio.
De qual dos dois a sua tomada precisa
A decisão inteira de MiniMax H3 Max contra MiniMax H3 cabe numa tabela:
| Se a tomada tem de… | Use | Onde |
|---|---|---|
| sobreviver a ser cortada, reenquadrada ou exibida grande | MiniMax H3 | Gere em 2K |
| segurar o mesmo personagem ao longo de vários cortes | MiniMax H3 | Referência para vídeo |
| mudar um elemento de imagens que já funcionam | MiniMax H3 | Vídeo para vídeo |
| sair com quatro segundos | MiniMax H3 | Texto para vídeo |
| partir de um quadro parado que você já tem | qualquer um dos dois | Imagem para vídeo |
| ser uma de quarenta tentativas nesta tarde, nenhuma delas final | MiniMax H3 Max | só hospedado na fal |
A última linha é real e o H3 Max ganha ela sozinho. Repare no que ela descreve, porém: uma etapa do trabalho, não a coisa que você entrega.
O que o MiniMax H3 Max te dá
Três coisas, e a primeira vale mais do que parece.
Um clipe de cinco segundos chega em uns três segundos. Mais rápido que assistir de volta. Quando o render deixa de ser uma pausa para o café, você para de editar de antemão na cabeça — você simplesmente tenta a versão sobre a qual estava em dúvida. Ao longo de uma tarde isso muda o que você faz, não só a velocidade com que faz.
A aderência ao prompt é onde a fal gastou o pós-treino. Nomeie as batidas em ordem e elas chegam em ordem. Peça palavras na tela e elas voltam compostas, não aproximadas.
Tudo o que faz o H3 ser o H3 vem junto: um contexto unificado para texto e imagem, e uma faixa sincronizada gerada na mesma passagem que a imagem em vez de posta por baixo depois.
O envelope, em 31 de agosto de 2026: 480p ou 768p, 768p por padrão — 1344×768 em 16:9, 24 fps. De cinco a quinze segundos. Texto para vídeo aceita 21:9, 16:9, 4:3, 1:1, 3:4 e 9:16; imagem para vídeo segue o quadro parado que você entrega e aceita um quadro final opcional, então primeiro-e-último-quadro também funciona.
Onde o teto de 768p de fato morde
768p são 1344×768 — cerca de 1,0 megapixel. O 2K do H3 põe 1440 no lado curto, uns 3,7 megapixels nas proporções largas. Três vezes e meia os pixels, e você percebe isso em quatro lugares específicos:
- Numa linha do tempo que não é 768p. Solte um clipe 768p numa sequência em 1440p e ele é ampliado. Tudo de que você gostou na textura amolece.
- Quando você corta. Reenquadrar um plano aberto para quadrado ou vertical joga fora pixels que você não tinha de sobra.
- Em qualquer tela maior que um celular. Um clipe de destaque numa página ou num monitor mostra as bordas.
- Em rostos e letras. Detalhe fino é a primeira coisa que o 768p gasta.
Se nada disso descreve o trabalho, 768p é genuinamente suficiente e a velocidade é dinheiro de graça. Se algo disso descreve, o teto não é uma linha de ficha técnica — é o motivo pelo qual você vai refazer a tomada.
Por que você não pode rascunhar no H3 Max e finalizar em 2K
O plano parece óbvio o bastante para eu ter ido caçar o botão: iterar barato e rápido em 768p, travar a versão de que você gostou, e então rodar esse prompt exato em 2K para entregar. Esse botão não existe, e duas coisas separadas impedem.
O H3 Max não tem 2K nenhum, então «finalizar» quer dizer mudar para o H3 padrão. E o H3 Max é um modelo diferente — pós-treinado, com outros pesos. Entregar o mesmo prompt e a mesma seed a um modelo diferente não te dá a mesma tomada em resolução maior. Te dá uma tomada diferente. A composição deriva, o tempo das batidas se move, e a coisa que você escolheu em quarenta tentativas não é o que volta.
Também não tem botão de upscale escondido em lugar nenhum. Neste site 768p e 2K são duas gerações separadas, cobradas separadamente — não existe caminho de clipe para 2K aqui, e não existe no H3 Max.
Então a ordem importa mais que o modelo: decida a resolução de entrega primeiro, e depois itere no modelo que consegue entregar ela. Se a resposta é 2K, faça as quarenta tentativas no H3 também — em 768p no mesmo modelo, onde o rascunho de fato prevê o master, e troque a resolução na passagem final. Você paga um pouco mais por tentativa e fica com a tomada que escolheu. O que isso custa em créditos está na página de preços, nas nossas próprias unidades, sem conversão por segundo para fazer.
Ponha o número de velocidade da fal no seu próprio cronograma
Os dois números a seguir são da própria fal, do mesmo FAQ, e o segundo é o que ninguém cita:
| Duração do clipe | Renderiza em | Computação por segundo de vídeo pronto |
|---|---|---|
| 5 s (o padrão) | menos de 3 s | ~0,5 s |
| 15 s (o máximo) | «cerca de 15 segundos» | ~1,0 s |
O custo por segundo pronto mais ou menos dobra entre o clipe mais curto e o mais longo. «Mais rápido que o tempo real» é verdade em cinco segundos e já foi embora em quinze — uma geração de duração completa leva mais ou menos o mesmo tempo que a coisa que ela fez.
Então a regra honesta de planejamento é por unidade de trabalho, não por modelo. Cortando batidas de cinco segundos para redes? O ciclo é apertado mesmo, e vai mudar a sua tarde. Construindo cenas de quinze segundos? Reserve tempo real e trate a manchete dos 35× — a medição da fal contra o endpoint da própria MiniMax — como uma afirmação sobre clipes curtos.
Mais um número fácil de ler errado: a fal reporta cerca de 2,5 s desse render
como timings.inference, e documenta o campo como o tempo de denoising do
DiT no backend de GPU. É o relógio do modelo, não o seu. Fila, tratamento do
prompt e transferência ficam fora dele.
Consiga uma comparação justa do MiniMax H3 Max
Se você está prestes a testar o H3 Max contra qualquer outra coisa, confira um parâmetro antes ou o seu resultado não é sobre o modelo.
O prompt_expansion_mode é obrigatório na API do H3 Max. Ele tem três
ajustes, o padrão reescreve o seu prompt antes da geração, e a resposta devolve
um campo expanded_prompt mostrando o texto que foi de fato enviado.
| Ajuste | O que acontece | O que custa |
|---|---|---|
disabled | as suas palavras passam intactas | nada |
balanced (padrão) | ele decide a cada requisição quanto reescrever | cerca de um segundo |
quality | uma reescrita completa num briefing mais rico | até ~30 s — mais ou menos dez vezes o render |
Duas coisas decorrem disso. Uma comparação com ajustes padrão é o seu prompt
no outro modelo contra a reescrita que a fal fez do seu prompt aqui — ponha
disabled dos dois lados e espere a saída mudar, porque essa mudança era a
medição vazando. E se você já se perguntou por que um «modelo de três segundos»
pareceu lento, confira se você deixou ele em quality: trinta segundos de
reescrita na frente de três segundos de render.
O hábito útil de todo jeito é ler o expanded_prompt em algumas execuções. Ele
te mostra como é um bom briefing para este modelo, escrito por quem treinou
ele. Depois escreva o seu assim — a mesma
estrutura que a nossa ferramenta de prompt monta, e o
motivo pelo qual um prompt detalhado ainda ganha de um curto mais expansão.
Confira o primeiro lugar você mesmo
A fal diz que o H3 Max é o primeiro, e é. Você consegue confirmar tudo em uns dois minutos, o que é melhor que acreditar em mim:
- Design Arena, imagem para vídeo — H3 Max com 1.341 de Elo, com o MiniMax H3 base logo atrás com 1.333.
- Artificial Analysis, imagem para vídeo com faixa de áudio — 1.201 de Elo, ±11 a 95% de confiança, com mais de 2.177 amostras. Arquivado como MiniMax H3 Turbo (768p), que é onde o nome Turbo fica visível.
- O estudo de preferência da própria fal contra doze modelos — primeiro em qualidade, entendimento do prompt e estética. Conduzido pela fal, na infraestrutura da fal.
Os dois painéis são Elo de preferência: pessoas escolhendo entre dois clipes. Isso é um sinal de verdade e não é um benchmark de capacidade.
Aí olhe os dois números lado a lado. Oito pontos separam o H3 Max do modelo a partir do qual ele foi pós-treinado, no painel que lista os dois. O painel que publica intervalo de confiança publica ±11. Painéis diferentes, então isso não é um teste de significância — mas é a noção certa de escala. A afirmação que sobrevive é: em 768p, o H3 Max é pelo menos tão bom quanto o H3, e os dois estão perto.
E leia o nome da entrada mais uma vez. Os dois painéis estão ranqueando saída em 768p. Nada neles diz qualquer coisa sobre o 2K que você de fato entregaria.
Onde o MiniMax H3 Max fica na questão dos pesos abertos
Versão curta: não existe checkpoint do H3 Max, e não vai existir por acidente.
A licença comunitária do H3 define Model Derivative de forma ampla o bastante para um pós-treino ser claramente um, e ela te concede a propriedade dos derivados que você faz. Então a fal baixou pesos publicados, treinou em cima deles, ficou com o resultado e serve ele fechado — isso é a licença funcionando como escrita, não uma brecha nela. É a demonstração mais clara que eu já vi do que pesos abertos de fato compram, que é uma pergunta diferente de o que você recebe no download.
Uma cláusula corta para o outro lado, a favor de todo mundo. A restrição de território que as pessoas citam se aplica ao modelo como lançado no repositório dele — ela rege rodar os pesos, não usar um serviço hospedado construído a partir deles. Isso cobre o H3 Max, e cobre todo caminho hospedado, este inclusive. Isto é um resumo, não aconselhamento jurídico.
Perguntas frequentes sobre o MiniMax H3 Max
O MiniMax H3 Max suporta 2K? Não. Só 480p e 768p. A própria página do modelo na fal te manda para o MiniMax H3 padrão para saída em 2K.
O MiniMax H3 Max é melhor que o MiniMax H3? Em 768p, marginalmente — oito pontos de Elo no painel que lista os dois. Em 2K a pergunta não se aplica, porque o H3 Max não gera 2K.
O MiniMax H3 Max faz referência para vídeo ou consistência de personagem? Ainda não. Em 25 de agosto a fal disse que referência para vídeo chegaria «ainda esta semana»; em 31 de agosto ainda são dois endpoints, e a documentação da própria MiniMax ainda lista isso como em breve. Conte os endpoints antes de planejar em cima disso.
O MiniMax H3 Max é grátis? É uma API hospedada paga com uma cota promocional no host dela. Se uma cota gratuita é o que você veio buscar de fato, o que aqui não custa nada e o que custa está escrito com todas as letras.
O MiniMax H3 Max é um modelo oficial da MiniMax? Ele é chancelado pela MiniMax, anunciado em conjunto, e listado na documentação de geração de vídeo da própria MiniMax. Foi construído pela fal, não pela MiniMax, e só a fal serve ele.
Qual é o clipe mais curto que o MiniMax H3 Max consegue fazer? Cinco segundos. A especificação da própria MiniMax para o H3 desce até quatro, e quatro é o que você recebe aqui — vale saber se você corta curto. Por que os segundos que você pede nem sempre são os segundos que você recebe é uma história à parte, e mais estranha.
Por que ele se chama Max se o H3 faz mais? Porque Max descreve o ponto de operação para o qual a fal afinou — velocidade máxima em 768p com aderência ao prompt mais forte — e não o teto de capacidade. O nome no ranking, H3 Turbo, é o que te conta o que aconteceu.
Última verificação em 31 de agosto de 2026. Todo número acima é da fal ou da própria MiniMax, inclusive os que favorecem o H3 Max, e Elo de preferência não é um benchmark de capacidade — cada um está com fonte para você reconferir em vez de confiar. Este modelo tem quatro semanas: referência para vídeo foi prometida para uma semana que já passou, e um teto de resolução é exatamente o tipo de coisa que se move.
Escrito por
Redação
minimax-h3ai.video
Publicado no gerador de vídeo com IA MiniMax H3, uma interface independente, de terceiros, construída sobre o MiniMax H3.


