Alternatives

O MiniMax H3 Max não é o H3 maior — a entrada dele no ranking chama ele de Turbo

O MiniMax H3 Max renderiza um clipe de 5 segundos em uns 3 e para em 768p. Que tomadas isso serve, o que custa em silêncio, e como escolher antes.

10 min de leituraRedaçãoRedação
O MiniMax H3 Max não é o H3 maior — a entrada dele no ranking chama ele de Turbo

Eu li «Max» e presumi que era o maior. Não é.

O MiniMax H3 Max é um MiniMax H3 mais rápido com um teto mais baixo. A fal Research pós-treinou ele em cima dos pesos publicados do H3, afinou bastante para velocidade e aderência ao prompt, e ele para em 768p, onde o H3 padrão chega a 2K. Ele roda dois endpoints; o H3 padrão fica com esses dois e acrescenta referência para vídeo e edição por cima. A entrada dele no ranking da Artificial Analysis entrega o jogo — a fal lista ele lá como MiniMax H3 Turbo (768p). Turbo é a palavra honesta.

Nada disso faz dele um modelo pior. Gerar mais rápido do que o clipe leva para tocar é uma mudança real em como uma tarde transcorre. Mas o nome aponta para um teto maior, a ficha técnica aponta para um mais baixo, e existe um fluxo de trabalho que a distância entre os dois quebra em silêncio.

De qual dos dois a sua tomada precisa

A decisão inteira de MiniMax H3 Max contra MiniMax H3 cabe numa tabela:

Se a tomada tem de…UseOnde
sobreviver a ser cortada, reenquadrada ou exibida grandeMiniMax H3Gere em 2K
segurar o mesmo personagem ao longo de vários cortesMiniMax H3Referência para vídeo
mudar um elemento de imagens que já funcionamMiniMax H3Vídeo para vídeo
sair com quatro segundosMiniMax H3Texto para vídeo
partir de um quadro parado que você já temqualquer um dos doisImagem para vídeo
ser uma de quarenta tentativas nesta tarde, nenhuma delas finalMiniMax H3 Maxsó hospedado na fal

A última linha é real e o H3 Max ganha ela sozinho. Repare no que ela descreve, porém: uma etapa do trabalho, não a coisa que você entrega.

O que o MiniMax H3 Max te dá

Três coisas, e a primeira vale mais do que parece.

Um clipe de cinco segundos chega em uns três segundos. Mais rápido que assistir de volta. Quando o render deixa de ser uma pausa para o café, você para de editar de antemão na cabeça — você simplesmente tenta a versão sobre a qual estava em dúvida. Ao longo de uma tarde isso muda o que você faz, não só a velocidade com que faz.

A aderência ao prompt é onde a fal gastou o pós-treino. Nomeie as batidas em ordem e elas chegam em ordem. Peça palavras na tela e elas voltam compostas, não aproximadas.

Tudo o que faz o H3 ser o H3 vem junto: um contexto unificado para texto e imagem, e uma faixa sincronizada gerada na mesma passagem que a imagem em vez de posta por baixo depois.

O envelope, em 31 de agosto de 2026: 480p ou 768p, 768p por padrão — 1344×768 em 16:9, 24 fps. De cinco a quinze segundos. Texto para vídeo aceita 21:9, 16:9, 4:3, 1:1, 3:4 e 9:16; imagem para vídeo segue o quadro parado que você entrega e aceita um quadro final opcional, então primeiro-e-último-quadro também funciona.

Onde o teto de 768p de fato morde

768p são 1344×768 — cerca de 1,0 megapixel. O 2K do H3 põe 1440 no lado curto, uns 3,7 megapixels nas proporções largas. Três vezes e meia os pixels, e você percebe isso em quatro lugares específicos:

  • Numa linha do tempo que não é 768p. Solte um clipe 768p numa sequência em 1440p e ele é ampliado. Tudo de que você gostou na textura amolece.
  • Quando você corta. Reenquadrar um plano aberto para quadrado ou vertical joga fora pixels que você não tinha de sobra.
  • Em qualquer tela maior que um celular. Um clipe de destaque numa página ou num monitor mostra as bordas.
  • Em rostos e letras. Detalhe fino é a primeira coisa que o 768p gasta.

Se nada disso descreve o trabalho, 768p é genuinamente suficiente e a velocidade é dinheiro de graça. Se algo disso descreve, o teto não é uma linha de ficha técnica — é o motivo pelo qual você vai refazer a tomada.

Por que você não pode rascunhar no H3 Max e finalizar em 2K

O plano parece óbvio o bastante para eu ter ido caçar o botão: iterar barato e rápido em 768p, travar a versão de que você gostou, e então rodar esse prompt exato em 2K para entregar. Esse botão não existe, e duas coisas separadas impedem.

O H3 Max não tem 2K nenhum, então «finalizar» quer dizer mudar para o H3 padrão. E o H3 Max é um modelo diferente — pós-treinado, com outros pesos. Entregar o mesmo prompt e a mesma seed a um modelo diferente não te dá a mesma tomada em resolução maior. Te dá uma tomada diferente. A composição deriva, o tempo das batidas se move, e a coisa que você escolheu em quarenta tentativas não é o que volta.

Também não tem botão de upscale escondido em lugar nenhum. Neste site 768p e 2K são duas gerações separadas, cobradas separadamente — não existe caminho de clipe para 2K aqui, e não existe no H3 Max.

Então a ordem importa mais que o modelo: decida a resolução de entrega primeiro, e depois itere no modelo que consegue entregar ela. Se a resposta é 2K, faça as quarenta tentativas no H3 também — em 768p no mesmo modelo, onde o rascunho de fato prevê o master, e troque a resolução na passagem final. Você paga um pouco mais por tentativa e fica com a tomada que escolheu. O que isso custa em créditos está na página de preços, nas nossas próprias unidades, sem conversão por segundo para fazer.

Ponha o número de velocidade da fal no seu próprio cronograma

Os dois números a seguir são da própria fal, do mesmo FAQ, e o segundo é o que ninguém cita:

Duração do clipeRenderiza emComputação por segundo de vídeo pronto
5 s (o padrão)menos de 3 s~0,5 s
15 s (o máximo)«cerca de 15 segundos»~1,0 s

O custo por segundo pronto mais ou menos dobra entre o clipe mais curto e o mais longo. «Mais rápido que o tempo real» é verdade em cinco segundos e já foi embora em quinze — uma geração de duração completa leva mais ou menos o mesmo tempo que a coisa que ela fez.

Então a regra honesta de planejamento é por unidade de trabalho, não por modelo. Cortando batidas de cinco segundos para redes? O ciclo é apertado mesmo, e vai mudar a sua tarde. Construindo cenas de quinze segundos? Reserve tempo real e trate a manchete dos 35× — a medição da fal contra o endpoint da própria MiniMax — como uma afirmação sobre clipes curtos.

Mais um número fácil de ler errado: a fal reporta cerca de 2,5 s desse render como timings.inference, e documenta o campo como o tempo de denoising do DiT no backend de GPU. É o relógio do modelo, não o seu. Fila, tratamento do prompt e transferência ficam fora dele.

Consiga uma comparação justa do MiniMax H3 Max

Se você está prestes a testar o H3 Max contra qualquer outra coisa, confira um parâmetro antes ou o seu resultado não é sobre o modelo.

O prompt_expansion_mode é obrigatório na API do H3 Max. Ele tem três ajustes, o padrão reescreve o seu prompt antes da geração, e a resposta devolve um campo expanded_prompt mostrando o texto que foi de fato enviado.

AjusteO que aconteceO que custa
disabledas suas palavras passam intactasnada
balanced (padrão)ele decide a cada requisição quanto reescrevercerca de um segundo
qualityuma reescrita completa num briefing mais ricoaté ~30 s — mais ou menos dez vezes o render

Duas coisas decorrem disso. Uma comparação com ajustes padrão é o seu prompt no outro modelo contra a reescrita que a fal fez do seu prompt aqui — ponha disabled dos dois lados e espere a saída mudar, porque essa mudança era a medição vazando. E se você já se perguntou por que um «modelo de três segundos» pareceu lento, confira se você deixou ele em quality: trinta segundos de reescrita na frente de três segundos de render.

O hábito útil de todo jeito é ler o expanded_prompt em algumas execuções. Ele te mostra como é um bom briefing para este modelo, escrito por quem treinou ele. Depois escreva o seu assim — a mesma estrutura que a nossa ferramenta de prompt monta, e o motivo pelo qual um prompt detalhado ainda ganha de um curto mais expansão.

Confira o primeiro lugar você mesmo

A fal diz que o H3 Max é o primeiro, e é. Você consegue confirmar tudo em uns dois minutos, o que é melhor que acreditar em mim:

  • Design Arena, imagem para vídeo — H3 Max com 1.341 de Elo, com o MiniMax H3 base logo atrás com 1.333.
  • Artificial Analysis, imagem para vídeo com faixa de áudio1.201 de Elo, ±11 a 95% de confiança, com mais de 2.177 amostras. Arquivado como MiniMax H3 Turbo (768p), que é onde o nome Turbo fica visível.
  • O estudo de preferência da própria fal contra doze modelos — primeiro em qualidade, entendimento do prompt e estética. Conduzido pela fal, na infraestrutura da fal.

Os dois painéis são Elo de preferência: pessoas escolhendo entre dois clipes. Isso é um sinal de verdade e não é um benchmark de capacidade.

Aí olhe os dois números lado a lado. Oito pontos separam o H3 Max do modelo a partir do qual ele foi pós-treinado, no painel que lista os dois. O painel que publica intervalo de confiança publica ±11. Painéis diferentes, então isso não é um teste de significância — mas é a noção certa de escala. A afirmação que sobrevive é: em 768p, o H3 Max é pelo menos tão bom quanto o H3, e os dois estão perto.

E leia o nome da entrada mais uma vez. Os dois painéis estão ranqueando saída em 768p. Nada neles diz qualquer coisa sobre o 2K que você de fato entregaria.

Onde o MiniMax H3 Max fica na questão dos pesos abertos

Versão curta: não existe checkpoint do H3 Max, e não vai existir por acidente.

A licença comunitária do H3 define Model Derivative de forma ampla o bastante para um pós-treino ser claramente um, e ela te concede a propriedade dos derivados que você faz. Então a fal baixou pesos publicados, treinou em cima deles, ficou com o resultado e serve ele fechado — isso é a licença funcionando como escrita, não uma brecha nela. É a demonstração mais clara que eu já vi do que pesos abertos de fato compram, que é uma pergunta diferente de o que você recebe no download.

Uma cláusula corta para o outro lado, a favor de todo mundo. A restrição de território que as pessoas citam se aplica ao modelo como lançado no repositório dele — ela rege rodar os pesos, não usar um serviço hospedado construído a partir deles. Isso cobre o H3 Max, e cobre todo caminho hospedado, este inclusive. Isto é um resumo, não aconselhamento jurídico.

Perguntas frequentes sobre o MiniMax H3 Max

O MiniMax H3 Max suporta 2K? Não. Só 480p e 768p. A própria página do modelo na fal te manda para o MiniMax H3 padrão para saída em 2K.

O MiniMax H3 Max é melhor que o MiniMax H3? Em 768p, marginalmente — oito pontos de Elo no painel que lista os dois. Em 2K a pergunta não se aplica, porque o H3 Max não gera 2K.

O MiniMax H3 Max faz referência para vídeo ou consistência de personagem? Ainda não. Em 25 de agosto a fal disse que referência para vídeo chegaria «ainda esta semana»; em 31 de agosto ainda são dois endpoints, e a documentação da própria MiniMax ainda lista isso como em breve. Conte os endpoints antes de planejar em cima disso.

O MiniMax H3 Max é grátis? É uma API hospedada paga com uma cota promocional no host dela. Se uma cota gratuita é o que você veio buscar de fato, o que aqui não custa nada e o que custa está escrito com todas as letras.

O MiniMax H3 Max é um modelo oficial da MiniMax? Ele é chancelado pela MiniMax, anunciado em conjunto, e listado na documentação de geração de vídeo da própria MiniMax. Foi construído pela fal, não pela MiniMax, e só a fal serve ele.

Qual é o clipe mais curto que o MiniMax H3 Max consegue fazer? Cinco segundos. A especificação da própria MiniMax para o H3 desce até quatro, e quatro é o que você recebe aqui — vale saber se você corta curto. Por que os segundos que você pede nem sempre são os segundos que você recebe é uma história à parte, e mais estranha.

Por que ele se chama Max se o H3 faz mais? Porque Max descreve o ponto de operação para o qual a fal afinou — velocidade máxima em 768p com aderência ao prompt mais forte — e não o teto de capacidade. O nome no ranking, H3 Turbo, é o que te conta o que aconteceu.


Última verificação em 31 de agosto de 2026. Todo número acima é da fal ou da própria MiniMax, inclusive os que favorecem o H3 Max, e Elo de preferência não é um benchmark de capacidade — cada um está com fonte para você reconferir em vez de confiar. Este modelo tem quatro semanas: referência para vídeo foi prometida para uma semana que já passou, e um teto de resolução é exatamente o tipo de coisa que se move.

Redação

Escrito por

Redação

minimax-h3ai.video

Publicado no gerador de vídeo com IA MiniMax H3, uma interface independente, de terceiros, construída sobre o MiniMax H3.

Todos os artigos