Gerador de prompt do MiniMax H3
Descreva a ideia em uma linha. Receba ela de volta como os três campos que o H3 foi treinado para ler — primeiro a imagem, depois o som.
O seu prompt estruturado
integrated_multimodal_descriptionoverall_soundscapenon_diegetic_music
Verificações12 regras, rodadas antes de você copiar
- A ordem dos campos bate com a sequência oficial
- Sem marca de tempo no [Shot 1]
- A linha de câmera nomeia um movimento mas não a amplitude nem a velocidade
the camera pushes in
O esqueleto cinza é o formato de verdade — três campos nos modos base, seis no modo referência.
0 / 7,000 characters
O seu primeiro clipe neste site é grátis — sem cartão.
O que o gerador de prompt do MiniMax H3
devolve
Um prompt que o H3 consegue executar, não um parágrafo que ele tem de interpretar.
O gerador de prompt do MiniMax H3 pega uma ideia em linguagem simples e reescreve ela do jeito que o modelo foi treinado para ler: uma descrição de imagem plano a plano, depois o som da cena, depois a trilha, nessa ordem fixa. A maior parte das ferramentas de gerador de prompt de vídeo com IA ainda te entrega um bloco de prosa de cinema mudo, ou um formulário de vinte campos que faz você mesmo estruturar tudo. Este aqui pede uma frase, escreve a estrutura por você, confere contra as regras oficiais, e nunca pede conta.
- Uma linha
- 1
- Campos
- 3 / 6
- Regras
- 12
- Teto de caracteres
- 7,000
Uma linha
Campos
Regras
Teto de caracteres
- Sem formulário de vinte campos
- Sem conta
- Sem gastar créditos
A estrutura de prompt de três campos, na ordem que o H3 espera
Este é o formato da própria MiniMax — a skill h3-prompt-writing que eles publicaram no repositório do H3 no GitHub em agosto de 2026, com arquivos de referência que fixam os campos, a ordem deles e as regras. No pipeline da própria MiniMax, um estágio hospedado chamado Context-IR reescreve o que você digita nessa estrutura antes de o modelo ver. Chame a API e você ganha esse estágio; em todo o resto você monta sozinho. Aqui ele já está rodando, no seu navegador.
integrated_multimodal_descriptionA imagem, plano a plano.overall_soundscapeComo a própria cena soa.non_diegetic_musicA trilha, ou «N/A».
[Shot 1], marcas de tempo e diálogo
Os planos são numerados, todo corte a partir do segundo plano ganha uma marca de tempo, e o primeiro plano nunca ganha. Dentro de cada plano a ordem oficial é composição, sujeito, ambiente, ação, câmera, som. O diálogo mora aqui também: identidade e entonação fora da etiqueta, palavras exatas dentro. Escreva «ela diz algo emocionante» e o H3 inventa a fala — raramente a que você queria. Espere que este campo carregue uns sessenta por cento do prompt, e a maior parte das recusas.
(S1) says: <d>[Portuguese] Siga o vento.</d>
overall_soundscape e non_diegetic_music
Os dois campos finais são os que as ferramentas de modelo mudo nunca escrevem. O ambiente sonoro é o som que a própria cena faz — chuva no tecido, uma caneca sendo pousada, o trânsito duas ruas adiante — com distância e tempo. O campo de música é a trilha que só a plateia ouve: instrumentos, andamento, onde entra e onde resolve. Um teste: os personagens conseguiriam ouvir? Se sim, ambiente sonoro; se não, música.
non_diegetic_music: N/A
Gramática de câmera: movimento, amplitude, velocidade
O H3 recebe o trabalho de câmera como inglês simples dentro do plano, montado em três partes.
- Movimentopush in
- Amplitudesmall
- Velocidadeslow
slow push-in, small amplitudestatic hold throughoutcinematic camera workNão há nada ali para executar.[Push in][Truck left]Sintaxe do Hailuo 02. O H3 não lê isso.
«The camera pushes in with small amplitude at slow speed» é executável. «Cinematic camera work» não é. Omita amplitude e velocidade quando você quiser dizer médio e normal. Se você aprendeu no Hailuo 02, desaprenda os colchetes: as etiquetas empilhadas acabaram, os colchetes agora marcam número de plano, e o gerador de prompt do MiniMax H3 escreve o movimento dentro da frase.
Diga static quando quiser um quadro travado — uma câmera que você nunca menciona é uma câmera que o modelo está livre para mexer. E no texto para vídeo puro, resista a dirigir demais: os testes da comunidade mostram que um parágrafo natural ganha de uma pilha de diretivas técnicas.
Um gerador de prompt do MiniMax H3, cinco modos de entrada
O modo decide o esqueleto, então o modo vem primeiro.
Texto
T2VA
A linha do tempo inteira é construída com palavras.
Proporção obrigatória — adaptativo é recusado
Primeiro quadro
I2VA
A sua imagem abre o plano e o clipe se desenvolve para a frente.
1º + último
FL2VA
Duas imagens, e o caminho entre elas é gerado.
Último quadro
L2VA
Descreva uma aproximação plausível e deixe o clipe convergir para a sua imagem.
Real, e quase não documentado em lugar nenhum
Referências
Ref2VA
Os arquivos definem os sujeitos; a cena é construída para obedecer a eles.
Os três modos de imagem acrescentam uma linha que os prompts base não têm: uma declaração de alinhamento fixando cada imagem ao momento dela. Os modos de imagem ignoram a sua proporção — quem decide é a imagem.
Ref2VA: seis seções e oito marcadores de retenção
O modo referência troca três campos por seis. Todo arquivo ganha uma etiqueta, e uma etiqueta usada mas nunca definida invalida o prompt inteiro. O summary abre com tipos de tarefa entre colchetes, e retention_analysis atribui a cada referência um de oito marcadores em dois conjuntos fixos — quatro visuais, quatro de áudio. Os conjuntos nunca se cruzam. É o quinto mais difícil do formato para escrever à mão, então o formulário monta isso por arquivo. O guia completo dos marcadores está em referência para vídeo.
As verificações que um gerador de prompt do MiniMax H3 roda antes de você copiar
A skill oficial termina com regras de saída. Todo prompt daqui é conferido contra elas antes de você ver.
- A ordem dos campos bate com a sequência oficial
- Sem marca de tempo no primeiro plano[Shot 1]
- Todo corte cabe na duração pedida00:09.000 num clipe de 8 s
- Comprimento total abaixo do teto da API7.000 caracteres
- O modo texto tem uma proporção concretaadaptativo é recusado
- Toda etiqueta de referência está definidasubject_definitions
- Os marcadores de retenção ficam no conjunto delesvisual ≠ áudio
- As descrições estão em inglêso diálogo fica no idioma dele
- O diálogo nomeia as palavras exatas
- As linhas de câmera trazem as três partes
- Os modos de imagem abrem com uma linha de alinhamento
- A prosa se lê como um plano, não como resumo de enredo
Um achado, do jeito que o conferidor escreve
«the camera pushes in» — nomeia um movimento mas não a amplitude nem a velocidade.
O H3 executa as três. Tente: slow push-in, small amplitude.
Cole qualquer prompt já existente na aba de conferência e o gerador de prompt do MiniMax H3 dá a ele o mesmo tratamento, com a linha que falhou citada e a correção sugerida.
Um prompt quebrado normalmente custa uma geração paga para ser descoberto. Aqui não custa nada.
Vídeo para prompt: quando o clipe já existe
Tudo acima vai da ideia para o prompt. Isto é a mesma viagem ao contrário.
Esta página
Uma linha de palavras simplesOs três campos, em ordem
Vídeo para prompt
Lista de planos, trajeto de câmera, os dois campos de somUm clipe que você já tem
Você tem um clipe e quer o prompt que poderia fazer um parecido — lista de planos, trajeto de câmera e os dois campos de som lidos de volta a partir da filmagem. A marcha a ré é uma ferramenta própria: cole um link em vídeo para prompt e traga o resultado de volta para cá para editar.
Se o objetivo é manter o enquadramento ou a trilha originais, pule os prompts e entregue o clipe ao modo referência.
Levar um prompt do H3 para o Veo, o Seedance ou o Kling
Os prompts são seus, e a estrutura viaja — quase toda. Primeiro o limite duro.
MiniMax H37.000 caracteres
Veo 3.11.024 tokens — uma lista de planos inteira do H3 não cabe
Guarde a descrição de um plano, tire os rótulos dos campos, reescreva a linha de câmera. O Seedance lê referências @AssetName em vez de definições de etiqueta. O Kling e quase todos os outros querem um parágrafo descritivo único, então mande só o campo visual.
Os dois campos de som não têm destino em lugar nenhum — nenhum outro modelo do mercado aceita som como campos etiquetados, e é justamente para isso que serve boa parte de um gerador de prompt do MiniMax H3.
Decidindo entre modelos em vez de portar um prompt? Comece em MiniMax H3 vs Veo 3.
Como montar um prompt do MiniMax H3
Escrever o prompt nunca gasta créditos, então vale rodar as verificações antes de gerar qualquer coisa.
Escolha o modo de entrada
T2VA, I2VA, FL2VA, L2VA ou Ref2VA. O modo decide quais campos o H3 espera e em que ordem.
Cinco modosDigite a ideia em linguagem simples
Uma linha basta. Ela é reescrita na ordem oficial dos campos, com os dois campos de áudio incluídos.
Grátis, sem contaLeia as doze verificações
Cada regra que falha cita a linha que a quebrou, para você ver o que o H3 teria ignorado.
Linha que falhou citadaCopie, ou mande direto para o gerador
O contador de caracteres acompanha o teto de 7.000 caracteres da API enquanto você edita.
Teto de 7.000 caracteres
Já escreveu um prompt em outro lugar? A aba de conferência roda as mesmas doze regras contra ele sem reescrever nada.
Perguntas frequentes sobre o gerador de prompt do MiniMax H3
O que saber antes de escrever o seu primeiro prompt do H3
O que é o gerador de prompt do MiniMax H3?
Este é o formato oficial?
O que é o Context-IR, e eu ainda preciso dele?
Qual deve ser o tamanho de um prompt do H3?
Eu tenho de escrever em inglês?
Como eu escrevo diálogo?
Como eu escrevo movimento de câmera?
O que separa o ambiente sonoro do campo de música?
Por que as minhas marcas de tempo foram recusadas?
Ele consegue virar um vídeo em prompt?
É grátis, e eu posso levar os prompts para qualquer lugar?
Entra uma linha, sai a ordem oficial dos campos.
Grátis, sem conta, e o prompt é seu para onde você levar.
Crie a conta de graça · 1 clipe no MiniMax H3Escrito e mantido pela equipe editorial do MiniMax H3 AI Video GeneratorPublicado em Atualizado em Versão da ferramenta 2026.09.4