Gerador de prompt do MiniMax H3

Descreva a ideia em uma linha. Receba ela de volta como os três campos que o H3 foi treinado para ler — primeiro a imagem, depois o som.

Onde você vai usar? O modo muda o esqueleto dos campos.

Sem conta. Nunca gasta créditos.

Partir de , , , , , , , ou carregue um exemplo pronto: , ,

Grátis. Sem conta. Nunca gasta créditos.

O seu prompt estruturado

  • integrated_multimodal_description
  • overall_soundscape
  • non_diegetic_music

Verificações12 regras, rodadas antes de você copiar

  • A ordem dos campos bate com a sequência oficial
  • Sem marca de tempo no [Shot 1]
  • A linha de câmera nomeia um movimento mas não a amplitude nem a velocidadethe camera pushes in

O esqueleto cinza é o formato de verdade — três campos nos modos base, seis no modo referência.

0 / 7,000 characters

O seu primeiro clipe neste site é grátis — sem cartão.

O que volta

O que o gerador de prompt do MiniMax H3 devolve

Um prompt que o H3 consegue executar, não um parágrafo que ele tem de interpretar.

O gerador de prompt do MiniMax H3 pega uma ideia em linguagem simples e reescreve ela do jeito que o modelo foi treinado para ler: uma descrição de imagem plano a plano, depois o som da cena, depois a trilha, nessa ordem fixa. A maior parte das ferramentas de gerador de prompt de vídeo com IA ainda te entrega um bloco de prosa de cinema mudo, ou um formulário de vinte campos que faz você mesmo estruturar tudo. Este aqui pede uma frase, escreve a estrutura por você, confere contra as regras oficiais, e nunca pede conta.

Uma linha
1

Uma linha

Campos
3 / 6

Campos

Regras
12

Regras

Teto de caracteres
7,000

Teto de caracteres

  • Sem formulário de vinte campos
  • Sem conta
  • Sem gastar créditos

O formato

A estrutura de prompt de três campos, na ordem que o H3 espera

Este é o formato da própria MiniMax — a skill h3-prompt-writing que eles publicaram no repositório do H3 no GitHub em agosto de 2026, com arquivos de referência que fixam os campos, a ordem deles e as regras. No pipeline da própria MiniMax, um estágio hospedado chamado Context-IR reescreve o que você digita nessa estrutura antes de o modelo ver. Chame a API e você ganha esse estágio; em todo o resto você monta sozinho. Aqui ele já está rodando, no seu navegador.

  1. integrated_multimodal_descriptionA imagem, plano a plano.
  2. overall_soundscapeComo a própria cena soa.
  3. non_diegetic_musicA trilha, ou «N/A».

[Shot 1], marcas de tempo e diálogo

Os planos são numerados, todo corte a partir do segundo plano ganha uma marca de tempo, e o primeiro plano nunca ganha. Dentro de cada plano a ordem oficial é composição, sujeito, ambiente, ação, câmera, som. O diálogo mora aqui também: identidade e entonação fora da etiqueta, palavras exatas dentro. Escreva «ela diz algo emocionante» e o H3 inventa a fala — raramente a que você queria. Espere que este campo carregue uns sessenta por cento do prompt, e a maior parte das recusas.

(S1) says: <d>[Portuguese] Siga o vento.</d>

overall_soundscape e non_diegetic_music

Os dois campos finais são os que as ferramentas de modelo mudo nunca escrevem. O ambiente sonoro é o som que a própria cena faz — chuva no tecido, uma caneca sendo pousada, o trânsito duas ruas adiante — com distância e tempo. O campo de música é a trilha que só a plateia ouve: instrumentos, andamento, onde entra e onde resolve. Um teste: os personagens conseguiriam ouvir? Se sim, ambiente sonoro; se não, música.

non_diegetic_music: N/A

Gramática de câmera

Gramática de câmera: movimento, amplitude, velocidade

O H3 recebe o trabalho de câmera como inglês simples dentro do plano, montado em três partes.

  • Movimentopush in
  • Amplitudesmall
  • Velocidadeslow
  • slow push-in, small amplitude
  • static hold throughout
  • cinematic camera workNão há nada ali para executar.
  • [Push in][Truck left]Sintaxe do Hailuo 02. O H3 não lê isso.

«The camera pushes in with small amplitude at slow speed» é executável. «Cinematic camera work» não é. Omita amplitude e velocidade quando você quiser dizer médio e normal. Se você aprendeu no Hailuo 02, desaprenda os colchetes: as etiquetas empilhadas acabaram, os colchetes agora marcam número de plano, e o gerador de prompt do MiniMax H3 escreve o movimento dentro da frase.

Diga static quando quiser um quadro travado — uma câmera que você nunca menciona é uma câmera que o modelo está livre para mexer. E no texto para vídeo puro, resista a dirigir demais: os testes da comunidade mostram que um parágrafo natural ganha de uma pilha de diretivas técnicas.

Cinco modos de entrada

Um gerador de prompt do MiniMax H3, cinco modos de entrada

O modo decide o esqueleto, então o modo vem primeiro.

  • Texto

    T2VA
    Feito no gerador de prompt do MiniMax H3: um plano construído inteiramente com palavras

    A linha do tempo inteira é construída com palavras.

    Proporção obrigatória — adaptativo é recusado

  • Primeiro quadro

    I2VA
    Saída do gerador de prompt: uma fotografia usada como quadro de abertura

    A sua imagem abre o plano e o clipe se desenvolve para a frente.

  • 1º + último

    FL2VA
    Do gerador de prompt — duas imagens com o caminho entre elas gerado

    Duas imagens, e o caminho entre elas é gerado.

  • Último quadro

    L2VA
    Feito no gerador de prompt do MiniMax H3: um clipe convergindo para um quadro final fornecido

    Descreva uma aproximação plausível e deixe o clipe convergir para a sua imagem.

    Real, e quase não documentado em lugar nenhum

  • Referências

    Ref2VA
    Saída do gerador de prompt: material de referência definindo um sujeito

    Os arquivos definem os sujeitos; a cena é construída para obedecer a eles.

Os três modos de imagem acrescentam uma linha que os prompts base não têm: uma declaração de alinhamento fixando cada imagem ao momento dela. Os modos de imagem ignoram a sua proporção — quem decide é a imagem.

Ref2VA: seis seções e oito marcadores de retenção

O modo referência troca três campos por seis. Todo arquivo ganha uma etiqueta, e uma etiqueta usada mas nunca definida invalida o prompt inteiro. O summary abre com tipos de tarefa entre colchetes, e retention_analysis atribui a cada referência um de oito marcadores em dois conjuntos fixos — quatro visuais, quatro de áudio. Os conjuntos nunca se cruzam. É o quinto mais difícil do formato para escrever à mão, então o formulário monta isso por arquivo. O guia completo dos marcadores está em referência para vídeo.

  1. subject_definitions
  2. summary
  3. retention_analysis
  4. detailed_description
  5. overall_soundscape
  6. non_diegetic_music

O conferidor

As verificações que um gerador de prompt do MiniMax H3 roda antes de você copiar

A skill oficial termina com regras de saída. Todo prompt daqui é conferido contra elas antes de você ver.

  • A ordem dos campos bate com a sequência oficial
  • Sem marca de tempo no primeiro plano[Shot 1]
  • Todo corte cabe na duração pedida00:09.000 num clipe de 8 s
  • Comprimento total abaixo do teto da API7.000 caracteres
  • O modo texto tem uma proporção concretaadaptativo é recusado
  • Toda etiqueta de referência está definidasubject_definitions
  • Os marcadores de retenção ficam no conjunto delesvisual ≠ áudio
  • As descrições estão em inglêso diálogo fica no idioma dele
  • O diálogo nomeia as palavras exatas
  • As linhas de câmera trazem as três partes
  • Os modos de imagem abrem com uma linha de alinhamento
  • A prosa se lê como um plano, não como resumo de enredo

Um achado, do jeito que o conferidor escreve

«the camera pushes in» — nomeia um movimento mas não a amplitude nem a velocidade.

O H3 executa as três. Tente: slow push-in, small amplitude.

Cole qualquer prompt já existente na aba de conferência e o gerador de prompt do MiniMax H3 dá a ele o mesmo tratamento, com a linha que falhou citada e a correção sugerida.

Um prompt quebrado normalmente custa uma geração paga para ser descoberto. Aqui não custa nada.

A outra direção

Vídeo para prompt: quando o clipe já existe

Tudo acima vai da ideia para o prompt. Isto é a mesma viagem ao contrário.

  • Esta página

    Uma linha de palavras simplesOs três campos, em ordem

  • Vídeo para prompt

    Lista de planos, trajeto de câmera, os dois campos de somUm clipe que você já tem

Você tem um clipe e quer o prompt que poderia fazer um parecido — lista de planos, trajeto de câmera e os dois campos de som lidos de volta a partir da filmagem. A marcha a ré é uma ferramenta própria: cole um link em vídeo para prompt e traga o resultado de volta para cá para editar.

Se o objetivo é manter o enquadramento ou a trilha originais, pule os prompts e entregue o clipe ao modo referência.

Levar para outro lugar

Levar um prompt do H3 para o Veo, o Seedance ou o Kling

Os prompts são seus, e a estrutura viaja — quase toda. Primeiro o limite duro.

  • MiniMax H37.000 caracteres

  • Veo 3.11.024 tokens — uma lista de planos inteira do H3 não cabe

Guarde a descrição de um plano, tire os rótulos dos campos, reescreva a linha de câmera. O Seedance lê referências @AssetName em vez de definições de etiqueta. O Kling e quase todos os outros querem um parágrafo descritivo único, então mande só o campo visual.

Os dois campos de som não têm destino em lugar nenhum — nenhum outro modelo do mercado aceita som como campos etiquetados, e é justamente para isso que serve boa parte de um gerador de prompt do MiniMax H3.

Decidindo entre modelos em vez de portar um prompt? Comece em MiniMax H3 vs Veo 3.

O procedimento inteiro

Como montar um prompt do MiniMax H3

Escrever o prompt nunca gasta créditos, então vale rodar as verificações antes de gerar qualquer coisa.

  1. Escolha o modo de entrada

    T2VA, I2VA, FL2VA, L2VA ou Ref2VA. O modo decide quais campos o H3 espera e em que ordem.

    Cinco modos
  2. Digite a ideia em linguagem simples

    Uma linha basta. Ela é reescrita na ordem oficial dos campos, com os dois campos de áudio incluídos.

    Grátis, sem conta
  3. Leia as doze verificações

    Cada regra que falha cita a linha que a quebrou, para você ver o que o H3 teria ignorado.

    Linha que falhou citada
  4. Copie, ou mande direto para o gerador

    O contador de caracteres acompanha o teto de 7.000 caracteres da API enquanto você edita.

    Teto de 7.000 caracteres

Já escreveu um prompt em outro lugar? A aba de conferência roda as mesmas doze regras contra ele sem reescrever nada.

Perguntas que as pessoas fazem mesmo

Perguntas frequentes sobre o gerador de prompt do MiniMax H3

O que saber antes de escrever o seu primeiro prompt do H3

O que é o gerador de prompt do MiniMax H3?

Ele transforma uma ideia em linguagem simples no prompt estruturado e etiquetado que o MiniMax H3 espera — três campos nos modos base, seis no modo referência — e valida contra as regras de saída oficiais antes de você copiar.

Este é o formato oficial?

É. O gerador de prompt do MiniMax H3 segue a skill oficial h3-prompt-writing e os arquivos de referência dela. A ferramenta em si é independente; nós não somos a MiniMax.

O que é o Context-IR, e eu ainda preciso dele?

O Context-IR é o estágio hospedado da MiniMax que reescreve a entrada nesta estrutura, cobrado por token. Esta página é a alternativa feita em casa que a própria orientação oficial descreve. Pipelines de API com volume alto ainda podem preferir ele.

Qual deve ser o tamanho de um prompt do H3?

Mais longo e mais específico costuma ganhar, até o limite de 7.000 caracteres da API. Os próprios exemplos de Context-IR da MiniMax expandem ideias curtas em milhares de tokens.

Eu tenho de escrever em inglês?

As descrições, sim. Diálogo, letras de música e texto na tela ficam no idioma original — essa é a regra oficial.

Como eu escrevo diálogo?

ID de quem fala, entonação, e então a fala exata dentro de uma etiqueta de idioma: (S1) says: <d>[Portuguese] sua fala aqui.</d> A identidade fica fora da etiqueta. Onze idiomas têm suporte estável.

Como eu escrevo movimento de câmera?

As três partes numa frase: tipo de movimento, amplitude, velocidade. «The camera pushes in with small amplitude at slow speed» executa; «dynamic camera work» não.

O que separa o ambiente sonoro do campo de música?

Se os personagens conseguiriam ouvir. Som que existe dentro da cena vai no ambiente sonoro; a trilha que só a plateia ouve é música.

Por que as minhas marcas de tempo foram recusadas?

Um tempo que contradiz a duração pedida quebra uma regra oficial explícita. O conferidor aponta isso antes de você copiar — inclusive a clássica: uma marca de tempo no primeiro plano.

Ele consegue virar um vídeo em prompt?

Esta página não — isso é vídeo para prompt, a ferramenta inversa. Cole um clipe lá e ela lê de volta a lista de planos e os dois campos de som.

É grátis, e eu posso levar os prompts para qualquer lugar?

Grátis, sem conta, e escrever um prompt nunca gasta créditos. Os prompts são seus: cole no nosso gerador de texto para vídeo, na API da MiniMax, no Hailuo, no ComfyUI, onde for. Limites de uso justo mantêm tudo rápido.

Entra uma linha, sai a ordem oficial dos campos.

Grátis, sem conta, e o prompt é seu para onde você levar.

Crie a conta de graça · 1 clipe no MiniMax H3

Escrito e mantido pela equipe editorial do MiniMax H3 AI Video GeneratorPublicado em Atualizado em Versão da ferramenta 2026.09.4