Generador de prompts de MiniMax H3

Describe la idea en una línea. Te vuelve como los tres campos que H3 fue entrenado para leer — primero el plano, luego el sonido.

¿Dónde lo vas a usar? El modo cambia el esqueleto de campos.

Sin cuenta. Nunca gasta créditos.

Empezar por , , , , , , , o carga un ejemplo ya trabajado: , ,

Gratis. Sin cuenta. Nunca gasta créditos.

Tu prompt estructurado

  • integrated_multimodal_description
  • overall_soundscape
  • non_diegetic_music

Comprobaciones12 reglas, pasadas antes de copiar

  • El orden de campos coincide con la secuencia oficial
  • Sin marca de tiempo en [Shot 1]
  • La línea de cámara nombra un movimiento pero no su amplitud ni su velocidadthe camera pushes in

El esqueleto gris es el formato de verdad — tres campos en los modos base, seis en el modo referencia.

0 / 7,000 characters

Tu primer clip en este sitio es gratis — sin tarjeta.

Qué te devuelve

Qué devuelve el generador de prompts de MiniMax H3

Un prompt que H3 puede ejecutar, no un párrafo que tiene que interpretar.

El generador de prompts de MiniMax H3 coge una idea en lenguaje llano y la reescribe como el modelo fue entrenado para leerla: una descripción de la imagen plano a plano, luego el sonido de la escena, luego la banda sonora, en ese orden fijo. Casi todos los generadores de prompts de video con IA te siguen dando un bloque de prosa de cine mudo, o un formulario de veinte campos que te obliga a estructurar a ti. Éste pide una frase, te escribe la estructura, la comprueba contra las reglas oficiales y no pide cuenta nunca.

Una línea
1

Una línea

Campos
3 / 6

Campos

Reglas
12

Reglas

Techo de caracteres
7 000

Techo de caracteres

  • Sin formulario de veinte campos
  • Sin cuenta
  • Sin gastar créditos

El formato

La estructura de tres campos, en el orden que H3 espera

Éste es el formato de la propia MiniMax — la skill h3-prompt-writing que publicaron en el repositorio de H3 en GitHub en agosto de 2026, con archivos de referencia que fijan los campos, su orden y las reglas. En la canalización de la propia MiniMax hay una etapa alojada llamada Context-IR que reescribe lo que escribas a esta estructura antes de que el modelo la vea. Llama a la API y tienes esa etapa; en cualquier otro sitio te la construyes tú. Aquí ya está corriendo, en tu navegador.

  1. integrated_multimodal_descriptionLa imagen, plano a plano.
  2. overall_soundscapeA qué suena la escena en sí.
  3. non_diegetic_musicLa banda sonora, o “N/A”.

[Shot 1], marcas de tiempo y diálogo

Los planos van numerados, cada corte a partir del segundo lleva marca de tiempo, y el primero no la lleva nunca. Dentro de cada plano el orden oficial es composición, sujeto, entorno, acción, cámara, sonido. El diálogo también vive aquí: identidad e interpretación fuera de la etiqueta, palabras exactas dentro. Escribe “dice algo emotivo” y H3 se inventa la frase — pocas veces la que querías. Cuenta con que este campo lleve alrededor del sesenta por ciento del prompt, y la mayoría de los rechazos.

(S1) says: <d>[Spanish] Sigue al viento.</d>

overall_soundscape y non_diegetic_music

Los dos campos de cierre son los que las herramientas de modelos mudos no escriben nunca. El soundscape es el sonido que hace la escena en sí — lluvia sobre la tela, una taza que se posa, tráfico a dos calles — con distancia y momento. El campo de música es la banda sonora que sólo oye el público: instrumentos, tempo, dónde entra y dónde resuelve. Una prueba: ¿podrían oírlo los personajes? Si sí, soundscape; si no, música.

non_diegetic_music: N/A

Gramática de cámara

Gramática de cámara: movimiento, amplitud, velocidad

H3 lee el trabajo de cámara como inglés llano dentro del plano, construido con tres partes.

  • Movimientopush in
  • Amplitudsmall
  • Velocidadslow
  • slow push-in, small amplitude
  • static hold throughout
  • cinematic camera workNo hay nada ahí que ejecutar.
  • [Push in][Truck left]Sintaxis de Hailuo 02. H3 no la lee.

“The camera pushes in with small amplitude at slow speed” es ejecutable. “Cinematic camera work” no lo es. Omite la amplitud y la velocidad cuando quieras decir media y normal. Si aprendiste Hailuo 02, desaprende los corchetes: las etiquetas apiladas ya no están, los corchetes cuadrados marcan ahora números de plano, y el generador de prompts de MiniMax H3 escribe el movimiento dentro de la frase.

Di static cuando quieras un encuadre fijo — una cámara que no mencionas es una cámara que el modelo puede mover a su antojo. Y en texto a video puro, resístete a sobredirigir: las pruebas de la comunidad encuentran que un párrafo natural le gana a un montón de directivas técnicas.

Cinco modos de entrada

Un generador de prompts de MiniMax H3, cinco modos de entrada

El modo decide el esqueleto, así que el modo va primero.

  • Texto

    T2VA
    Construido en el generador de prompts de MiniMax H3: un plano hecho enteramente de palabras

    Toda la línea de tiempo se construye con palabras.

    Relación obligatoria — adaptativa se rechaza

  • Primer fotograma

    I2VA
    Salida del generador de prompts: una fotografía usada como primer fotograma

    Tu imagen abre el plano y el clip avanza hacia delante.

  • Primero + último

    FL2VA
    Del generador de prompts — dos imágenes con el camino entre ellas generado

    Dos imágenes, y el camino entre ellas se genera.

  • Último

    L2VA
    Construido en el generador de prompts de MiniMax H3: un clip que converge en un fotograma final dado

    Describe una carrerilla plausible y deja que el clip converja en tu imagen.

    Real, y casi sin documentar en ningún sitio

  • Referencias

    Ref2VA
    Salida del generador de prompts: material de referencia que define un sujeto

    Los materiales definen sujetos; la escena se construye para obedecerlos.

Los tres modos con imagen añaden una línea que los prompts base no tienen: una declaración de alineación que fija cada imagen a su momento. Los modos con imagen ignoran tu relación de aspecto — la decide la imagen.

Ref2VA: seis secciones y ocho marcadores de retención

El modo referencia cambia tres campos por seis. Cada material recibe una etiqueta, y una etiqueta usada pero nunca definida invalida el prompt entero. El resumen abre con tipos de tarea entre corchetes, y retention_analysis asigna a cada referencia uno de ocho marcadores en dos conjuntos fijos — cuatro visuales, cuatro de audio. Los conjuntos no se cruzan nunca. Es el quinto más difícil del formato de escribir a mano, así que el formulario lo construye material a material. La guía completa de marcadores está en imagen de referencia.

  1. subject_definitions
  2. summary
  3. retention_analysis
  4. detailed_description
  5. overall_soundscape
  6. non_diegetic_music

El comprobador

Las comprobaciones que pasa un generador de prompts de MiniMax H3 antes de que copies

La skill oficial cierra con reglas de salida. Cada prompt de aquí se comprueba contra ellas antes de que lo veas.

  • El orden de campos coincide con la secuencia oficial
  • Sin marca de tiempo en el primer plano[Shot 1]
  • Cada corte cabe en la duración pedida00:09.000 en un clip de 8 s
  • Longitud total bajo el techo de la API7 000 caracteres
  • El modo texto tiene una relación concretaadaptativa se rechaza
  • Toda etiqueta de referencia definidasubject_definitions
  • Los marcadores se quedan en su conjuntovisual ≠ audio
  • Las descripciones van en inglésel diálogo se queda en su propio idioma
  • El diálogo nombra las palabras exactas
  • Las líneas de cámara llevan las tres partes
  • Los modos con imagen abren con una alineación
  • La prosa se lee como un plano, no como una sinopsis

Un hallazgo, tal como lo escribe el comprobador

“the camera pushes in” — names a move but not its amplitude or speed.

H3 ejecuta las tres. Prueba: push-in lento, amplitud pequeña.

Pega cualquier prompt que ya tengas en la pestaña Comprobar y el generador de prompts de MiniMax H3 le da el mismo trato, con la línea que falla citada y el arreglo sugerido.

Descubrir que un prompt está roto suele costar una generación de pago. Aquí no cuesta nada.

La otra dirección

Video a prompt: cuando el clip ya existe

Todo lo de arriba va de la idea al prompt. Esto es el mismo viaje al revés.

  • Esta página

    Una línea de palabras llanasLos tres campos, en orden

  • Video a prompt

    Lista de planos, trayectoria de cámara, los dos campos de sonidoUn clip que ya tienes

Tienes un clip y quieres el prompt que podría hacer uno parecido — lista de planos, trayectoria de cámara y los dos campos de sonido leídos del propio material. La marcha atrás es su propia herramienta: pega un enlace en video a prompt y trae el resultado aquí para editarlo.

Si lo que quieres es conservar el encuadre o la banda sonora originales, sáltate los prompts y dale el clip al modo referencia.

Llevártelo a otro sitio

Llevar un prompt de H3 a Veo, Seedance o Kling

Los prompts son tuyos, y la estructura viaja — casi siempre. Primero el límite duro.

  • MiniMax H37 000 caracteres

  • Veo 3.11 024 tokens — una lista de planos completa de H3 no cabe

Quédate con la descripción de un plano, quita las etiquetas de campo, reescribe la línea de cámara. Seedance lee referencias @AssetName en vez de definiciones de etiqueta. Kling y casi todos los demás quieren un solo párrafo descriptivo, así que manda sólo el campo visual.

Los dos campos de sonido no tienen destino en ninguna parte — ningún otro modelo mayoritario acepta el sonido como campos etiquetados, y eso es la mayor parte de para lo que sirve un generador de prompts de MiniMax H3.

¿Estás decidiendo entre modelos en vez de portar un prompt? Empieza por MiniMax H3 frente a Veo 3.

El procedimiento entero

Cómo construir un prompt de MiniMax H3

Escribir el prompt nunca gasta créditos, así que merece la pena pasar las comprobaciones antes de generar nada.

  1. Elige el modo de entrada

    T2VA, I2VA, FL2VA, L2VA o Ref2VA. El modo decide qué campos espera H3 y en qué orden.

    Cinco modos
  2. Escribe la idea en lenguaje llano

    Con una línea basta. Se reescribe al orden de campos oficial, con los dos campos de audio incluidos.

    Gratis, sin cuenta
  3. Lee las doce comprobaciones

    Cada regla que falla cita la línea que la rompió, para que veas qué habría ignorado H3.

    Línea que falla, citada
  4. Cópialo, o mándalo directo al generador

    El contador de caracteres sigue el techo de 7 000 caracteres de la API mientras editas.

    Techo de 7 000 caracteres

¿Ya has escrito un prompt en otro sitio? La pestaña Comprobar le pasa las mismas doce reglas sin reescribir nada.

Preguntas que la gente hace de verdad

Preguntas frecuentes sobre el generador de prompts de MiniMax H3

Lo que conviene saber antes de escribir tu primer prompt de H3

¿Qué es el generador de prompts de MiniMax H3?

Convierte una idea en lenguaje llano en el prompt estructurado y etiquetado que espera MiniMax H3 — tres campos en los modos base, seis en el modo referencia — y lo valida contra las reglas de salida oficiales antes de que lo copies.

¿Es éste el formato oficial?

Sí. El generador de prompts de MiniMax H3 sigue la skill oficial h3-prompt-writing y sus archivos de referencia. La herramienta en sí es independiente; no somos MiniMax.

¿Qué es Context-IR, y lo sigo necesitando?

Context-IR es la etapa alojada de MiniMax que reescribe la entrada a esta estructura, facturada por token. Esta página es la alternativa de construcción propia que describe la guía oficial. Las canalizaciones de API de mucho volumen todavía pueden preferirla.

¿Cuánto debería medir un prompt de H3?

Más largo y más concreto suele ganar, hasta el límite de 7 000 caracteres de la API. Los propios ejemplos de Context-IR de MiniMax expanden ideas cortas hasta miles de tokens.

¿Tengo que escribir en inglés?

Las descripciones, sí. El diálogo, la letra y el texto en pantalla se quedan en su idioma original — ésa es la regla oficial.

¿Cómo se escribe el diálogo?

Identificador de hablante, interpretación y luego la frase exacta dentro de una etiqueta de idioma: (S1) says: <d>[Spanish] tu frase aquí.</d> La identidad se queda fuera de la etiqueta. Once idiomas tienen soporte estable.

¿Cómo se escribe el movimiento de cámara?

Las tres partes en una frase: tipo de movimiento, amplitud, velocidad. “The camera pushes in with small amplitude at slow speed” se ejecuta; “dynamic camera work” no.

¿Qué separa el soundscape del campo de música?

Si los personajes podrían oírlo o no. El sonido que existe en la escena va al soundscape; la banda sonora que sólo oye el público es música.

¿Por qué me rechazaron las marcas de tiempo?

Un tiempo que contradice la duración pedida rompe una regla oficial explícita. El comprobador lo marca antes de que copies — incluida la clásica: una marca de tiempo en el primer plano.

¿Puede convertir un video en un prompt?

Esta página no — eso es video a prompt, la herramienta inversa. Pega un clip allí y te lee la lista de planos y los dos campos de sonido.

¿Es gratis, y puedo llevarme los prompts a donde sea?

Gratis, sin cuenta, y escribir un prompt nunca gasta créditos. Los prompts son tuyos: pégalos en nuestro generador de texto a video, en la API de MiniMax, en Hailuo, en ComfyUI, donde quieras. Unos límites de uso razonable lo mantienen rápido.

Una línea entra, el orden de campos oficial sale.

Gratis, sin cuenta, y el prompt es tuyo allá donde te lo lleves.

Crear cuenta gratis · 1 clip en MiniMax H3

Escrito y mantenido por el equipo editorial de MiniMax H3 AI Video GeneratorPublicado el Última actualización: