Generador de prompts de MiniMax H3
Describe la idea en una línea. Te vuelve como los tres campos que H3 fue entrenado para leer — primero el plano, luego el sonido.
Tu prompt estructurado
integrated_multimodal_descriptionoverall_soundscapenon_diegetic_music
Comprobaciones12 reglas, pasadas antes de copiar
- El orden de campos coincide con la secuencia oficial
- Sin marca de tiempo en [Shot 1]
- La línea de cámara nombra un movimiento pero no su amplitud ni su velocidad
the camera pushes in
El esqueleto gris es el formato de verdad — tres campos en los modos base, seis en el modo referencia.
0 / 7,000 characters
Tu primer clip en este sitio es gratis — sin tarjeta.
Qué devuelve el generador
de prompts de MiniMax H3
Un prompt que H3 puede ejecutar, no un párrafo que tiene que interpretar.
El generador de prompts de MiniMax H3 coge una idea en lenguaje llano y la reescribe como el modelo fue entrenado para leerla: una descripción de la imagen plano a plano, luego el sonido de la escena, luego la banda sonora, en ese orden fijo. Casi todos los generadores de prompts de video con IA te siguen dando un bloque de prosa de cine mudo, o un formulario de veinte campos que te obliga a estructurar a ti. Éste pide una frase, te escribe la estructura, la comprueba contra las reglas oficiales y no pide cuenta nunca.
- Una línea
- 1
- Campos
- 3 / 6
- Reglas
- 12
- Techo de caracteres
- 7 000
Una línea
Campos
Reglas
Techo de caracteres
- Sin formulario de veinte campos
- Sin cuenta
- Sin gastar créditos
La estructura de tres campos, en el orden que H3 espera
Éste es el formato de la propia MiniMax — la skill h3-prompt-writing que publicaron en el repositorio de H3 en GitHub en agosto de 2026, con archivos de referencia que fijan los campos, su orden y las reglas. En la canalización de la propia MiniMax hay una etapa alojada llamada Context-IR que reescribe lo que escribas a esta estructura antes de que el modelo la vea. Llama a la API y tienes esa etapa; en cualquier otro sitio te la construyes tú. Aquí ya está corriendo, en tu navegador.
integrated_multimodal_descriptionLa imagen, plano a plano.overall_soundscapeA qué suena la escena en sí.non_diegetic_musicLa banda sonora, o “N/A”.
[Shot 1], marcas de tiempo y diálogo
Los planos van numerados, cada corte a partir del segundo lleva marca de tiempo, y el primero no la lleva nunca. Dentro de cada plano el orden oficial es composición, sujeto, entorno, acción, cámara, sonido. El diálogo también vive aquí: identidad e interpretación fuera de la etiqueta, palabras exactas dentro. Escribe “dice algo emotivo” y H3 se inventa la frase — pocas veces la que querías. Cuenta con que este campo lleve alrededor del sesenta por ciento del prompt, y la mayoría de los rechazos.
(S1) says: <d>[Spanish] Sigue al viento.</d>
overall_soundscape y non_diegetic_music
Los dos campos de cierre son los que las herramientas de modelos mudos no escriben nunca. El soundscape es el sonido que hace la escena en sí — lluvia sobre la tela, una taza que se posa, tráfico a dos calles — con distancia y momento. El campo de música es la banda sonora que sólo oye el público: instrumentos, tempo, dónde entra y dónde resuelve. Una prueba: ¿podrían oírlo los personajes? Si sí, soundscape; si no, música.
non_diegetic_music: N/A
Gramática de cámara: movimiento, amplitud, velocidad
H3 lee el trabajo de cámara como inglés llano dentro del plano, construido con tres partes.
- Movimientopush in
- Amplitudsmall
- Velocidadslow
slow push-in, small amplitudestatic hold throughoutcinematic camera workNo hay nada ahí que ejecutar.[Push in][Truck left]Sintaxis de Hailuo 02. H3 no la lee.
“The camera pushes in with small amplitude at slow speed” es ejecutable. “Cinematic camera work” no lo es. Omite la amplitud y la velocidad cuando quieras decir media y normal. Si aprendiste Hailuo 02, desaprende los corchetes: las etiquetas apiladas ya no están, los corchetes cuadrados marcan ahora números de plano, y el generador de prompts de MiniMax H3 escribe el movimiento dentro de la frase.
Di static cuando quieras un encuadre fijo — una cámara que no mencionas es una cámara que el modelo puede mover a su antojo. Y en texto a video puro, resístete a sobredirigir: las pruebas de la comunidad encuentran que un párrafo natural le gana a un montón de directivas técnicas.
Un generador de prompts de MiniMax H3, cinco modos de entrada
El modo decide el esqueleto, así que el modo va primero.
Texto
T2VA
Toda la línea de tiempo se construye con palabras.
Relación obligatoria — adaptativa se rechaza
Primer fotograma
I2VA
Tu imagen abre el plano y el clip avanza hacia delante.
Primero + último
FL2VA
Dos imágenes, y el camino entre ellas se genera.
Último
L2VA
Describe una carrerilla plausible y deja que el clip converja en tu imagen.
Real, y casi sin documentar en ningún sitio
Referencias
Ref2VA
Los materiales definen sujetos; la escena se construye para obedecerlos.
Los tres modos con imagen añaden una línea que los prompts base no tienen: una declaración de alineación que fija cada imagen a su momento. Los modos con imagen ignoran tu relación de aspecto — la decide la imagen.
Ref2VA: seis secciones y ocho marcadores de retención
El modo referencia cambia tres campos por seis. Cada material recibe una etiqueta, y una etiqueta usada pero nunca definida invalida el prompt entero. El resumen abre con tipos de tarea entre corchetes, y retention_analysis asigna a cada referencia uno de ocho marcadores en dos conjuntos fijos — cuatro visuales, cuatro de audio. Los conjuntos no se cruzan nunca. Es el quinto más difícil del formato de escribir a mano, así que el formulario lo construye material a material. La guía completa de marcadores está en imagen de referencia.
Las comprobaciones que pasa un generador de prompts de MiniMax H3 antes de que copies
La skill oficial cierra con reglas de salida. Cada prompt de aquí se comprueba contra ellas antes de que lo veas.
- El orden de campos coincide con la secuencia oficial
- Sin marca de tiempo en el primer plano[Shot 1]
- Cada corte cabe en la duración pedida00:09.000 en un clip de 8 s
- Longitud total bajo el techo de la API7 000 caracteres
- El modo texto tiene una relación concretaadaptativa se rechaza
- Toda etiqueta de referencia definidasubject_definitions
- Los marcadores se quedan en su conjuntovisual ≠ audio
- Las descripciones van en inglésel diálogo se queda en su propio idioma
- El diálogo nombra las palabras exactas
- Las líneas de cámara llevan las tres partes
- Los modos con imagen abren con una alineación
- La prosa se lee como un plano, no como una sinopsis
Un hallazgo, tal como lo escribe el comprobador
“the camera pushes in” — names a move but not its amplitude or speed.
H3 ejecuta las tres. Prueba: push-in lento, amplitud pequeña.
Pega cualquier prompt que ya tengas en la pestaña Comprobar y el generador de prompts de MiniMax H3 le da el mismo trato, con la línea que falla citada y el arreglo sugerido.
Descubrir que un prompt está roto suele costar una generación de pago. Aquí no cuesta nada.
Video a prompt: cuando el clip ya existe
Todo lo de arriba va de la idea al prompt. Esto es el mismo viaje al revés.
Esta página
Una línea de palabras llanasLos tres campos, en orden
Video a prompt
Lista de planos, trayectoria de cámara, los dos campos de sonidoUn clip que ya tienes
Tienes un clip y quieres el prompt que podría hacer uno parecido — lista de planos, trayectoria de cámara y los dos campos de sonido leídos del propio material. La marcha atrás es su propia herramienta: pega un enlace en video a prompt y trae el resultado aquí para editarlo.
Si lo que quieres es conservar el encuadre o la banda sonora originales, sáltate los prompts y dale el clip al modo referencia.
Llevar un prompt de H3 a Veo, Seedance o Kling
Los prompts son tuyos, y la estructura viaja — casi siempre. Primero el límite duro.
MiniMax H37 000 caracteres
Veo 3.11 024 tokens — una lista de planos completa de H3 no cabe
Quédate con la descripción de un plano, quita las etiquetas de campo, reescribe la línea de cámara. Seedance lee referencias @AssetName en vez de definiciones de etiqueta. Kling y casi todos los demás quieren un solo párrafo descriptivo, así que manda sólo el campo visual.
Los dos campos de sonido no tienen destino en ninguna parte — ningún otro modelo mayoritario acepta el sonido como campos etiquetados, y eso es la mayor parte de para lo que sirve un generador de prompts de MiniMax H3.
¿Estás decidiendo entre modelos en vez de portar un prompt? Empieza por MiniMax H3 frente a Veo 3.
Cómo construir un prompt de MiniMax H3
Escribir el prompt nunca gasta créditos, así que merece la pena pasar las comprobaciones antes de generar nada.
Elige el modo de entrada
T2VA, I2VA, FL2VA, L2VA o Ref2VA. El modo decide qué campos espera H3 y en qué orden.
Cinco modosEscribe la idea en lenguaje llano
Con una línea basta. Se reescribe al orden de campos oficial, con los dos campos de audio incluidos.
Gratis, sin cuentaLee las doce comprobaciones
Cada regla que falla cita la línea que la rompió, para que veas qué habría ignorado H3.
Línea que falla, citadaCópialo, o mándalo directo al generador
El contador de caracteres sigue el techo de 7 000 caracteres de la API mientras editas.
Techo de 7 000 caracteres
¿Ya has escrito un prompt en otro sitio? La pestaña Comprobar le pasa las mismas doce reglas sin reescribir nada.
Preguntas frecuentes sobre el generador de prompts de MiniMax H3
Lo que conviene saber antes de escribir tu primer prompt de H3
¿Qué es el generador de prompts de MiniMax H3?
¿Es éste el formato oficial?
¿Qué es Context-IR, y lo sigo necesitando?
¿Cuánto debería medir un prompt de H3?
¿Tengo que escribir en inglés?
¿Cómo se escribe el diálogo?
¿Cómo se escribe el movimiento de cámara?
¿Qué separa el soundscape del campo de música?
¿Por qué me rechazaron las marcas de tiempo?
¿Puede convertir un video en un prompt?
¿Es gratis, y puedo llevarme los prompts a donde sea?
Una línea entra, el orden de campos oficial sale.
Gratis, sin cuenta, y el prompt es tuyo allá donde te lo lleves.
Crear cuenta gratis · 1 clip en MiniMax H3Escrito y mantenido por el equipo editorial de MiniMax H3 AI Video GeneratorPublicado el Última actualización: