Alternatives

MiniMax H3 Max no es el H3 grande — su propia entrada en el ranking lo llama Turbo

MiniMax H3 Max renderiza un clip de 5 segundos en unos 3 y se para en 768p. Para qué planos sirve, qué te cuesta sin decirlo, y cómo elegir primero.

10 min de lecturaRedacciónRedacción
MiniMax H3 Max no es el H3 grande — su propia entrada en el ranking lo llama Turbo

Leí “Max” y di por hecho que era el grande. No lo es.

MiniMax H3 Max es un MiniMax H3 más rápido con un techo más bajo. fal Research lo posentrenó sobre los pesos publicados de H3, lo afinó a fondo para velocidad y adherencia al prompt, y topa en 768p donde el H3 estándar llega a 2K. Corre dos endpoints; el H3 estándar conserva esos dos y añade encima la referencia a video y la edición. Su propia entrada en el ranking de Artificial Analysis lo delata — fal lo lista allí como MiniMax H3 Turbo (768p). Turbo es la palabra honesta.

Nada de eso lo hace peor modelo. Generar más rápido de lo que dura el clip es un cambio real en cómo transcurre una tarde. Pero el nombre apunta a un techo más alto, la ficha técnica apunta a uno más bajo, y hay un flujo de trabajo que la distancia entre esos dos rompe sin hacer ruido.

Cuál necesita tu plano

Toda la decisión de MiniMax H3 Max frente a MiniMax H3 cabe en una tabla:

Si el plano tiene que…UsaDónde
sobrevivir a un recorte, a un reencuadre o a verse grandeMiniMax H3Generar en 2K
sostener el mismo personaje entre varios cortesMiniMax H3Referencia a video
cambiar un elemento de un material que ya funcionaMiniMax H3Video a video
durar cuatro segundosMiniMax H3Texto a video
arrancar de una imagen fija que ya tienescualquiera de los dosFoto a video
ser uno de cuarenta intentos de esta tarde, ninguno definitivoMiniMax H3 Maxsólo alojado en fal

La última fila es real y H3 Max se la lleva entera. Fíjate en lo que describe, eso sí: una fase del trabajo, no la cosa que entregas.

Lo que te da MiniMax H3 Max

Tres cosas, y la primera vale más de lo que suena.

Un clip de cinco segundos llega en unos tres. Más rápido que verlo. En cuanto el render deja de ser una pausa para el café, dejas de premontar en tu cabeza: simplemente pruebas la versión sobre la que dudabas. A lo largo de una tarde eso cambia lo que haces, no sólo lo rápido que lo haces.

La adherencia al prompt es en lo que fal gastó el posentrenamiento. Nombra los golpes en orden y llegan en orden. Pide palabras en pantalla y vuelven compuestas en vez de aproximadas.

Todo lo que hace que H3 sea H3 se traslada: un contexto unificado para el texto y las imágenes, y una pista sincronizada generada en la misma pasada que la imagen en lugar de puesta debajo después.

El sobre, a 31 de agosto de 2026: 480p o 768p, con 768p por defecto — 1344×768 a 16:9, 24 fps. De cinco a quince segundos. Texto a video acepta 21:9, 16:9, 4:3, 1:1, 3:4 y 9:16; foto a video sigue a la imagen que le des y acepta un fotograma final opcional, así que el primer y último fotograma también funciona.

Dónde muerde de verdad el techo de 768p

768p son 1344×768 — alrededor de 1,0 megapíxeles. El 2K de H3 pone 1440 en el lado corto, más o menos 3,7 megapíxeles en las relaciones anchas. Tres veces y media los píxeles, y se nota en cuatro sitios concretos:

  • En una línea de tiempo que no es 768p. Suelta un clip en 768p dentro de una secuencia a 1440p y se reescala hacia arriba. Todo lo que te gustaba de la textura se ablanda.
  • Cuando recortas. Reencuadrar un plano general a un cuadrado o a un vertical tira píxeles que no te sobraban.
  • En cualquier pantalla más grande que un móvil. Un clip protagonista en una página de aterrizaje o en un monitor enseña sus bordes.
  • En las caras y en las letras. El detalle fino es lo primero que gasta el 768p.

Si nada de eso describe el trabajo, el 768p es realmente suficiente y la velocidad es dinero gratis. Si algo de eso lo describe, el techo no es una línea de la ficha técnica: es el motivo por el que vas a repetir la toma.

Por qué no puedes hacer el borrador en H3 Max y terminar en 2K

El plan parece tan evidente que me puse a buscar el botón: itera barato y rápido en 768p, fija la versión que te gusta y luego vuelve a ejecutar ese mismo prompt en 2K para la entrega. No existe tal botón, y lo impiden dos cosas distintas.

H3 Max no tiene 2K en absoluto, así que “terminar” significa mudarse al H3 estándar. Y H3 Max es otro modelo — posentrenado, con otros pesos. Darle el mismo prompt y la misma semilla a otro modelo no te da el mismo plano a más resolución. Te da otro plano. La composición se desplaza, los tiempos de los golpes se mueven, y lo que pasaste cuarenta intentos eligiendo no es lo que vuelve.

Tampoco hay ningún botón de reescalado escondido por ahí. En este sitio el 768p y el 2K son dos generaciones separadas, cobradas por separado — aquí no existe ninguna vía de clip a 2K, y en H3 Max tampoco.

Así que importa más el orden que el modelo: decide primero la resolución de entrega y después itera en el modelo que pueda entregarla. Si la respuesta es 2K, haz los cuarenta intentos también en H3 — en 768p sobre el mismo modelo, donde el borrador sí predice el máster, y cambia la resolución para la pasada final. Pagas un poco más por intento y te quedas con el plano que elegiste. Lo que eso cuesta en créditos está en la página de precios, en nuestras propias unidades y sin ninguna conversión por segundo que hacer.

Pon el número de velocidad de fal en tu propio calendario

Las dos cifras son de la propia fal, salidas de las mismas preguntas frecuentes, y la segunda es la que no cita nadie:

Duración del clipSe renderiza enCómputo por segundo de video terminado
5 s (el valor por defecto)menos de 3 s~0,5 s
15 s (el máximo)“unos 15 segundos”~1,0 s

El coste por segundo terminado se dobla más o menos entre el clip más corto y el más largo. “Más rápido que el tiempo real” es cierto a cinco segundos y ya no lo es a quince — una generación de duración completa tarda más o menos lo mismo que dura lo que hizo.

Así que la regla honesta para planificar es por unidad de trabajo, no por modelo. ¿Estás montando golpes de cinco segundos para redes? El bucle sí que es así de apretado, y te va a cambiar la tarde. ¿Estás construyendo escenas de quince segundos? Presupuesta tiempo real y trata el titular del 35× — la medición de fal contra el propio endpoint de MiniMax — como una afirmación sobre clips cortos.

Hay otro número fácil de leer mal: fal informa de unos 2,5 s de ese render como timings.inference, y documenta el campo como el tiempo de eliminación de ruido del DiT en el backend de GPU. Es el reloj del modelo, no el tuyo. La cola, el tratamiento del prompt y la transferencia quedan fuera.

Sácale una comparación justa a MiniMax H3 Max

Si estás a punto de probar H3 Max contra cualquier otra cosa, mira antes un parámetro o tu resultado no va a ir sobre el modelo.

prompt_expansion_mode es obligatorio en la API de H3 Max. Tiene tres ajustes, el valor por defecto reescribe tu prompt antes de generar, y la respuesta te devuelve un campo expanded_prompt con el texto que se mandó de verdad.

AjusteQué pasaQué cuesta
disabledtus palabras pasan intactasnada
balanced (por defecto)decide petición a petición cuánto reescribiralrededor de un segundo
qualityuna reescritura completa hacia un encargo más ricohasta ~30 s — unas diez veces el render

De ahí salen dos cosas. Una comparación con los ajustes por defecto es tu prompt en el otro modelo contra la reescritura que fal hace de tu prompt aquí — pon disabled en los dos lados y espera que la salida cambie, porque ese cambio era la medición escapándose. Y si alguna vez te preguntaste por qué un “modelo de tres segundos” se sentía lento, mira si lo dejaste en quality, porque son treinta segundos de reescritura delante de tres de render.

El hábito útil en cualquier caso es leer expanded_prompt en unas cuantas ejecuciones. Te enseña qué aspecto tiene un buen encargo para este modelo, escrito por la gente que lo entrenó. Y después escribe el tuyo así — la misma estructura que construye nuestra herramienta de prompts, y el motivo de que un prompt detallado le siga ganando a uno corto más expansión.

Comprueba tú mismo el número 1

fal dice que H3 Max va primero, y va primero. Puedes confirmarlo entero en unos dos minutos, que es mejor que creerme a mí:

  • Design Arena, foto a video — H3 Max con 1 341 de Elo, y el MiniMax H3 base justo detrás con 1 333.
  • Artificial Analysis, foto a video con pista1 201 de Elo, ±11 al 95% de confianza, sobre 2 177 muestras. Archivado como MiniMax H3 Turbo (768p), que es donde se ve el nombre Turbo.
  • El estudio de preferencia de la propia fal contra doce modelos — primero en calidad, en comprensión del prompt y en estética. Hecho por fal, sobre la pila de fal.

Los dos paneles son Elo de preferencia: personas eligiendo entre dos clips. Eso es una señal real y no es un benchmark de capacidad.

Y ahora mira los dos números uno al lado del otro. Ocho puntos separan a H3 Max del modelo del que se posentrenó, en el panel que lista los dos. El panel que publica un intervalo de confianza publica ±11. Son paneles distintos, así que eso no es una prueba de significación — pero da la escala correcta. La afirmación que sobrevive es: a 768p, H3 Max es al menos tan bueno como H3, y están cerca.

Y lee el nombre de la entrada una vez más. Los dos paneles están clasificando salida en 768p. Nada de lo que hay ahí dice nada del 2K que entregarías de verdad.

Dónde queda MiniMax H3 Max en el asunto de los pesos abiertos

Versión corta: no hay ningún checkpoint de H3 Max, y no va a haberlo por accidente.

La licencia comunitaria de H3 define Model Derivative con la amplitud suficiente para que un posentrenamiento sea claramente uno, y te concede la propiedad de los derivados que hagas. Así que fal descargó pesos publicados, entrenó encima, se quedó el resultado y lo sirve cerrado — eso es la licencia funcionando como está escrita, no un agujero en ella. Es la demostración más clara que he visto de lo que compran de verdad los pesos abiertos, que es una pregunta distinta de qué te llevas en la descarga.

Hay una cláusula que corta hacia el otro lado, a favor de todos. La restricción de territorio que la gente cita se aplica a el modelo tal como se publicó en su repositorio — gobierna ejecutar los pesos, no usar un servicio alojado construido a partir de ellos. Eso cubre a H3 Max, y cubre cada vía alojada, ésta incluida. Esto es un resumen, no asesoramiento legal.

Preguntas frecuentes sobre MiniMax H3 Max

¿MiniMax H3 Max admite 2K? No. Sólo 480p y 768p. La propia página de modelo de fal te manda al MiniMax H3 estándar para salida en 2K.

¿MiniMax H3 Max es mejor que MiniMax H3? A 768p, marginalmente — ocho puntos de Elo en el panel que lista los dos. A 2K la pregunta no se aplica, porque H3 Max no genera 2K.

¿MiniMax H3 Max puede hacer referencia a video o consistencia de personaje? Todavía no. El 25 de agosto fal dijo que la referencia a video llegaría “esta misma semana”; a 31 de agosto siguen siendo dos endpoints, y la propia documentación de MiniMax la sigue listando como próximamente. Cuenta los endpoints antes de planificar sobre ella.

¿MiniMax H3 Max es gratis? Es una API alojada de pago con una asignación promocional en su anfitrión. Si lo que venías buscando de verdad es una asignación gratuita, qué no cuesta nada aquí y qué sí está escrito claro.

¿MiniMax H3 Max es un modelo oficial de MiniMax? Está avalado por MiniMax, se anunció conjuntamente y está listado en la propia documentación de generación de video de MiniMax. Lo construyó fal, no MiniMax, y sólo fal lo sirve.

¿Cuál es el clip más corto que puede hacer MiniMax H3 Max? Cinco segundos. La especificación de la propia MiniMax para H3 baja hasta cuatro, y cuatro es lo que te llevas aquí — conviene saberlo si montas corto. Por qué los segundos que pides no siempre son los que recibes es una historia aparte y más rara.

¿Por qué se llama Max si H3 hace más? Porque Max describe el punto de funcionamiento para el que fal lo afinó — velocidad punta a 768p con mayor adherencia al prompt — y no el techo de capacidad. El nombre del ranking, H3 Turbo, es el que te cuenta lo que pasó.


Última verificación: 31 de agosto de 2026. Todas las cifras de arriba son de fal o de MiniMax, incluidas las que favorecen a H3 Max, y el Elo de preferencia no es un benchmark de capacidad — cada una va con fuente para que puedas volver a comprobarla en vez de fiarte. Este modelo tiene cuatro semanas: la referencia a video se prometió para una semana que ya pasó, y un techo de resolución es exactamente la clase de cosa que se mueve.

Redacción

Escrito por

Redacción

minimax-h3ai.video

Publicado en el generador de video con IA MiniMax H3, una interfaz independiente de terceros construida sobre MiniMax H3.

Todos los artículos