Guides

MiniMax H3 en local u online: el requisito que nadie cita son minutos

Las tablas de requisitos dicen cuánta memoria hace falta. Lo que frena es el mismo trabajo en 480p: 182 segundos en una máquina y 90 minutos en otra.

8 min de lecturaRedacciónRedacción
MiniMax H3 en local u online: el requisito que nadie cita son minutos

Autoalojar o no se reduce a tres números: cuánta memoria tienes, cuántos minutos te cuesta un clip y si la licencia cubre el sitio donde vives.

No hay una especificación mínima única que valga para todos los montajes: los requisitos se mueven con el checkpoint, con el lienzo y con cuánto se desborda a la memoria del anfitrión. Lo que sí está fijo: la descarga más pequeña son 42,47 GB, te llevas H3-Base, o sea salida de clase 768 y nada de 2K, y la licencia excluye Estados Unidos, la Unión Europea, el Reino Unido y Corea del Sur. La salida alojada cuesta $0.08 por segundo.

La RAM del anfitrión aprieta más veces que la VRAM: los archivos superan a cualquier tarjeta de consumo, así que algo se desborda, y dos personas con 32 GB han contado resultados opuestos. En cuanto sabes en qué banda estás, esto deja de ser una pregunta de hardware y se vuelve aritmética.

Se mide en minutos por clip, no en gigabytes

Los gigabytes te dicen si carga. Los minutos te dicen si lo vas a usar.

El mismo trabajo en 480p ha salido en 182 segundos en una tarjeta de portátil de 16 GB con SageAttention, y en 90 minutos en un Mac Studio de 128 GB — una diferencia de treinta veces entre máquinas que cualquier tabla de requisitos da por suficientes. La generación alojada tarda de 30 a 90 segundos.

Todas las cifras de aquí son el resultado publicado de otra persona, con enlace a su fuente. Hay catorce configuraciones con fuente en la página de ComfyUI.

La cifra oficial se lee aparte: 559,67 segundos son dos tarjetas a cincuenta pasos en otro runtime, no una referencia de una sola tarjeta en ComfyUI. Ese registro llegó a un pico de 26,3 GiB por tarjeta en un anfitrión que resultaba tener 377 GiB — el origen del rumor de los “384 GB”, y la configuración de la máquina de pruebas, no un requisito.

Dónde estás lo decide antes que el coste

Para buena parte del mercado anglosajón, la aritmética no llega a empezar.

La licencia comunitaria de MiniMax excluye Estados Unidos, la Unión Europea, el Reino Unido y Corea del Sur, y la exclusión sigue a las salidas, no sólo a los pesos: renderiza en un país permitido, publica en uno excluido, y sigues fuera de la concesión. Las solicitudes van por platform.minimax.io/h3-license. La cláusula cubre los pesos, no la API alojada, que MiniMax declara disponible en todo el mundo — aunque esa API tiene sus propios términos y no es una respuesta automática de cumplimiento. La licencia, cláusula a cláusula tiene el resto. Es un resumen, no asesoramiento legal.

Si estás excluido y lo que necesitas de verdad es autoalojar, la respuesta honesta no somos nosotros: existe un modelo de pesos abiertos sin exclusión territorial, y corre en 16 GB.

Los dos requisitos que ninguna GPU satisface

H3 corre en tres etapas y lo que se descarga es la de en medio. H3-Context-IR reescribe tu prompt y tus referencias como una descripción estructurada de planos. H3-Base genera la imagen de clase 768 y su audio en una sola pasada. H3-Regenerate-2K vuelve a pasar ese resultado por el modelo con el contexto original, que es por lo que el texto pequeño sobrevive. Sólo se publicó H3-Base.

Ninguna tarjeta arregla esto: un bastidor de H200 sigue topando en 768. Así que el comparador honesto es $0.08 por segundo de salida, no $0.13 — citar la tarifa del 2K contra un render local infla el lado alojado en un 62 %. La falta de Context-IR se puede sortear en parte escribiendo tú mismo el prompt estructurado; la falta del 2K, no.

Sobre el coste, la línea la fija el uso

Dos clips a la semana y doscientos no son la misma pregunta, y lo que los separa no es la tarifa por hora.

La partida que toda tabla de local contra alojado se deja fuera es el almacenamiento persistente. El paquete compacto son 42,47 GB, el repositorio completo unos 498,5 GB, y un volumen en la nube factura cada mes generes o no generes.

Pila compactaRepositorio completo
Tamaño42,47 GB~498,5 GB
Almacenamiento a $0.07 por GB y mes~$3 al mes~$35 al mes
Amortizado en 30 clips al mes~$0.10 por clip~$1.17 por clip

Esa segunda columna es más de lo que cuesta alojar el clip directamente. Por eso la decisión gira sobre el uso y no sobre la tarifa por hora, y por eso una calculadora sin esta línea favorece a la opción local.

Hay otros dos números que son tuyos, no nuestros. Las tarifas de GPU en la nube se mueven cada semana y por región, así que mira la de hoy en vez de fiarte de un presupuesto en caché. Y los intentos por clip aprovechable: lo habitual es que la gente cuente tres o cuatro, lo que multiplica todo lo de arriba.

Sobre la privacidad: qué sale de verdad de tu máquina

“Local significa privado” es cierto bajo una condición que nadie escribe.

H3-Base en tu propia GPU está genuinamente sin conexión en cuanto los pesos han bajado. Recurre a Context-IR para mejorar un prompt, o a Regenerate-2K para una resolución entregable, y tu material se sube — las dos etapas están alojadas, y llamarlas desde una interfaz local no las vuelve locales.

Así que la configuración sin conexión es la que renuncia a la comprensión del prompt y al 2K. Un intercambio real, no una victoria gratis. Y que conste: generar aquí también sube tu material.

Cuál es tu fila

Autoalojar es lo correcto si tu material no puede salir de tu red, si quieres hacer fine-tuning, o si tienes una tarjeta rápida y generas a diario. Mejor saberlo aquí que después de pagarnos.

El fine-tuning es la única ventaja que el dinero no alquila. MiniMax publicó los pesos completos para permitirlo, y ninguna interfaz alojada, la nuestra incluida, puede hacerlo. Para lo que sirve el acceso alojado es para la otra mitad: sin descarga, sin controladores, con 2K y con las dos etapas que nunca se publicaron.

Lo que la gente pregunta antes de descargar

¿Cuáles son los requisitos mínimos? No se ha publicado ningún mínimo universal, así que la respuesta es una banda y no un número. Hay una ejecución terminada en 12 GB con 32 GB de RAM de anfitrión y mucha descarga a memoria; en 16 GB hay un resultado de 182 segundos; por encima de ahí no hay ninguna referencia controlada. La RAM del anfitrión aprieta más veces que la VRAM.

¿Sale más barato ejecutarlo en local? Normalmente no, salvo que tus GPU estén siempre ocupadas. La computación alquilada puede quedar por debajo de $0.08 por segundo, pero el almacenamiento persistente es un coste mensual fijo que ignora tu producción, y con poco volumen manda él.

¿Puedo sacar 2K en local? No, con ningún presupuesto de hardware. Los pesos abiertos son H3-Base, que topa en la clase 768. El 2K oficial es una etapa alojada.

¿Funciona en un Mac? Sí, despacio. No hay nada validado oficialmente, pero las ejecuciones de la comunidad terminan: 90 minutos para un clip de 15 segundos en 480p en un M4 Max de 128 GB, una hora para nueve segundos en un M5 Pro de 64 GB. El audio también sale del modelo local. Vale para la curiosidad, no para iterar.

¿Funciona en AMD? Las MI300X y MI355X de centro de datos están validadas a través de los runtimes de servidor. Eso no es prueba para las tarjetas Radeon de consumo, y no se ha publicado ningún resultado terminado en una Radeon de escritorio.

¿Cuánto tarda un clip? De tres minutos a una hora y media, según tu máquina y tu lienzo. La generación alojada se cuenta en 30 a 90 segundos.

¿Necesito 384 GB de RAM de sistema? No. Esa cifra lee mal un benchmark oficial de servidor: 377 GiB es lo que tenía la máquina de pruebas, no lo que necesita el modelo. Esa misma ejecución llegó a un pico de 26,3 GiB por tarjeta, y los montajes de consumo terminan con 32 GB.

¿Cuánto tengo que descargar? 42,47 GB para el juego compacto de texto e imagen, 63,44 GB con el checkpoint de referencia. Deja holgura por encima de eso para las cachés y las salidas.

¿Se me permite ejecutarlo donde vivo? Sólo fuera de los territorios excluidos: Estados Unidos, la Unión Europea, el Reino Unido y Corea del Sur. La restricción alcanza también a las salidas. El acceso alojado no se ve afectado por esa cláusula. Es un resumen, no asesoramiento legal.


Qué puede cambiar. La atención dispersa nativa no está en la primera publicación abierta, así que todos los tiempos de aquí son de atención completa. Si alguna vez se publica H3-Regenerate-2K, la frase “nada de 2K en local” deja de ser cierta. Las tarifas de GPU en la nube cambian cada semana. Última verificación: 14 de agosto de 2026.

Dos minutos en el generador de video con IA de MiniMax H3 cuestan menos que una tarde y 42,47 GB. Salgan como salgan tus números, puedes oír lo que hace H3 — a partir de una línea de texto — antes de comprometerte con ninguna de las dos vías.

Redacción

Escrito por

Redacción

minimax-h3ai.video

Publicado en el generador de video con IA MiniMax H3, una interfaz independiente de terceros construida sobre MiniMax H3.

Todos los artículos