MiniMax H3 local ou en ligne : le seuil est en minutes
Tous les tableaux de prérequis parlent de mémoire. Ce qui bloque vraiment : le même rendu 480p prend 182 secondes ici et 90 minutes ailleurs.

S’auto-héberger ou non se ramène à trois nombres : combien de mémoire vous avez, combien de minutes vous coûte un clip, et si la licence couvre l’endroit où vous vivez.
Aucune configuration minimale unique ne couvre tous les montages : les prérequis bougent avec le checkpoint, avec la surface, et avec ce qui déborde en mémoire système. Ce qui est fixe : le plus petit téléchargement fait 42,47 Go, vous obtenez H3-Base, donc des sorties de classe 768 et pas de 2K, et la licence exclut les États-Unis, l’Union européenne, le Royaume-Uni et la Corée du Sud. La sortie hébergée est à $0.08 la seconde.
La RAM système est plus souvent le facteur limitant que la VRAM : les fichiers dépassent n’importe quelle carte grand public, donc quelque chose déborde, et deux personnes équipées de 32 Go ont rapporté des résultats opposés. Une fois votre fourchette connue, ce n’est plus une question de matériel, c’est de l’arithmétique.
Mesuré en minutes par clip, pas en gigaoctets
Les gigaoctets vous disent si ça charge. Les minutes vous disent si vous vous en servirez.
Le même rendu 480p a pris 182 secondes sur une carte de portable de 16 Go avec SageAttention, et 90 minutes sur un Mac Studio de 128 Go — un écart de un à trente entre des machines que tous les tableaux de prérequis déclarent suffisantes. La génération hébergée prend de 30 à 90 secondes.
Chaque chiffre ici est le résultat publié par quelqu’un d’autre, relié à sa source. Quatorze configurations sourcées sont sur la page ComfyUI.
Lisez le chiffre officiel à part : 559,67 secondes, ce sont deux cartes à cinquante étapes dans un autre moteur d’exécution, pas une référence ComfyUI mono-carte. Cet enregistrement a plafonné à 26,3 Gio par carte sur une machine qui se trouvait avoir 377 Gio — l’origine de la rumeur des 384 Go, et la configuration de la machine de test, pas un prérequis.
L’endroit où vous êtes tranche avant le coût
Pour une grande partie du marché anglophone, le calcul ne commence jamais.
La licence communautaire de MiniMax exclut les États-Unis, l’Union européenne,
le Royaume-Uni et la Corée du Sud, et l’exclusion suit les productions, pas
seulement les poids : générer dans un pays autorisé, publier dans un pays exclu,
et l’on reste hors de la concession. Les demandes passent par
platform.minimax.io/h3-license. L’article porte sur les poids, pas sur l’API
hébergée, que MiniMax déclare disponible dans le monde entier — étant entendu
que cette API a ses propres conditions et ne constitue pas une réponse
automatique en matière de conformité.
La licence, article par article contient le
reste. Un résumé, pas un avis juridique.
Si vous êtes exclu et que l’auto-hébergement est vraiment ce qu’il vous faut, la réponse honnête n’est pas nous : il existe un modèle à poids ouverts sans exclusion de territoire, et il tourne sur 16 Go.
Les deux prérequis qu’aucun GPU ne satisfait
H3 fonctionne en trois étapes et le téléchargement, c’est celle du milieu. H3-Context-IR réécrit votre prompt et vos références en une description de plan structurée. H3-Base génère l’image de classe 768 et son audio en une seule passe. H3-Regenerate-2K repasse ce résultat dans le modèle avec le contexte d’origine, ce qui explique que les petits textes survivent. Seul H3-Base a été publié.
Aucune carte ne répare cela : une baie de H200 plafonne encore à 768. Le point de comparaison honnête est donc $0.08 la seconde produite, pas $0.13 — opposer le tarif 2K à un rendu local gonfle le côté hébergé de 62 %. L’absence de Context-IR se contourne en partie en écrivant vous-même le prompt structuré ; l’absence de 2K, non.
Côté coût, c’est le taux d’utilisation qui trace la ligne
Deux clips par semaine et deux cents ne sont pas la même question, et ce n’est pas le tarif horaire qui les sépare.
Le poste que tous les tableaux « local contre hébergé » oublient, c’est le stockage persistant. Le paquet compact fait 42,47 Go, le dépôt complet environ 498,5 Go, et un volume dans le nuage se facture au mois que vous génériez ou non.
| Pile compacte | Dépôt complet | |
|---|---|---|
| Taille | 42,47 Go | ~498,5 Go |
| Stockage à $0.07 par Go-mois | ~$3 / mois | ~$35 / mois |
| Amorti sur 30 clips par mois | ~$0.10 le clip | ~$1.17 le clip |
Cette seconde colonne coûte plus cher que d’héberger le clip purement et simplement. C’est pour cela que la décision se joue sur le taux d’utilisation plutôt que sur le tarif horaire, et pour cela qu’un calculateur sans cette ligne flatte l’option locale.
Deux autres nombres sont les vôtres, pas les nôtres. Les tarifs GPU dans le nuage bougent chaque semaine et selon la région, donc regardez ceux du jour plutôt qu’un devis en cache. Et le nombre d’essais par clip gardé : les créateurs rapportent couramment trois ou quatre, ce qui multiplie tout ce qui précède.
Côté vie privée : ce qui quitte réellement votre machine
L’idée que « local veut dire privé » est vraie sous une condition que personne n’écrit.
H3-Base sur votre propre GPU est réellement hors ligne une fois les poids descendus. Tendez la main vers Context-IR pour améliorer un prompt, ou vers Regenerate-2K pour une résolution livrable, et votre matériel part en ligne — les deux étapes sont hébergées, et les appeler depuis une interface locale ne les rend pas locales.
La configuration hors ligne est donc celle qui renonce à la compréhension du prompt et au 2K. Un vrai échange, pas un gain sans contrepartie. Et pour être complet : générer ici envoie votre matériel en ligne aussi.
Quelle ligne est la vôtre
L’auto-hébergement est le bon choix si votre matériel ne peut pas quitter votre réseau, si vous voulez affiner le modèle, ou si vous possédez une carte rapide et générez tous les jours. Mieux vaut le savoir ici qu’après nous avoir payés.
L’affinage est le seul avantage que l’argent ne loue pas. MiniMax a publié des poids complets pour le rendre possible, et aucune interface hébergée, la nôtre comprise, ne le permet. Ce à quoi l’accès hébergé est bon, c’est l’autre moitié : pas de téléchargement, pas de pilotes, le 2K, et les deux étapes qui ne sont jamais sorties.
Ce qu’on demande avant de télécharger
Quels sont les prérequis minimaux ? Aucun minimum universel n’a été publié, donc la réponse est une fourchette plutôt qu’un nombre unique. Il existe une exécution menée à terme sur 12 Go avec 32 Go de RAM système et un déchargement massif ; 16 Go a un résultat à 182 secondes ; au-dessus, aucune référence contrôlée. La RAM système est plus souvent limitante que la VRAM.
Est-ce moins cher en local ? En général non, sauf si vos GPU restent occupés. Du calcul loué peut passer sous les $0.08 la seconde, mais le stockage persistant est un coût mensuel fixe qui ignore votre production, et à faible volume il domine.
Puis-je obtenir du 2K en local ? Non, quel que soit le budget matériel. Les poids ouverts sont H3-Base, qui plafonne à la classe 768. Le 2K officiel est une étape hébergée.
Est-ce que ça tourne sur un Mac ? Oui, lentement. Rien n’est officiellement validé, mais des exécutions de la communauté vont au bout : 90 minutes pour un clip 480p de 15 secondes sur un M4 Max de 128 Go, une heure pour neuf secondes sur un M5 Pro de 64 Go. Le son sort aussi du modèle local. Viable par curiosité, pas pour itérer.
Est-ce que ça marche sur AMD ? Les MI300X et MI355X de centre de données sont validées via les moteurs serveur. Ce n’est pas une preuve pour les cartes Radeon grand public, et aucun résultat abouti sur Radeon de bureau n’a été publié.
Combien de temps prend un clip ? De trois minutes à une heure et demie, selon votre machine et votre surface. La génération hébergée est rapportée entre 30 et 90 secondes.
Me faut-il 384 Go de RAM système ? Non. Ce chiffre est une mauvaise lecture d’un banc d’essai serveur officiel : 377 Gio, c’est ce que la machine de test avait, pas ce dont le modèle a besoin. La même exécution a plafonné à 26,3 Gio par carte, et des montages grand public vont au bout sur 32 Go.
Combien dois-je télécharger ? 42,47 Go pour l’ensemble compact texte et image, 63,44 Go avec le checkpoint de référence. Prévoyez de la marge au-delà pour les caches et les sorties.
Ai-je le droit de le faire tourner là où je vis ? Seulement en dehors des territoires exclus : les États-Unis, l’Union européenne, le Royaume-Uni et la Corée du Sud. La restriction atteint aussi les productions. L’accès hébergé n’est pas concerné par cet article. Un résumé, pas un avis juridique.
Ce qui peut changer. L’attention creuse native n’est pas dans la première publication ouverte, donc tous les temps donnés ici sont en attention pleine. Si H3-Regenerate-2K est publié un jour, la phrase « pas de 2K en local » cessera d’être vraie. Les tarifs GPU dans le nuage changent chaque semaine. Dernière vérification le 2026-08-14.
Deux minutes dans le navigateur coûtent moins qu’un après-midi et 42,47 Go. Quel que soit le résultat de vos calculs, vous pouvez entendre ce que fait H3 avant de vous engager sur l’une ou l’autre route.
Deux minutes dans le générateur de vidéo IA MiniMax H3 coûtent moins qu’un après-midi et 42,47 Go. Quel que soit le résultat de vos calculs, vous pouvez entendre ce que fait H3 — à partir d’une ligne de texte — avant de vous engager sur l’une ou l’autre voie.
Rédigé par
Rédaction
minimax-h3ai.video
Publié sur le MiniMax H3 AI Video Generator, une interface tierce indépendante bâtie sur MiniMax H3.


