MiniMax H3 Max ou H3 : rapide, plafonné en 768p
H3 Max est le H3 accéléré par fal : 5 s de clip en 3 s environ, mais 768p au plafond. Quels plans s’en contentent, et quand revenir au 2K de H3.

J’ai lu « Max » et j’ai supposé que c’était le plus gros des deux. Ce n’est pas le cas.
MiniMax H3 Max est un MiniMax H3 plus rapide, avec un plafond plus bas. fal Research l’a post-entraîné sur les poids publiés de H3, réglé à fond pour la vitesse et le respect du prompt, et il s’arrête à 768p là où le H3 standard atteint le 2K. Il expose deux points d’entrée ; le H3 standard garde ces deux-là et ajoute par-dessus la génération à partir d’une image de référence et l’édition. Sa propre ligne dans le classement d’Artificial Analysis vend la mèche : fal l’y inscrit sous le nom MiniMax H3 Turbo (768p). Turbo est le mot honnête.
Rien de tout cela n’en fait un moins bon modèle. Générer plus vite que le clip ne se lit change réellement la façon dont se passe un après-midi. Mais le nom pointe vers un plafond plus haut, la fiche technique vers un plafond plus bas, et l’écart entre les deux casse discrètement un flux de travail.
Ce que votre plan exige décide pour vous
Tout le choix entre MiniMax H3 Max et MiniMax H3 tient dans un tableau.
| Si le plan doit… | Prenez | Où |
|---|---|---|
| survivre à un recadrage, à une reprise de cadrage, à un grand écran | MiniMax H3 | générer en 2K |
| garder le même personnage sur plusieurs coupes | MiniMax H3 | la cohérence des personnages |
| changer un élément dans un métrage qui fonctionne déjà | MiniMax H3 | Vidéo à vidéo |
| tenir en quatre secondes | MiniMax H3 | De texte à vidéo |
| partir d’une photo que vous avez déjà | l’un ou l’autre | animer une photo |
| n’être qu’un essai sur quarante cet après-midi, aucun n’étant définitif | MiniMax H3 Max | hébergé chez fal uniquement |
La dernière ligne est réelle et H3 Max la tient sans partage. Regardez tout de même ce qu’elle décrit : une étape du travail, pas la chose que vous livrez.
Ce que MiniMax H3 Max apporte vraiment
Trois choses, et la première vaut plus qu’elle n’en a l’air.
Un clip de 5 secondes arrive en 3 secondes environ. Plus vite que de le revoir. Dès que la génération cesse d’être une pause café, vous arrêtez de monter dans votre tête : vous essayez simplement la version dont vous n’étiez pas sûr. Sur un après-midi, ce n’est pas seulement la vitesse qui change, c’est ce que vous fabriquez.
Le respect du prompt est ce sur quoi fal a dépensé le post-entraînement. Nommez les temps forts dans l’ordre et ils arrivent dans l’ordre. Demandez du texte à l’écran et il revient composé plutôt qu’approché.
Tout ce qui fait de H3 un H3 reste en place : un contexte unifié pour le texte et les images, et une piste sonore générée dans la même passe que l’image au lieu d’être posée dessous après coup.
L’enveloppe, au 31 août 2026 : 480p ou 768p, 768p par défaut — 1344×768 en 16:9, 24 images par seconde. De cinq à quinze secondes. La voie texte accepte le 21:9, le 16:9, le 4:3, le 1:1, le 3:4 et le 9:16 ; la voie photo suit l’image fixe que vous fournissez et accepte une dernière image facultative, ce qui permet aussi de fixer la première et la dernière.
Là où le plafond de 768p mord vraiment
768p, c’est 1344×768, soit environ un mégapixel. Le 2K de H3 met 1440 sur le petit côté, donc à peu près 3,7 mégapixels sur les formats larges. Trois fois et demie plus de pixels, et cela se voit à quatre endroits précis.
- Sur un montage qui n’est pas en 768p. Posez un clip 768p dans une séquence 1440p et il est agrandi. Toute la matière que vous aimiez devient molle.
- Quand vous recadrez. Repasser un plan large en carré ou en vertical jette des pixels dont vous n’aviez pas de trop.
- Sur tout écran plus grand qu’un téléphone. Un clip d’accueil sur une page de vente, ou un moniteur, montre les bords.
- Sur les visages et les lettrages. Le détail fin est la première chose que le 768p dépense.
Si rien de tout cela ne décrit le travail, 768p suffit vraiment et la vitesse est un cadeau. Si un seul point s’applique, ce plafond n’est plus une ligne de fiche technique : c’est la raison pour laquelle vous allez recommencer.
Pourquoi on ne peut pas dégrossir en H3 Max et finir en 2K
Le plan paraît si évident que je suis parti chercher le bouton : itérer vite et pour pas cher en 768p, verrouiller la version qui plaît, puis relancer ce même prompt en 2K pour la livraison. Ce bouton n’existe pas, et deux choses distinctes l’empêchent.
H3 Max n’a pas de 2K du tout, donc « finir » veut dire passer au H3 standard. Et H3 Max est un autre modèle : post-entraîné, avec d’autres poids. Donner le même prompt et la même graine à un autre modèle ne rend pas le même plan en plus grand. Cela rend un autre plan. La composition dérive, le minutage des temps forts bouge, et la chose que vous avez mis quarante essais à choisir n’est pas celle qui revient.
Aucun bouton d’agrandissement ne se cache ailleurs non plus. Sur ce site, 768p et 2K sont deux générations distinctes, facturées séparément : il n’y a pas ici de passage d’un clip au 2K, et il n’y en a pas chez H3 Max.
L’ordre compte donc plus que le modèle : décidez d’abord la résolution de livraison, puis itérez sur le modèle capable de la livrer. Si la réponse est 2K, faites aussi les quarante essais sur H3 — en 768p sur le même modèle, là où le brouillon prédit vraiment le master, et changez la résolution pour la passe finale. Vous payez un peu plus par essai et vous gardez le plan que vous avez choisi. Ce que cela coûte en crédits est sur la page des tarifs, dans nos propres unités, sans conversion à la seconde à faire.
Reposez le chiffre de vitesse de fal sur votre propre planning
Les deux viennent de fal, tirés de la même FAQ, et le second n’est jamais cité.
| Durée du clip | Temps de génération | Calcul par seconde de vidéo finie |
|---|---|---|
| 5 s (par défaut) | moins de 3 s | environ 0,5 s |
| 15 s (maximum) | « autour de 15 secondes » | environ 1,0 s |
Le coût par seconde finie double à peu près entre le clip le plus court et le plus long. « Plus rapide que le temps réel » est vrai à cinq secondes et a disparu à quinze : une génération pleine longueur prend à peu près le temps de la chose qu’elle a fabriquée.
La règle de planification honnête porte donc sur l’unité de travail, pas sur le modèle. Vous montez des séquences sociales de cinq secondes ? La boucle est réellement aussi serrée, et elle changera votre après-midi. Vous bâtissez des scènes de quinze secondes ? Prévoyez du temps réel et prenez le chiffre de 35 fois — la mesure de fal contre le point d’entrée de MiniMax lui-même — comme une affirmation sur les clips courts.
Un dernier nombre facile à mal lire : fal rapporte environ 2,5 s de cette
génération sous timings.inference, et documente le champ comme le temps de
débruitage du DiT sur le back-end GPU. C’est l’horloge du modèle, pas la
vôtre. La file d’attente, le traitement du prompt et le transfert sont en
dehors.
Un réglage à vérifier avant de comparer MiniMax H3 Max
Si vous vous apprêtez à mesurer H3 Max contre autre chose, vérifiez d’abord ce paramètre, sinon votre résultat ne parle pas du modèle.
prompt_expansion_mode est obligatoire dans l’API de H3 Max. Il a trois
valeurs, celle par défaut réécrit votre prompt avant la génération, et la
réponse renvoie un champ expanded_prompt qui montre le texte réellement
envoyé.
| Valeur | Ce qui se passe | Ce que cela coûte |
|---|---|---|
disabled | vos mots passent intacts | rien |
balanced (par défaut) | il décide requête par requête de l’ampleur de la réécriture | environ une seconde |
quality | réécriture complète en un brief plus riche | jusqu’à 30 s environ — à peu près dix fois la génération |
Deux conséquences. Une comparaison réglée par défaut oppose votre prompt sur
l’autre modèle à la réécriture de votre prompt par fal ici même : mettez
disabled des deux côtés et attendez-vous à voir la sortie changer, parce que
ce changement était la mesure qui fuyait. Et si vous vous êtes déjà demandé
pourquoi un « modèle à trois secondes » vous semblait lent, vérifiez que vous
ne l’aviez pas laissé sur quality : trente secondes de réécriture devant
trois secondes de génération.
Dans les deux cas, la bonne habitude est de lire expanded_prompt sur quelques
exécutions. Il vous montre à quoi ressemble un bon brief pour ce modèle, écrit
par les gens qui l’ont entraîné. Écrivez ensuite le vôtre de la même façon —
c’est la structure que bâtit le générateur de prompts, et
la raison pour laquelle un prompt détaillé bat encore une phrase courte plus
une expansion.
Vérifiez vous-même la première place
fal dit que H3 Max arrive premier, et c’est le cas. Vous pouvez tout confirmer en deux minutes, ce qui vaut mieux que de me croire sur parole.
- Design Arena, photo vers vidéo — H3 Max à 1 341 Elo, le MiniMax H3 de base juste derrière à 1 333.
- Artificial Analysis, photo vers vidéo avec le son — 1 201 Elo, ±11 à 95 % de confiance, sur 2 177 échantillons. Classé sous MiniMax H3 Turbo (768p), et c’est là que le nom Turbo devient visible.
- L’étude de préférence de fal, contre douze modèles — premier en qualité, en compréhension du prompt et en esthétique. Menée par fal, sur la pile de fal.
Les deux classements sont des Elo de préférence : des humains choisissent entre deux clips. C’est un vrai signal, et ce n’est pas un banc d’essai de capacité.
Regardez ensuite les deux nombres côte à côte. Huit points séparent H3 Max du modèle dont il est issu, sur le classement qui liste les deux. Celui qui publie un intervalle de confiance publie ±11. Classements différents, donc ce n’est pas un test de significativité — mais c’est le bon ordre de grandeur. L’affirmation qui survit est celle-ci : en 768p, H3 Max fait au moins aussi bien que H3, et les deux sont proches.
Relisez enfin le nom de l’entrée. Les deux classements notent une sortie en 768p. Rien chez eux ne dit quoi que ce soit sur le 2K que vous livreriez vraiment.
Où se situe MiniMax H3 Max côté poids ouverts
Version courte : il n’existe pas de point de contrôle H3 Max, et il n’en apparaîtra pas un par accident.
La licence communautaire de H3 définit le dérivé de modèle assez largement pour qu’un post-entraînement en soit manifestement un, et elle vous accorde la propriété des dérivés que vous produisez. fal a donc téléchargé des poids publiés, s’est entraîné par-dessus, a gardé le résultat et le sert en vase clos — c’est la licence qui fonctionne telle qu’elle est écrite, pas une faille dedans. C’est la démonstration la plus claire que j’aie vue de ce que les poids ouverts achètent réellement, question différente de ce que contient le téléchargement.
Une clause joue dans l’autre sens, à l’avantage de tout le monde. La restriction territoriale que l’on cite partout s’applique au modèle tel que publié dans son dépôt : elle encadre l’exécution des poids, pas l’usage d’un service hébergé bâti à partir d’eux. Cela couvre H3 Max, et cela couvre toutes les voies hébergées, y compris celle-ci. Ceci est un résumé, pas un conseil juridique.
MiniMax H3 Max : questions fréquentes
MiniMax H3 Max prend-il en charge le 2K ? Non. 480p et 768p uniquement. La page de modèle de fal renvoie elle-même vers le MiniMax H3 standard pour une sortie en 2K.
MiniMax H3 Max est-il meilleur que MiniMax H3 ? En 768p, marginalement — huit points Elo sur le classement qui liste les deux. En 2K la question ne se pose pas, puisque H3 Max ne génère pas de 2K.
MiniMax H3 Max sait-il partir d’une image de référence ou tenir un personnage ? Pas encore. Le 25 août, fal annonçait la génération par référence pour « plus tard cette semaine » ; au 31 août il y a toujours deux points d’entrée, et la documentation de MiniMax la donne encore comme à venir. Comptez les points d’entrée avant de planifier autour.
MiniMax H3 Max est-il gratuit ? C’est une API hébergée payante, avec une dotation promotionnelle chez son hébergeur. Si c’est bien une offre sans frais que vous cherchiez, ce qui ne coûte rien ici et ce qui coûte est écrit noir sur blanc.
MiniMax H3 Max est-il un modèle officiel de MiniMax ? Il est validé par MiniMax, annoncé conjointement et listé dans la documentation de génération vidéo de MiniMax. Il a été bâti par fal, pas par MiniMax, et seul fal le sert.
Quel est le clip le plus court que MiniMax H3 Max sache faire ? Cinq secondes. La spécification de MiniMax pour H3 descend à quatre, et c’est quatre que vous obtenez ici — bon à savoir si vous montez court. Pourquoi les secondes demandées ne sont pas toujours celles reçues est une autre histoire, plus étrange encore.
Pourquoi l’appeler Max si H3 en fait davantage ? Parce que Max décrit le point de fonctionnement visé par fal — vitesse maximale en 768p, avec un meilleur respect du prompt — et non le plafond de capacité. Le nom porté au classement, H3 Turbo, est celui qui raconte ce qui s’est passé.
Dernière vérification le 31 août 2026. Chaque chiffre ci-dessus vient de fal ou de MiniMax, y compris ceux qui flattent H3 Max, et un Elo de préférence n’est pas un banc d’essai de capacité : chacun est sourcé pour que vous puissiez le revérifier plutôt que le croire. Ce modèle a quatre semaines. La génération par référence était promise pour une semaine déjà passée, et un plafond de résolution est exactement le genre de chose qui bouge.
Rédigé par
Rédaction
minimax-h3ai.video
Publié sur le MiniMax H3 AI Video Generator, une interface tierce indépendante bâtie sur MiniMax H3.


