MiniMax H3 Max 不是更大的那個 H3——它自己的排行榜條目叫它 Turbo
MiniMax H3 Max 算一支 5 秒片子大約 3 秒,而且停在 768p。它適合哪些鏡頭、它悄悄讓你付出什麼,以及該怎麼先挑。

我看到「Max」就以為它是比較大的那個。它不是。
MiniMax H3 Max 是一個更快、但天花板更低的 MiniMax H3。 fal Research 拿 H3 公布的權重做後訓練,往速度和提示詞遵從度上狠調, 而它的上限是 768p,標準 H3 到得了 2K。 它跑兩個端點;標準 H3 保有這兩個,再往上加參考圖生影片和編輯。 它在 Artificial Analysis 排行榜上自己的條目就把底掀了—— fal 在那裡把它列成 MiniMax H3 Turbo (768p)。Turbo 才是誠實的那個字。
這些都不會讓它變成比較差的模型。生成得比片子播放還快, 是「一個下午怎麼過」這件事上一個真實的改變。 但名字指向一個更高的天花板,規格表指向一個更低的, 而這兩者之間的落差,會悄悄弄壞一條工作流。
你的鏡頭需要哪一個
整個 MiniMax H3 Max 對比 MiniMax H3 的決定,一張表就裝得下:
| 如果這顆鏡頭必須… | 用 | 在哪裡 |
|---|---|---|
| 撐得住被裁切、重新構圖,或被放大播 | MiniMax H3 | 用 2K 生成 |
| 跨好幾個鏡頭守住同一個角色 | MiniMax H3 | 參考圖生影片 |
| 在一段已經成立的素材裡換掉一個元素 | MiniMax H3 | 影片轉影片 |
| 交在四秒 | MiniMax H3 | 文字轉影片 |
| 從你手上已有的一張靜態圖開始 | 都可以 | 圖片轉影片 |
| 是這個下午四十次嘗試裡的一次,沒有一次是定稿 | MiniMax H3 Max | 只在 fal 託管 |
最後那一行是真的,而且 H3 Max 完全獨佔。不過注意它描述的是什麼: 工作的一個階段,不是你交出去的那個東西。
MiniMax H3 Max 給你什麼
三樣,而第一樣比它聽起來值錢。
一支五秒的片子大約三秒就到。 比你回看一遍還快。 一旦算圖不再是一段喝咖啡的時間,你就不會再在腦子裡先剪一遍—— 你會直接把那個你拿不定主意的版本試出來。 在一個下午的尺度上,這改變的是你做出什麼,不只是你做得多快。
提示詞遵從度是 fal 在後訓練上花的力氣。 按順序點名那些節拍,它們就按順序到。要畫面上出現字, 回來的是排好的字,不是近似的字。
讓 H3 之所以是 H3 的東西全部帶過來了: 文字與圖片共用一份統一的上下文, 以及一條在畫面的同一次運算裡產生、而不是事後鋪到底下的同步聲軌。
到 2026 年 8 月 31 日為止的範圍:480p 或 768p,預設 768p—— 16:9 下是 1344×768,24 fps。五到十五秒。 文字轉影片收 21:9、16:9、4:3、1:1、3:4 和 9:16; 圖片轉影片跟著你餵進去的那張靜態圖,並接受一張選填的結尾影格, 所以首尾影格也做得了。
768p 這個天花板實際上會咬在哪裡
768p 是 1344×768——大約 1.0 百萬像素。H3 的 2K 把短邊放到 1440, 在寬比例下大約 3.7 百萬像素。三倍半的像素, 而你會在四個很具體的地方注意到它:
- 在一條不是 768p 的時間軸上。 把一支 768p 的片子丟進 1440p 的序列裡, 它會被放大。你喜歡的那些材質全部變軟。
- 當你裁切的時候。 把一顆廣角鏡頭重新構成正方形或直式, 丟掉的是你本來就不夠用的像素。
- 在任何比手機大的螢幕上。 落地頁上的主視覺片子或一台螢幕,會露出邊緣。
- 在臉和字上。 細節是 768p 最先花掉的東西。
如果上面沒有一條描述得到你的工作,768p 是真的夠,而那個速度是白賺的。 如果有一條說中了,這個天花板就不是規格表上的一行——它是你會重拍的原因。
為什麼你不能在 H3 Max 上打草稿、再用 2K 完成
這個計畫看起來明顯到我真的去找那顆按鈕:在 768p 便宜又快地反覆試, 鎖定你喜歡的版本,然後把同一份提示詞用 2K 再跑一次交件。 沒有這顆按鈕,而且有兩件各自獨立的事擋著它。
H3 Max 根本沒有 2K,所以「完成」意思就是換到標準 H3。 而且 H3 Max 是另一個模型——後訓練過、權重不同。 把同一份提示詞和同一個種子交給另一個模型,不會給你同一顆鏡頭的高解析版。 它給你的是另一顆鏡頭。構圖會漂、節拍的時間會移, 你花四十次挑出來的那個東西,不是回來的那個。
也沒有任何地方藏著一顆放大按鈕。在本站,768p 和 2K 是兩次各自獨立的生成, 分開計費——這裡沒有從片子升到 2K 的路徑,H3 Max 上也沒有。
所以順序比模型更要緊:先決定交付的解析度,再在做得到那個解析度的模型上反覆試。 如果答案是 2K,那四十次也在 H3 上做——用同一個模型的 768p, 在那裡草稿才真的預測得到母帶,最後一次再把解析度切過去。 你每次多付一點,但你留得住自己挑的那顆鏡頭。 那要花多少點數在價格頁上,用我們自己的單位寫,不用做每秒換算。
把 fal 的速度數字放進你自己的行程表
底下兩個都是 fal 自己的數字,出自同一份問答,而第二個沒有人引用:
| 片長 | 算多久 | 每一秒成品耗掉的運算 |
|---|---|---|
| 5 秒(預設) | 不到 3 秒 | 約 0.5 秒 |
| 15 秒(最長) | 「大約 15 秒」 | 約 1.0 秒 |
每一秒成品的成本,從最短的片子到最長的片子大致翻倍。 「比真實時間還快」在五秒時成立,到十五秒就沒了—— 一支滿長的生成,花的時間大約等於它做出來的那個東西。
所以誠實的規劃規則是按工作單位、不是按模型。 在剪五秒的社群片段?那個循環是真的那麼緊,而它會改變你的下午。 在搭十五秒的場景?照真實時間編預算, 並把那個 35 倍的標題——fal 拿自己的量測去比 MiniMax 自家端點—— 當成一個關於短片子的說法。
還有一個很容易讀錯的數字:fal 回報那次算圖裡大約 2.5 秒是
timings.inference,並把這個欄位記為 GPU 後端上的 DiT 去噪時間。
那是模型的碼錶,不是你的。排隊、提示詞處理和傳輸都在它外面。
從 MiniMax H3 Max 拿到一個公平的比較
如果你正要拿 H3 Max 去比任何東西,先檢查一個參數, 否則你的結果講的不是這個模型。
prompt_expansion_mode 在 H3 Max 的 API 上是必填。它有三個設定,
預設那個會在生成之前改寫你的提示詞,
而回應裡會給回一個 expanded_prompt 欄位,顯示真正被送出去的文字。
| 設定 | 會發生什麼 | 代價 |
|---|---|---|
disabled | 你的字原樣送過去 | 沒有 |
balanced(預設) | 它逐次請求決定要改寫多少 | 大約一秒 |
quality | 完整改寫成一份更豐富的簡報 | 最多約 30 秒——大約是算圖的十倍 |
由此推出兩件事。一場用預設值做的比較,是「你的提示詞在另一個模型上」
對「fal 改寫過的你的提示詞在這裡」——兩邊都設 disabled,
然後預期輸出會變,因為那個變化就是量測在漏水。
還有,如果你曾經納悶一個「三秒的模型」為什麼感覺很慢,
去看看你是不是把它留在 quality 上了:三秒的算圖前面掛著三十秒的改寫。
不管怎樣,有用的習慣是在幾次執行上讀一讀 expanded_prompt。
它會讓你看到這個模型眼中一份好簡報長什麼樣,而且是訓練它的人寫的。
然後照那樣寫自己的——就是我們提示詞工具搭出來的那個結構,
也是為什麼一份詳細的提示詞仍然勝過一句短的加上一次擴寫。
那個第一名,自己去查
fal 說 H3 Max 排第一,而它確實是。你大約兩分鐘就能把整件事確認完, 那比聽我說好:
- Design Arena,圖片轉影片——H3 Max 1,341 Elo, 基礎款 MiniMax H3 緊跟在後 1,333。
- Artificial Analysis,帶聲軌的圖片轉影片——1,201 Elo, 95% 信賴水準下 ±11,樣本超過 2,177。歸檔在 MiniMax H3 Turbo (768p) 底下,Turbo 這個名字就是在那裡看得到的。
- fal 自己對十二個模型做的偏好研究——品質、提示詞理解和美感都第一。 由 fal 執行,跑在 fal 的環境上。
兩個榜都是偏好 Elo:人在兩支片子之間挑一支。那是一個真實的訊號, 而它不是一個能力基準。
然後把那兩個數字並排看。在同時列出兩者的那個榜上, H3 Max 和它後訓練所本的那個模型差 八分。 有公布信賴區間的那個榜,公布的是 ±11。 不同的榜,所以那不是一次顯著性檢定——但它給的尺度感是對的。 撐得住的說法是:在 768p,H3 Max 至少跟 H3 一樣好,而且兩者很接近。
還有,再讀一次那個條目名稱。兩個榜排的都是 768p 的輸出。 裡面沒有任何一句話在講你真正要交付的那個 2K。
MiniMax H3 Max 在開放權重上的位置
短版:沒有 H3 Max 的檢查點,而且也不會不小心冒出一份。
H3 的社群授權對「模型衍生物」的定義寬到後訓練顯然算一種, 而它把你做出來的衍生物的所有權給你。所以 fal 下載公布的權重、在上面訓練、 留下結果並以閉源方式提供服務——那是授權照著字面在運作,不是它的漏洞。 這是我見過最清楚的一次示範,說明開放權重實際上買到的是什麼, 而那跟下載包裡有什麼是不同的問題。
有一條反方向的條款,對每個人都有利。大家在引用的那條地域限制, 適用的是在它的倉庫裡釋出的那個模型——它管的是跑那些權重, 不是使用一個用它們蓋出來的託管服務。這一條涵蓋 H3 Max, 也涵蓋每一條託管的路,包括這一條。 以下是摘要,不是法律意見。
MiniMax H3 Max 常見問題
MiniMax H3 Max 支援 2K 嗎? 不支援。只有 480p 和 768p。fal 自己的模型頁會把你送去標準的 MiniMax H3 拿 2K。
MiniMax H3 Max 比 MiniMax H3 好嗎? 在 768p,好一點點——在同時列出兩者的榜上是八個 Elo 分。 到了 2K 這個問題就不適用了,因為 H3 Max 不生成 2K。
MiniMax H3 Max 做得了參考圖生影片或角色一致性嗎? 還不行。8 月 25 日 fal 說參考圖生影片會在「這週稍晚」到; 到了 8 月 31 日它還是兩個端點,而 MiniMax 自己的文件也還把它列成即將推出。 在你照著它規劃之前,先數一數端點。
MiniMax H3 Max 免費嗎? 它是一個付費的託管 API,在它的託管方那裡有一份促銷額度。 如果你真正是為了免費額度而來, 這裡什麼不用錢、什麼要錢 寫得很清楚。
MiniMax H3 Max 是官方的 MiniMax 模型嗎? 它經 MiniMax 認可、由雙方共同宣布,並列在 MiniMax 自己的影片生成文件裡。 它是 fal 做的,不是 MiniMax,而且只有 fal 提供它。
MiniMax H3 Max 做得出最短的片子是多長? 五秒。MiniMax 自己對 H3 的規格下探到四秒,而四秒就是你在這裡拿得到的—— 如果你剪得短,這一點值得知道。 為什麼你要的秒數不一定是你拿到的秒數 是另一個、而且更怪的故事。
H3 做得更多,那它為什麼叫 Max? 因為 Max 描述的是 fal 調校的那個工作點——768p 下的最高速度加上更強的提示詞遵從度—— 而不是能力的天花板。排行榜上那個名字,H3 Turbo,才是告訴你發生了什麼的那個。
最後查核 2026 年 8 月 31 日。 上面每一個數字都是 fal 或 MiniMax 自己的, 包括那些對 H3 Max 有利的,而偏好 Elo 不是能力基準—— 每一個都附了出處,所以你可以自己重查,而不是信任它。 這個模型才四週大:參考圖生影片被承諾在一個已經過去的週次, 而解析度天花板正好是那種會動的東西。

