MiniMax H3 本機還是線上:沒人報的那個門檻,單位是分鐘
需求表回答的是要多少記憶體才載得進去。真正卡住人的是同一個 480p 任務,在一台機器上跑 182 秒,在另一台上跑 90 分鐘。

要不要自架,歸結成三個數字:你有多少記憶體、一支片子花掉你幾分鐘, 以及授權涵不涵蓋你住的地方。
沒有哪一份最低規格適用於所有環境:需求會隨檢查點、畫布大小, 以及有多少東西溢出到主機記憶體而變動。固定的是:最小的下載是 42.47 GB, 你拿到的是 H3-Base,所以是 768 級的輸出、沒有 2K,而授權排除美國、歐盟、 英國和南韓。託管的輸出是每秒 $0.08。
主機 RAM 比 VRAM 更常成為瓶頸:這些檔案超過任何一張消費級顯示卡, 所以一定有東西溢出,而兩個同樣用 32 GB 的人回報過相反的結果。 一旦知道自己落在哪一段,這就不再是硬體問題,而是算術。
要用每支片子幾分鐘來量,不是用 GB
GB 告訴你它載不載得進去。分鐘告訴你你會不會真的用它。
同一個 480p 任務,在一張 16 GB 的筆電顯示卡加 SageAttention 上跑了 182 秒, 在一台 128 GB 的 Mac Studio 上跑了 90 分鐘——三十倍的落差, 而每一份需求表都說這兩台夠用。託管生成要 30 到 90 秒。
這裡每一個數字都是別人公布的結果,都附了出處。 十四種有出處的組態列在 ComfyUI 那一頁。
官方那個數字要分開讀:559.67 秒是另一個執行環境下、兩張卡跑五十步的結果, 不是單卡 ComfyUI 的基準。那筆紀錄的尖峰是每張卡 26.3 GiB, 跑在一台剛好有 377 GiB 的主機上——「384 GB」這個傳言就是這麼來的, 那是測試機的組態,不是需求。
你人在哪裡,比成本更早決定這件事
對英語市場的很大一部分來說,這筆帳根本不會開始算。
MiniMax 的社群授權排除美國、歐盟、英國和南韓,而這條排除跟著產出走,
不只跟著權重:在允許的國家算圖、在被排除的國家發布,一樣在授權之外。
申請走 platform.minimax.io/h3-license。這一條管的是權重,不是託管 API,
MiniMax 聲明後者全球可用——不過那個 API 有它自己的條款,
並不是一個自動成立的合規答案。
逐條看這份授權 有剩下的部分。以下是摘要,不是法律意見。
如果你被排除在外,而自架又正是你需要的,誠實的答案不是我們: 確實有沒有地區排除的開放權重模型存在,而且它跑得動 16 GB。
兩個沒有任何顯示卡滿足得了的需求
H3 分三段跑,而下載的是中間那一段。H3-Context-IR 把你的提示詞和參考素材 改寫成一份結構化的鏡頭描述。H3-Base 在同一次運算裡生出 768 級的畫面和它的聲音。 H3-Regenerate-2K 帶著原本的上下文,把那個結果再過一次模型,小字才保得住。 只有 H3-Base 被放出來。
沒有任何一張卡解決得了這件事:一整櫃 H200 的上限還是 768。 所以誠實的比較對象是每輸出秒 $0.08,不是 $0.13—— 拿 2K 的費率去比一次本機算圖,等於把託管那一邊灌水 62%。 少掉 Context-IR,你還能靠自己寫結構化提示詞補一部分;少掉 2K,你補不了。
談成本,是使用率在畫那條線
一週兩支和兩百支不是同一個問題,而分開它們的不是時薪。
每一張「本機對託管」的表都漏掉的那一行是常駐儲存。 精簡包是 42.47 GB,完整倉庫大約 498.5 GB, 而雲端磁碟不管你生不生成,都按月收錢。
| 精簡組 | 完整倉庫 | |
|---|---|---|
| 大小 | 42.47 GB | 約 498.5 GB |
| 每 GB 月 $0.07 的儲存費 | 約 $3/月 | 約 $35/月 |
| 攤到一個月 30 支片子上 | 約每支 $0.10 | 約每支 $1.17 |
第二欄比直接託管那支片子還貴。這就是為什麼這個決定轉在使用率上, 而不是轉在時薪上,也是為什麼一個沒有這一行的計算器,會把本機那個選項講得太好聽。
另外兩個數字是你的,不是我們的。雲端顯示卡的費率每週都在動、還分地區, 所以查今天的,別信一份快取下來的報價。還有每留下一支要試幾次: 創作者普遍回報三到四次,而那會把上面所有東西再乘一遍。
談隱私:到底什麼東西離開了你的機器
「本機就是隱私」這句話,在一個沒人寫下來的條件下才成立。
權重下載完之後,跑在你自己顯示卡上的 H3-Base 是真的離線。 一旦你去叫 Context-IR 來改提示詞、或者叫 Regenerate-2K 來拿一個交得出去的解析度, 你的素材就上傳了——這兩段都在託管端,而從一個本機介面呼叫它們, 並不會讓它們變成本機的。
所以那個真正離線的組態,就是放棄提示詞理解和 2K 的那一個。 這是一筆真的交換,不是白賺的。另外,也說清楚:在這裡生成,一樣會上傳你的素材。
哪一行是你
如果你的素材不能離開你的網路、如果你想微調、 或者你有一張快卡而且每天都在生成,那自架就是對的。 這件事在這裡知道,比付完錢給我們之後才知道好。
微調是那個花錢租不到的優勢。MiniMax 放出完整權重就是為了支持它, 而沒有任何託管介面做得到,包括我們的。託管能給的是另一半: 不用下載、不用驅動程式、有 2K,還有那兩段從來沒放出來的。
大家下載之前會問的問題
最低需求是什麼? 官方沒有公布一個通用的最低值,所以答案是一個區間,不是一個數字。 有一筆完成的紀錄跑在 12 GB 加 32 GB 主機 RAM、外加大量卸載上; 16 GB 有一筆 182 秒的結果;再往上就沒有受控的基準了。 主機 RAM 比 VRAM 更常成為瓶頸。
本機跑比較便宜嗎? 通常不是,除非你的顯示卡一直在忙。租來的算力可以壓到每秒 $0.08 以下, 但常駐儲存是一筆不管你產出多少都照收的月固定成本,量小的時候它就是大頭。
本機拿得到 2K 嗎? 不行,硬體預算多少都不行。開放權重是 H3-Base,上限就在 768 這一級。 官方的 2K 是一段託管的階段。
Mac 上跑得動嗎? 跑得動,慢。官方沒有驗證過任何組態,但社群的紀錄是跑得完的: 128 GB 的 M4 Max 上,一支 15 秒的 480p 要 90 分鐘; 64 GB 的 M5 Pro 上,九秒要一小時。聲音一樣是本機模型出的。 拿來滿足好奇可以,拿來反覆試不行。
AMD 上可以嗎? 資料中心的 MI300X 和 MI355X 在伺服器執行環境上是驗證過的。 那不能當作消費級 Radeon 的證據,而目前沒有任何桌機 Radeon 跑完的結果被公布。
一支片子要多久? 三分鐘到一個半小時,看你的機器和畫布。託管生成回報的是 30 到 90 秒。
我需要 384 GB 的系統記憶體嗎? 不需要。那個數字誤讀了一份官方的伺服器基準:377 GiB 是那台測試機有的, 不是模型需要的。同一次紀錄的尖峰是每張卡 26.3 GiB,而消費級的組態在 32 GB 上跑得完。
我要下載多少? 文字加圖片的精簡組是 42.47 GB,加上參考用的檢查點是 63.44 GB。 在那之上還要替快取和輸出留空間。
我住的地方可以跑嗎? 只有在被排除的地區之外可以:美國、歐盟、英國和南韓。 這條限制連產出一起管。託管使用不受這一條影響。以下是摘要,不是法律意見。
可能會變的事。 原生稀疏注意力不在第一次開放釋出裡, 所以這裡每一個時間都是全注意力下量的。如果 H3-Regenerate-2K 哪天被放出來, 「本機沒有 2K」這句話就不再成立。雲端顯示卡費率每週都在變。 最後查核 2026-08-14。
在 MiniMax H3 AI 影片生成器 上花兩分鐘,比花一個下午加 42.47 GB 便宜。 不管你的數字算出來偏哪一邊,你都可以先聽聽 H3 做出來是什麼樣—— 從一行文字開始——再決定走哪一條路。


