MiniMax H3 AI 圖片轉影片
丟一張照片進來,說清楚接下來要發生什麼。你拿回 4 到 15 秒、最高 2K 的影片,聲音已經在檔案裡——而且你不只能定它從哪裡開始,還能定它在哪裡結束。
20 段真提示詞 · 按「試這個」直接載進來
起始影格 · 21:9 · 768P繞著一張靜態圖螺旋運鏡
MiniMax H3 AI 圖生影片
拿你的照片做了什麼
你的照片會成為真正的第一個影格——不是拿來參考風格,就是這顆鏡頭的開頭本身。

第 001 個影格 · 你的
照你描述的內容生成
從這個影格開始,MiniMax H3 AI 圖生影片照你寫的方式移動鏡頭和主體,長度是 4 到 15 秒之間任何一個整秒,24 影格每秒,768P 或 2K。JPG、PNG、WEBP 和 HEIC 都收,手機裡直接拿出來的照片就能用。
- 你的照片就是第一個影格
- 001
- 任何一個整秒
- 4–15 秒
- 影格率
- 24 fps
- 解析度
- 768P / 2K
你的照片就是第一個影格
任何一個整秒
影格率
解析度
- 不做風格轉換
- 沒有強度滑桿
- 不用把照片再描述一遍
從這裡開始、在這裡結束,還是兩頭都定?
MiniMax H3 AI 圖生影片的三種跑法
多數工具只給你一個上傳框,就叫它圖生影片。這裡給你三個,而且第二個幾乎沒有別人做。照你確定的那一頭挑:知道開場怎麼走,就給第一個影格;知道要落在哪裡,就給最後一個影格;兩頭都知道,就兩個都給,中間讓 H3 接。
從這裡開始
I2VA
一張照片當第一個影格。影片從你的圖開場,然後往前走。想讓產品在展台上轉一圈、讓人像開口說話、讓風景呼吸,用這個。
這一段怎麼寫
寫「接下來發生什麼」,不要寫「畫面裡有什麼」——那張圖模型自己看得見。把照片內容再列一遍,等於把你唯一那次下指令的機會浪費掉。
- 少見
在這裡結束
L2VA
一張照片當最後一個影格。把結局交給 H3,它會推一個說得通的開頭,最後一個影格正好收在你這張圖上。做「揭曉」就靠這個:蓋子掀開,穩穩落在你手上那張產品圖。
這一段怎麼寫
從結尾倒著寫:要讓你這張圖當最後一個影格,前面那些東西得是什麼狀態,然後讓動作收進去。
開始 → 結束
FL2VA

兩張照片,一頭一尾,中間那段路 H3 幫你補。前後對比、變形、換場都可以。兩張影格在主體、構圖和光線上越接近,中間那段就越乾淨。
這一段怎麼寫
兩張差太遠的話,把中間發生了什麼直接寫出來,不然 H3 會自己編一個你沒要的轉場。
它會不會把我的臉改掉?
在 MiniMax H3 裡鎖住你的主體
大家問的第一個問題。同一張照片跑兩次,答案自己就出來了。
這是大家問的第一個問題,而且問得有道理。如果你的提示詞只描述動作,那些你沒描述的東西就全是敞開的,模型可以在第三秒前後隨手重新發明一次。臉會飄。Logo 會糊。一個紅瓶子會變成另一個有點不一樣的紅瓶子。
解法是一句話,而且它寫在提示詞裡,不在某個設定裡。像對一個看不到它的人那樣描述你的主體——頭髮、衣服、材質、顏色、Logo 在哪——然後說整支片子裡這些都不會變。外觀鎖定會照你在框裡打的字,替你把那一句寫好。貼在任何一段提示詞的最後面,漂移就明顯下降,不管你用的是 MiniMax H3 AI 圖生影片 三種影格模式裡的哪一種。

大衣的織法變了,髮際線也挪了。提示詞裡沒有一句說它們不該變。

同樣的運鏡、同樣的長度、同樣的條件。唯一的變數就是那一句。
兩次之間唯一的差別
主體——紅色羊毛大衣、深色瀏海、左手銀戒指——全程保持同一張臉、同樣的頭髮、衣服與顏色;只有鏡頭和描述過的動作在變。
把不許變的東西打進來。下面那一句就是會接到你提示詞後面的內容。
會接在你提示詞的最後面
主體全程保持同一張臉、同樣的頭髮、衣服與顏色;只有鏡頭和描述過的動作在變。
如果你要的是同一個人出現在好幾支各自獨立的片子裡,而不是在同一支裡保持不變,那第一個影格就是用錯工具了。那是身份問題,不是構圖問題,參考圖生影片 就是為這件事做的。
什麼樣的圖片能用在 MiniMax H3 AI 圖生影片上
上傳框會在你花掉任何東西之前,先把這五項全查一遍。下面每一個數值都連到它的一手來源。
iPhone 照片可以直接傳。HEIC 和 HEIF 直接進得來,這一點值得說出來,因為多數工具都會不聲不響地要你先轉檔。
丟一個檔案進來,尺寸、比例和大小會先對著上面這些限制查一遍,然後才輪到花錢——一次被擋下的上傳應該只花你一秒,不該花掉一次生成。超過 30 MB,用低一點的畫質匯出,不要縮像素。長寬比超出範圍,用裁切而不是補邊——黑邊會變成畫面的一部分,也跟著一起動。要自己送請求的話,完整教學 講了 API 自己的 first_frame 與 last_frame 欄位。
為什麼 MiniMax H3 會替你決定長寬比
圖生影片的比例是 adaptive,直接從你的圖讀出來,所以一張直式照片就給你一支直式影片,你什麼都不用碰。這和 文字轉影片 正好相反:那邊沒有圖可以讀,比例得你自己選。
圖生影片 · 本頁
ratio: adaptive
從你上傳的那張圖片讀出來。可以改,但它已經知道了。
文字轉影片
ratio: 必填
adaptive 會被直接擋下——沒有圖片可以用來推斷畫面比例。
你還是可以覆蓋它——要 9:16 就給你 9:16,裁切到符合。片子有固定去處的時候值得這麼做:一張 4:3 的照片留著自適應,就會給你一支 4:3 的影片,放進手機動態裡就是上下加黑邊的一塊。
一支 MiniMax H3 圖生影片要多少錢
按輸出秒數計費,不是按次數,所以跑一支 4 秒的試片比 15 秒的成品便宜,2K 也比 768P 貴。生成失敗會自動退回。註冊是免費的,而且附一支 MiniMax H3 影片,4 秒 768P,帶聲音。再往後的 H3 就從點數包或方案裡來。
兩種繳法,每月點數一樣
- 免費免綁卡
一支真的 MiniMax H3 影片,帶聲音。4 秒 · 768P 之外的一切都靠點數。
$0永遠從頭到尾都不用信用卡
免費開始只驗機器人——不要 email
在 MiniMax H3 上跑 1 支
MiniMax H3 · 4 秒 · 768P · 16:9 · 帶聲音
7 天後回來看看——37 點數,再一支$9.9 起的任何一個點數包,都能解鎖 MiniMax H3 AI 影片生成器——每一種輸入方式、768P 和 2K
- 原生 2K 的 MiniMax H3只有付費
- 聲音和畫面一起生成只有付費
- 一支,不用綁卡
- 一次跑 1 支
- 跑壞的不收錢
- 生成內容不公開
- 任何一個點數包都能解鎖 MiniMax H3 AI 影片生成器的每一種輸入方式
免費層跑的是另一個引擎。看方案
速度與排隊
- 排隊
- 免費通道
- 同時任務數
- 1
- 批次
- 1
- 紀錄保留
- 24 小時 · 登入後 7 天
- 支援
- 社群
- Lite省 30%
用原生 2K 解鎖 MiniMax H3 AI 影片生成器。最小的付費方案——大多數人選的是 Pro。
$16.9/mo$24.9年繳 $202.8 · 一年省 $96
7 天退款 · 隨時取消
750 點數 / 月 · 約 20 支影片
4 秒 · 768P · 文字轉影片
或 4 秒 2K 約 13 支
月繳年繳,每月點數一樣
- 原生 2K 的 MiniMax H3——還有原生音訊
- 對白、音效與音樂在同一個檔案裡
- 最長 15 秒15 秒
- 每月約 20 支 4 秒 768P 的文字轉影片
- 跑壞的不收錢
- 點數沒動過,7 天內可退
- 一次跑 1 個任務
- 同一段提示詞批次跑 2 個版本
包含商業使用——涵蓋範圍
速度與排隊
- 排隊
- 一般
- 同時任務數
- 1
- 批次
- 2
- 紀錄保留
- 7 天
- 支援
- Email · 48 小時
- 多數人推薦Pro省 30%
比 Lite 多 $32。每月約 47 支影片,同一個 MiniMax H3 AI 影片生成器,排隊更快。
$39.9/mo$56.9年繳 $478.8 · 一年省 $204
7 天退款 · 隨時取消
1,775 點數 / 月 · 約 47 支影片
4 秒 · 768P · 文字轉影片
或 4 秒 2K 約 31 支
月繳年繳,每月點數一樣
- Lite 的全部
- 每月約 47 支 4 秒 768P 的文字轉影片
- 同時 3 個任務3×
- 影片轉提示詞
- 同一段提示詞批次跑 4 個版本
- 紀錄保留 7 天
- 點數沒動過,7 天內可退
包含商業使用——涵蓋範圍
速度與排隊
- 排隊
- 快速
- 同時任務數
- 3
- 批次
- 4
- 紀錄保留
- 7 天
- 支援
- Email · 12 小時
- Studio省 30%
整整一個月的量、排隊排在最前面,還有一個 4 小時內回覆的真人。
$99.9/mo$142.9年繳 $1,198.8 · 一年省 $516
7 天退款 · 隨時取消
4,425 點數 / 月 · 約 119 支影片
4 秒 · 768P · 文字轉影片
或 4 秒 2K 約 77 支
月繳年繳,每月點數一樣
- Pro 的全部
- 每月約 119 支 4 秒 768P 的文字轉影片
- 同時 8 個任務8×
- 同一段提示詞批次跑 4 個版本
- 紀錄保留 7 天
- 4 小時內的優先支援
- 我們給得出的最低點數消耗
- 點數沒動過,7 天內可退
包含商業使用——涵蓋範圍
速度與排隊
- 排隊
- 優先——排在最前面
- 同時任務數
- 8
- 批次
- 4
- 紀錄保留
- 7 天
- 支援
- 優先 · 4 小時
怎麼用 MiniMax H3 圖生影片讓一張靜圖動起來
決定結果的是第二步:你這張照片是這支片子的哪一頭。
上傳你的靜圖
一張就夠。它會變成輸出裡真正的一個影格,不是一個風格提示。
JPG 或 PNG選第一個影格、最後一個影格,或者兩個都選
第一個影格是從這張照片往前走。最後一個影格是走到它。兩個都給,模型就把兩頭接起來。
三種模式寫清楚什麼在動、聽起來是什麼樣
提示詞描述的是你定死的那些影格之間的動作,外加對白和音效。
聲音寫在同一個欄位裡設長度和解析度,然後生成
4 到 15 秒的整秒,24 影格每秒,768P 或 2K,回來的是一個 MP4,音訊在裡面。
最高 2K
上傳的照片本身永遠不會被改動,輸出的是一個新檔案。
MiniMax H3 AI 圖生影片常見問題
讓第一張照片動起來之前,先知道這些
圖生影片可以上傳哪些格式?
圖片尺寸有什麼要求?
可以只給最後一個影格、不給第一個嗎?
可以同時設第一個和最後一個影格嗎?
它會把我主體的臉改掉嗎?
長寬比一定要選嗎?
一支片子最長可以多長?
從一張照片能出 2K 嗎?
輸出有聲音嗎?
產品照片可以做成廣告嗎?
為什麼我的主體跑到一半就變樣了?
試這個一定要註冊嗎?
免費做出來的片子有聲音嗎?
這些影片可以商業使用嗎?
由 MiniMax H3 AI Video Generator 編輯團隊撰寫與維護發布於 最後更新 工具版本 2026.09.4
