MiniMax H3 參考圖生影片
把最多九張圖、三段影片和三把嗓音交給 MiniMax H3,它會造出一支新的影片,看起來和聽起來還是你那一套——4 到 15 秒,768P 或 2K。你不說的話,你的參考不會變成第一個影格。
20 段真提示詞 · 按「試這個」直接載進來
2 張靜圖 · 9:16 · 768P兩張靜圖,四個空間
MiniMax H3 參考圖生影片
到底拿你的檔案做了什麼
你上傳素材,模型造出一個聽它話的場景。
MiniMax H3 參考圖生影片收最多九張圖、三段影片和三段音訊——總共十二個檔案——並且把每一個都當成約束,而不是起點。你的角色可以帶著自己的臉,出現在他從沒去過的地方。回來的是 4 到 15 秒、768P 或 2K,聲音已經在 MP4 裡。
- 圖片 · 影片 · 音訊
- 9 + 3 + 3
- 單次請求的檔案數
- 12
- 保留標記
- 8
- 768P 或 2K
- 4–15 秒
圖片 · 影片 · 音訊
單次請求的檔案數
保留標記
768P 或 2K
- 你不說,它就不會當第一個影格
- 沒有風格強度滑桿
- 不用每顆鏡頭重傳一次
你的檔案不等於你的主體
同一個演員的四張照片不是四個參考。它們是一個主體,由四個檔案描述。
role · frameAnchor<Picture 1>影格錨點標成影格錨點,這張照片就還是它自己那個檔案,鏡頭會從它開場。
role · character<Subject 1>身份標成一個身份,同一張照片描述的就是一個人,模型接著把他放到別的地方去。
MiniMax H3 把這兩層分得很清楚。檔案是 `Picture 1`、`Video 1` 或 `Audio 1`,照上傳順序編號;主體則是這些檔案描述的那個人、那件商品、那個地方。把四張人像歸進 `Subject 1`,模型守的就是一個身份;不歸組,它看到的是四個長得像的人——臉會飄就是從這裡來的。
有一個例外幾乎每個人都會踩到。如果某張圖真的要當成一個影格,就把它標成影格錨點,它會保持自己的 `Picture 1`,不併進任何主體。上面那兩支片子都出自同一張照片。如果鏡頭必須從你那張圖開始,用 圖片轉影片。
你可以拿什麼來參考,以及那道 12 個檔案的牆
三類素材可以一起進來:九張圖、三段影片、三段音訊。
九加三加三是十五,但一次請求總共只收十二個檔案。你不可能三樣都塞滿。早一點決定誰來扛身份——通常是圖片——剩下的額度再繞著它花。
參考片段可以比你要做的影片長,自己挑出你要的那一段就行。什麼都不傳,這次請求會悄悄變成文字轉影片。提示詞框上面那個計數器會同時盯著檔案數和花費。
照抄、遷移,還是只當參考?八個保留標記
關於這個模式的抱怨,幾乎全都出在這個機制上。你定義的每一個標籤都會有一個歸宿,而歸宿由你宣告。MiniMax H3 參考圖生影片讀兩組共八個標記,伸手拿錯組就是一個錯誤。
視覺
給一切看得見的東西——圖片和影片。
fully_preserved原樣保留
臉、戲服、瓶子上的標籤。
同一張臉,同一件大衣,換一座城市。
partially_preserved保留大部分
還是這個主體,某些特徵變了。
同一個人,換一件大衣。
attribute_transfer把它挪到別人身上
把某個特徵挪到另一個人身上:參考片段裡的那種走路方式,由你的角色來走。
你的吉祥物,那個舞者的走姿。
weak_reference只借那個感覺
配色、質感、構圖語言。
只要那個調,別的都不要。
音訊
給聲音用。一張圖片卡上出現這些選項,那是 bug。
fully_copy整條音軌都用
來源音軌原封不動變成最後那條音軌。
你那條底噪,不變。
partially_copy只用其中一層
留下一層,壓在新的對白下面。
留住房間聲,去掉人聲。
reference對上這把嗓音,一個字都不照抄
音色、節奏和念法,不複製任何訊號。這一個會複製一把嗓音。
新台詞,同一把嗓子。
weak_reference只借那個氛圍
只要大致的氛圍,別的都不要。
一個聽起來像這樣的地方。
標錯,就是結果看起來像影印本的原因。把構圖標成 `fully_preserved`,模型就把你的構圖保下來——這是聽話,不是 bug。把身份標成 `fully_preserved`、其餘標成 `weak_reference`,場景才打得開。
在每一張卡上設好,它會自己寫進你的提示詞。想幫已經有的片子換個風格?那是 影片轉影片。
參考標籤,和那套六個欄位的 MiniMax H3 參考圖生影片提示詞
結構不是審美偏好。模型是照著六個固定順序的欄位訓練出來的,其中兩個之所以存在,純粹因為你帶了素材過來。
subject_definitions一個主體一行,替它命名並引用它的上傳檔案。你寫下來的那些特徵,就是模型會去守的那些。
<Subject 1> is the woman in <Picture 1> and <Picture 2>, short dark hair, grey wool coat.
retention_analysis一個標籤一行,用上面那些標記,寫清楚它出現在哪些鏡頭裡。這個欄位留空,模型就替你決定。
<Subject 1>: fully_preserved. <Picture 3>: weak_reference, palette only.
summary · overall_soundscape · non_diegetic_music系統替你填好,然後折起來。它們和你的參考素材沒有關係——文字轉影片 那一頁才是講它們的地方。
寫 Image 1,不要寫 @image1
Image 1 · Video 1 · Audio 1MiniMax H3@image1Seedance
這一條會實實在在燒掉你的生成次數。`@image1` 是 Seedance 的寫法;好幾份教學把它照搬給 MiniMax H3,而 H3 根本不讀它。素材是照上傳順序編號的——重排一次,你送出的就是另一個請求。
同一個標籤在每一個欄位裡都必須寫得一模一樣,引用一個沒定義過的標籤會讓整個請求失敗。不想自己寫?提示詞產生器 能從一句話把六個欄位都填好。
按下生成之前,先看這五件事
參考模式是唯一一個連輸入都要花錢的模式,所以白跑一次會疼兩次。生成按鈕上面那塊面板會讀你的設定,直接告訴你接下來會發生什麼。
順序
你的上傳是照你丟進來的先後編號的,而這個編號是請求的一部分。
順序:Image 1 · Image 2 · Video 1
原聲會跟著一起進來
一段參考片段預設會連它自己的音訊一起被當成條件,除非你把那個關掉——這就是為什麼會冒出你根本沒上傳過的聲音。
Video 1 也會連同它自己的原聲一起被當成條件。
音訊會被切掉
如果你的片子比嗓音參考短,多出來的那一段會被丟掉。把長度對齊,或者把參考裁短。
音訊有 12 秒,但你的片子只有 5 秒——多出來的會被丟掉。
自適應不是承諾
它是讓模型從你的素材裡挑一個畫面形狀。要直式?就明講 9:16。
adaptive 是讓模型自己挑。你的參考素材看起來是 16:9。
十二
你還剩幾個檔案額度。
12 個檔案裡已經用掉 7 個。
打算自己跑開源權重?有些規則不一樣——見 開源權重指南。
一支 MiniMax H3 參考圖生影片要多少錢
參考素材不是免費的,而且其中一樣貴得出乎意料。前五張圖不要錢,之後每張四美分。音訊不要錢。參考片段按它自己的長度、以你的輸出費率計費:在一支 8 秒的 2K 生成上掛 10 秒參考,參考比生成本身還貴。把參考片段裁到剛好能說明你意思的最短一段。在 MiniMax 自己的 API 上,先出 768P 之後再升級也一樣省不到錢——八美分加五美分,正好就是十三。
跑一次,換算成你在這裡花掉的點數
- 輸出 · 8 秒 2K
- 480 點
- 參考圖 · 6 張(前 5 張免費)
- 每張 4¢
- 參考片段 · 10 秒 2K
- 按它自己的長度計費
- 參考音訊 · 2 段
- 0 點
- 你的第一支
- 免費 · 768P
消耗速率 · 2K 每秒 8 點、768P 每秒 4 點 · 每個方案都一樣 · 點數就印在每一個方案上 完整價格
兩種繳法,每月點數一樣
- 免費免綁卡
一支真的 MiniMax H3 影片,帶聲音。4 秒 · 768P 之外的一切都靠點數。
$0永遠從頭到尾都不用信用卡
免費開始只驗機器人——不要 email
在 MiniMax H3 上跑 1 支
MiniMax H3 · 4 秒 · 768P · 16:9 · 帶聲音
7 天後回來看看——37 點數,再一支$9.9 起的任何一個點數包,都能解鎖 MiniMax H3 AI 影片生成器——每一種輸入方式、768P 和 2K
- 原生 2K 的 MiniMax H3只有付費
- 聲音和畫面一起生成只有付費
- 一支,不用綁卡
- 一次跑 1 支
- 跑壞的不收錢
- 生成內容不公開
- 任何一個點數包都能解鎖 MiniMax H3 AI 影片生成器的每一種輸入方式
免費層跑的是另一個引擎。看方案
速度與排隊
- 排隊
- 免費通道
- 同時任務數
- 1
- 批次
- 1
- 紀錄保留
- 24 小時 · 登入後 7 天
- 支援
- 社群
- Lite省 30%
用原生 2K 解鎖 MiniMax H3 AI 影片生成器。最小的付費方案——大多數人選的是 Pro。
$16.9/mo$24.9年繳 $202.8 · 一年省 $96
7 天退款 · 隨時取消
750 點數 / 月 · 約 20 支影片
4 秒 · 768P · 文字轉影片
或 4 秒 2K 約 13 支
月繳年繳,每月點數一樣
- 原生 2K 的 MiniMax H3——還有原生音訊
- 對白、音效與音樂在同一個檔案裡
- 最長 15 秒15 秒
- 每月約 20 支 4 秒 768P 的文字轉影片
- 跑壞的不收錢
- 點數沒動過,7 天內可退
- 一次跑 1 個任務
- 同一段提示詞批次跑 2 個版本
包含商業使用——涵蓋範圍
速度與排隊
- 排隊
- 一般
- 同時任務數
- 1
- 批次
- 2
- 紀錄保留
- 7 天
- 支援
- Email · 48 小時
- 多數人推薦Pro省 30%
比 Lite 多 $32。每月約 47 支影片,同一個 MiniMax H3 AI 影片生成器,排隊更快。
$39.9/mo$56.9年繳 $478.8 · 一年省 $204
7 天退款 · 隨時取消
1,775 點數 / 月 · 約 47 支影片
4 秒 · 768P · 文字轉影片
或 4 秒 2K 約 31 支
月繳年繳,每月點數一樣
- Lite 的全部
- 每月約 47 支 4 秒 768P 的文字轉影片
- 同時 3 個任務3×
- 影片轉提示詞
- 同一段提示詞批次跑 4 個版本
- 紀錄保留 7 天
- 點數沒動過,7 天內可退
包含商業使用——涵蓋範圍
速度與排隊
- 排隊
- 快速
- 同時任務數
- 3
- 批次
- 4
- 紀錄保留
- 7 天
- 支援
- Email · 12 小時
- Studio省 30%
整整一個月的量、排隊排在最前面,還有一個 4 小時內回覆的真人。
$99.9/mo$142.9年繳 $1,198.8 · 一年省 $516
7 天退款 · 隨時取消
4,425 點數 / 月 · 約 119 支影片
4 秒 · 768P · 文字轉影片
或 4 秒 2K 約 77 支
月繳年繳,每月點數一樣
- Pro 的全部
- 每月約 119 支 4 秒 768P 的文字轉影片
- 同時 8 個任務8×
- 同一段提示詞批次跑 4 個版本
- 紀錄保留 7 天
- 4 小時內的優先支援
- 我們給得出的最低點數消耗
- 點數沒動過,7 天內可退
包含商業使用——涵蓋範圍
速度與排隊
- 排隊
- 優先——排在最前面
- 同時任務數
- 8
- 批次
- 4
- 紀錄保留
- 7 天
- 支援
- 優先 · 4 小時
人臉、嗓音與角色的負責任使用
參考素材才是法律風險真正待著的地方。
- 人臉用真人的影像要本人同意——公眾人物不行,陌生人的照片也不行。
- 嗓音音色參考會把某一個特定的人的聲音複製出來。只用你自己的、拿到授權的,或者合成的。
- 角色一個受著作權保護的角色,不會因為被模型重新生成一遍就變成你的。
- 未成年人任何描繪未成年人的參考素材,一律不要上傳。
- 內容審核MiniMax 會自動篩查送上去的媒體;誤判與漏判都會發生。
怎麼用參考圖生影片讓同一個角色貫穿好幾支片子
把檔案傳上去是簡單的那一半。決定身份守不守得住的,是標籤。
上傳你的參考素材
最多九張圖、三段影片和三段音訊——單次請求 12 個檔案、64 MB。
≤12 個檔案,≤64 MB說清楚每個檔案是做什麼用的
主體、圖片、影格錨點,還是音色。好幾個檔案可以歸成一組,描述同一個身份。
角色與主體分組設定它要被保留多少
視覺與音訊兩組共八個保留標記,每一份參考被照做到什麼程度,由你決定。
8 個保留標記寫提示詞,然後生成
4 到 15 秒,24 影格每秒,768P 或 2K,32 kHz 立體聲和畫面一起生成。
參考素材的順序會有影響
每次請求含五張參考圖;超出的每一張要 2 點數。
MiniMax H3 參考圖生影片常見問題
把同一張臉鎖在好幾顆鏡頭裡之前,先知道這些
MiniMax H3 參考圖生影片是什麼?
可以用幾張參考圖?為什麼我的角色還是飄掉了?
為什麼我的片子裡有我從來沒上傳過的聲音?
@image1 能用嗎?參考的順序有差嗎?
可以只拿音訊當唯一的參考嗎?
可以複製一把嗓音嗎?
輸出有聲音嗎?
計費是怎麼算的?
需要註冊嗎?出來的片子有聲音嗎?
這些影片可以商業使用嗎?
帶一個角色過來,答案就出來了。
參考圖生影片跑在 MiniMax H3 上,而 H3 是付費的——在 /pricing 解鎖。註冊免費,而且附一支 MiniMax H3 影片,可以花在文字轉影片或圖片轉影片上。
免費註冊 · 送 1 支 MiniMax H3由 MiniMax H3 AI Video Generator 編輯團隊撰寫與維護發布於 最後更新 工具版本 2026.09.4
