MiniMax H3 參考圖生影片

把最多九張圖、三段影片和三把嗓音交給 MiniMax H3,它會造出一支新的影片,看起來和聽起來還是你那一套——4 到 15 秒,768P 或 2K。你不說的話,你的參考不會變成第一個影格。

用你自己的素材來造

上傳 1–12 個檔案 · 影片合計 ≤15 秒 · 音訊合計 ≤15 秒

0 / 12 個檔案

9 + 3 + 3 是 15。請求只收 12 個。

還什麼都沒上傳——這次請求會悄悄變成文字轉影片。點右邊載入一個素材包,看看標好標籤是什麼樣子。

0 / 7000

參考圖生影片跑在 MiniMax H3 上,免費那一支收不了參考素材。用 H3 跑你自己的提示詞,一個月 $9.9 起。

20 段真提示詞 · 按「試這個」直接載進來

MiniMax H3 參考圖生影片:穿條紋針織衫的金髮女子,當作展間廣告兩張靜圖裡的第一張2 張靜圖 · 9:16 · 768P

兩張靜圖,四個空間

你的素材會被拿去做什麼

MiniMax H3 參考圖生影片到底拿你的檔案做了什麼

你上傳素材,模型造出一個聽它話的場景。

MiniMax H3 參考圖生影片收最多九張圖、三段影片和三段音訊——總共十二個檔案——並且把每一個都當成約束,而不是起點。你的角色可以帶著自己的臉,出現在他從沒去過的地方。回來的是 4 到 15 秒、768P 或 2K,聲音已經在 MP4 裡。

圖片 · 影片 · 音訊
9 + 3 + 3

圖片 · 影片 · 音訊

單次請求的檔案數
12

單次請求的檔案數

保留標記
8

保留標記

768P 或 2K
4–15 秒

768P 或 2K

  • 你不說,它就不會當第一個影格
  • 沒有風格強度滑桿
  • 不用每顆鏡頭重傳一次

檔案與主體

你的檔案不等於你的主體

同一個演員的四張照片不是四個參考。它們是一個主體,由四個檔案描述。

  • 參考圖生影片輸出:一支從參考照片本身開場的片子role · frameAnchor
    <Picture 1>影格錨點標成影格錨點,這張照片就還是它自己那個檔案,鏡頭會從它開場。
  • MiniMax H3 參考圖生影片:同一個人出現在一個他從沒被拍過的場景裡role · character
    <Subject 1>身份標成一個身份,同一張照片描述的就是一個人,模型接著把他放到別的地方去。

MiniMax H3 把這兩層分得很清楚。檔案是 `Picture 1`、`Video 1` 或 `Audio 1`,照上傳順序編號;主體則是這些檔案描述的那個人、那件商品、那個地方。把四張人像歸進 `Subject 1`,模型守的就是一個身份;不歸組,它看到的是四個長得像的人——臉會飄就是從這裡來的。

有一個例外幾乎每個人都會踩到。如果某張圖真的要當成一個影格,就把它標成影格錨點,它會保持自己的 `Picture 1`,不併進任何主體。上面那兩支片子都出自同一張照片。如果鏡頭必須從你那張圖開始,用 圖片轉影片

能傳什麼

你可以拿什麼來參考,以及那道 12 個檔案的牆

三類素材可以一起進來:九張圖、三段影片、三段音訊。

九加三加三是十五,但一次請求總共只收十二個檔案。你不可能三樣都塞滿。早一點決定誰來扛身份——通常是圖片——剩下的額度再繞著它花。

圖片
≤ 9 · 每張 ≤ 30 MB · JPG · JPEG · PNG · WEBP · HEIC · HEIF
官方
影片片段
≤ 3 · ≤ 50 MB · 每段 2–15 秒 · 合計 ≤ 15 秒 · MP4 · MOV
官方
音訊片段
≤ 3 · ≤ 15 MB · 每段 2–15 秒 · 合計 ≤ 15 秒 · WAV · MP3
官方
全部類型
≤ 12 個檔案 · 單次請求 ≤ 64 MB
官方
輸出
4–15 秒,24 影格每秒 · 768P 或 2KMiniMax 自己的 API 收 4–15 的整秒。fal 列的是 5–15。開源權重那條路下限是 5。
官方

參考片段可以比你要做的影片長,自己挑出你要的那一段就行。什麼都不傳,這次請求會悄悄變成文字轉影片。提示詞框上面那個計數器會同時盯著檔案數和花費。

保留標記

照抄、遷移,還是只當參考?八個保留標記

關於這個模式的抱怨,幾乎全都出在這個機制上。你定義的每一個標籤都會有一個歸宿,而歸宿由你宣告。MiniMax H3 參考圖生影片讀兩組共八個標記,伸手拿錯組就是一個錯誤。

視覺

給一切看得見的東西——圖片和影片。

  • fully_preserved

    原樣保留

    臉、戲服、瓶子上的標籤。

    同一張臉,同一件大衣,換一座城市。

  • partially_preserved

    保留大部分

    還是這個主體,某些特徵變了。

    同一個人,換一件大衣。

  • attribute_transfer

    把它挪到別人身上

    把某個特徵挪到另一個人身上:參考片段裡的那種走路方式,由你的角色來走。

    你的吉祥物,那個舞者的走姿。

  • weak_reference

    只借那個感覺

    配色、質感、構圖語言。

    只要那個調,別的都不要。

音訊

給聲音用。一張圖片卡上出現這些選項,那是 bug。

  • fully_copy

    整條音軌都用

    來源音軌原封不動變成最後那條音軌。

    你那條底噪,不變。

  • partially_copy

    只用其中一層

    留下一層,壓在新的對白下面。

    留住房間聲,去掉人聲。

  • reference

    對上這把嗓音,一個字都不照抄

    音色、節奏和念法,不複製任何訊號。這一個會複製一把嗓音。

    新台詞,同一把嗓子。

  • weak_reference

    只借那個氛圍

    只要大致的氛圍,別的都不要。

    一個聽起來像這樣的地方。

標錯,就是結果看起來像影印本的原因。把構圖標成 `fully_preserved`,模型就把你的構圖保下來——這是聽話,不是 bug。把身份標成 `fully_preserved`、其餘標成 `weak_reference`,場景才打得開。

在每一張卡上設好,它會自己寫進你的提示詞。想幫已經有的片子換個風格?那是 影片轉影片

參考標籤

參考標籤,和那套六個欄位的 MiniMax H3 參考圖生影片提示詞

結構不是審美偏好。模型是照著六個固定順序的欄位訓練出來的,其中兩個之所以存在,純粹因為你帶了素材過來。

  • Field 01subject_definitions

    一個主體一行,替它命名並引用它的上傳檔案。你寫下來的那些特徵,就是模型會去守的那些。

    <Subject 1> is the woman in <Picture 1> and <Picture 2>, short dark hair, grey wool coat.

  • Field 02retention_analysis

    一個標籤一行,用上面那些標記,寫清楚它出現在哪些鏡頭裡。這個欄位留空,模型就替你決定。

    <Subject 1>: fully_preserved. <Picture 3>: weak_reference, palette only.

  • Fields 03–06summary · overall_soundscape · non_diegetic_music

    系統替你填好,然後折起來。它們和你的參考素材沒有關係——文字轉影片 那一頁才是講它們的地方。

寫 Image 1,不要寫 @image1

  • Image 1 · Video 1 · Audio 1MiniMax H3
  • @image1Seedance

這一條會實實在在燒掉你的生成次數。`@image1` 是 Seedance 的寫法;好幾份教學把它照搬給 MiniMax H3,而 H3 根本不讀它。素材是照上傳順序編號的——重排一次,你送出的就是另一個請求。

同一個標籤在每一個欄位裡都必須寫得一模一樣,引用一個沒定義過的標籤會讓整個請求失敗。不想自己寫?提示詞產生器 能從一句話把六個欄位都填好。

生成之前

按下生成之前,先看這五件事

參考模式是唯一一個連輸入都要花錢的模式,所以白跑一次會疼兩次。生成按鈕上面那塊面板會讀你的設定,直接告訴你接下來會發生什麼。

  1. 01順序

    你的上傳是照你丟進來的先後編號的,而這個編號是請求的一部分。

    順序:Image 1 · Image 2 · Video 1

  2. 02原聲會跟著一起進來

    一段參考片段預設會連它自己的音訊一起被當成條件,除非你把那個關掉——這就是為什麼會冒出你根本沒上傳過的聲音。

    Video 1 也會連同它自己的原聲一起被當成條件。

  3. 03音訊會被切掉

    如果你的片子比嗓音參考短,多出來的那一段會被丟掉。把長度對齊,或者把參考裁短。

    音訊有 12 秒,但你的片子只有 5 秒——多出來的會被丟掉。

  4. 04自適應不是承諾

    它是讓模型從你的素材裡挑一個畫面形狀。要直式?就明講 9:16。

    adaptive 是讓模型自己挑。你的參考素材看起來是 16:9。

  5. 05十二

    你還剩幾個檔案額度。

    12 個檔案裡已經用掉 7 個。

打算自己跑開源權重?有些規則不一樣——見 開源權重指南

價格 · 每個付費方案都出 2K · 原生音訊

一支 MiniMax H3 參考圖生影片要多少錢

參考素材不是免費的,而且其中一樣貴得出乎意料。前五張圖不要錢,之後每張四美分。音訊不要錢。參考片段按它自己的長度、以你的輸出費率計費:在一支 8 秒的 2K 生成上掛 10 秒參考,參考比生成本身還貴。把參考片段裁到剛好能說明你意思的最短一段。在 MiniMax 自己的 API 上,先出 768P 之後再升級也一樣省不到錢——八美分加五美分,正好就是十三。

跑一次,換算成你在這裡花掉的點數

輸出 · 8 秒 2K
480 點
參考圖 · 6 張(前 5 張免費)
每張 4¢
參考片段 · 10 秒 2K
按它自己的長度計費
參考音訊 · 2 段
0 點
你的第一支
免費 · 768P

消耗速率 · 2K 每秒 8 點、768P 每秒 4 點 · 每個方案都一樣 · 點數就印在每一個方案上 完整價格

兩種繳法,每月點數一樣

  • 免費免綁卡

    一支真的 MiniMax H3 影片,帶聲音。4 秒 · 768P 之外的一切都靠點數。

    $0永遠

    從頭到尾都不用信用卡

    免費開始

    只驗機器人——不要 email

    在 MiniMax H3 上跑 1 支

    MiniMax H3 · 4 秒 · 768P · 16:9 · 帶聲音
    7 天後回來看看——37 點數,再一支

    $9.9 起的任何一個點數包,都能解鎖 MiniMax H3 AI 影片生成器——每一種輸入方式、768P 和 2K

    • 原生 2K 的 MiniMax H3只有付費
    • 聲音和畫面一起生成只有付費
    • 一支,不用綁卡
    • 一次跑 1 支
    • 跑壞的不收錢
    • 生成內容不公開
    • 任何一個點數包都能解鎖 MiniMax H3 AI 影片生成器的每一種輸入方式

    免費層跑的是另一個引擎。看方案

    速度與排隊

    排隊
    免費通道
    同時任務數
    1
    批次
    1
    紀錄保留
    24 小時 · 登入後 7 天
    支援
    社群
  • Lite省 30%

    用原生 2K 解鎖 MiniMax H3 AI 影片生成器。最小的付費方案——大多數人選的是 Pro。

    $16.9/mo$24.9

    年繳 $202.8 · 一年省 $96

    7 天退款 · 隨時取消

    750 點數 / 月 · 約 20 支影片

    4 秒 · 768P · 文字轉影片

    或 4 秒 2K 約 13 支

    月繳年繳,每月點數一樣

    • 原生 2K 的 MiniMax H3——還有原生音訊
    • 對白、音效與音樂在同一個檔案裡
    • 最長 15 秒15 秒
    • 每月約 20 支 4 秒 768P 的文字轉影片
    • 跑壞的不收錢
    • 點數沒動過,7 天內可退
    • 一次跑 1 個任務
    • 同一段提示詞批次跑 2 個版本

    包含商業使用——涵蓋範圍

    速度與排隊

    排隊
    一般
    同時任務數
    1
    批次
    2
    紀錄保留
    7 天
    支援
    Email · 48 小時
  • 多數人推薦
    Pro省 30%

    比 Lite 多 $32。每月約 47 支影片,同一個 MiniMax H3 AI 影片生成器,排隊更快。

    $39.9/mo$56.9

    年繳 $478.8 · 一年省 $204

    7 天退款 · 隨時取消

    1,775 點數 / 月 · 約 47 支影片

    4 秒 · 768P · 文字轉影片

    或 4 秒 2K 約 31 支

    月繳年繳,每月點數一樣

    • Lite 的全部
    • 每月約 47 支 4 秒 768P 的文字轉影片
    • 同時 3 個任務
    • 影片轉提示詞
    • 同一段提示詞批次跑 4 個版本
    • 紀錄保留 7 天
    • 點數沒動過,7 天內可退

    包含商業使用——涵蓋範圍

    速度與排隊

    排隊
    快速
    同時任務數
    3
    批次
    4
    紀錄保留
    7 天
    支援
    Email · 12 小時
  • Studio省 30%

    整整一個月的量、排隊排在最前面,還有一個 4 小時內回覆的真人。

    $99.9/mo$142.9

    年繳 $1,198.8 · 一年省 $516

    7 天退款 · 隨時取消

    4,425 點數 / 月 · 約 119 支影片

    4 秒 · 768P · 文字轉影片

    或 4 秒 2K 約 77 支

    月繳年繳,每月點數一樣

    • Pro 的全部
    • 每月約 119 支 4 秒 768P 的文字轉影片
    • 同時 8 個任務
    • 同一段提示詞批次跑 4 個版本
    • 紀錄保留 7 天
    • 4 小時內的優先支援
    • 我們給得出的最低點數消耗
    • 點數沒動過,7 天內可退

    包含商業使用——涵蓋範圍

    速度與排隊

    排隊
    優先——排在最前面
    同時任務數
    8
    批次
    4
    紀錄保留
    7 天
    支援
    優先 · 4 小時

負責任使用

人臉、嗓音與角色的負責任使用

參考素材才是法律風險真正待著的地方。

  • 人臉用真人的影像要本人同意——公眾人物不行,陌生人的照片也不行。
  • 嗓音音色參考會把某一個特定的人的聲音複製出來。只用你自己的、拿到授權的,或者合成的。
  • 角色一個受著作權保護的角色,不會因為被模型重新生成一遍就變成你的。
  • 未成年人任何描繪未成年人的參考素材,一律不要上傳。
  • 內容審核MiniMax 會自動篩查送上去的媒體;誤判與漏判都會發生。

完整政策:負責任使用

完整流程

怎麼用參考圖生影片讓同一個角色貫穿好幾支片子

把檔案傳上去是簡單的那一半。決定身份守不守得住的,是標籤。

  1. 上傳你的參考素材

    最多九張圖、三段影片和三段音訊——單次請求 12 個檔案、64 MB。

    ≤12 個檔案,≤64 MB
  2. 說清楚每個檔案是做什麼用的

    主體、圖片、影格錨點,還是音色。好幾個檔案可以歸成一組,描述同一個身份。

    角色與主體分組
  3. 設定它要被保留多少

    視覺與音訊兩組共八個保留標記,每一份參考被照做到什麼程度,由你決定。

    8 個保留標記
  4. 寫提示詞,然後生成

    4 到 15 秒,24 影格每秒,768P 或 2K,32 kHz 立體聲和畫面一起生成。

    參考素材的順序會有影響

每次請求含五張參考圖;超出的每一張要 2 點數。

大家真的會問的問題

MiniMax H3 參考圖生影片常見問題

把同一張臉鎖在好幾顆鏡頭裡之前,先知道這些

MiniMax H3 參考圖生影片是什麼?

用 MiniMax H3 參考圖生影片,它會造出一個聽你上傳素材的話的新場景——九張圖、三段影片、三段音訊,總共十二個——而不是讓一張圖動起來。

可以用幾張參考圖?為什麼我的角色還是飄掉了?

九張。會飄通常是因為它們從來沒被歸組:同一個人的好幾張照片是一個主體,不是好幾個參考。

為什麼我的片子裡有我從來沒上傳過的聲音?

一段參考片段預設會連它自己的原聲一起被當成條件。在那張卡上關掉,它就只用動作。

@image1 能用嗎?參考的順序有差嗎?

不能,以及有差。素材照上傳順序是 Image 1、Video 1 和 Audio 1,而那個順序是請求的一部分。

可以只拿音訊當唯一的參考嗎?

在這裡可以——一段音訊就是一個合法的請求。在開源權重上,音訊必須和一張圖或一段影片一起送。

可以複製一把嗓音嗎?

音色參考可以讓一個角色用那把嗓音念新的台詞。只用你有權使用的嗓音。

輸出有聲音嗎?

有,32 kHz 立體聲,和畫面一起生成,不管你有沒有給音訊參考。

計費是怎麼算的?

按輸出秒數,再加上參考素材:前五張之後,每張圖四美分;參考片段按它自己的長度算;音訊免費。

需要註冊嗎?出來的片子有聲音嗎?

參考圖生影片跑在 MiniMax H3 上,而 H3 是付費的——在 /pricing 解鎖。註冊是免費的,而且附一支 MiniMax H3 影片,你可以花在文字轉影片或圖片轉影片上。免費那一支跑的就是 H3,帶著聲音——這裡已經沒有無聲的那一層了。

這些影片可以商業使用嗎?

可以,每個方案都可以,免費的也算。這裡的影片是透過 MiniMax 的 API 生成的,而 MiniMax 對你生成的產出不主張任何權利——本站把這一點原樣傳給你:任何一層都不加浮水印,不按支收授權費,也沒有另外要買的授權。你寫的提示詞同樣是你的,拿到哪裡跑都行。本站做不到的是替 MiniMax 發言——這裡是獨立的第三方介面,模型授權本身要由 MiniMax 自己說明。以上是概述,不構成法律意見。

帶一個角色過來,答案就出來了。

參考圖生影片跑在 MiniMax H3 上,而 H3 是付費的——在 /pricing 解鎖。註冊免費,而且附一支 MiniMax H3 影片,可以花在文字轉影片或圖片轉影片上。

免費註冊 · 送 1 支 MiniMax H3

MiniMax H3 AI Video Generator 編輯團隊撰寫與維護發布於 最後更新 工具版本 2026.09.4