MiniMax H3 AI 影片轉影片
上傳一支片子,MiniMax H3 照著它做出一支新的——換個風格、換一句話,或者從它停下的地方接著往下拍。最多三段來源,每段 2 到 15 秒,出片 4 到 15 秒。你的檔案它一個位元組都不會動。
20 段真提示詞 · 按「試這個」直接載進來
起始影格 · 2:3 · 768P四個主角,一支廣告
MiniMax H3 AI 影片轉影片
對你的片子做了什麼
嚴格說,什麼都沒做。這一點值得先弄清楚。
MiniMax H3 AI 影片轉影片把你的片子當成一個條件來讀,再生成一支服從它的新片。動作、取景和節奏之所以延續下來,是因為你要求了,不是因為像素被保留了。最多給它三段來源,每段 2 到 15 秒、合計 15 秒,你拿回 4 到 15 秒的 768P 或 2K,聲音就在同一個 MP4 裡。
- 來源片段數
- 3
- 所有來源合計
- 15 秒
- 輸出,24 影格每秒
- 4–15 秒
- 解析度
- 768P / 2K
來源片段數
所有來源合計
輸出,24 影格每秒
解析度
- 沒有編輯端點
- 沒有時間軸
- 你的檔案一個都不會被改
沒有任何東西被編輯。你的片子是被重做了一遍
凡是你沒釘死的東西都可能動——所以下面這張對照表把「守住了什麼」和「變了什麼」一條一條列出來。
你的片子
你的片子 · 6 秒出來的樣子
[video editing] · 768P守住了取景服裝節奏
變了調色材質
Runway Aleph 和 Gemini Omni Flash 有編輯端點:它們會直接改你交上去的那個檔案。MiniMax H3 沒有這種端點。影片是從參考那條路進去的,出來的是一支照著你的片子搭出來的新片。聽起來像個缺點,直到你去看那張榜——H3 在影片編輯榜上排第一,靠的正是「帶著完整多模態上下文重做一遍」在大家真正想要的那些改動上贏過外科手術式的編輯。
但它確實定下了這一頁的規矩:凡是你沒釘死的東西都可能動。落到實處就是,把那些你以為不用講的東西寫下來——背景、服裝、時間——因為在你說出口之前,它們都不是承重牆。把好幾份素材拼進一個從來不存在的場景,那是另一件事——那是 參考圖生影片。
大家拿 MiniMax H3 AI 影片轉影片做的四件事
MiniMax H3 會在提示詞裡宣告自己在做什麼,下面這四件事就是四種不同的宣告。挑錯,是結果跑掉最常見的原因。
換風格——樣子變,動作不變
[video editing]只描述新的樣子,其餘的別碰;凡是你提到的,都可能被改。動作和節奏是最容易守住的部分,材質和打光是最容易變的部分。
- 守得住
- 動作、節奏、構圖
- 會變
- 材質、打光、調色
換聲音——話變了,人沒變
[video editing + audio reuse]台詞寫短一點,要塞得進你要的那幾秒,不然嘴型對不上。
- 守得住
- 人物、場景
- 會變
- 對嘴、台詞
接著拍——從片子停下的地方接上
[video continuation]你的片子是助跑;描述最後一個影格之後發生了什麼。
- 守得住
- 主體、場景、風格
- 會變
- 接下來發生什麼
搬運鏡——借走運鏡,主體整個換掉
[reference generation]你的片子只供那段運動。描述新的主體,運鏡本身一個字都別提——講兩遍,你就再也分不清鏡頭聽的是哪一條指令。
- 守得住
- 運鏡路徑與節奏
- 會變
- 主體和場景,整個換
按官方口徑,這一條叫參考生成。它講在 參考圖生影片 那一頁。
方括號裡那些名字是官方的 `summary` 前綴,不是我們編的簡寫。換風格、換聲音和接著拍也都要以 `The target video is an edited version of <Video 1>.` 開頭。
你的來源片段得長什麼樣,以及哪一筆要付兩遍
檢查器在上傳之前就把你的檔案讀一遍,直接告訴你該改哪一個數字。
你的來源片段按它自己的長度計費,而且是在輸出之外另外算的。2K 下進十秒、出十秒,等於收兩遍。把來源裁到真正要緊的那幾秒,同一次跑能少花三分之一。
畫面每邊在 256 到 5,760 像素之間,長寬比要落在 0.4 到 2.5 之間——用手機拍的東西幾乎都已經符合。還有兩條:來源影片會頂掉第一個與最後一個影格的控制,兩者不能同時用;輸出永遠是 24 影格每秒。完整費率在 價格 那一頁。
你片子的音軌會跟著一起進來
上傳一支片子,它的聲音也一併成了條件,不管你是不是有意的。
這就是為什麼一個你從沒上傳過的聲音會出現在結果裡,而且它把性別和口音一起帶了進來。一段從女性那裡錄來的笑聲,落在男性的臉上,聽起來還是女性的笑聲。
整條留下
原來那條音軌就是最後那條音軌。
fully_copy墊在新對白下面
音樂留下來,墊在你寫的台詞底下。
partially_copy只寫動作
音訊被丟掉,片子只以動作為條件。
weak_reference
這是 H3 會讀的 八個保留標記 裡的三個;另外五個在你從零搭一個場景的時候更要緊。
MiniMax H3 AI 影片轉影片排在哪,以及什麼時候別用它
Artificial Analysis 做的是盲測兩兩比對,票數公開。這是「影片編輯(帶聲音)」榜 2026-08-14 的快照。
- 第一名(名次區間 1–2)
#1
9001500- Elo
- 1,127
- 95% CI
- ±6
- 票數
- 11,474
- 名次區間
- 1–2
引用之前先把這一行讀完:Gemini Omni Flash 只落後三分,1,124,而且區間是重疊的。那是平手,不是贏。站得住的說法要窄一些,也更有用——H3 是那張榜上唯一的開源權重模型,而且它在榜首。
什麼時候該換別的:Runway Aleph 2.0 在這裡排第六,但它是在你的檔案上做真正的編輯,而且吃得下更長的片子。如果你要的是對一段不能被重畫的素材做一處外科手術式的改動,那就該用它。
H3 橫向比較 把其餘的都走過一遍。
Artificial Analysis · 影片編輯(帶聲音)· 2026-08-14 快照
上傳別人的素材之前
換聲音會讓畫面裡一個真實的人說出他沒說過的話。這是本站風險最高的一個控制項。
- 肖像讓一個真實的人說出他從沒說過的話,可能違法,而且未經本人同意就這麼做也違反我們的條款。
- 聲音音色參考會把某一個特定的人的聲音複製出來。只用你自己的、拿到授權的,或者合成的。
- 著作權上傳你並不擁有的素材或音樂,不會把任何權利轉到輸出上。回去查來源的授權。
- 內容審核MiniMax 會自動篩查送上去的媒體;誤判與漏判都會發生。
- 標示你發到哪裡,就照那裡的標示規則來。
怎麼在 MiniMax H3 上跑影片轉影片
H3 不會編輯你的檔案。它讀一遍,再生成一個新的——所以任務類型必須一開始就宣告清楚。
最多上傳三段來源片段
每段 2 到 15 秒,合計 15 秒。MP4 或 MOV,H.264 或 H.265。
≤3 段,合計 ≤15 秒宣告這次要做什麼
影片編輯、音軌重用、從最後一個影格往下續拍,還是參考生成。挑哪一個,決定模型守住什麼。
四種任務類型決定音軌怎麼辦
整條留下、墊在新對白下面,或者只取動作、讓 H3 重寫一套聲音。
三條音軌走法生成那個新檔案
出片 4 到 15 秒,24 影格每秒,768P 或 2K,配 32 kHz 立體聲。你的來源一個位元組都沒動。
出來的是一個新的 MP4
輸入影片的秒數,照你方案裡和輸出一樣的每秒費率計費。
MiniMax H3 AI 影片轉影片常見問題
把手上的素材換個風格之前,先知道這些
MiniMax H3 AI 影片轉影片是什麼?
它會改我的原始檔案嗎?
我的來源片段最長可以多久?
哪些格式可以用?
我可以守住原來的背景嗎?
我沒傳音訊,聲音為什麼變了?
可以超過 15 秒嗎?
會照我來源的影格率回來嗎?帶聲音嗎?
計費是怎麼算的?
要註冊嗎?有聲音嗎?可以商業使用嗎?
帶一支片子來,看看什麼守得住。
來源影片跑在 MiniMax H3 上,而 H3 是付費的——在 /pricing 解鎖。註冊免費,而且附一支 MiniMax H3 影片,可以花在文字轉影片或圖片轉影片上。
免費註冊 · 送 1 支 MiniMax H3由 MiniMax H3 AI Video Generator 編輯團隊撰寫與維護發布於 最後更新 工具版本 2026.09.4

