MiniMax H3 影片轉提示詞

看一支片子,拿回一段能做出同一類片子的提示詞——三個欄位齊全,順序照 H3 的規矩排。

把一支片子讀回來

你想拿走什麼?

目標長度H3 只出 4–15 秒

不用帳號每週 1 次免費,有帳號 3 次。之後每次 5 點數。

你的片子在你自己的瀏覽器裡讀完,不會上傳。

你的結構化提示詞

  • integrated_multimodal_description分鏡 · 運鏡 · 對白
  • overall_soundscape這個場景自己發出來的聲音
  • non_diegetic_music沒有就寫 None。

拆成欄位,不是一段散文——時間戳記已經重排好了。

拿一支範例片試試: , , ,

複製之前

  • 學風格可以;照搬一部認得出來的作品不行。
  • 真實、認得出來的人,要先拿到本人同意。
  • 寫情緒,不要點某一首歌。
負責任使用

你在本站的第一支片子免費——不用綁卡。

你會拿到什麼

MiniMax H3 影片轉提示詞到底倒推出什麼

給的是一段提示詞,不是一句圖說。

MiniMax H3 影片轉提示詞:一支參考片正在被一個影格一個影格地讀

你的片子

照欄位讀出來,不是一段散文

MiniMax H3 影片轉提示詞會把你的片子看一遍——影格和音訊都看——再寫回一段能做出同一類片子的結構化提示詞:一份帶編號、帶運鏡和時間戳記的分鏡表,場景本身的聲音,還有配樂,裝進 H3 會讀的那三個帶標籤的欄位裡。通用工具回給你的是一段關於畫面的散文。H3 不吃散文,而且你這支片子有一半的內容是聽出來的。貼一條連結或者拖一個檔案進來;每週第一次倒推不用帳號。

通讀遍數
7

通讀遍數

輸出的欄位數
3

輸出的欄位數

讀得了的來源長度
≤ 60 秒

讀得了的來源長度

時間戳記重排到
4–15 秒

時間戳記重排到

  • 不抽關鍵影格
  • 不給一段散文
  • 不用帳號

倒推一支片子的五個理由

大家從一支參考片裡拿走的五樣東西

先說清楚你要哪一樣,才知道哪一遍通讀最要緊、措辭要精確到什麼程度,以及一段寫出來的提示詞是不是根本就不該是答案。

  • 風格

    GRADE
    用影片轉提示詞倒推的——一條夜裡的霓虹街道,讀的是它的調色

    調色、光、質感——東西還沒動之前的那個樣子。

  • 構圖

    FRAME
    影片轉提示詞輸出:一個新聞棚的雙人鏡頭,讀的是它的取景

    取景與走位:東西擺在哪裡,眼睛沿著什麼路線走。

  • 運動

    PATH
    MiniMax H3 影片轉提示詞:一段手持跟拍,穿過街邊小吃攤

    調度與運鏡路徑,寫成類型、幅度、速度三樣。

  • 聲音

    MIX
    用影片轉提示詞倒推的——一個廚房近景,讀的是它的混音

    讓它聽起來很貴的那套混音,分三層寫。

  • 人物

    WHO
    影片轉提示詞輸出:一張人物特寫,唯一一個要先拿到同意的目標

    畫面裡的人是誰——也是唯一一個要先拿到同意的目標。

    肖像界線見下

一支舞蹈片和一支香水廣告可能共用同一套調色,但你倒推它們的理由正好相反——前者要的是運動,後者要的是光。在倒推器裡挑好目標,重點就跟著挪。

方法

從素材到欄位:七遍通讀

這次倒推讀一顆鏡頭的順序,和官方提示詞指南要你寫一顆鏡頭的順序是同一個:構圖、主體、環境、動作、運鏡、聲音——以及每一樣被提到的東西究竟在哪一秒出現。

  1. Pass 01切點

    一共幾顆鏡頭,切在哪裡。

    [Shot n] · At 00:0x.xxx

  2. Pass 02構圖

    景別與機位高度,一顆鏡頭一顆鏡頭讀。

    每一顆鏡頭的開頭

  3. Pass 03主體

    具體到一個陌生人照著能重畫出來——「三十出頭的女子,黑色齊耳短髮,寬大的灰色風衣」,而不是「一個女人」。

    主體描述

  4. Pass 04環境

    地點、天氣,還有光從哪個方向來。H3 把光當成物理量處理,所以「窗光從畫面左側進來」比「光影很美」有用得多。

    環境描述

  5. Pass 05動作

    到底發生了什麼,照先後順序寫。

    動作描述

  6. Pass 06運鏡

    照 H3 執行它的方式寫:類型、幅度、速度。「緩慢推進,小幅度」活得過這一趟;「流暢的電影感運動」活不過——裡面沒有任何可以執行的東西。

    運鏡描述

  7. Pass 07聲音

    下面那三層,也是別的工具全都跳過的那一遍。

    兩個聲音欄位 + 對白

別人跳過的那一遍

你這支片子正在發出的三種聲音

關鍵影格工具抽的是靜止畫面,等於把你的片子靜音之後再分析。

這裡的倒推是真的在聽,而且把聽到的東西分成三份,因為 H3 對每一層的處理位置都不一樣。後兩層怎麼分,只要問一句:片子裡的人聽得見嗎?

  • MiniMax H3 影片轉提示詞:同一顆鏡頭裡兩個人在說話

    對白

    人真正說出口的話,逐句轉寫,帶說話者編號、語氣和語言標記,落在鏡頭描述裡面。

    (S1) says warmly, [English] …
  • 用影片轉提示詞倒推的——一個廚房近景:場景自己發出來的聲音

    環境音

    場景自己產生的一切:雨打在雨棚上、刀落在砧板上、兩條街外的車流——每一個聲源都帶一個距離和一個落點時間。

    overall_soundscape
  • 影片轉提示詞輸出:一張字卡,底下墊著只有觀眾聽得見的配樂

    配樂

    只有觀眾聽得見的那一層:樂器、速度、在哪裡推起來、在哪裡停。片子裡沒有配樂,這一格就寫 None——這本身也是一條 H3 會照辦的指令。

    non_diegetic_music

這一刀切下去,就是為什麼 MiniMax H3 影片轉提示詞的結果末尾會掛著兩個聲音欄位,也是為什麼少了它們的結果等於把這個模型浪費掉一半。

時間軸重排

30 秒的片子塞不進 15 秒的鐘

H3 只出 4 到 15 秒,而你的參考片多半不在這個區間裡。

  • 你的參考片30 秒 —— 掐掉贅句,拍點重新分布

  • H3 出片4–15 秒,24 影格每秒

把它的時間戳記原樣搬過去,會直接違反一條寫明的官方規則——與請求長度矛盾的時間安排會被打回——所以倒推器改成重排。挑一個目標長度,要緊的拍點(切點、動作峰值、聲音事件)會留下並重新分布。或者乾脆從來源裡拖出一段,只取那一段;緊湊的四秒通常比鬆垮的三十秒更好倒推。

測試裡得出兩個可以直接用的數字:一顆有真實動作變化的鏡頭大約要三秒,一顆靜態的情緒鏡頭兩秒就夠——所以八秒裝得下大約兩顆鏡頭,十五秒大約三顆。選段器會把它留下的拍點和丟掉的拍點都標出來,機器的品味你可以一票否決。

影格會在 24 影格每秒下對齊 H3 的 17n+5 格線,而每一個重排過的時間戳記,都會在你複製之前跟你挑的長度核對一遍。

該走哪條路

什麼時候 MiniMax H3 影片轉提示詞是錯的工具

要留住就交檔案,要重做才寫提示詞。

  • 想學它

    這支片子為什麼好看?這一頁

  • 想做一支像它的

    一支帶著它那股勁的新片子這一頁

  • 想留住

    留住原本的取景、光或者配樂參考圖生影片

  • 想改它

    幫真實素材換聲音,或者接著往下拍影片轉影片

  • 傳不上去

    別人的素材,或者不能外傳的內容只有這一頁走得通

提示詞是一段描述,而描述是故意有損的。目標要是搞懂一支片子為什麼好看,或者做一支帶著它那股勁的新片,這份損耗正是重點。目標要是留住原本的取景、打光或者配樂,就別再描述了,直接把片子交給 H3——參考模式保住的是重寫只能逼近的東西;幫真實素材換聲音或者接著往下拍,那是 影片轉影片 的活。

提示詞是唯一那條路的情況只有一種:來源根本傳不上去——別人的素材、不能外傳的內容——因為你自己寫出來的描述歸你,一份拷貝永遠做不到這一點。

界線在哪裡

重現別人的片子:界線畫在哪裡

風格不受保護,某一部具體的作品受保護。

  • 風格看出一支片子吃的是黃昏光加一個緩慢推進,沒問題。
  • 某一部具體作品把一部認得出來的作品一顆鏡頭一顆鏡頭複製出來,不行。
  • 真實的人把一個真實、認得出來的人描述給模型,也不行。
  • 音樂寫情緒和配器;不要去重建某一首具體的歌。
  • 商標與商品不管影片是怎麼做出來的,它們都受保護。你的產出要是會被認成別人的東西,先去問對方。

完整政策:負責任使用

完整流程

怎麼把一支參考片變成 MiniMax H3 提示詞

它讀的是影格和音訊,不是抽出來的關鍵影格——所以聲音才能自己成一組欄位回來。

  1. 貼一條連結,或者上傳一支片子

    60 秒、50 MB 以內。直接連結和檔案一樣好用。

    ≤60 秒,≤50 MB
  2. 讓七遍通讀跑完

    切點、構圖、主體、環境、動作、運鏡和聲音,分開讀。

    七遍通讀
  3. 看分鏡表和那兩個聲音欄位

    對白會帶著說話者編號、語氣和語言標記轉寫回來;環境音與配樂各自獨立。

    官方欄位順序
  4. 把重排好的提示詞拿走

    時間戳記會從你片子的長度重排到 4–15 秒的目標上,所以結果拿去就能跑。

    重排到 4–15 秒

不用帳號每週倒推一次,登入後三次,之後每次 5 點數。

大家真的會問的問題

MiniMax H3 影片轉提示詞常見問題

把一支片子倒推回提示詞之前,先知道這些

MiniMax H3 影片轉提示詞是什麼?

用 MiniMax H3 影片轉提示詞,就是替提示詞做逆向:它把一支參考片看一遍,影格和音訊都看,再回給你一段能做出同一類片子的結構化三欄位提示詞,時間戳記已經重排到 H3 的 4 到 15 秒區間裡。

我會拿回一模一樣的影片嗎?

不會。H3 不開放 seed 讓你重放,而提示詞是一段描述,不是一份錄影。能指望的是同一類鏡頭,不是同一顆鏡頭。

為什麼不用通用的影片轉提示詞工具?

兩個原因。多數工具抽的是關鍵影格,從頭到尾沒聽過這支片子,所以聲音要嘛是編的、要嘛乾脆沒有。而且它們回的是一段散文,H3 要的是三個帶標籤、順序固定的欄位。

我是不是乾脆把這支片子當參考素材用?

如果你想留住它的取景、打光或者配樂——是的。參考模式是保住原物,不是逼近。這一頁管的是學它和重做,不管留住。

我的來源有四十秒,會怎麼樣?

你可以在時間軸上挑一段,也可以讓拍點照比例壓縮。H3 最長到 15 秒,而每一個時間戳記都會照你挑的目標重算一遍。

它會把對白轉寫出來嗎?

會——原話、說話者編號、一條語氣說明和一個語言標記,照 H3 會讀的格式排。有十一種對白語言的支援是穩的。

拿到提示詞之後要做什麼?

哪一個欄位單獨複製都行,或者一鍵把整份送進文字轉影片的生成器。它就是純文字,所以在 MiniMax API、Hailuo 或 ComfyUI 裡一樣能用。

重現別人的影片合法嗎?

學風格一般可以;照搬某一部具體的作品,或者重現一個真人的樣貌,不行。上面那一節把界線畫出來了,完整版在我們的負責任使用頁。

我可以貼什麼、上傳什麼,最長可以多久?

一條指向 MP4 或 MOV 的公開直接連結,或者一個 50 MB、60 秒以內的檔案。超過 15 秒的會出現選段器,因為那是 H3 的上限。

片子裡沒有人說話,還能用嗎?

能。它會把環境音和配樂兩個欄位填上,對白留空——一個欄位裡的沉默本身也是資訊。

它是免費的嗎?

每週都有一份免費額度:不用帳號 1 次,登入之後 3 次。超出之後每次 5 點數,大約是生成一支影片的十三分之一,因為讀一支片子比做一支片子便宜太多。不管哪一種,速率限制對每個人都在。

可以反過來嗎——從想法出提示詞?

那是提示詞產生器,這個工具的鏡像。手上只有想法沒有素材,去那邊寫;手上有素材寫不出話,在這邊倒推。

把片子貼進來,讀回一段提示詞。

不用帳號每週免費倒推一次,而你複製走的東西歸你。

免費註冊 · 送 1 支 MiniMax H3

MiniMax H3 AI Video Generator 編輯團隊撰寫與維護發布於 最後更新 工具版本 2026.09.4