MiniMax H3 参照素材から動画

MiniMax H3 に画像 9 枚・動画 3 本・声 3 本まで渡すと、あなたのものらしく見えて、あなたのものらしく聞こえる新しい動画を組み立てます。4〜15 秒、768P か 2K。そう言わない限り、参照素材は最初のコマにはなりません。

あなたの素材から組み立てる

1〜12 ファイル · 動画は合計 15 秒以内 · 音声は合計 15 秒以内

0 / 12 ファイル

9 + 3 + 3 は 15。リクエストが受け取るのは 12 です。

まだ何もアップロードされていません。このままだとリクエストは静かにテキストから動画に変わります。右のパックを読み込むと、ラベル付きの一式が見られます。

0 / 7000
無料ログイン · 1 日 3 本

参照素材つきの生成は MiniMax H3 で動きます。無料エンジンは参照動画を受け取れません。自分のプロンプトで H3 を回すなら月 $24.9 からです。

実際のプロンプト 20 本 · 「これで試す」で読み込み

縞のニットを着た金髪の女性。ショールーム広告の 1 枚目の静止画静止画 2 枚 · 9:16 · 768P

静止画 2 枚、4 つの部屋

素材に何が起きるか

参照素材から動画があなたのファイルに実際にすること

素材をアップロードすると、モデルがそれに従うシーンを組み立てます。

MiniMax H3 の参照素材から動画は、画像 9 枚・動画 3 本・音声 3 本、合計 12 ファイルまでを受け取り、それぞれを出発点ではなく制約として扱います。あなたのキャラクターは、行ったことのない場所でも顔をそのまま保ちます。返ってくるのは 768P か 2K で 4〜15 秒、音はすでに MP4 の中です。

画像 · 動画 · 音声
9 + 3 + 3

画像 · 動画 · 音声

1 回のファイル数
12

1 回のファイル数

保持マーカー
8

保持マーカー

768P か 2K
4〜15 秒

768P か 2K

  • 指定しない限り最初のコマにはならない
  • 作風の強さスライダーなし
  • ショットごとの再アップロード不要

ファイルと被写体

ファイルは、被写体ではありません

1 人の役者の写真 4 枚は、4 つの参照ではありません。4 つのファイルで表された 1 人の被写体です。

  • 参照した写真そのものから始まる映像role · frameAnchor
    <Picture 1>フレームアンカーフレームアンカーとして宣言すると、その写真は独立したファイルのまま残り、ショットはそこから始まります。
  • 撮影したことのない場所にいる同じ人物の映像role · character
    <Subject 1>人物として人物として宣言すると、同じ写真が 1 人の人間を表し、モデルはその人を新しい場所に置きます。

MiniMax H3 はこの 2 つの層を分けています。ファイルは `Picture 1`・`Video 1`・`Audio 1` で、アップロード順に番号が付きます。被写体は、それらのファイルが表している人・商品・場所のほうです。ポートレート 4 枚を `Subject 1` にまとめれば、モデルは 1 つの人物像を守ります。まとめないと、似た人が 4 人いると見なされます。顔がぶれる原因はここです。

ほぼ全員がつまずく例外が 1 つ。その画像を実際のコマとして使いたいなら、フレームアンカーに指定してください。被写体に合流せず、`Picture 1` のまま残ります。上の 2 本はどちらも同じ 1 枚の写真から出ています。ショットが必ずあなたの画像から始まってほしいなら 画像から動画 を使ってください。

入れられるもの

参照できるものと、12 ファイルの壁

入れられる素材は 3 種類、それぞれに上限があります。画像 9 枚、動画 3 本、音声 3 本。

9 + 3 + 3 は 15 ですが、リクエストが受け取るのは合計 12 ファイルです。 3 種類すべてを満たすことはできません。何が人物像を担うのか——たいていは画像です——を早めに決めて、残りをその周りに使ってください。

画像
9 枚以内 · 各 30 MB 以内 · JPG · JPEG · PNG · WEBP · HEIC · HEIF
公式
動画
3 本以内 · 50 MB 以内 · 各 2〜15 秒 · 合計 15 秒以内 · MP4 · MOV
公式
音声
3 本以内 · 15 MB 以内 · 各 2〜15 秒 · 合計 15 秒以内 · WAV · MP3
公式
全種類
12 ファイル以内 · リクエスト 64 MB 以内
公式
出力
24 fps で 4〜15 秒 · 768P か 2KMiniMax 自身の API は 4〜15 の整数秒。fal は 5〜15 と記載。オープンウェイト経路の下限は 5 です。
公式

参照する映像は、これから作る動画より長くて構いません。使いたい区間を選んでください。何もアップロードしなければ、リクエストは静かにテキストから動画に変わります。プロンプト欄の上のカウンタが、ファイル数と金額の両方で追いかけます。

保持マーカー

コピーか、移植か、参照か。8 つの保持マーカー

このモードへの不満のほとんどは、この仕組みから来ています。定義したラベルにはそれぞれ行き先があり、それを決めるのはあなたです。MiniMax H3 の参照素材から動画は 2 つの組に分かれた 8 つのマーカーを読み、間違った組から取ってくるとエラーになります。

視覚

目に見えるもの——画像と動画——のための組。

  • fully_preserved

    そのまま残す

    顔、衣装、ボトルのラベル。

    同じ顔、同じコート、新しい街。

  • partially_preserved

    だいたい残す

    同じ被写体のまま、一部の特徴は変わる。

    同じ人物、新しいコート。

  • attribute_transfer

    別の人へ移す

    その特徴を別の誰かに移します。参照した映像の歩き方を、あなたのキャラクターが演じる、といった具合に。

    自社のマスコットが、あのダンサーの歩き方で。

  • weak_reference

    雰囲気だけ借りる

    配色、質感、画づくりの言語。

    あの色味だけ、ほかは要らない。

音声

音のための組。画像のカードにこれが出ていたら不具合です。

  • fully_copy

    トラックをまるごと使う

    元のトラックがそのまま完成品のトラックになります。

    この下地を、そのまま。

  • partially_copy

    1 層だけ使う

    1 つの層だけが残り、新しいセリフの下に混ざります。

    部屋の空気感は残して、声は落とす。

  • reference

    声を合わせ、音は写さない

    音色・リズム・言い回しだけで、信号は写しません。これが声の複製にあたります。

    新しいセリフを、同じ話し手で。

  • weak_reference

    空気感だけ借りる

    全体の空気感だけ、それ以上は何も。

    こういう音がする場所で。

ラベルを付け違えると、結果がコピー機で刷ったようになります。構図に `fully_preserved` を付ければ、モデルはあなたの構図を保ちます。不具合ではなく、従っているだけです。人物像に `fully_preserved`、残りに `weak_reference` を付ければ、シーンは一気に開きます。

各カードで設定すれば、そのままプロンプトに書き込まれます。すでにある映像を作り替えたいのなら、それは 動画から動画 です。

参照のラベル

参照のラベルと、6 項目のプロンプト

構造は好みの問題ではありません。このモデルは決まった順の 6 項目に対して訓練されており、そのうち 2 つは、あなたが素材を持ち込んだからこそ存在します。

  • Field 01subject_definitions

    被写体ごとに 1 行。名前を付け、どのアップロードを指すかを書きます。ここに書いた特徴が、モデルが守る特徴になります。

    <Subject 1> is the woman in <Picture 1> and <Picture 2>, short dark hair, grey wool coat.

  • Field 02retention_analysis

    ラベルごとに 1 行。上のマーカーと、それが出てくるショットを書きます。この項目を省くと、モデルが勝手に決めます。

    <Subject 1>: fully_preserved. <Picture 3>: weak_reference, palette only.

  • Fields 03–06summary · overall_soundscape · non_diegetic_music

    こちらで埋めて畳んであります。参照素材とは関係のない項目で、解説は テキストから動画 のページにあります。

@image1 ではなく Image 1

  • Image 1 · Video 1 · Audio 1MiniMax H3
  • @image1Seedance

これは実際に生成 1 回ぶんの損になります。`@image1` は Seedance の書き方で、いくつかの解説が MiniMax H3 にもそのまま書いていますが、H3 はこれを読みません。素材はアップロード順に番号が付くので、並べ替えれば別のリクエストになります。

ラベルはどの項目でも一字一句同じでなければならず、定義されていないラベルが 1 つあるとリクエストごと失敗します。自分で書きたくない場合は、プロンプト生成 が 1 文から 6 項目すべてを埋めます。

生成する前に

生成する前に見ておく 5 つ

参照モードは、入力側にもお金がかかる唯一のモードです。空振りすると二重に痛みます。生成ボタンの上のパネルが設定を読み、これから何が起きるかを教えます。

  1. 01順番

    アップロードした順に番号が付き、その番号付けもリクエストの一部です。

    順番:Image 1 · Image 2 · Video 1

  2. 02音も一緒に乗ってくる

    参照動画は、切らない限りその映像自身の音も条件になります。アップロードしていない音が出てくるのはこのためです。

    Video 1 は、その映像自身の音も条件になります。

  3. 03音声は切り落とされる

    作る動画が声の参照より短ければ、余った分は捨てられます。長さを合わせるか、参照側を切り詰めてください。

    音声は 12 秒ですが動画は 5 秒です。残りは捨てられます。

  4. 04adaptive は約束ではありません

    素材から画面の形をモデルに選ばせる設定です。縦にしたいなら 9:16 を指定してください。

    adaptive はモデルに選ばせます。参照素材は 16:9 に見えます。

  5. 0512

    あと何ファイル入れられるか。

    12 ファイル中 7 使用。

オープンウェイトを自分で回していますか。いくつかルールが変わります。オープンウェイトの解説 をご覧ください。

料金 · どの有料プランでも 2K · ネイティブ音声

参照素材から動画 1 本にいくらかかるか

参照素材はタダではありませんし、1 つだけ想定外に高いものがあります。画像は最初の 5 枚まで無料、それ以降は 1 枚 4 セント。音声は無料。参照動画はその長さぶんが出力と同じ単価で課金されるので、8 秒 2K の生成に 10 秒の参照動画を付けると、生成そのものより高くつきます。参照する映像は、意図が伝わる最短の区間まで切り詰めてください。MiniMax 自身の API では、768P で試してから上げても得はしません。8 セント+5 セントはちょうど 13 セントです。

1 回の生成で、ここで消費するクレジット

出力 · 8 秒 2K
480 cr
参照画像 · 6 枚(5 枚無料)
1 枚 4¢
参照動画 · 10 秒 2K
その長さぶん課金
参照音声 · 2 本
0 cr
最初の 1 本
無料 · 768P

標準の消費 · 2K は 1 秒 20 cr · クレジット数は各プランに明記 · プラン単価はこれより安い。料金の全体

毎月のクレジットはどちらでも同じ

  • 無料カード不要

    アカウントなしで 1 本、無料エンジンで。MiniMax H3 自体は有料です。

    $0ずっと

    クレジットカードは一度も要りません

    無料で開始

    ボット確認だけ — メール不要

    1 本、アカウント不要

    Agnes Video V2.0 · 16:9 · 5 秒 · 無音
    無料でログイン — Agnes で 1 日 3 本、無音

    $9.9 からのどのパックでも MiniMax H3 が解放されます — 全モード、768P と 2K

    • ネイティブ 2K の H3有料のみ
    • 映像と一緒のネイティブ音声有料のみ
    • 1 本、アカウント不要
    • 同時 1 本
    • 失敗した分は無料
    • 非公開で生成
    • どのパックでも全モードで H3 が解放

    無料枠は別のエンジンです。プランを見る

    速度と順番待ち

    順番待ち
    無料レーン
    同時実行
    1
    まとめ生成
    1
    履歴の保存
    24 時間 · ログイン時は 7 日
    サポート
    コミュニティ
  • Lite50% お得

    ネイティブ 2K の MiniMax H3 を解放。いちばん小さい有料プランです — 多くの人が選ぶのは Pro です。

    $24.9/mo$49.9

    年額 $298.8 · 年間 $300 お得

    7 日返金 · いつでも解約

    毎月 1,290 クレジット · 約 22 本

    4 秒 · 768P · テキストから動画

    4 秒 2K なら約 17 本

    月払いでも年払いでもクレジットは同じ

    • ネイティブ 2K の H3 — ネイティブ音声つき
    • セリフ・効果音・音楽が同じファイルに
    • 最長 15 秒15 秒
    • 4 秒 768P のテキストから動画で毎月約 22 本
    • 失敗した分は無料
    • クレジット未使用なら 7 日返金
    • 同時実行 1 本
    • 1 つのプロンプトから 2 通り

    個人利用・評価目的 — 理由

    速度と順番待ち

    順番待ち
    標準
    同時実行
    1
    まとめ生成
    2
    履歴の保存
    7 日間
    サポート
    メール · 48 時間
  • 多くの人が選ぶ
    Pro50% お得

    Lite より $50 高いだけ。毎月およそ 125 本、同じ MiniMax H3、順番待ちも速い。

    $49.9/mo$99.9

    年額 $598.8 · 年間 $600 お得

    7 日返金 · いつでも解約

    毎月 4,990 クレジット · 約 125 本

    4 秒 · 768P · テキストから動画

    4 秒 2K なら約 84 本

    月払いでも年払いでもクレジットは同じ

    • Lite の全部に加えて
    • 4 秒 768P のテキストから動画で毎月約 125 本
    • 同時 3 本
    • 動画→プロンプト
    • 1 つのプロンプトから 4 通り
    • 履歴は 7 日間保存
    • クレジット未使用なら 7 日返金

    個人利用・評価目的 — 理由

    速度と順番待ち

    順番待ち
    高速
    同時実行
    3
    まとめ生成
    4
    履歴の保存
    7 日間
    サポート
    メール · 12 時間
  • Studio50% お得

    ひと月ぶんの本数、順番待ちの先頭、そして 4 時間以内に人が返します。

    $99.9/mo$199.9

    年額 $1,198.8 · 年間 $1,200 お得

    7 日返金 · いつでも解約

    毎月 12,990 クレジット · 約 325 本

    4 秒 · 768P · テキストから動画

    4 秒 2K なら約 217 本

    月払いでも年払いでもクレジットは同じ

    • Pro の全部に加えて
    • 4 秒 768P のテキストから動画で毎月約 325 本
    • 同時 8 本
    • 1 つのプロンプトから 4 通り
    • 履歴は 7 日間保存
    • 4 時間以内の優先サポート
    • 当サイトで最も安い消費レート
    • クレジット未使用なら 7 日返金

    個人利用・評価目的 — 理由

    速度と順番待ち

    順番待ち
    優先 — 順番待ちの先頭
    同時実行
    8
    まとめ生成
    4
    履歴の保存
    7 日間
    サポート
    優先 · 4 時間

責任ある利用

顔・声・キャラクターの責任ある扱い

法的なリスクが集まるのは参照素材です。

  • 実在の人物が写った映像には本人の同意が要ります。著名人も、他人の写真も同じです。
  • 音色の参照は、特定の人の声の響きを複製します。自分の声か、許諾を得た声か、合成の声を使ってください。
  • キャラクター著作権のあるキャラクターは、モデルが生成し直したからといってあなたのものにはなりません。
  • 未成年未成年が写った参照素材は、絶対にアップロードしないでください。
  • 審査MiniMax は投稿された素材を自動で審査します。誤検知も見落としも起こります。

全文:責任ある利用

手順のすべて

リファレンスから動画で、1 人のキャラクターを保つまで

ファイルをアップロードするのは簡単なほうの半分です。人物像が保たれるかどうかを決めるのはラベル付けです。

  1. 参照素材をアップロードする

    画像 9 枚・動画 3 本・音声 3 本まで。1 リクエストにつき 12 ファイル・64 MB。

    12 ファイル以内、64 MB 以内
  2. 各ファイルが何のためのものかを言う

    被写体、画像、フレームアンカー、声の音色。複数のファイルをまとめて 1 人を表すこともできます。

    役割と被写体のグループ
  3. どこまで残すかを決める

    視覚と音声、2 つの組にまたがる 8 つの保持マーカー。参照ごとに、どこまで忠実に従うかを選べます。

    8 つの保持マーカー
  4. プロンプトを書いて生成する

    24 fps で 4〜15 秒、768P か 2K、32 kHz ステレオ音声が映像と一緒に生成されます。

    参照の順番も効きます

参照画像は 1 リクエストにつき 5 枚まで込みで、それを超える 1 枚ごとに 20 クレジットかかります。

実際によく聞かれること

リファレンスから動画についてよくある質問

10 問 · すべて表示 · 折りたたみなし

リファレンスから動画とは何ですか?

アップロードした素材——画像 9 枚、動画 3 本、音声 3 本、合計 12——に従う新しいシーンを組み立てるものです。1 枚の絵を動かすのとは違います。

参照画像は何枚使えますか。それでもキャラクターがぶれるのはなぜですか?

9 枚です。ぶれるのはたいてい、グループ化していないからです。1 人の写真が複数あるなら、それは複数の参照ではなく 1 つの被写体です。

アップロードしていない音が入っているのはなぜですか?

参照動画は、既定でその映像自身の音も条件になります。カード上で切れば、動きだけを使います。

@image1 は使えますか。参照の順番は効きますか?

使えません。順番は効きます。素材はアップロード順に Image 1・Video 1・Audio 1 となり、その順番もリクエストの一部です。

音声だけを参照にできますか?

ここではできます。音声 1 本だけでも有効なリクエストです。オープンウェイトでは、音声は画像か動画と一緒でなければなりません。

声を複製できますか?

音色の参照を使えば、キャラクターがその声で新しいセリフを喋ります。使う権利のある声だけにしてください。

出力に音は付きますか?

はい。音声の参照を出したかどうかにかかわらず、32 kHz ステレオが映像と一緒に生成されます。

課金はどうなりますか?

出力の秒数に、参照ぶんが加わります。画像は最初の 5 枚を超えると 1 枚 4 セント、参照動画はその長さぶん、音声は無料です。

登録は必要ですか。結果に音は付きますか?

参照動画つきの生成は MiniMax H3 で動きます。ログインは無料で 30 クレジット、そのあと /pricing で H3 を解放してください。無料エンジンで出てくる動画は無音で、H3 は映像と一緒に音を生成します。

動画を商用に使えますか?

当サイトからは使えません。ここで生成したものはすべて、無料枠を含むどのプランでも個人利用・評価目的に限られます。当サイトは独立した第三者のインターフェースであり、出力の商用権をお渡しできる立場にありません。仕事で使う場合は、MiniMax 自身の Hailuo 製品か公式 API で生成してください。どちらにも商用の条件が付いています。これは要約であって、法的助言ではありません。

キャラクターを 1 人持ってきて、確かめてください。

参照動画つきの生成は MiniMax H3 で動きます。ログインは無料で 30 クレジット、そのあと /pricing で H3 を解放してください。

無料で生成 · 順番待ち

MiniMax H3 AI Video Generator 編集部が執筆・更新しています公開 最終更新