同じキャラクターの動画生成

リクエストをまたいであなたのキャラクターを覚えている動画モデルはありません。覚えていると言っているものは、ファイルを預かって返しているだけです。だったら、先に学習させる ID は飛ばしてしまう:静止画も、クリップも、声も、今頼もうとしているカットにそのまま添える。1 リクエストで最大十二ファイルです。
最初の 1 本は無料。カード不要。

次のカットを書く

0 / 7000

This run spends credits — the free clip is 4s · 768P · 16:9.

Sign up free and your first MiniMax H3 clip renders 4s · 768P · 16:9, with sound. A plan raises the ceiling to 15s, 2K and four at a time — the free clip is a size, not a different model.

  • キャラクターには形容詞ではなくファイルを与える — 正面のきれいな静止画 1 枚は、段落ひとつぶんの説明にいつでも勝ちます
  • どのファイルが何のためかを書く:これは顔、これは動き、これは声
  • 動いてはいけない特徴を名指しする — 髪、上着、傷跡。名前のないものは自由に描き替えられます
  • 1 シーンはカットごとに 1 リクエスト。同じ参照素材を毎回入れ直します

カード不要:このページのクリップはすべてアカウントなしで再生でき、無料登録すれば自分のものが 1 本回ります — 4 秒・768P、音声つき、透かしなし。ダウンロードして商用に使えます。

キャラクターの保ち方を四通り、MiniMax 自身が公開している例から。どのカードもプロンプト全文を開きます。

同じキャラクターの AI 動画:台所の流しで男女が食器用洗剤の泡をかけ合う。女性の顔は静止画から、間の取り方は別の参照クリップから

顔は静止画、芝居はクリップ

プロンプトを入れ、配役が出る

左がプロンプト。右が、返ってきたもの。

顔は静止画、芝居はクリップ16:9 · 15 秒 · 参照画像 1 枚 + クリップ 1 本

二つのファイルに、二つの役割。静止画がこれが誰かを言い、クリップがどう動くか、どの速さで、どんな間で、を言います。どちらも相手の仕事をしていません — そしてプロンプトは、動作をひとつも書き出す前に、どのファイルがどの問いに答えるのかを名指しています。

The character's actions, expressions, and performance rhythm in Image 1 strictly reference input Video 1. A boy stands at the sink on the right side of the frame and hands a washed plate to the girl on the left side of the frame, then suddenly turns and flicks dish soap foam with his right hand towards the girl at the left edge of the frame. The girl, startled, immediately counterattacks, and the two begin happily splashing foam at each other and dodging, accompanied by loud laughter.

同じキャラクターの AI 動画:台所の流しで男女が食器用洗剤の泡をかけ合う。女性の顔は静止画から、間の取り方は別の参照クリップから
十五秒のあいだ保たれたキャラクター16:9 · 15 秒 · 参照画像 2 枚

最初の一節を読んでください:画像 2 をキャラクターの固定参照として使う、そのあとに四つの特徴が一つずつ名指されます — 半分結った黒髪、銀の透かし彫りの冠、衣、配色。あのリストが手口のすべてです。名指さなかった特徴は、モデルが自由に描き替えてよい特徴になります。

Use Image 2 as a fixed character reference, maintaining consistency of black half-tied long hair, silver hollow hair crown, dark blue hair ribbon, light layered Hanfu, semi-transparent blue outer robe, dark blue waist seal, silver floral buckle ornament, and long tassels. Use Image 1 as a reference for shot storyboarding and rhythm. The visuals are high-quality 4K 16:9 Guofeng 3D, with a film-grade xianxia texture,热血、庄严、宿命感强. The shots sequentially express the content in the storyboard, ensuring natural camera movement and transitions between each shot, it cannot be like a ppt. Character face reveals can only be close-ups or extreme close-ups, long shots can only be back views, side-back views, or environmental empty shots, no front-facing long shots.

同じキャラクターの AI 動画:白い衣に銀の髪冠の仙侠のヒロインが雪の連続シーンを進む。衣装はカットが変わっても同じまま
主演二人、ティザー 1 本9:16 · 15 秒 · 参照画像 2 枚

キャラクターではなく配役です。このプロンプトは、拍を一つも書く前に両方の主演を参照画像に固定します。二人いるシーンは、それぞれ別々にずれていける二つの同一性だからです — そして動くのは、固定しなかったほうです。

Generate a 15-second, 9:16 vertical overseas real-person vampire romance short drama teaser clip. The appearance of the male and female leads references Image 1, and the scene references Image 2. Maintain the identity consistency of the male and female leads, real-person texture, and high-quality short drama texture. Overall story: The innocent human female lead mistakenly enters the forbidden area of an ancient castle and accidentally awakens the sleeping vampire noble male lead. The male lead discovers that she carries a certain aura related to an ancient war, thus developing a strong desire for control and dangerous interest in her. The female lead is afraid of him but does not completely submit, resisting his oppression. Overall style: Overseas ReelShort / DramaBox vampire romance short drama teaser feel. Dark romance, dangerous attraction, sense of fate, strong sense of control, gloomy oppression, highlight reversal. The visuals are high-end, restrained, and compact, like the hook of a hit short drama's first 15 seconds. No blood, no cheap horror, no Halloween feel, no modern street feel. Aspect ratio: 9:16 vertical composition, suitable for TikTok / ReelShort / DramaBox. Characters are mainly medium close-ups, close-ups, and extreme close-ups; the vertical screen should highlight faces, eyes, sense of oppression, and relationship tension.

同じキャラクターの AI 動画:縦型のヴァンパイア・ロマンスのティザー。玄関、廊下、寄りの二人画のあいだで同じ主演二人を保つ
配役は入れ替え、振付はそのまま16:9 · 6 秒 · 参照クリップ 1 本

ここで保たれている同一性は顔ではありません — 振付です。スーツの男性三人がカピバラ三匹になり、それでも九手の床運動が拍ひとつ残らず生き延びます。間を運んでいるのが文ではなくクリップだからです。

Reference Video 1 for action imitation. Fixed wide-angle shot, replace the three men in suits in the original video with three highly realistic capybaras. The capybaras must strictly follow the original video's motion trajectory: quickly lie down on the floor in sequence, then the leftmost capybara jumps to the middle position, the middle capybara rolls to the far left, then the middle capybara rolls to the far right, the rightmost capybara jumps to the middle, and finally the middle capybara jumps onto the backs of the other two, stacking into a pyramid shape. Maintain the original fixed camera position. Ensure the capybaras' fur texture and lighting integrate with the environment.

同じキャラクターの AI 動画:スーツ姿のカピバラ三匹が複雑な床運動を、参照クリップの男性三人の動きどおりに演じる

これが何で、何ではないか

ここでは何もあなたのキャラクターを覚えていません。 それが問題のすべてで、方法のすべてです。

この節を先に置くのは、そもそもここに来るべきかどうかがここで決まるからです。キャラクターの一貫性を売っている製品はどれも、保存された ID を売っています — Higgsfield は Soul ID を学習させ、Vidu は複数参照のセットを持ち、Runway はセッションを固定します。保存されているのはファイルで、生成のときに起きているのは、そのファイルがあなたのリクエストに添えられることです。
だから問いは、ツールが覚えているかどうかではありません。一度に何ファイル受け取れるのか、そしてそれをどこかに置いておくために何を払っているのか、です。

測定値は誰に対しても厳しく、予算を組む前に知っておく価値があります。Face Consistency Benchmark では、テキストから動画を 1 本生成しただけでも、実写の同じ測定に比べて顔が 2.1〜5.7 倍遠くへずれます — 実写が ArcFace コサイン距離 0.0843 に対し、測定された最良のモデルが 0.1734、最悪が 0.4843。別々の 2 本のあいだになると、易しくなるどころか難しくなります:ContextAnyone の比較で参照条件つきの手法が届くのは、動画間の ArcFace 類似度で 0.54〜0.59 です。
参照の静止画は存在する中で最大のてこであり、錠前ではありません。 買えるのは、見る人が同じ人物だと読む顔が、たいていのテイクで、1 テイクぶんの値段で手に入るということです。

月額、保存された ID に
$15–$129

月額、保存された ID に

他社の 1 回あたり、尺ごと
$0.45–$2.00

他社の 1 回あたり、尺ごと

1 リクエストの画像・クリップ・音声
9 · 3 · 3

1 リクエストの画像・クリップ・音声

ここでの 8 秒のカット、音つき
~$1.52

ここでの 8 秒のカット、音つき

  • 最初のカットの前に学習させる ID なし
  • 家賃を払い続けるキャラクターライブラリなし
  • 別途買うリップシンクの工程なし
  • どのプランでも、説明すべき透かしなし

渡すもの

これが誰かを言う方法は四つ

肝心なのは一点だけ:モデルは全ピクセルを描き直します。顔も含めてです。 参照素材をそのまま貼り込むことはありません。だから以下のファイルの役割はすべて、素材を供給することではなく、描き直しを縛ることです。

  • キャラクターの静止画

    9 枚まで。きれいな正面 1 枚は、悪い角度 3 枚より価値があります — 正面でない参照を入れた場合、同一性のスコアは半分以下に落ちるという測定があります。衣装と小道具は別の画像として足してください。

    いちばん強い信号 · 画像 9 枚まで
  • その人が出ているクリップ

    3 本まで。動画は静止画に運べないものを運びます — 歩き方、間、ためのつくり方、カメラの動線。このページの四例のうち 2 例は、芝居をここから取っています。

    動きとリズム · クリップ 3 本まで
  • その人の声

    音声 3 本まで。同一性は顔であると同じくらい声です。H3 は声質を参照して、あなたの新しいセリフをその声で、映像と同じパスで喋ります。音声は画像かクリップと一緒でなければ渡せません。

    クローンではなく声質 · 音声 3 本まで
  • 説明だけ

    1 カットの中では効き、カットとカットのあいだでは効きません。一度書いてキャラクターを生成し、気に入ったフレームを取っておいて、それ以降すべての参照に使ってください。

    1 カット限り · テキストから動画

四つとも同じモデル、同じ単価で動きます — 768P は 1 秒 8 クレジット、2K は 13、それにクリップごとに 5。参照素材の追加料金はありません。上限と単価のすべてを、最後に変わった日付つきで

最初から最後まで

一人のキャラクターを保つ、四ステップ

順番の重みがこのサイトのどのページより大きいのは、1 カット目で固めなかった配役は、6 カット目では取り返せないからです。

  1. 白い衣の仙侠のキャラクター。これが参照の静止画になるフレーム

    書く前にキャスティングする

    キャラクターになるフレームを選ぶ。キャスティングのつもりで選んでください:きれいな正面 1 枚、斜め 1 枚、衣装、小道具。正面でない入力だけの場合、測定された同一性スコアは半分以下に落ちます — つまり正面は好みではなく、荷重を支えているファイルです。

    画像 9 枚まできれいな正面 1 枚
  2. 台所の二人画。顔は静止画から、間はクリップから来ている

    ファイルごとに、文の中で役割を与える

    H3 は言語モデルでプロンプトを読むので、どのファイルがどの問いに答えるかを伝えられます。画像 1 がキャラクター、動画 1 が動きとリズムは機能する文です。四ファイル添えてシーンを書く、は機能しません。

    ファイルを名指す役割を名指す
  3. 縦型ティザーの主演二人が、カットをまたいで保たれている

    男女の主演の見た目は参照画像に厳密に従うこと… 声は参照音声の声質に従う。

    映像

    配役を次のカットへ持っていく

    リクエストのあいだで覚えられているものは何もありません。2 カット目には 1 カット目と同じ参照素材、そこに — ここが飛ばされがちですが — 1 カット目から取っておいたフレームを足します。直前のカットの出力は、次のカットにとって手に入るいちばん良い参照です。

    毎回添え直すフレームを 1 枚残す
  4. 作画の男性主人公の寄り、仕上がったテイク
    音声トラック · 32 kHzSHOT-01.MP4

    768P で試し、残す 1 本を 2K で仕上げる

    768P は 1 秒 8 クレジット、2K は 13。そして 768P で仕上げたクリップをあとから上げても、最初から 2K で出したのと同じ額です — つまり顔を決めるまでの六テイクが安く済みます。生成に失敗した分は自動で返却されます。

    768P · 1 秒 8 クレジット2K · 1 秒 13 クレジット

四ステップ、インストールなし、カード不要。入力欄を開く

誰も言わないこと

ずれるのはカットの中ではなく、カットとカットのあいだです。 その代金がこれです。

キャラクターの一貫性を売っているページはどこもクリップを 1 本だけ見せますし、1 本の中でならこの問題はほぼ解けています。実際に手元にある仕事は、つないで成立する 6 本です。そしてそれは別の測定 — 1 本の中ではなく、動画と動画のあいだで取った、以下の数字です。

  1. 01本当の数字はカット間のほう

    参照条件つきの手法は、同一人物の動画 2 本のあいだで ArcFace 類似度 0.54〜0.59 です。1 本の中ならもっと上が出ます。予算はテイクではなく、つなぎ目に対して組んでください。

    カット間で 0.54〜0.59

  2. 02正面 1 枚は斜め 3 枚ぶん

    参照画像が正面でないとき、公開されている最強のベースラインでも同一性スコアは 50% 以上落ちます。キャラクターの良いフレームが 1 枚あるなら、送るべきはそれです — しかも毎回送ってください。

    正面でないと 50% 超の低下

  3. 03上限は画像 9・クリップ 3・音声 3

    1 リクエストで合計十二ファイル、そして音声は単独では渡せず、画像か動画と一緒である必要があります。この上限こそ比べる価値のある数字です。このモデルへの入口を提供しているサイトの多くは、自分の上限を公開していません。

    12 ファイル、1 リクエスト

  4. 04変わってはいけないものを名指す

    保っている公開例は、特徴を一つずつ列挙しています — 半分結った髪、銀の冠、上着の色。名指さなかった特徴は、描き直しが解釈し直してよい特徴であり、たいてい 4 カット目でそうなります。

    特徴を、箇条書きで

  5. 051 シーンはカットごとに 1 リクエスト

    H3 が出すのは 4〜15 秒の連続した 1 カットです。6 カットのシーンは 1 回あたり約 $1.52 のリクエスト 6 回と、編集ソフトでのひと作業 — シーン全体でおよそ $9 で、これが ID の月額と天秤にかける数字になります。

    6 カット ≈ $9

出典、確かめられるように:1 本の中でのずれの数字は Face Consistency Benchmark の ArcFace 列(実写 0.0843、測定された最良のモデル 0.1734、最悪 0.4843 — 低いほど良い)。動画間の数字と正面でない場合の低下は ContextAnyoneFaithfulFaces から。どれも MiniMax H3 は測定しておらず、当方でもベンチマークは回していません — 問題の大きさを測るために置いてあるのであって、このモデルを順位づけるためではありません。

キャラクターライブラリではなくこれを選ぶ理由

キャラクターは、顔であると同じくらいです

ショートドラマを編集している人に聞いてみてください。捨てられるテイクの半分は、顔は保ったのに芝居が保たなかったから捨てられています — そしてたいていのツールでは、声は別売りの二つ目の商品で、同期も手作業です。

  • 1 リクエスト、1 パス

    声は顔と一緒に返ってくる

    32 kHz ステレオが映像と並んで生成され、音声は参照素材の一つにできます — つまり添えた声質が、新しいセリフを喋る声質になります。リップシンクの工程も、別立ての音声サブスクもありません。

  • 一度に十二ファイル

    配役ぜんぶが 1 リクエストに収まる

    画像 9・クリップ 3・音声 3 の合計十二。衣装とロケ地のプレートつきの二人芝居はその内側に十分収まります。上のヴァンパイアのティザーが一人ではなく二人を保っているのは、そのためです。

  • 保存されるものはなし

    学習させる ID も、その家賃もなし

    ここには Soul ID もキャラクター枠も ID ごとの料金もありません — ファイルはあなたのディスクにあり、リクエストと一緒に上がります。名簿を作りたいなら不利ですし、キャラクター 1 人とカット 6 本なら有利です。

  • 単価ひとつ、形は六つ

    縦は横と同じ値段

    21:9、16:9、4:3、1:1、3:4、9:16 のすべてが同じ秒単価です。上流が秒で課金していて形を見ていないからです。ショートドラマは縦ですが、そのぶん高くなることはありません。

手放すもの

保証です。これがこのカテゴリ全体の正直な限界です:参照素材があれば、たいていのテイクで顔は同じ人物として読まれます。そしてカット間では、公開されている数字は 1 ではなく 0.55 あたりに座ります。納品物がフレーム単位で正確な顔を要求するなら — 名の知れた俳優、ブランドの顔、権利のある肖像 — その人をキャスティングして撮ってください。その周りのカットのほうを生成しましょう。

繰り返し来る仕事

十五秒を生き延びる、キャラクターの仕事が四つ

四つの別々の仕事、実際にこのやり方で作られたクリップ 4 本、そして各ボタンの向こうにそれを作ったプロンプト。どれもあなた自身のファイルを一つ欲しがります — クリップのバッジがどれかを示し、ボタンが正しい扉を開きます。

  • 同じキャラクターの AI 動画:夏の野原を走る子どもたち。一人がゴールデンレトリバーに置き換わり、上着が一着だけ色を変え、他は手つかず
    16:9 · 6 秒 · 参照画像 2 枚 + クリップ 1 本

    一人だけ替えて、あとはそのまま

    一文で二か所の編集:後ろの子どもが画像 1 の犬になり、いちばん左の上着の色が変わる。画面の他の誰にも言及がなく、他の誰も変わりません。 これは編集者に出すメモの形であり、H3 が読む形でもあります。

  • 同じキャラクターの AI 動画:二人画の左側に、揃いのスーツの人物が足され、他と歩調を合わせて動く
    16:9 · 6 秒 · 参照クリップ 1 本

    そこにいて当然の人を足す

    一行で、新しく来た人が制服も歩き方も光も引き継ぎます。モデルは切り抜きを合成しているのではなく、一人多い状態でカットを描き直しています — 影が正しく落ちる理由であり、元のピクセルが戻ってこない理由でもあります。

  • 同じキャラクターの AI 動画:革ジャンの乙女ゲームの男性主人公が夜の街の PV を進む。どのカットでもデザインは変わらない
    16:9 · 15 秒 · 参照画像 2 枚

    作画キャラクターを、設定画どおりに

    ずれがいちばん目に見えるのは作画です。描かれた顔には写真のような逃げ場がなく、目の間隔が設定画と合っているか、合っていないかのどちらかだからです。画像 2 が同一性の厳密な参照で、プロンプトの残りはカメラと空気感です。

  • 同じキャラクターの AI 動画:小さな飲食店の店内での縦型ショートドラマの口論。同じ二人の演者がやり取りのあいだ保たれる
    9:16 · 15 秒 · 参照画像 2 枚

    配役を固定した縦型シーン

    縦型ショートドラマこそ、このページが存在する理由です:何十カット、同じ二つの顔、縦。十五秒で 1 カット — 配役は次のリクエストに添え直すものであり、つなぐのはあなたの編集ソフトで、ここではありません

四つとも MiniMax 自身が公開している例で、CC BY 4.0 で集めています — だから各ボタンが、実際に回されたとおりのプロンプトを読み込めます。

実際にかかる額

キャラクター 1 人の 6 カットのシーンで 414 クレジット 約 $9。

1 クリップにつき、プロンプト理解のパスとして一律 5 クレジット、それに 768P なら 1 秒 8 クレジット、2K なら 13。参照素材は無料です — 画像を 9 枚つけても、1 枚もつけないのと同じ額です。1 クレジットは MiniMax が自社で公開している定価の 1 セントなので、当サイトが管理していないページと突き合わせて確かめられます。生成に失敗した分は自動で返却されます。 ここではそれがどこよりも効きます:顔を保つのは、やり直す仕事だからです。

キャラクターのカットの費用、尺ごとに

4 秒のカット 1 本、768P
37 クレジット
8 秒のカット 1 本、768P
69 クレジット
15 秒のカット 1 本、768P
125 クレジット
8 秒のカット 6 本、768P
414 クレジット
8 秒のカット 1 本、2K
109 クレジット
8 秒のカット 6 本、2K
654 クレジット

料金の全体 · 上限と単価のすべて、日付つき · 2K の 1 秒が実際にいくらか

毎月のクレジットはどちらでも同じ

  • 無料カード不要

    MiniMax H3 本体の 1 本、音つき。4 秒 · 768P を超えるぶんはクレジット制です。

    $0ずっと

    クレジットカードは一度も要りません

    無料で開始

    ボット確認だけ — メール不要

    MiniMax H3 を 1 本

    MiniMax H3 · 4 秒 · 768P · 16:9 · 音つき
    7 日チェックイン — 37 クレジット、もう 1 本ぶん

    $9.9 からのどのパックでも MiniMax H3 が解放されます — 全モード、768P と 2K

    • ネイティブ 2K の H3有料のみ
    • 映像と一緒のネイティブ音声有料のみ
    • 1 本、カード不要
    • 同時 1 本
    • 失敗した分は無料
    • 非公開で生成
    • どのパックでも全モードで H3 が解放

    無料枠は別のエンジンです。プランを見る

    速度と順番待ち

    順番待ち
    無料レーン
    同時実行
    1
    まとめ生成
    1
    履歴の保存
    24 時間 · ログイン時は 7 日
    サポート
    コミュニティ
  • Lite30% お得

    ネイティブ 2K の MiniMax H3 を解放。いちばん小さい有料プランです — 多くの人が選ぶのは Pro です。

    $16.9/mo$24.9

    年額 $202.8 · 年間 $96 お得

    7 日返金 · いつでも解約

    毎月 750 クレジット · 約 20 本

    4 秒 · 768P · テキストから動画

    4 秒 2K なら約 13 本

    月払いでも年払いでもクレジットは同じ

    • ネイティブ 2K の H3 — ネイティブ音声つき
    • セリフ・効果音・音楽が同じファイルに
    • 最長 15 秒15 秒
    • 4 秒 768P のテキストから動画で毎月約 20 本
    • 失敗した分は無料
    • クレジット未使用なら 7 日返金
    • 同時実行 1 本
    • 1 つのプロンプトから 2 通り

    全プランで商用利用可 — 対象範囲

    速度と順番待ち

    順番待ち
    標準
    同時実行
    1
    まとめ生成
    2
    履歴の保存
    7 日間
    サポート
    メール · 48 時間
  • 多くの人が選ぶ
    Pro30% お得

    Lite より $32 高いだけ。毎月およそ 47 本、同じ MiniMax H3、順番待ちも速い。

    $39.9/mo$56.9

    年額 $478.8 · 年間 $204 お得

    7 日返金 · いつでも解約

    毎月 1,775 クレジット · 約 47 本

    4 秒 · 768P · テキストから動画

    4 秒 2K なら約 31 本

    月払いでも年払いでもクレジットは同じ

    • Lite の全部に加えて
    • 4 秒 768P のテキストから動画で毎月約 47 本
    • 同時 3 本
    • 動画→プロンプト
    • 1 つのプロンプトから 4 通り
    • 履歴は 7 日間保存
    • クレジット未使用なら 7 日返金

    全プランで商用利用可 — 対象範囲

    速度と順番待ち

    順番待ち
    高速
    同時実行
    3
    まとめ生成
    4
    履歴の保存
    7 日間
    サポート
    メール · 12 時間
  • Studio30% お得

    ひと月ぶんの本数、順番待ちの先頭、そして 4 時間以内に人が返します。

    $99.9/mo$142.9

    年額 $1,198.8 · 年間 $516 お得

    7 日返金 · いつでも解約

    毎月 4,425 クレジット · 約 119 本

    4 秒 · 768P · テキストから動画

    4 秒 2K なら約 77 本

    月払いでも年払いでもクレジットは同じ

    • Pro の全部に加えて
    • 4 秒 768P のテキストから動画で毎月約 119 本
    • 同時 8 本
    • 1 つのプロンプトから 4 通り
    • 履歴は 7 日間保存
    • 4 時間以内の優先サポート
    • 当サイトで最も安い消費レート
    • クレジット未使用なら 7 日返金

    全プランで商用利用可 — 対象範囲

    速度と順番待ち

    順番待ち
    優先 — 順番待ちの先頭
    同時実行
    8
    まとめ生成
    4
    履歴の保存
    7 日間
    サポート
    優先 · 4 時間

本当に使えるのか

はい、商用でも — そして肖像の問題はあなたの側です

当サイトで、問題になる権利がこちらのものではない唯一のページです。顔をアップロードするのはロゴをアップロードするのとは違うので、お金を使う前に位置を書いておきます。

  • 商用利用無料の 1 本も同じです。どのプランでも透かしは入らず、クリップごとのロイヤリティも、別途買うライセンスもありません。MiniMax は生成された Outputs に対する権利を主張せず、当サイトも独自の権利を足しません。
  • あなたのものでない顔ここで効いてくるのがこれです。このページのどれも、他人の肖像に対する権利を与えません。写真を持っていたからといって、実在の人物の顔を広告に入れてよいことにはなりません。撮影のときと同じ許諾を取ってください。
  • 自分の出演者同意している人の参照静止画は、あなたのものであり続けます。アップロードはあなたのリクエストを回すために使われ、返ってきたものは放送しても構いません。実写素材に対してするのと同じ権利確認が適用されます。
  • 拒否されるもの残虐な暴力と性的な内容は、1 秒も課金される前に入力の段階で拒否されます。生成した人物を実在の著名人として通そうとする素材も同じです。この確認はプロンプトと、添えたファイルの両方に対して走ります。

責任ある利用の全文

キャスティングの前に

MiniMax H3 でキャラクターを保ってみて分かったこと

モデルカードの読み上げではなく、実際の生成で測ったもの — 参照素材の上限、カットが落ちるべきフレームのグリッド、そして音がどう書かれるか。

お金を使う前に

キャラクターの一貫性についてのよくある質問

キャラクターをシーンに固定する前に聞かれる八つの質問に、その裏の数字つきで答えます。

この同じキャラクターの動画生成は無料ですか?

最初の 1 本は無料で、しかも本物のモデルです — 4 秒・768P・音声つき、透かしなし、カード不要。期限もありません。このページのものはすべてアカウントなしで再生できます。そのあとは 768P の 8 秒のカットで 69 クレジット、15 秒で 125。クレジットは $9.9 からなので、6 カットのシーンで約 $9 です。生成に失敗した分はかかりません。

キャラクターは本当にどのカットでも同じ見た目になりますか?

同じ人物として読まれる、という意味でなら、たいていのテイクではい。フレーム単位で同一、という意味ではいいえ — このカテゴリのどのツールもそれは出せません。公開されている測定では、参照条件つきの同一性類似度は動画 2 本のあいだでおよそ 0.54〜0.59、実写のベースラインはそれよりずっと締まっています。六本のうち四本を残すつもりで、そして毎リクエストで同じ参照素材を添え直すつもりで組んでください。

参照ファイルは何個まで添えられますか?

1 リクエストに 画像 9 枚・動画クリップ 3 本・音声 3 本、合計 12 ファイルまで。音声は単独ではなく、画像かクリップと一緒である必要があります。参照素材を添えることに追加料金はかかりません — 払うのは生成する秒数です。

写真と動画クリップ、キャラクターをよく保つのはどちらですか?

保つものが違います。静止画は顔と衣装にとっていちばん強い信号で、クリップは歩き方、間、カメラを運びます。両方使って、どちらがどちらかをプロンプトで書いてください。ファイルが 1 つしか用意できないなら、きれいな正面の静止画にしてください:正面でない入力では、測定された同一性スコアが半分以下に落ちます。

キャラクターの声も同じにできますか?

できます — 音声を参照として添えれば、H3 はその声質であなたの新しいセリフを喋ります。あとから吹き替えるのではなく、映像と同じパスで生成されます。声質の参照であって、貯めておけるクローン音声ではありません。そして画像かクリップを隣に必要とします。

Soul ID やキャラクターライブラリと何が違いますか?

あちらは ID を保存して、その名簿にサブスクを課金します — 例えば Higgsfield なら月 $15〜$129。ここには保存されるものがありません:ファイルはリクエストごとに上がり、払うのは秒です。キャラクター二十人を管理しているなら不利、一人とカット 6 本なら有利です。

シーン全体を一度に作れますか?

できません。H3 が出すのは 24 fps で 4〜15 秒の整数秒、連続した 1 カットです。だから 1 シーンはカットごとに 1 リクエストで、つなぐのはあなたの編集ソフトです。尺は 17n+5 フレームのグリッドに乗るので、192 フレーム — ちょうど 8.000 秒 — が範囲内で唯一の整数秒であり、カットを音楽に合わせるならこれを使ってください。

他人の顔を参照に使えますか?

その権利がある場合に限ります。ここにあるどれも人物の肖像に対する権利を与えませんし、実在の著名人の生成は入力の段階で拒否されます。自分の出演者については、撮影のときと同じ許諾を取ってください。そうすれば返ってきたものは、無料の 1 本を含むどのプランでも商用に使えます。

キャラクターを説明するのをやめて、キャスティングする。

静止画 1 枚、どのファイルが何のためかを書いた一文、そして九十秒ほどで返ってくる 1 カット。最初の 1 本は無料です — カード不要、透かしなし、商用にも使えます。

無料登録 · MiniMax H3 を 1 本

MiniMax H3 AI Video Generator 編集部が執筆・更新しています公開 最終更新 ツールバージョン 2026.09.4