MiniMax H3 Referenz zu Video

Gib MiniMax H3 bis zu neun Bilder, drei Clips und drei Stimmen, und es baut ein neues Video, das immer noch aussieht und klingt wie deins — 4 bis 15 Sekunden, 768P oder 2K. Deine Referenz ist nicht der erste Frame, es sei denn, du sagst es.

Aus deinem Material bauen

1–12 Dateien hochladen · Video ≤15 s gesamt · Audio ≤15 s gesamt

0 / 12 Dateien

9 + 3 + 3 sind 15. Die Anfrage nimmt 12.

Noch nichts hochgeladen — die Anfrage wird stillschweigend zu Text zu Video. Lade rechts ein Paket, um ein beschriftetes Set zu sehen.

0 / 7000

Referenzclips laufen auf MiniMax H3. Der kostenlose Clip nimmt kein Referenzvideo an. H3 auf deinem eigenen Prompt beginnt bei $9.9 im Monat.

20 echte Prompts · Drück auf Ausprobieren, um einen zu laden

MiniMax H3 Referenz zu Video: eine blonde Frau in einem gestreiften Strick, das erste von zwei Bildern für einen Showroom-Spot2 BILDER · 9:16 · 768P

Zwei Bilder, vier Räume

Was mit deinen Dateien passiert

Was MiniMax H3 Referenz zu Video wirklich mit deinen Dateien macht

Du lädst Material hoch, und das Modell baut eine Szene, die ihm folgt.

MiniMax H3 Referenz zu Video nimmt bis zu neun Bilder, drei Videoclips und drei Audioclips — zwölf Dateien insgesamt — und behandelt jede als Einschränkung statt als Startpunkt. Deine Figur behält ihr Gesicht an einem Ort, an dem sie nie war. Zurück kommen 4 bis 15 Sekunden in 768P oder 2K, der Ton schon in der MP4.

Bilder · Clips · Audio
9 + 3 + 3

Bilder · Clips · Audio

Dateien je Anfrage
12

Dateien je Anfrage

Retention-Marker
8

Retention-Marker

768P oder 2K
4–15 s

768P oder 2K

  • Kein erster Frame, außer du willst es
  • Kein Regler für Stilstärke
  • Kein Neu-Hochladen je Einstellung

Dateien vs. Motive

Deine Dateien sind nicht deine Motive

Vier Fotos einer Darstellerin sind nicht vier Referenzen. Sie sind ein Motiv, beschrieben durch vier Dateien.

  • Ausgabe von Referenz zu Video: ein Clip, der auf dem Referenzfoto selbst aufmachtrole · frameAnchor
    <Picture 1>Frame-AnkerAls Frame-Anker deklariert, bleibt das Foto seine eigene Datei, und die Einstellung macht damit auf.
  • MiniMax H3 Referenz zu Video: ein Clip derselben Person in einer Szene, in der sie nie fotografiert wurderole · character
    <Subject 1>IdentitätAls Identität deklariert, beschreibt dasselbe Foto eine Person, die das Modell dann woanders hinsetzt.

MiniMax H3 hält diese Ebenen auseinander. Eine Datei ist `Picture 1`, `Video 1` oder `Audio 1`, in der Reihenfolge des Hochladens nummeriert; ein Motiv ist die Person, das Produkt oder der Ort, den diese Dateien beschreiben. Gruppier vier Porträts zu `Subject 1`, und das Modell verteidigt eine Identität. Lass sie ungruppiert, und es sieht vier Doppelgänger — daher kommen driftende Gesichter.

Eine Ausnahme erwischt fast jeden. Soll ein Bild ein echter Frame sein, markier es als Frame-Anker, und es bleibt sein eigenes `Picture 1`, statt einem Motiv beizutreten. Beide Clips oben kamen aus einem Foto. Muss die Einstellung mit deinem Bild beginnen, nimm Bild zu Video.

Was reingeht

Was du referenzieren kannst, und die 12-Dateien-Wand

Drei Arten Material gehen hinein: neun Bilder, drei Videoclips und drei Audioclips.

Neun plus drei plus drei sind fünfzehn, aber die Anfrage nimmt zwölf Dateien insgesamt. Du kannst nicht alle drei ausschöpfen. Entscheide früh, was die Identität trägt — meist die Bilder — und gib den Rest drumherum aus.

Bilder
≤ 9 · je ≤ 30 MB · JPG · JPEG · PNG · WEBP · HEIC · HEIF
Offiziell
Videoclips
≤ 3 · ≤ 50 MB · je 2–15 s · ≤ 15 s gesamt · MP4 · MOV
Offiziell
Audioclips
≤ 3 · ≤ 15 MB · je 2–15 s · ≤ 15 s gesamt · WAV · MP3
Offiziell
Alle Typen
≤ 12 Dateien · Anfrage ≤ 64 MB
Offiziell
Ausgabe
4–15 s bei 24 fps · 768P oder 2KDie eigene API von MiniMax nimmt 4–15 ganze Sekunden. fal listet 5–15. Der Weg über die Open Weights fängt bei 5 an.
Offiziell

Ein Referenzclip darf länger sein als das Video, das du machst, wähl also den Abschnitt, den du willst. Lade nichts hoch, und die Anfrage wird stillschweigend zu Text zu Video. Der Zähler über dem Prompt-Feld verfolgt das in Dateien und in Geld.

Retention-Marker

Kopieren, übertragen oder referenzieren? Die acht Retention-Marker

Hier steht der Mechanismus hinter fast jeder Beschwerde über diesen Modus. Jedes Label, das du definierst, bekommt ein Schicksal, und du erklärst es. MiniMax H3 Referenz zu Video liest acht Marker in zwei Sätzen, und in den falschen Satz zu greifen ist ein Fehler.

Visuell

Für alles Sichtbare — Bilder und Video.

  • fully_preserved

    Genau behalten

    Gesichter, Kostüm, das Etikett auf einer Flasche.

    Gleiches Gesicht, gleicher Mantel, neue Stadt.

  • partially_preserved

    Das meiste behalten

    Immer noch dieses Motiv, einige Merkmale geändert.

    Gleiche Person, neuer Mantel.

  • attribute_transfer

    Auf jemand anderen übertragen

    Übertrag das Merkmal auf jemand anderen: ein Gang aus deinem Referenzclip, ausgeführt von deiner Figur.

    Dein Maskottchen, der Gang dieser Tänzerin.

  • weak_reference

    Nur das Gefühl leihen

    Palette, Textur, Bildsprache.

    Diese Farbe, sonst nichts.

Audio

Für Ton. Eine Bildkarte, die einen davon anbietet, ist ein Fehler.

  • fully_copy

    Ganze Spur nehmen

    Die Quellspur wird ganz zur fertigen Spur.

    Dein Bett, unverändert.

  • partially_copy

    Eine Schicht davon

    Eine Schicht überlebt, unter neuen Dialog gemischt.

    Raumton behalten, Stimme weg.

  • reference

    Stimme treffen, nichts kopieren

    Klangfarbe, Rhythmus und Vortrag, kein Signal kopiert. Dieser hier klont eine Stimme.

    Neue Zeilen, gleicher Sprecher.

  • weak_reference

    Nur die Atmosphäre leihen

    Die allgemeine Atmosphäre, mehr nicht.

    Irgendwo, das so klingt.

Falsch beschriften ist der Grund, warum Ergebnisse wie eine Fotokopie zurückkommen. Markier den Bildaufbau als `fully_preserved`, und das Modell bewahrt deinen Bildaufbau — Gehorsam, kein Fehler. Markier die Identität als `fully_preserved` und den Rest als `weak_reference`, und die Szene macht auf.

Setz es auf jeder Karte, und es schreibt sich in deinen Prompt. Willst du einen Clip umstilisieren, den du schon hast? Das ist Video zu Video.

Referenzlabels

Referenzlabels und der Sechsfeld-Prompt für MiniMax H3 Referenz zu Video

Struktur ist keine Stilfrage. Das Modell wurde gegen sechs Felder in fester Reihenfolge trainiert, und zwei davon gibt es nur, weil du Material mitgebracht hast.

  • Field 01subject_definitions

    Eine Zeile je Motiv, die es benennt und seine Uploads zitiert. Die Merkmale, die du aufschreibst, sind die, die das Modell verteidigt.

    <Subject 1> is the woman in <Picture 1> and <Picture 2>, short dark hair, grey wool coat.

  • Field 02retention_analysis

    Eine Zeile je Label, mit den Markern oben und den Einstellungen, in denen es vorkommt. Lass das Feld weg, und das Modell entscheidet für dich.

    <Subject 1>: fully_preserved. <Picture 3>: weak_reference, palette only.

  • Fields 03–06summary · overall_soundscape · non_diegetic_music

    Werden für dich gefüllt und eingeklappt. Sie haben nichts mit deinen Referenzen zu tun — erklärt werden sie auf der Seite Text zu Video.

Image 1 schreiben, nicht @image1

  • Image 1 · Video 1 · Audio 1MiniMax H3
  • @image1Seedance

Das hier kostet echte Generierungen. `@image1` ist Seedance-Syntax; mehrere Anleitungen wiederholen sie für MiniMax H3, das sie nicht liest. Assets werden in der Reihenfolge des Hochladens nummeriert — sortier sie um, und du hast eine andere Anfrage gestellt.

Labels müssen in jedem Feld gleich lauten, und ein undefiniertes lässt die Anfrage scheitern. Willst du das lieber nicht schreiben? Der Prompt-Generator füllt alle sechs aus einem Satz.

Vor dem Generieren

Fünf Dinge, die du vor dem Generieren prüfen solltest

Der Referenzmodus ist der einzige, in dem auch deine Eingaben Geld kosten, ein verschwendeter Lauf tut also doppelt weh. Das Feld über dem Generieren-Knopf liest dein Setup und sagt, was passieren wird.

  1. 01Reihenfolge

    Deine Uploads werden so nummeriert, wie du sie abgelegt hast, und die Nummerierung ist Teil der Anfrage.

    Reihenfolge: Image 1 · Image 2 · Video 1

  2. 02Tonspuren fahren mit

    Ein Referenzvideo wird auf seinen eigenen Ton konditioniert, solange du das nicht abschaltest — und deshalb taucht Ton auf, den du nie hochgeladen hast.

    Video 1 wird auch auf seine eigene Tonspur konditioniert.

  3. 03Ton wird abgeschnitten

    Ist dein Clip kürzer als deine Stimmreferenz, wird der Rest verworfen. Pass die Länge an oder kürz die Referenz.

    Der Ton läuft 12 s, dein Clip 5 s — der Rest fällt weg.

  4. 04Adaptive ist kein Versprechen

    Es lässt das Modell eine Form aus deinem Material wählen. Du willst hochkant? Verlang 9:16.

    Adaptive lässt das Modell wählen. Deine Referenzen sehen nach 16:9 aus.

  5. 05Zwölf

    Wie viele Dateien dir noch bleiben.

    7 von 12 Dateien belegt.

Fährst du die Open Weights selbst? Dann ändern sich einige Regeln — siehe den Leitfaden zu den Open Weights.

Preise · 2K in jedem bezahlten Tarif · Nativer Ton

Was ein Clip aus MiniMax H3 Referenz zu Video kostet

Referenzen sind nicht gratis, und eine ist auf eine Art teuer, mit der Leute nicht rechnen. Deine ersten fünf Bilder kosten nichts, danach vier Cent je Stück. Audio kostet nichts. Ein Referenzvideo wird nach seiner eigenen Länge zu deinem Ausgabesatz berechnet: zehn Sekunden Referenz auf einer Generierung von acht Sekunden in 2K kosten mehr als die Generierung. Kürz Referenzclips auf die kürzeste Spanne, die zeigt, was du meinst. Auf der eigenen API von MiniMax spart es auch nichts, in 768P zu entwerfen und später hochzustufen — acht Cent plus fünf sind genau dreizehn.

Ein Lauf, in den Credits, die du hier ausgibst

Ausgabe · 8 s in 2K
480 Cr
Referenzbilder · 6 (5 gratis)
je 4 ¢
Referenzvideo · 10 s in 2K
nach eigener Länge berechnet
Referenzton · 2 Clips
0 Cr
Dein erster Clip
gratis · 768P

Verbrauch · 2K 8 Cr/s, 768P 4 · in jedem Tarif gleich · Credits stehen auf jedem Alle Preise

So oder so dieselben Credits im Monat

  • KostenlosOhne Karte

    Ein echter MiniMax-H3-Clip, mit Ton. Alles nach 4 s · 768P läuft auf Credits.

    $0für immer

    Zu keinem Zeitpunkt eine Kreditkarte

    Gratis los

    Nur Bot-Prüfung — keine E-Mail

    1 Clip auf MiniMax H3

    MiniMax H3 · 4 s · 768P · 16:9 · mit Ton
    7 Tage einchecken — 37 Credits, ein Clip mehr

    Jedes Paket ab $9.9 schaltet den MiniMax H3 KI-Videogenerator frei — jeder Modus, 768P und 2K

    • MiniMax H3 in nativem 2KNur bezahlt
    • Nativer Ton mit dem BildNur bezahlt
    • Ein Clip, ohne Karte
    • 1 Aufgabe gleichzeitig
    • Gescheiterte Clips kosten nichts
    • Private Generierung
    • Jedes Paket schaltet den MiniMax H3 KI-Videogenerator in jedem Modus frei

    Gratis ist eine andere Engine. Tarife ansehen

    Tempo & Queue

    Queue
    Gratis-Spur
    Gleichzeitig
    1
    Batch
    1
    Historie
    24 h · 7 Tage angemeldet
    Support
    Community
  • Lite30 % sparen

    Schalt den MiniMax H3 KI-Videogenerator in nativem 2K frei. Der kleinste bezahlte Tarif — Pro nehmen die meisten.

    $16.9/mo$24.9

    $202.8 jährlich abgerechnet · $96 im Jahr sparen

    7 Tage Rückerstattung · jederzeit kündbar

    750 Credits / Monat · ~20 Videos

    4 s · 768P · Text zu Video

    oder ~13 mit 4 s 2K

    Gleiche Credits, monatlich wie jährlich

    • MiniMax H3 in nativem 2K — mit nativem Ton
    • Dialog, Effekte und Musik in derselben Datei
    • Bis 15 Sekunden15 s
    • ~20 Videos im Monat mit 4 s 768P, Text zu Video
    • Gescheiterte Clips kosten nichts
    • 7 Tage Rückerstattung bei ungenutzten Credits
    • 1 Aufgabe gleichzeitig
    • 2 Varianten eines Prompts im Batch

    Kommerzielle Nutzung enthalten — was das abdeckt

    Tempo & Queue

    Queue
    Standard
    Gleichzeitig
    1
    Batch
    2
    Historie
    7 Tage
    Support
    E-Mail · 48 h
  • Für die meisten empfohlen
    Pro30 % sparen

    $32 mehr als Lite. ~47 Videos im Monat, derselbe MiniMax H3 KI-Videogenerator, schnellere Warteschlange.

    $39.9/mo$56.9

    $478.8 jährlich abgerechnet · $204 im Jahr sparen

    7 Tage Rückerstattung · jederzeit kündbar

    1.775 Credits / Monat · ~47 Videos

    4 s · 768P · Text zu Video

    oder ~31 mit 4 s 2K

    Gleiche Credits, monatlich wie jährlich

    • Alles aus Lite
    • ~47 Videos im Monat mit 4 s 768P, Text zu Video
    • 3 gleichzeitig
    • Video zu Prompt
    • 4 Varianten eines Prompts im Batch
    • Historie 7 Tage
    • 7 Tage Rückerstattung bei ungenutzten Credits

    Kommerzielle Nutzung enthalten — was das abdeckt

    Tempo & Queue

    Queue
    Schnell
    Gleichzeitig
    3
    Batch
    4
    Historie
    7 Tage
    Support
    E-Mail · 12 h
  • Studio30 % sparen

    Ein ganzer Monat Volumen, als Erster in der Reihe, und ein Mensch, der in 4 Stunden antwortet.

    $99.9/mo$142.9

    $1 198.8 jährlich abgerechnet · $516 im Jahr sparen

    7 Tage Rückerstattung · jederzeit kündbar

    4.425 Credits / Monat · ~119 Videos

    4 s · 768P · Text zu Video

    oder ~77 mit 4 s 2K

    Gleiche Credits, monatlich wie jährlich

    • Alles aus Pro
    • ~119 Videos im Monat mit 4 s 768P, Text zu Video
    • 8 gleichzeitig
    • 4 Varianten eines Prompts im Batch
    • Historie 7 Tage
    • Priorisierter Support in 4 Stunden
    • Niedrigster Verbrauch bei uns
    • 7 Tage Rückerstattung bei ungenutzten Credits

    Kommerzielle Nutzung enthalten — was das abdeckt

    Tempo & Queue

    Queue
    Priorität — als Erster in der Reihe
    Gleichzeitig
    8
    Batch
    4
    Historie
    7 Tage
    Support
    Priorität · 4 h

Verantwortungsvoll

Verantwortungsvoller Umgang mit Gesichtern, Stimmen und Figuren

Im Referenzmaterial sitzt das rechtliche Risiko.

  • GesichterVideo einer realen Person braucht deren Einwilligung — keine Personen des öffentlichen Lebens, kein fremdes Foto.
  • StimmenEine Klangreferenz klont, wie eine bestimmte Person klingt. Nimm deine eigene, eine lizenzierte oder eine synthetische.
  • FigurenEine urheberrechtlich geschützte Figur wird nicht deine, weil ein Modell sie neu generiert hat.
  • KinderLade nie Referenzen hoch, die Minderjährige zeigen.
  • PrüfungMiniMax prüft eingereichte Medien automatisch; Fehlalarme und Durchrutscher kommen vor.

Regeln: Verantwortungsvolle Nutzung

Das ganze Verfahren

So hältst du eine Figur über mehrere Clips mit Referenz zu Video

Die Dateien hochzuladen ist die leichte Hälfte. Ob die Identität überlebt, entscheidet die Beschriftung.

  1. Deine Referenzen hochladen

    Bis zu neun Bilder, drei Videoclips und drei Audioclips — zwölf Dateien und 64 MB je Anfrage.

    ≤12 Dateien, ≤64 MB
  2. Sagen, wofür jede Datei da ist

    Motiv, Bild, Frame-Anker oder Stimmklang. Mehrere Dateien dürfen eine Identität beschreiben, wenn du sie gruppierst.

    Rollen und Motivgruppen
  3. Festlegen, wie viel davon überleben soll

    Acht Retention-Marker in zwei Sätzen, visuell und akustisch, du wählst also je Referenz, wie wörtlich ihr gefolgt wird.

    8 Retention-Marker
  4. Den Prompt schreiben und generieren

    4 bis 15 Sekunden bei 24 fps, 768P oder 2K, mit 32 kHz Stereo, das neben dem Bild entsteht.

    Die Reihenfolge der Referenzen zählt

Fünf Referenzbilder sind je Anfrage enthalten; jedes weitere Bild kostet 2 Credits.

Fragen, die wirklich gestellt werden

FAQ zu MiniMax H3 Referenz zu Video

Was du wissen solltest, bevor du ein Gesicht über mehrere Einstellungen fixierst

Was ist MiniMax H3 Referenz zu Video?

Mit MiniMax H3 Referenz zu Video baut das Modell eine neue Szene, die dem Material folgt, das du hochlädst — neun Bilder, drei Clips, drei Audiodateien, zwölf insgesamt — statt ein Bild zu animieren.

Wie viele Referenzbilder kann ich nehmen, und warum ist meine Figur trotzdem gedriftet?

Neun. Drift heißt meistens, dass sie nie gruppiert wurden: mehrere Fotos einer Person sind ein Motiv, nicht mehrere Referenzen.

Warum hat mein Clip Ton, den ich nie hochgeladen habe?

Ein Referenzvideo wird standardmäßig auf seine eigene Tonspur konditioniert. Schalt das auf der Karte ab, und es nutzt allein die Bewegung.

Funktioniert @image1, und zählt die Reihenfolge der Referenzen?

Nein, und ja. Assets heißen Image 1, Video 1 und Audio 1 in der Reihenfolge des Hochladens, und diese Reihenfolge ist Teil der Anfrage.

Kann Audio meine einzige Referenz sein?

Hier ja — ein Audioclip ist eine gültige Anfrage. Bei den Open Weights muss Audio mit einem Bild oder Video reisen.

Kann ich eine Stimme klonen?

Eine Klangreferenz lässt eine Figur neue Zeilen in dieser Stimme sprechen. Nimm nur Stimmen, die du nehmen darfst.

Hat die Ausgabe Ton?

Ja, 32 kHz Stereo, zusammen mit dem Bild generiert, ob du eine Tonreferenz mitgegeben hast oder nicht.

Wie wird abgerechnet?

Nach Ausgabesekunde, dazu die Referenzen: Bilder ab dem sechsten kosten vier Cent je Stück, Referenzvideo nach eigener Länge, Audio gratis.

Muss ich mich registrieren, und hat das Ergebnis Ton?

Referenzvideo läuft auf MiniMax H3, und das ist kostenpflichtig — freischalten kannst du es unter /pricing. Die Anmeldung ist kostenlos und enthält einen MiniMax-H3-Clip, den du auf Text zu Video oder Bild zu Video ausgeben kannst. Dieser kostenlose Clip ist ebenfalls H3, er kommt also mit Ton — eine stumme Stufe gibt es hier nicht.

Darf ich die Videos kommerziell nutzen?

Ja, in jedem Tarif, den kostenlosen eingeschlossen. Clips hier entstehen über die API von MiniMax, und MiniMax beansprucht keine Rechte an den Outputs, die du generierst — diese Seite gibt das weiter: kein Wasserzeichen in irgendeinem Tarif, keine Gebühr je Clip, keine gesondert zu kaufende Lizenz. Die Prompts, die du schreibst, gehören ebenfalls dir und laufen überall. Was diese Seite nicht kann, ist für MiniMax sprechen — sie ist eine unabhängige Oberfläche von Drittanbietern, die Modelllizenz selbst zu erklären ist Sache von MiniMax. Eine Zusammenfassung, keine Rechtsberatung.

Bring eine Figur mit und finde es heraus.

Referenzvideo läuft auf MiniMax H3, und das ist kostenpflichtig — freischalten kannst du es unter /pricing. Die Anmeldung ist kostenlos und enthält einen MiniMax-H3-Clip auf Text zu Video oder Bild zu Video.

Gratis registrieren · 1 Clip auf MiniMax H3

Geschrieben und gepflegt vom Redaktionsteam von MiniMax H3 AI Video GeneratorVeröffentlicht am Zuletzt aktualisiert am Tool-Version 2026.09.4