MiniMax H3-Prompts als kompakte Regieanweisungen für einzelne Aufnahmen schreiben
Ein guter MiniMax H3-Prompt ist mehr als eine Sammlung von Moodboard-Begriffen. Definiere ein klares Motiv, einen verständlichen Schauplatz, eine gezielte Bewegung, die Kameraführung, optional eine Klangidee und einen Abschluss. Entferne anschließend alles, was von der Haupthandlung ablenkt.
Ordne deine Entscheidungen in der Reihenfolge der Wiedergabe. Eine dominante Bewegung und eine klare Kameraführung vermitteln meist mehr als zahlreiche widersprüchliche Anweisungen.
Motiv
Wer oder was zählt
Szene
Wo die Aufnahme spielt
Bewegung
Was sich über Zeit verändert
Kamera + Ende
Wie die Aufnahme gezeigt und abgeschlossen wird
T2VA
Textgesteuerte Szenenerfindung
I2VA
Bewegung ab dem Anfangsbild
FL2V
Anfang → Ende
R2VA
Omni-Referenzen
Prompt-Limit
7.000 Zeichen
Dauer
4–15 Sekunden
Kurzfassung
Ein starker MiniMax H3-Prompt folgt einer Zeitleiste statt einer Schlagwortliste
MiniMax H3 kann eine vollständige Szene erzeugen, ein festgelegtes Bild animieren, Anfangs- und Endbilder verbinden oder Omni-Referenzen folgen. Am zuverlässigsten steuerst du diese Möglichkeiten mit einer kurzen Regieanweisung in Wiedergabereihenfolge: Szene, Motiv, Handlung, Kamera, Klangidee und Ende.
01
Abspielreihenfolge schlägt Schlagwortwolken
Wenn das Modell zwischen fünf visuellen Stilen und drei Kamerabewegungen wählen muss, verliert die Aufnahme meist an Klarheit. Ordne die Entscheidungen in der Reihenfolge, in der das Publikum sie sehen soll.
02
Modus zuerst, Adjektive danach
Im reinen Textmodus erzeugt H3 die gesamte Welt. Mit einem Anfangsbild setzt es eine vorhandene Welt in Bewegung. Im Referenzmodus übernimmt es gezielt Merkmale. Schreibe passend zur gewählten Aufgabe.
Vorlagen
Mit der passenden MiniMax H3-Vorlage beginnen und alles Unnötige entfernen
Der Inhalt kann ähnlich aussehen, aber der Auftrag ist anders. Wähle den Modus, bevor du die Sprache verfeinerst.
Text zu Video · t2va
Vorlage für den Szenenaufbau
Verwende dies, wenn MiniMax H3 Motiv, Umgebung und Eröffnungskomposition aus Text erfinden soll. Das Seitenverhältnis ist im reinen Textmodus erforderlich.
T2VA-Template
[Dauer und Seitenverhältnis-Intention]. [Motiv und bestimmendes Erscheinungsbild] in [konkreter Szene und Zeitpunkt]. [Primäre Aktion oder Veränderung über den Clip]. [Kamerapfad und Framing-Entwicklung]. [Licht, Farbpalette, Material, Atmosphäre]. [Optionaler Dialog oder Klangintention]. Ende auf [finaler Komposition oder emotionalem Beat].
Bild zu Video · i2va
Vorlage für die Bewegung
Verwende dies, wenn das Erstbild bereits Identität, Komposition und initiale Ästhetik festlegt.
I2VA-Template
[Das im Bild sichtbare Hauptmotiv] [führt eine klare Aktion aus]. [Umgebung oder sekundäre Elemente verändern sich]. [Kamerapfad] unter Beibehaltung des bestimmenden Erscheinungsbilds des Motivs und des ursprünglichen visuellen Stils. Optionaler Klang: [Stimme/Ambience-Hinweis]. Ende mit [finaler Pose oder Framing].
Anfangs- und Endbild · FL2V
Vorlage für den Übergang
Beschreibe, wie das festgelegte Anfangsbild in das Endbild übergeht, statt beide Bilder getrennt neu zu beschreiben.
FL2V-Template
Ausgehend vom Erstbild [Motivhandlung und Umgebungsübergang]. [Kamerabewegung und Timing]. Beibehaltung von [Identität, Objekt oder Stilvorgaben], während sich die Komposition natürlich in das vorgegebene Letztbild entwickelt.
Omni-Referenz · r2va
Vorlage für die Referenzzuordnung
Ordne jede Referenz zu, bevor du Stiladjektive wiederholst. Mische keine Referenzrollen mit Erst-/Letztbild-Rollen.
R2VA-Template
Referenzbild(er) verwenden für [Figur / Produkt / Stil]. Referenzvideo verwenden für [Bewegung / Kamera / Rhythmus]. Referenzaudio verwenden für [Stimmtimbre / Ausdrucksweise], falls vorhanden. Eine [Dauer]-Aufnahme in [Szene] erstellen. Motivhandlung: [eine lesbare Aktion]. Kamera: [Pfad]. Referenzierte Identität konsistent halten. Ende auf [finalem Beat].
Prompt-Formel
Die MiniMax H3-Regieanweisung aus sechs Entscheidungen aufbauen
Füge Details nur hinzu, wenn sie die Kontrolle verbessern. Jedes weitere Adjektiv konkurriert um Aufmerksamkeit mit der Bewegung.
01
Motiv
Benenne die Hauptperson, das Produkt, die Kreatur oder die Form. Füge Erscheinungsdetails nur hinzu, wenn sie die Wiedererkennung beeinflussen.
02
Szenenraum
Platziere das Motiv in einer konkreten Umgebung: Nachtstraße, Studio, Waldrand, Brückeninneres, stilisierte Welt.
03
Bewegung oder Veränderung
Beschreibe die Aktion und wie sich die Szene entwickelt. Video braucht eine Veränderung über Zeit, keine Liste statischer visueller Tags.
04
Kamerapfad
Wähle Bildausschnitt und Kamerabewegung: statisch, Truck, Push, Pull, Aufwärtsfahrt, Schwenk, Orbit oder eine zurückhaltende Abfolge.
05
Klangintention
Wenn Dialog, Raumklang oder Stimmreferenz wichtig sind, nenne es. Kopple Audio-Referenzen mit visuellen Medien im R2VA-Modus.
06
Abschluss
Definiere, wie die Aufnahme enden soll: mit einem nahen Gesichtsausdruck, einer weiten Enthüllung, einer abgeschlossenen Drehung oder einem ruhigen Produktbild.
Die Dauer ist Teil des Prompt-Designs
MiniMax H3 akzeptiert ganzzahlige Werte von 4 bis 15 Sekunden. Eine fünfsekündige Produktpräsentation und eine zwölfsekündige Figurenszene brauchen eine unterschiedliche Handlungsdichte. Presse keine Drei-Akt-Geschichte in einen kurzen Clip.
Eingabemodi
Wähle den Prompt-Modus, bevor du die erste Zeile schreibst
Die Formulierungen können ähnlich aussehen, doch die Aufgabe von MiniMax H3 ändert sich mit den verwendeten Medienrollen.
T2VA
Text erzeugt das gesamte Bild
Nutze die verfügbaren Tokens für Erscheinungsbild, Umgebung und Anfangskomposition. Im reinen Textmodus darf ratio nicht den Wert adaptive haben.
I2VA
Das Anfangsbild gibt die Identität vor
Beschreibe nicht jeden Pixel neu. Steuere Bewegung, Kamera, Lichtwechsel und was konsistent bleiben muss.
FL2V
Zwei Kompositionen überbrücken
Beschreibe die Logik des Übergangs: Was bewegt oder verwandelt sich, und wie verhält sich die Kamera zwischen den vorgegebenen Kompositionen?
R2VA
Referenzen geben die Merkmale vor
Lege fest, welche Datei Gesicht, Kleidung, Bewegung, Kamerasprache oder Stimme steuert. Verwende in derselben Anfrage keine Rollen für Anfangs- oder Endbilder.
Referenz-Checkliste
Beschreibe Referenzen wie in einer Regieanweisung, nicht als bloße Dateisammlung
Das Hochladen der Medien allein reicht nicht. Weise jeder Referenz im Prompt eine konkrete Aufgabe zu.
Identität
Welches Bild gibt Gesicht, Produkt oder Logo vor?
Sag es explizit, wenn mehrere Bilder konkurrieren könnten.
Bewegung
Welches Video gibt Körpersprache oder Kamerarhythmus vor?
Halte Referenzclips kurz und fokussiert – dokumentierte Limits sind 2–15s pro Clip.
Stimme
Welche Audiodatei gibt Timbre oder Sprechweise vor?
Audio kann nicht allein verwendet werden; kombiniere es mit Bild- oder Videoreferenzen.
Ausschluss
Mische Erst-/Letztbilder mit Referenzrollen?
Falls ja, teile den Ablauf in zwei Aufträge. In der öffentlichen Schnittstelle schließen sich diese Modi gegenseitig aus.
Budget
Bist du unter 12 Mediendateien und 7.000 Prompt-Zeichen?
Entferne zuerst entbehrliche Adjektive, bevor du Referenzen streichst.
Ende
Kannst du sich das Letztbild in einem Satz vorstellen?
Falls nicht, verliert die Bewegung häufig ihr Ziel, statt sauber zu enden.
Zeitlicher Aufbau
Setze Aktion, Kamera und Klang dort ein, wo sie passieren
Zeitangaben helfen MiniMax H3, Prioritäten zu erkennen. Nutze sie zur Inszenierung der Aufnahme, nicht zur Mikrokontrolle jedes einzelnen Bildes.
01
Eröffnung
Raum und Motiv etablieren
Zeige in der ersten Sekunde, wen wir sehen und wo sich die Szene befindet. Beginne nicht mitten im Chaos, sofern das Anfangsbild die Szene nicht bereits eindeutig erklärt.
02
Entwicklung
Eine primäre Aktion
Mittleres Fenster: die Bewegung, die die Generierung von Video statt eines Stills rechtfertigt.
03
Kamera
Eine Kamerabewegung, gegebenenfalls eine zweite
Wenn du zwei Kameraideen brauchst, ordne sie nacheinander an – etwa erst Truck, dann Push –, statt beide gleichzeitig zu priorisieren.
04
Abschluss
Die Komposition zu Ende führen
Schließe etwa mit einem gehaltenen Ausdruck, einem ruhigen Produktbild, einer weiten Enthüllung oder einer abgeschlossenen Geste ab.
Beispiel-Prompts
Vier wiederverwendbare Aufnahmeformen für MiniMax H3
Dies sind neu verfasste strukturelle Beispiele. Tausche Motiv und Setting aus, während du die Hierarchie beibehältst.
Text zu Video · Kamerafahrt
Radfahrer im regennassen Neonlicht
Eine Handlung, eine Kamerabewegung und ein emotionaler Abschluss.
5–8s filmische Aufnahme
Erstelle eine 8-sekündige filmische Nachtaufnahme im Format 16:9. Ein Kurier in reflektierender Jacke fährt durch eine regennasse Kreuzung in der Stadt. Wasser spritzt von den Reifen, während sich Neonreflexionen über den Asphalt ziehen. Die Kamera fährt neben dem Fahrrad mit und schwenkt anschließend sanft auf den konzentrierten Gesichtsausdruck des Kuriers. Kühle blaue Lichtquellen mit zurückhaltenden Magenta-Akzenten und realistische nasse Oberflächen. Leises Reifenrauschen und entfernter Verkehr. Ende mit einer klar erkennbaren Dreiviertel-Nahaufnahme des Gesichts.
Bild zu Video · Produkt
Präsentation einer Uhr
Lass das Erstbild das Produktdesign besitzen, während der Prompt Licht und Kamerabewegung steuert.
Kontrollierte Bildanimation
Die Uhr bleibt zentriert, während ein schmaler Streifen warmen Lichts über das gebürstete Metallgehäuse wandert. Feiner Nebel bewegt sich langsam hinter dem Produkt. Die Kamera truckt leicht nach rechts, während sie die Uhrengeometrie und die dunkle Marmoroberfläche beibehält. Kein Redesign des Zifferblatts. Ende auf einem sauberen Dreiviertel-Produktwinkel mit vollständig lesbarem Zifferblatt.
Anfangs- und Endbild · FL2V
Studio-zu-Straße-Übergang
Beschreibe die Entwicklung zwischen zwei vorgegebenen Kompositionen.
Regieanweisung für den Übergang
Ausgehend vom Erstbild geht das Model vorwärts, während Studiosoftboxen in regennasse Straßenpraktiken übergehen. Stoffbewegung bleibt natürlich und die Identität konsistent. Die Kamera zieht sich langsam zurück, während die Umgebung den Übergang in das vorgegebene Letztbild vollendet. Ende exakt auf dieser letzten Komposition mit eingefrorener Haltung.
Omni-Referenz · r2va
Figur mit Stimmhinweis
Ordne Referenzen zu, bevor du Stiladjektive wiederholst.
R2VA-Regieanweisung
Referenzbilder verwenden für Gesicht und Garderobe der Figur. Referenzvideo verwenden für entspannten Geh-Rhythmus. Referenzaudio verwenden für warmes mittleres Stimmtimbre. Eine 10-sekündige Mittlere Einstellung auf einer windigen Küstenpromenade zur Goldenen Stunde erstellen. Die Figur geht auf die Kamera zu, lächelt einmal und sagt eine kurze freigeistige Zeile. Kamera fährt rückwärts mit. Identität und Garderobe konsistent halten. Ende auf einer stabilen mittleren Nahaufnahme.
Häufige Fehlermuster
Wenn das Ergebnis unruhig wirkt, vereinfache zuerst die Regieanweisung
Die meisten schwachen MiniMax H3-Prompts brauchen nicht mehr Wörter, sondern ein eindeutigeres Motiv, eine klarere Handlung, den passenden Modus oder eine klare Priorität bei der Kameraführung.
Schlagwortwolke
Statische Stil-Tags ohne zeitliche Veränderung
Ersetze „filmisch, schön, 4K, dramatisch“ durch ein Motiv, das in einer klar definierten Szene eine sichtbare Handlung ausführt.
Modus-Fehlanpassung
T2VA-Sprache für einen I2VA-Auftrag schreiben
Wenn das Erstbild bereits existiert, hör auf, Garderobe und Hintergrund von Grund auf neu aufzubauen, es sei denn, die Veränderung ist beabsichtigt.
Referenz-Dump
Viele Dateien, keine Zuweisung
Lege fest, welche Datei Gesicht, Bewegung oder Stimme steuert. Nicht zugewiesene Referenzen erzeugen unnötiges Rauschen.
Konkurrierende Kameras
Mehrere Bewegungen mit gleicher Priorität
Wähle einen dominanten Pfad. Wenn ein zweiter nötig ist, platziere ihn später als Sequenz.
Überladene Geschichte
Zu viele Beats für einen Clip
Gib der Aufnahme einen Auftrag. Baue längere Sequenzen aus mehreren generierten Clips.
Ungültige Mischung
Erst-/Letztbilder plus Referenzrollen
Teile den Ablauf auf. In der öffentlichen MiniMax-H3-Schnittstelle schließen sich diese Modusfamilien gegenseitig aus.
Vor der Generierung
MiniMax H3-Prompt-Check mit sechs Fragen
Lies den Prompt einmal als Regisseur und einmal als Timeline.
Modus
Ist der Generierungsmodus explizit?
Nur Text, Anfangsbild, Anfangs- und Endbild oder Omni-Referenz – wähle genau einen Modus.
Motiv
Ist ein Motiv klar dominant?
Ein Betrachter sollte wissen, was er beobachten soll, bevor die Kamera sich bewegt.
Szene
Ist die Umgebung konkret?
Nenne Ort, Zeit, Wetter oder Produktionskontext, wenn es das visuelle Ergebnis verändert.
Bewegung
Verändert sich etwas Sichtbares?
Beschreibe, wie sich eine Handlung, Verwandlung, Mimik oder ein Ereignis in der Umgebung über die Zeit entwickelt.
Kamera
Gibt es einen primären Kamerapfad?
Sequenziere sekundäre Bewegungen; staple keine Widersprüche.
Ende
Kannst du sich das Letztbild vorstellen?
Ein klarer Abschluss gibt der Bewegung ein Ziel und verhindert, dass sie ausläuft.
Kamera-Vokabular-Anhang
Nützliche Kamera-Sprache, wenn du explizite Kontrolle brauchst
Natürlich formulierte Kameraanweisungen reichen für viele MiniMax H3-Aufnahmen aus. Wenn Präzision wichtig ist, verwende wenige Befehle und ordne sie nacheinander an.
Horizontale Fahrt
Truck
truck lefttruck right
Bewege die Kamera seitlich unter Beibehaltung der Blickrichtung.
Horizontale Drehung
Pan
pan leftpan right
Drehe links oder rechts von einer relativ fixen Position.
Vor und zurück
Push und Pull
push inpull out
Bewege sich physisch auf das Motiv zu oder davon weg.
Vertikale Fahrt
Pedestal / Rise
riselower
Hebe oder senke die Kamera, ohne sie dabei zu neigen.
Vertikale Drehung
Tilt
tilt uptilt down
Drehe die Sicht nach oben oder unten.
Motiv-geführter Pfad
Track / Follow
tracking shotfollow
Bewege die Kamera mit dem Motiv, sodass sich die Umgebung verändert und der Bildausschnitt dennoch klar bleibt.
Objektiv-Framing
Zoom
zoom inzoom out
Ändere die scheinbare Brennweite, statt die Kamera durch den Raum zu bewegen.
Keine Fahrt
Statisch
static shotlocked off
Halte die Kamera ruhig und lass die Performance den Clip tragen.
Energie
Handheld-Feeling
subtle handheldrestrained shake
Verwende sparsam, damit die Motivbewegung lesbar bleibt.
Prompt-Fragen
Steuere zuerst das Wichtige
Sollte ich einen langen MiniMax H3 Prompt schreiben?
Länge ist kein Selbstzweck. Beschreibe Motiv, Schauplatz, Bewegung, Kameraführung, optional die Klangidee und das Ende ausreichend genau. Entferne anschließend Anweisungen, die mit der Haupthandlung konkurrieren. Das dokumentierte Limit beträgt 7.000 Zeichen.
Wie unterscheiden sich Prompts für Bild-zu-Video und Text-zu-Video?
Das Erstbild etabliert bereits Motiv, Komposition und Stil. Konzentriere den Prompt auf Bewegung, Kameraverhalten, Umgebungsveränderung und die Merkmale, die konsistent bleiben müssen.
Wie sollte ich Prompts mit Omni-Referenzen schreiben?
Ordne jeder Referenz einen Auftrag zu – Gesicht, Garderobe, Bewegung, Kamera-Rhythmus oder Stimme – bevor du Stiladjektive hinzufügst. Halte die Gesamtmedien innerhalb dokumentierter Limits und mische niemals Referenzrollen mit Erst-/Letztbild-Rollen.
Kann ich Dialog oder Stimme anfordern?
Du kannst die gewünschte Sprechweise im Prompt angeben. Referenzaudio kann im Referenzmodus das Timbre steuern, wenn es mit visuellen Medien kombiniert wird. Halte den gesprochenen Text kurz genug für die gewählte Dauer.
Wo lerne ich die exakten API-Felder kennen?
Informationen zu content-Rollen, duration, ratio und der Statusverarbeitung findest du im MiniMax H3 API-Leitfaden auf dieser Website und in der offiziellen MiniMax V2-Dokumentation.
Von der Regieanweisung zur Bewegung
Beschreibe eine klare MiniMax H3-Aufnahme. Teste anschließend die Regie.
Wähle zuerst den Modus, triff eine gezielte Kameraentscheidung und vergleiche das Ergebnis, bevor du die Komplexität erhöhst.