NahaufnahmePorträt-Bewegungsstudie
Eine einzelne Person, ein klar erkennbarer Wechsel im Ausdruck und eine zurückhaltende Kamerabewegung.
MiniMax H3 ist MiniMaxs multimodales Videomodell der nächsten Generation mit offenen Gewichten und vielseitigem Einsatzspektrum. Es verarbeitet Text-, Bild-, Video- und Audioeingaben gemeinsam und erzeugt daraus gezielt steuerbare 2K-Clips statt isolierter, stummer Entwürfe.
MiniMax beschreibt MiniMax H3 als einheitliches Modell, das Aufnahmen aus Text erzeugt, Anfangs- und Endbilder fixiert und Ergebnisse mithilfe von Referenzmedien steuert.
Diese Vorschaubilder zeigen typische inszenierte Clips, für die H3 entwickelt wurde: Darstellung, Produktbewegung, Umgebungen, Mode und kamerageführtes Erzählen.
NahaufnahmeEine einzelne Person, ein klar erkennbarer Wechsel im Ausdruck und eine zurückhaltende Kamerabewegung.
Filmische StraßenszeneDie Umgebung, reale Lichtquellen und eine dominante Bewegung bestimmen das Bild.
I2VA-StilDas Produkt bleibt vom ersten Bild an konsistent, während Licht und Kamera für die Inszenierung sorgen.
LandschaftsbewegungMaßstab, Wetter und eine abschließende Totale wirken stärker als eine überladene Handlung.
EditorialEine konsistente Silhouette ist wichtiger als die bloße Aneinanderreihung zahlreicher Stilbegriffe.
Narrative EinheitKurze Clips funktionieren am besten, wenn sie eine einzige visuelle Idee klar zu Ende führen.
Frühere Hailuo-Generationen überzeugten bei kurzen Clips mit physikalisch plausibler Bewegung. MiniMax H3 erweitert den Funktionsumfang um längere Zeitfenster, natives 2K und multimodale Referenzen, die Gesicht, Bewegung, Kameraführung, Stil oder Stimme in die nächste Aufnahme übertragen können.
Der Text liefert die Regieanweisung, Bilder fixieren die Komposition, Videoreferenzen geben Bewegung oder Rhythmus vor und Audioreferenzen können in Kombination mit visuellen Medien die Stimmcharakteristik beeinflussen.
Referenzgenerierung eignet sich für Aufnahmen, bei denen Konsistenz entscheidend ist: wiederkehrende Figuren, Produktlinien, eine markentypische Bewegungssprache oder ein vertrauter Kamerastil.
Die dokumentierte Dauer reicht von 4 bis 15 ganzen Sekunden – genug für Einstieg, Handlung und Abschluss, ohne jede Idee auf eine sechssekündige Pointe reduzieren zu müssen.
MiniMax präsentiert H3 als multimodales Videomodell mit offenen Gewichten für den universellen Einsatz, nicht als einzweckigen Effektfilter.
Nutze diese Funktionen als konkrete Werkzeuge für die Produktion, nicht nur als Marketingbegriffe.
Lass Motiv, Schauplatz, Bewegung und Kameraführung aus einer Textbeschreibung entstehen, wenn noch kein festgelegtes Ausgangsbild vorliegt.
Beginne mit einem gestalteten Standbild und konzentriere den Prompt auf Bewegung, Lichtwechsel und Kameraführung.
Steuere den Übergang gezielt, wenn die Komposition am Ende ebenso wichtig ist wie das Ausgangsbild.
Kombiniere bis zu 9 Bilder, 3 Videos und 3 Audiodateien (12 insgesamt), um Identität, Bewegung, Stil oder Stimme zu steuern.
Die dokumentierte Ausgabeauflösung beträgt 2K. Dadurch können Masterdateien ohne automatisches Hochskalieren direkt in die Schnitt-Timeline übernommen werden.
Gängige Seitenverhältnisse werden unterstützt, mit adaptiver Geometrie, wenn Medien den Frame definieren.
Die Oberfläche dieser Website fasst die kreativen Ausgangspunkte in Modi zusammen. In der offiziellen API werden sie als Rollen innerhalb eines V2-content-Arrays abgebildet.
| Ausgangspunkt | Was du bereitstellst | Offizieller Modus | Am besten geeignet für |
|---|---|---|---|
| Text zu Video | Nur Prompt | t2va | Eine Szene aus einer schriftlichen Regieanweisung entwickeln |
| Bild zu Video | Erster Frame + Prompt | i2va | Einen festgelegten visuellen Einstieg animieren |
| Erster und letzter Frame | Zwei Bilder + Prompt | i2va + last_frame | Einen Übergang zu einem vorgegebenen Ende steuern |
| Omni-Referenz | Bilder / Videos / Audio + Prompt | r2va | Identität, Bewegung, Stil oder Stimme übernehmen |
Die Rollen first_frame/last_frame und die Referenzrollen schließen sich in der öffentlichen V2-Schnittstelle gegenseitig aus.
Diese Angaben stammen aus der öffentlichen MiniMax H3-Dokumentation von MiniMax. Prüfe sie erneut, bevor du daraus eine dauerhafte Produktzusage ableitest.
Verwende diese exakte ID in API-Anfragen.
Dokumentierte native Ausgabeauflösung von H3.
Nur ganzzahlige Werte.
Genug für ein vollständiges Aufnahmebriefing, nicht für einen Roman.
Jede Datei muss die dokumentierten Größen- und Seitenverhältnisgrenzen einhalten.
2–15s je Clip, insgesamt ≤ 15s.
Muss mit Bild- oder Videoeingabe kombiniert werden.
Der Request-Body sollte möglichst unter 64 MB bleiben.
Die besten Workflows geben jedem Clip eine klar umrissene Aufgabe und verbinden anschließend mehrere Ergebnisse im Schnitt oder in Kampagnensystemen.
Teste Kameraführung, Inszenierung, Licht und Atmosphäre vor dem eigentlichen Dreh.
Verwandle ein präzise gestaltetes Produktbild in kurze Bewegungsstudien und aufmerksamkeitsstarke Einstiege.
Nutze Referenzen, wenn dasselbe Gesicht, dieselbe Garderobe oder dieselbe Stimme wiederkehren soll.
Steuere Anfang und Ende gezielt, wenn die Kontinuität im Mittelpunkt der kreativen Idee steht.
Beschreibe die Aufnahme in der Reihenfolge, in der sie abgespielt wird. Nimm nur Details auf, die tatsächlich verändern, was das Publikum sieht oder hört.
Zum Beispiel ein nächtlicher Werbeclip auf der Straße, ein ruhiges Porträt, eine Produktinszenierung oder eine stilisierte Welt – noch vor Dialogen oder aufwendiger Kameraführung.
Beschreibe das Erscheinungsbild nur dort, wo es die Identität prägt. Nutze Referenzmedien, wenn Konsistenz wichtiger ist als eine ausführliche Beschreibung.
Eine dominante Handlung und eine klare Kamerabewegung wirken meist besser als mehrere konkurrierende Bewegungsabläufe.
Wenn Stimme, Atmosphäre oder ein bestimmtes Endbild wichtig sind, nenne es ausdrücklich. Schließe mit einer einprägsamen Komposition ab.
Auf dieser Website findest du weitere Hinweise zur kreativen Gestaltung, zu Prompts und zur API-Integration.
Nutze die Browser-Demo, wenn du einen schnellen Prompt-zu-Aufnahme-Workflow möchtest.
Vorlagen, Hilfen zur Moduswahl und Fehlerprüfungen für MiniMax H3-Regieanweisungen.
Informiere sich über Anfrageformate, den asynchronen Ablauf und die Endpunkte auf minimaxh3.video.
MiniMax H3 ist MiniMaxs multimodales Videomodell mit offenen Gewichten für den universellen Einsatz. Die öffentliche API-Model-ID ist MiniMax-H3. Es unterstützt Text-zu-Video, Bild-zu-Video mit erstem/letztem Frame und referenzbasierte Generierung.
Nein. Hailuo 2.3 ist eine frühere öffentlich verfügbare Modellfamilie, die für überzeugende Bewegungen in kürzeren Clips mit etwa 1080p bekannt ist. MiniMax H3 ist die neuere multimodale Generation mit dokumentierter 2K-Ausgabe, 4–15 Sekunden Dauer und Omni-Referenzen.
Beiträge aus der Community und von Partnern verwenden Hailuo 3.0 häufig als inoffizielle Bezeichnung. Orientiere dich für Integrationen am offiziellen Modellnamen MiniMax-H3 und an der V2-Dokumentation.
Nutze für produktive Aufträge die MiniMax H3 API auf minimaxh3.video. Wenn du zunächst die kreative Richtung einer Aufnahme testen möchtest, beginne im Browser-Generator.
Beginne mit Text, einem Anfangsbild, einem Paar aus Anfangs- und Endbild oder Omni-Referenzen. Gib dem Clip anschließend eine klar umrissene Aufgabe.