Primo pianoStudio del movimento in un ritratto
Un solo soggetto, un cambiamento d'espressione ben leggibile e un movimento misurato della camera.
MiniMax H3 è il modello video multimodale generalista di nuova generazione di MiniMax, distribuito con pesi aperti. Interpreta in modo unificato input di testo, immagini, video e audio e li trasforma in clip 2K controllabili, non in semplici bozze mute.
MiniMax presenta MiniMax H3 come un modello unificato capace di creare riprese da testo, vincolare il primo e l'ultimo fotogramma e guidare i risultati attraverso contenuti di riferimento.
Queste immagini mostrano i tipi di clip per cui H3 è stato progettato: interpretazione, movimento di prodotto, ambientazione, moda e narrazione guidata dalla camera.
Primo pianoUn solo soggetto, un cambiamento d'espressione ben leggibile e un movimento misurato della camera.
Strada cinematograficaAmbientazione, luci di scena e un movimento dominante che attraversa l'inquadratura.
Stile I2VAL'identità definita dal primo fotogramma resta stabile mentre luce e camera animano la scena.
Movimento paesaggisticoScala, condizioni atmosferiche e un finale in campo lungo, invece di una trama sovraccarica.
EditorialeLa continuità della silhouette conta più che accumulare cinque tag di stile.
Unità narrativaLe clip brevi funzionano meglio quando risolvono una singola intenzione visiva.
Le generazioni precedenti di Hailuo eccellevano nei movimenti brevi e fisicamente credibili. MiniMax H3 amplia le possibilità: durate maggiori, 2K nativo e riferimenti multimodali capaci di trasferire volto, movimento, camera, stile o voce alla ripresa successiva.
Il testo definisce il brief di regia. Le immagini fissano la composizione. I video di riferimento possono guidare movimento e ritmo, mentre l'audio può influenzare il timbro della voce quando è abbinato a contenuti visivi.
La generazione da riferimenti è ideale quando la coerenza è essenziale: personaggi ricorrenti, gamme di prodotti, movimenti distintivi del brand o uno stile di ripresa riconoscibile.
Le durate documentate vanno da 4 a 15 secondi interi: abbastanza per introdurre la scena, sviluppare un'azione e chiuderla senza comprimere ogni idea in sei secondi.
MiniMax presenta H3 come un modello video multimodale generalista a pesi aperti, non come un semplice filtro destinato a un unico effetto.
Considerale strumenti di produzione concreti, non semplici formule di marketing.
Definisci a parole soggetto, ambientazione, movimento e camera quando non disponi ancora di un fotogramma iniziale.
Parti da un'immagine fissa già progettata e usa il prompt per dirigere movimento, variazioni di luce e percorso della camera.
Dirigi una transizione quando la composizione finale è importante quanto l'apertura.
Combina fino a 9 immagini, 3 video e 3 file audio (12 totali) per guidare identità, movimento, stile o voce.
La risoluzione di output documentata è 2K, quindi i master possono entrare nella timeline di montaggio senza una fase automatica di upscaling.
Sono supportati i rapporti d'aspetto comuni, con geometria adattiva quando i media definiscono il fotogramma.
L'interfaccia MiniMax H3 di questo sito raggruppa i diversi punti di partenza creativi. L'API ufficiale li codifica come ruoli in un unico array content della V2.
| Punto di partenza | Cosa fornisci | Modalità ufficiale | Ideale per |
|---|---|---|---|
| Da testo a video | Solo prompt | t2va | Creare una scena a partire da istruzioni scritte |
| Da immagine a video | Primo fotogramma + prompt | i2va | Animare un'apertura visiva controllata |
| Primo e ultimo fotogramma | Due immagini + prompt | i2va + last_frame | Dirigere una transizione verso un finale scelto |
| Riferimento omni | Immagini / video / audio + prompt | r2va | Trasferire identità, movimento, stile o voce |
I ruoli primo/ultimo fotogramma e i ruoli di riferimento sono mutuamente esclusivi nel contratto pubblico V2.
Questi valori riassumono la documentazione pubblica di MiniMax H3 e vanno verificati di nuovo prima di formulare impegni di prodotto a lungo termine.
Usa esattamente questo ID nelle richieste API.
Classe di consegna nativa documentata per H3.
Solo valori interi.
Sufficiente per un brief di inquadratura completo, non per un romanzo.
Ciascuna entro i limiti documentati di dimensione e aspetto.
2–15s ciascuna, totale ≤ 15s.
Devono essere abbinate a input immagine o video.
È preferibile mantenere il corpo della richiesta sotto i 64 MB.
I flussi più efficaci assegnano a ogni clip una funzione precisa, quindi combinano più risultati nel montaggio o in una campagna.
Esplora camera, messa in scena, luce e atmosfera prima delle riprese dal vivo.
Trasforma un fotogramma di prodotto controllato in brevi studi di movimento e aperture efficaci.
Usa i riferimenti quando lo stesso volto, guardaroba o voce deve riapparire.
Dirigi aperture e chiusure quando la continuità è il fulcro creativo.
Scrivi l'inquadratura nell'ordine di riproduzione. I dettagli meritano spazio solo quando cambiano ciò che lo spettatore vede o sente.
Uno spot notturno in strada, un ritratto silenzioso, una presentazione di prodotto o un mondo stilizzato, prima di aggiungere dialoghi o virtuosismi di camera.
Descrivi l'aspetto solo quando incide sull'identità. Usa contenuti di riferimento quando la coerenza conta più delle descrizioni.
Un'azione dominante e un percorso chiaro della camera funzionano quasi sempre meglio di molti movimenti in conflitto.
Se voce, ambiente sonoro o fotogramma finale sono importanti, specificalo. Concludi con una composizione facile da ricordare.
Approfondisci su questo sito la direzione creativa, la scrittura dei prompt e l'integrazione API.
Usa la demo nel browser per passare rapidamente dal prompt alla ripresa.
Modelli, scelta della modalità e controlli degli errori per i brief MiniMax H3.
Consulta la struttura delle richieste, il flusso asincrono e gli endpoint di minimaxh3.video.
MiniMax H3 è il modello video multimodale generalista a pesi aperti di MiniMax. L'ID del modello nell'API pubblica è MiniMax-H3. Supporta la generazione da testo, da immagini con primo/ultimo fotogramma e da contenuti di riferimento.
No. Hailuo 2.3 è una famiglia video pubblica precedente, nota per il movimento efficace in clip brevi intorno ai 1080p. MiniMax H3 è la generazione multimodale più recente, con output documentato in 2K, durate di 4–15 s e riferimenti omni.
Articoli della community e dei partner usano spesso Hailuo 3.0 come alias informale. Per l'integrazione, fai affidamento sul nome ufficiale del modello MiniMax-H3 e sulla documentazione V2.
Usa l'API MiniMax H3 su minimaxh3.video per i flussi di produzione, oppure parti dal generatore nel browser se vuoi prima esplorare la direzione della ripresa.
Scegli il testo, un primo fotogramma, una coppia iniziale/finale o riferimenti omni, quindi assegna alla clip una funzione chiara.