クローズショット表情の変化を捉えるポートレート
ひとりの被写体、読み取れる表情の変化、抑制の効いたカメラの軌道。
MiniMax H3は、MiniMaxの次世代オープンウェイト汎用マルチモーダル動画モデルです。テキスト、画像、動画、音声を統一的に理解し、単発の無音ラフではなく、細かく制御できる2K動画へと変換します。
MiniMaxはMiniMax H3を、テキストからショットを考案し、開始・終了フレームを固定し、参照メディアで結果を導ける統合モデルとして公開しています。
ここに並ぶカバーは、H3が得意とする演技、プロダクトの動き、環境表現、ファッション、カメラ主導のストーリーテリングをイメージしたものです。
クローズショットひとりの被写体、読み取れる表情の変化、抑制の効いたカメラの軌道。
シネマティックな路上周囲の環境、実景の光源、フレーム内を貫くひとつの大きな動き。
I2VAスタイル開始フレームの商品らしさを保ち、光とカメラの動きで魅力を引き出します。
ランドスケープの動き込み入った物語ではなく、スケール、天候、最後に残るワイドショットで見せます。
エディトリアルスタイルタグをいくつも重ねるより、シルエットの一貫性を大切にします。
物語の最小単位短い動画は、ひとつの映像的な意図を最後まで描き切ると力を発揮します。
従来のHailuoシリーズは、短い動画で物理感のある動きを得意としてきました。MiniMax H3は、より長い動画尺、ネイティブ2K、そして顔、動き、カメラ、スタイル、声を次のテイクへ引き継げるマルチモーダルリファレンスへと可能性を広げています。
テキストは監督からの指示書、画像は構図の固定、参照動画は動きやリズム、参照音声は映像メディアと組み合わせて声の質感を導く役割を持ちます。
繰り返し登場する人物、商品ライン、ブランド独自の動き、決まったカメラの感触など、一貫性そのものが価値になるショットにリファレンス生成が向いています。
公開仕様では4〜15秒の整数を指定できます。導入、動作、余韻までを描けるため、すべてのアイデアを6秒の一発ネタに詰め込む必要はありません。
MiniMaxはH3を、単一用途のエフェクトではなく、オープンウェイトの汎用マルチモーダル動画モデルとして提示しています。
宣伝文句ではなく、制作で使える具体的な手段として捉えてください。
固定したフレームがまだない段階で、被写体、舞台、動き、カメラを文章から組み立てます。
デザイン済みの静止画から始め、プロンプトでは動き、光の変化、カメラの軌道に集中できます。
冒頭と同じくらいラストの構図が重要なときに、そこへ向かう変化を演出できます。
最大9枚の画像、3本の動画、3本の音声(合計12ファイル)を組み合わせ、同一性、動き、スタイル、声を導きます。
公開されている出力解像度は2Kです。自動アップスケールの工程を挟まず、編集タイムラインへマスターを渡せます。
一般的なアスペクト比に対応し、入力メディアが画角を決める場合はadaptiveも利用できます。
本サイトのMiniMax H3画面では、制作の始め方ごとにモードを分けています。公式APIでは、ひとつのV2 content配列に指定するroleで表現します。
| 出発点 | 用意するもの | 公式モード | 向いている用途 |
|---|---|---|---|
| テキストから動画 | プロンプトのみ | t2va | 文章による演出からシーンを考案 |
| 画像から動画 | 開始フレーム + プロンプト | i2va | 決めた冒頭のビジュアルを動かす |
| 開始・終了フレーム | 2枚の画像 + プロンプト | i2va + last_frame | 指定したラストへ向かう変化を演出 |
| オムニリファレンス | 画像・動画・音声 + プロンプト | r2va | 同一性、動き、スタイル、声を引き継ぐ |
公開されているV2仕様では、開始・終了フレームのroleとreferenceのroleは相互排他です。
以下はMiniMaxが公開しているMiniMax H3資料の要約です。長期的な製品仕様として約束する前に、最新情報を改めて確認してください。
APIリクエストでは、この正確なIDを使用します。
H3で公開されているネイティブ出力クラスです。
整数のみ指定できます。
ショット全体の指示には十分ですが、長編小説を書く欄ではありません。
各画像は公開されているサイズとアスペクト比の範囲内に収めます。
各2〜15秒、合計15秒以内です。
画像または動画入力と組み合わせる必要があります。
リクエストbodyは64MB未満を推奨します。
1本の動画に明確な役割を与え、複数の生成結果を編集やキャンペーンの仕組みで組み合わせると、強みを生かせます。
実写撮影の前に、カメラ、役者の動線、光、空気感を検討できます。
構図を決めた商品画像から、短い動きの検討素材や目を引く冒頭を作れます。
同じ顔、衣装、声を繰り返し登場させるときにリファレンスを活用できます。
絵のつながりが表現の中心になるときに、冒頭とラストを指定して演出できます。
再生される順番でショットを書きます。視聴者が見聞きする内容を変える情報だけを、必要な場所に入れましょう。
夜の街の広告、静かなポートレート、商品を主役にした映像、様式化した世界など、台詞や派手なカメラ演出より先に示します。
外見は同一性に関わる部分だけを書きます。一貫性が文章より重要なら、参照メディアを使います。
競合する動きをいくつも重ねるより、中心となる動作をひとつ、明確なカメラの軌道をひとつに絞るほうが伝わります。
声、環境音、終了フレームが重要なら明記します。視聴者の記憶に残る構図で終えましょう。
映像の方向づけ、プロンプト設計、API統合の情報を引き続き確認できます。
MiniMax H3は、MiniMaxのオープンな汎用マルチモーダル動画モデルです。公開APIのモデルIDはMiniMax-H3で、テキストからの動画生成、開始・終了フレームを使った画像からの動画生成、リファレンス生成に対応します。
いいえ。Hailuo 2.3は、1080p前後の短尺で力強い動きを得意とした以前の公開動画モデル群です。MiniMax H3は、2K出力、4〜15秒、オムニリファレンスに対応する新しいマルチモーダル世代です。
コミュニティやパートナーの記事では、Hailuo 3.0が非公式な呼び名として使われることがあります。API統合では、公式モデル名MiniMax-H3とV2ドキュメントを基準にしてください。
本番タスクにはminimaxh3.videoのMiniMax H3 APIを使用します。まず映像の方向性を検討したい場合は、ブラウザーの生成画面から始められます。
テキスト、開始フレーム、開始・終了フレーム、オムニリファレンスから入口を選び、1本の動画にひとつの明確な役割を与えましょう。