สร้างวิดีโอ
แนะนำโมเดลMiniMax H3 · MiniMax-H3 · วิดีโอมัลติโหมดแบบเปิด

ภาพรวม MiniMax H3 โมเดลวิดีโอมัลติโหมดสำหรับภาพเคลื่อนไหวแบบกำกับทิศทาง

MiniMax H3 คือโมเดลวิดีโอมัลติโหมดแบบเปิดรุ่นใหม่จาก MiniMax ประมวลผลข้อความ ภาพนิ่ง วิดีโอ และเสียงร่วมกัน แล้วสร้างเป็นคลิป 2K ที่กำกับได้ ไม่ใช่เพียงคลิปทดลองแบบเงียบที่ใช้แล้วจบ

ความสามารถอย่างเป็นทางการ

สร้าง อ้างอิง และตัดต่อ ในตระกูลมัลติโหมดเดียวกัน

MiniMax จัด MiniMax H3 เป็นโมเดลเอกภาพสำหรับสร้างช็อตจากข้อความ ล็อกเฟรมแรก/สุดท้าย และกำกับผลลัพธ์ด้วยสื่ออ้างอิง

T2VA
ข้อความเป็นวิดีโอ
I2VA
เฟรมแรก / เฟรมสุดท้าย
R2VA
สื่ออ้างอิงครบวงจร
API
API สร้างวิดีโอ V2
รหัสโมเดล
MiniMax-H3
ผลลัพธ์
2K Native
ระยะเวลา
4–15 วินาที
อินพุต
ข้อความ · ภาพนิ่ง · วิดีโอ · เสียง
ขนาดพรอมต์
สูงสุด 7,000 ตัวอักษร
สื่ออ้างอิงครบวงจร
สูงสุด 12 ไฟล์
ทิศทางภาพ

ไอเดียช็อตที่สอดคล้องกับการใช้งาน MiniMax H3

ภาพปกเหล่านี้เป็นตัวแทนคลิปแบบกำกับที่ H3 ออกแบบมา: การแสดง การเคลื่อนไหวสินค้า สภาพแวดล้อม แฟชั่น และการเล่าเรื่องผ่านกล้อง

ช็อตระยะใกล้
การแสดง

ศึกษาการเคลื่อนไหวพอร์ตเทรต

ตัวแบบเดี่ยว การเปลี่ยนสีหน้าที่อ่านออก และเส้นทางกล้องกระชับ

ถนนสไตล์ภาพยนตร์
เมืองยามค่ำคืน

ติดตามแสงฝน

สภาพแวดล้อม แสงจริง และการเคลื่อนไหวหลักเดียวผ่านเฟรม

สไตล์ I2VA
สินค้า

เผยวัสดุแบบควบคุม

เอกลักษณ์เฟรมแรกคงที่ ขณะที่แสงและกล้องทำงาน

การเคลื่อนไหวในฉากกว้าง
การสร้างโลก

พลังงานสภาพแวดล้อมกว้าง

มาตราส่วน สภาพอากาศ และจังหวะกว้างสุดท้ายแทนเนื้อเรื่องอัดแน่น

งานบรรณาธิการ
แฟชั่น

เครื่องแต่งกายและเส้นร่าง

ความต่อเนื่องของซิลูเอตสำคัญกว่าการสแต็กแท็กสไตล์ห้าอัน

หน่วยการเล่าเรื่อง
จังหวะเรื่อง

ฉากเดียว งานเดียว

คลิปสั้นทำงานดีที่สุดเมื่อตอบสนองเจตนาภาพเดียว

คำตอบสั้นๆ

ไม่ใช่แค่โมเดลคลิป 1080p อีกตัว

Hailuo รุ่นก่อนโดดเด่นด้านการเคลื่อนไหวระยะสั้นที่สอดคล้องกับหลักฟิสิกส์ ส่วน MiniMax H3 ขยายขีดความสามารถด้วยระยะเวลาที่ยาวขึ้น ผลลัพธ์ 2K โดยตรง และสื่ออ้างอิงมัลติโหมดที่ถ่ายทอดใบหน้า การเคลื่อนไหว กล้อง สไตล์ หรือเสียงไปยังช็อตถัดไป

01

ออกแบบมาเพื่อมัลติโหมด

ข้อความคือบรีฟผู้กำกับ ภาพนิ่งล็อกองค์ประกอบ วิดีโออ้างอิงกำกับการเคลื่อนไหวหรือจังหวะ เสียงอ้างอิงมีอิทธิพลต่อเนื้อเสียงเมื่อจับคู่กับสื่อภาพ

02

ควบคุมโดยไม่สร้างเอกลักษณ์ใหม่

การสร้างจากอ้างอิงเหมาะกับช็อตที่ความสม่ำเสมอคือผลิตภัณฑ์: ตัวละครซ้ำ สายผลิตภัณฑ์ ภาษาการเคลื่อนไหวของแบรนด์ หรือฟีลกล้องที่รู้จัก

03

ช่วงเวลาที่ใช้งานได้ยาวขึ้น

รองรับระยะเวลาเต็ม 4–15 วินาที เพียงพอสำหรับการเปิดฉาก การกระทำ และจังหวะปิด โดยไม่ต้องบีบทุกไอเดียให้จบในหกวินาที

04

ตำแหน่งแบบเปิดสำหรับงานทั่วไป

MiniMax นำเสนอ H3 เป็นโมเดลวิดีโอมัลติโหมดแบบเปิดสำหรับงานทั่วไป ไม่ใช่ฟิลเตอร์เอฟเฟกต์เฉพาะทาง

ภาพรวมความสามารถ

สิ่งที่ MiniMax H3 เวอร์ชันสาธารณะเน้น

อ่านสิ่งเหล่านี้เป็นก้านควบคุมการผลิต ไม่ใช่คุณศัพท์การตลาด

01

สร้างวิดีโอจากข้อความด้วยบรีฟที่ชัดเจน

สร้างตัวแบบ ฉาก การเคลื่อนไหว และกล้องจากภาษา เมื่อยังไม่มีเฟรมที่ล็อกไว้

02

แอนิเมชันจากเฟรมแรก

เริ่มจากภาพนิ่งที่ออกแบบไว้ และใช้พรอมต์กับการเคลื่อนไหว การเปลี่ยนแสง และเส้นทางกล้อง

03

ควบคุมเฟรมแรกและเฟรมสุดท้าย

กำกับการเปลี่ยนผ่านเมื่อองค์ประกอบตอนจบสำคัญพอๆ กับตอนเปิด

04

สร้างวิดีโอด้วยสื่ออ้างอิงครบวงจร

รวมภาพนิ่งสูงสุด 9 ภาพ วิดีโอ 3 คลิป และเสียง 3 คลิป (รวม 12) เพื่อกำกับเอกลักษณ์ การเคลื่อนไหว สไตล์ หรือเสียง

05

ส่งมอบความละเอียด 2K โดยตรง

ความละเอียดผลลัพธ์ที่บันทึกไว้คือ 2K มาสเตอร์เข้าไทม์ไลน์ตัดต่อได้โดยไม่ต้องอัปสเกลอัตโนมัติ

06

จัดเฟรมได้ยืดหยุ่น

รองรับสัดส่วนภาพทั่วไป พร้อมปรับเรขาคณิตอัตโนมัติเมื่อสื่อกำหนดเฟรม

การควบคุมเวิร์กโฟลว์

เลือกจุดเริ่มต้นก่อนเขียนบรรทัดแรก

ภาษาอินเตอร์เฟซ MiniMax H3 บนไซต์นี้จัดกลุ่มจุดเริ่มสร้างสรรค์ API อย่างเป็นทางการเข้ารหัสเป็น roles ใน content array V2 เดียว

จุดเริ่มต้นสิ่งที่คุณให้โหมดอย่างเป็นทางการเหมาะกับ
ข้อความเป็นวิดีโอพรอมต์เท่านั้นt2vaสร้างฉากจากคำบรรยาย
ภาพนิ่งเป็นวิดีโอเฟรมแรก + พรอมต์i2vaทำให้ภาพเปิดที่ควบคุมเคลื่อนไหว
เฟรมแรกและเฟรมสุดท้ายสองภาพ + พรอมต์i2va + last_frameกำกับการเปลี่ยนผ่านสู่ตอนจบที่เลือก
สื่ออ้างอิงครบวงจรภาพนิ่ง / วิดีโอ / เสียง + พรอมต์r2vaพาเอกลักษณ์ การเคลื่อนไหว สไตล์ หรือเสียง

First/last-frame roles และ reference roles เป็นเอกเทศกันใน V2 contract สาธารณะ

บันทึกโมเดล

ข้อจำกัดที่ควรรู้ก่อนออกแบบพรอมต์

ตัวเลขเหล่านี้สรุปจากเอกสาร MiniMax H3 สาธารณะ ควรตรวจสอบซ้ำก่อนสัญญาผลิตภัณฑ์ถาวร

ชื่อโมเดล

MiniMax-H3

ใช้ ID นี้ตรงๆ ใน API requests

ความละเอียดผลลัพธ์

2K

ความละเอียดผลลัพธ์โดยตรงตามเอกสารของ H3

ระยะเวลา

4–15 วินาที

ค่าจำนวนเต็มเท่านั้น

ความยาวพรอมต์

≤ 7,000 ตัวอักษร

พอสำหรับบรีฟช็อตเต็ม ไม่ใช่นิยาย

ภาพนิ่งอ้างอิง

≤ 9

แต่ละภาพอยู่ในขีดจำกัดขนาดและสัดส่วนที่บันทึกไว้

วิดีโออ้างอิง

≤ 3 คลิป

แต่ละคลิป 2–15 วินาที รวม ≤ 15 วินาที

เสียงอ้างอิง

≤ 3 คลิป

ต้องจับคู่กับอินพุตภาพนิ่งหรือวิดีโอ

สื่อผสม

≤ 12 ไฟล์

ขนาดคำขอควรต่ำกว่า 64 MB

จุดที่เหมาะสม

งานที่ดีสำหรับวิดีโอสั้น MiniMax H3

เวิร์กโฟลว์ที่แข็งแกร่งที่สุดให้งานเดียวกับคลิปหนึ่งชิ้น แล้วประกอบผลลัพธ์หลายชิ้นผ่านการตัดต่อหรือระบบแคมเปญ

การวางภาพล่วงหน้า

คอนเซปต์ภาพยนตร์และเรื่องราว

สำรวจกล้อง การบล็อก แสง และบรรยากาศก่อนถ่ายจริง

การผลิตแคมเปญ

การเคลื่อนไหวสินค้าและโซเชียล

เปลี่ยนเฟรมสินค้าที่กำหนดไว้ให้เป็นตัวอย่างการเคลื่อนไหวสั้นๆ และช็อตเปิดที่ดึงความสนใจ

ระบบตัวละคร

ตัวแสดงที่สม่ำเสมอ

ใช้อ้างอิงเมื่อใบหน้า เครื่องแต่งกาย หรือเสียงเดียวกันต้องกลับมา

การออกแบบทรานซิชัน

การเล่าเรื่องจากเฟรมแรกสู่เฟรมสุดท้าย

กำกับการเปิดและการจบเมื่อความต่อเนื่องคือจุดสร้างสรรค์

โครงสร้างพรอมต์

โครงสร้างพรอมต์ MiniMax H3 แบบใช้งานได้จริง

เขียนช็อตตามลำดับการเล่น รายละเอียดมีค่าเมื่อเปลี่ยนสิ่งที่ผู้ชมเห็นหรือได้ยิน

01
ฉาก

ระบุรูปแบบ สถานที่ และอารมณ์

โฆษณาถนนกลางคืน พอร์ตเทรตเงียบๆ ฮีโร่สินค้า หรือโลกสไตล์—ก่อนบทสนทนาหรือลูกเล่นกล้อง

02
ตัวแบบ

กำหนดใครหรืออะไรเป็นหัวใจของช็อต

ลักษณะเฉพาะเฉพาะที่มีผลต่อเอกลักษณ์ ใช้สื่ออ้างอิงเมื่อความสม่ำเสมอสำคัญกว่าโวหาร

03
การเคลื่อนไหว + กล้อง

บรรยายการเปลี่ยนแปลงตามเวลา

การกระทำหลักหนึ่งอย่างและเส้นทางกล้องชัดเจนมักชนะกองการเคลื่อนไหวที่แข่งกัน

04
เสียง + ตอนจบ

ปิดจังหวะ

หากเสียง บรรยากาศ หรือเฟรมออกสำคัญ ให้ระบุ จบด้วยองค์ประกอบที่ผู้ชมจำได้

คำถามเกี่ยวกับโมเดล

วิธีอธิบาย MiniMax H3 อย่างแม่นยำ

MiniMax H3 คืออะไร?

MiniMax H3 คือโมเดลวิดีโอมัลติโหมดแบบเปิดสำหรับงานทั่วไปจาก MiniMax API model ID อย่างเป็นทางการคือ MiniMax-H3 รองรับ text-to-video first/last-frame image-to-video และการสร้างจากอ้างอิง

MiniMax H3 กับ Hailuo 2.3 เหมือนกันหรือไม่?

ไม่ใช่ Hailuo 2.3 เป็นตระกูลโมเดลวิดีโอรุ่นก่อนที่เด่นด้านการเคลื่อนไหวในคลิปสั้นระดับประมาณ 1080p ส่วน MiniMax H3 เป็นรุ่นมัลติโหมดใหม่กว่า รองรับผลลัพธ์ 2K ระยะเวลา 4–15 วินาที และสื่ออ้างอิงหลายรูปแบบ

MiniMax H3 เรียกอีกชื่อว่า Hailuo 3.0 หรือไม่?

บทความจากชุมชนและพันธมิตรมักใช้ Hailuo 3.0 เป็นชื่อเล่นไม่เป็นทางการ สำหรับการผสาน ให้อ้างอิงชื่อโมเดลอย่างเป็นทางการ MiniMax-H3 และเอกสาร V2

สร้างวิดีโอ MiniMax H3 จากผลิตภัณฑ์ของฉันได้อย่างไร?

ใช้ MiniMax H3 API บน minimaxh3.video สำหรับงานผลิต หรือเริ่มที่เบราว์เซอร์เจนเนอเรเตอร์เมื่อต้องการสำรวจทิศทางช็อตก่อน

เริ่มด้วยช็อตที่โฟกัส

เลือกแหล่งที่มา กำกับการเคลื่อนไหว

เลือกข้อความ เฟรมแรก คู่เฟรมแรก-สุดท้าย หรือสื่ออ้างอิง แล้วกำหนดงานหลักหนึ่งอย่างให้คลิปอย่างชัดเจน