ช็อตระยะใกล้ศึกษาการเคลื่อนไหวพอร์ตเทรต
ตัวแบบเดี่ยว การเปลี่ยนสีหน้าที่อ่านออก และเส้นทางกล้องกระชับ
MiniMax H3 คือโมเดลวิดีโอมัลติโหมดแบบเปิดรุ่นใหม่จาก MiniMax ประมวลผลข้อความ ภาพนิ่ง วิดีโอ และเสียงร่วมกัน แล้วสร้างเป็นคลิป 2K ที่กำกับได้ ไม่ใช่เพียงคลิปทดลองแบบเงียบที่ใช้แล้วจบ
MiniMax จัด MiniMax H3 เป็นโมเดลเอกภาพสำหรับสร้างช็อตจากข้อความ ล็อกเฟรมแรก/สุดท้าย และกำกับผลลัพธ์ด้วยสื่ออ้างอิง
ภาพปกเหล่านี้เป็นตัวแทนคลิปแบบกำกับที่ H3 ออกแบบมา: การแสดง การเคลื่อนไหวสินค้า สภาพแวดล้อม แฟชั่น และการเล่าเรื่องผ่านกล้อง
ช็อตระยะใกล้ตัวแบบเดี่ยว การเปลี่ยนสีหน้าที่อ่านออก และเส้นทางกล้องกระชับ
ถนนสไตล์ภาพยนตร์สภาพแวดล้อม แสงจริง และการเคลื่อนไหวหลักเดียวผ่านเฟรม
สไตล์ I2VAเอกลักษณ์เฟรมแรกคงที่ ขณะที่แสงและกล้องทำงาน
การเคลื่อนไหวในฉากกว้างมาตราส่วน สภาพอากาศ และจังหวะกว้างสุดท้ายแทนเนื้อเรื่องอัดแน่น
งานบรรณาธิการความต่อเนื่องของซิลูเอตสำคัญกว่าการสแต็กแท็กสไตล์ห้าอัน
หน่วยการเล่าเรื่องคลิปสั้นทำงานดีที่สุดเมื่อตอบสนองเจตนาภาพเดียว
Hailuo รุ่นก่อนโดดเด่นด้านการเคลื่อนไหวระยะสั้นที่สอดคล้องกับหลักฟิสิกส์ ส่วน MiniMax H3 ขยายขีดความสามารถด้วยระยะเวลาที่ยาวขึ้น ผลลัพธ์ 2K โดยตรง และสื่ออ้างอิงมัลติโหมดที่ถ่ายทอดใบหน้า การเคลื่อนไหว กล้อง สไตล์ หรือเสียงไปยังช็อตถัดไป
ข้อความคือบรีฟผู้กำกับ ภาพนิ่งล็อกองค์ประกอบ วิดีโออ้างอิงกำกับการเคลื่อนไหวหรือจังหวะ เสียงอ้างอิงมีอิทธิพลต่อเนื้อเสียงเมื่อจับคู่กับสื่อภาพ
การสร้างจากอ้างอิงเหมาะกับช็อตที่ความสม่ำเสมอคือผลิตภัณฑ์: ตัวละครซ้ำ สายผลิตภัณฑ์ ภาษาการเคลื่อนไหวของแบรนด์ หรือฟีลกล้องที่รู้จัก
รองรับระยะเวลาเต็ม 4–15 วินาที เพียงพอสำหรับการเปิดฉาก การกระทำ และจังหวะปิด โดยไม่ต้องบีบทุกไอเดียให้จบในหกวินาที
MiniMax นำเสนอ H3 เป็นโมเดลวิดีโอมัลติโหมดแบบเปิดสำหรับงานทั่วไป ไม่ใช่ฟิลเตอร์เอฟเฟกต์เฉพาะทาง
อ่านสิ่งเหล่านี้เป็นก้านควบคุมการผลิต ไม่ใช่คุณศัพท์การตลาด
สร้างตัวแบบ ฉาก การเคลื่อนไหว และกล้องจากภาษา เมื่อยังไม่มีเฟรมที่ล็อกไว้
เริ่มจากภาพนิ่งที่ออกแบบไว้ และใช้พรอมต์กับการเคลื่อนไหว การเปลี่ยนแสง และเส้นทางกล้อง
กำกับการเปลี่ยนผ่านเมื่อองค์ประกอบตอนจบสำคัญพอๆ กับตอนเปิด
รวมภาพนิ่งสูงสุด 9 ภาพ วิดีโอ 3 คลิป และเสียง 3 คลิป (รวม 12) เพื่อกำกับเอกลักษณ์ การเคลื่อนไหว สไตล์ หรือเสียง
ความละเอียดผลลัพธ์ที่บันทึกไว้คือ 2K มาสเตอร์เข้าไทม์ไลน์ตัดต่อได้โดยไม่ต้องอัปสเกลอัตโนมัติ
รองรับสัดส่วนภาพทั่วไป พร้อมปรับเรขาคณิตอัตโนมัติเมื่อสื่อกำหนดเฟรม
ภาษาอินเตอร์เฟซ MiniMax H3 บนไซต์นี้จัดกลุ่มจุดเริ่มสร้างสรรค์ API อย่างเป็นทางการเข้ารหัสเป็น roles ใน content array V2 เดียว
| จุดเริ่มต้น | สิ่งที่คุณให้ | โหมดอย่างเป็นทางการ | เหมาะกับ |
|---|---|---|---|
| ข้อความเป็นวิดีโอ | พรอมต์เท่านั้น | t2va | สร้างฉากจากคำบรรยาย |
| ภาพนิ่งเป็นวิดีโอ | เฟรมแรก + พรอมต์ | i2va | ทำให้ภาพเปิดที่ควบคุมเคลื่อนไหว |
| เฟรมแรกและเฟรมสุดท้าย | สองภาพ + พรอมต์ | i2va + last_frame | กำกับการเปลี่ยนผ่านสู่ตอนจบที่เลือก |
| สื่ออ้างอิงครบวงจร | ภาพนิ่ง / วิดีโอ / เสียง + พรอมต์ | r2va | พาเอกลักษณ์ การเคลื่อนไหว สไตล์ หรือเสียง |
First/last-frame roles และ reference roles เป็นเอกเทศกันใน V2 contract สาธารณะ
ตัวเลขเหล่านี้สรุปจากเอกสาร MiniMax H3 สาธารณะ ควรตรวจสอบซ้ำก่อนสัญญาผลิตภัณฑ์ถาวร
ใช้ ID นี้ตรงๆ ใน API requests
ความละเอียดผลลัพธ์โดยตรงตามเอกสารของ H3
ค่าจำนวนเต็มเท่านั้น
พอสำหรับบรีฟช็อตเต็ม ไม่ใช่นิยาย
แต่ละภาพอยู่ในขีดจำกัดขนาดและสัดส่วนที่บันทึกไว้
แต่ละคลิป 2–15 วินาที รวม ≤ 15 วินาที
ต้องจับคู่กับอินพุตภาพนิ่งหรือวิดีโอ
ขนาดคำขอควรต่ำกว่า 64 MB
เวิร์กโฟลว์ที่แข็งแกร่งที่สุดให้งานเดียวกับคลิปหนึ่งชิ้น แล้วประกอบผลลัพธ์หลายชิ้นผ่านการตัดต่อหรือระบบแคมเปญ
สำรวจกล้อง การบล็อก แสง และบรรยากาศก่อนถ่ายจริง
เปลี่ยนเฟรมสินค้าที่กำหนดไว้ให้เป็นตัวอย่างการเคลื่อนไหวสั้นๆ และช็อตเปิดที่ดึงความสนใจ
ใช้อ้างอิงเมื่อใบหน้า เครื่องแต่งกาย หรือเสียงเดียวกันต้องกลับมา
กำกับการเปิดและการจบเมื่อความต่อเนื่องคือจุดสร้างสรรค์
เขียนช็อตตามลำดับการเล่น รายละเอียดมีค่าเมื่อเปลี่ยนสิ่งที่ผู้ชมเห็นหรือได้ยิน
โฆษณาถนนกลางคืน พอร์ตเทรตเงียบๆ ฮีโร่สินค้า หรือโลกสไตล์—ก่อนบทสนทนาหรือลูกเล่นกล้อง
ลักษณะเฉพาะเฉพาะที่มีผลต่อเอกลักษณ์ ใช้สื่ออ้างอิงเมื่อความสม่ำเสมอสำคัญกว่าโวหาร
การกระทำหลักหนึ่งอย่างและเส้นทางกล้องชัดเจนมักชนะกองการเคลื่อนไหวที่แข่งกัน
หากเสียง บรรยากาศ หรือเฟรมออกสำคัญ ให้ระบุ จบด้วยองค์ประกอบที่ผู้ชมจำได้
อยู่บนไซต์นี้สำหรับทิศทางสร้างสรรค์ การเขียนพรอมต์ และบันทึกการผสาน API
MiniMax H3 คือโมเดลวิดีโอมัลติโหมดแบบเปิดสำหรับงานทั่วไปจาก MiniMax API model ID อย่างเป็นทางการคือ MiniMax-H3 รองรับ text-to-video first/last-frame image-to-video และการสร้างจากอ้างอิง
ไม่ใช่ Hailuo 2.3 เป็นตระกูลโมเดลวิดีโอรุ่นก่อนที่เด่นด้านการเคลื่อนไหวในคลิปสั้นระดับประมาณ 1080p ส่วน MiniMax H3 เป็นรุ่นมัลติโหมดใหม่กว่า รองรับผลลัพธ์ 2K ระยะเวลา 4–15 วินาที และสื่ออ้างอิงหลายรูปแบบ
บทความจากชุมชนและพันธมิตรมักใช้ Hailuo 3.0 เป็นชื่อเล่นไม่เป็นทางการ สำหรับการผสาน ให้อ้างอิงชื่อโมเดลอย่างเป็นทางการ MiniMax-H3 และเอกสาร V2
ใช้ MiniMax H3 API บน minimaxh3.video สำหรับงานผลิต หรือเริ่มที่เบราว์เซอร์เจนเนอเรเตอร์เมื่อต้องการสำรวจทิศทางช็อตก่อน
เลือกข้อความ เฟรมแรก คู่เฟรมแรก-สุดท้าย หรือสื่ออ้างอิง แล้วกำหนดงานหลักหนึ่งอย่างให้คลิปอย่างชัดเจน