เจนวิดีโอจากสไลด์และสเปรดชีตได้เลย

จุดขายที่ต่างจากโมเดลเจนวิดีโอเจ้าอื่นคือ Wan3.0 รับไฟล์เอกสารอย่าง doc, xls, ppt, pdf, md รวมถึงหน้าเว็บ มาเป็นวัตถุดิบอ้างอิงในการเจนวิดีโอได้โดยตรง เท่ากับเปลี่ยนสไลด์นำเสนอหรือสเปรดชีตข้อมูลให้กลายเป็นวิดีโอได้ในขั้นตอนเดียว โมเดลยังมีฟีเจอร์แนะนำความยาวคลิปอัตโนมัติตามเนื้อหาพรอมต์ และมีเครื่องมือต่อความยาวคลิปเดิมเพื่อขยายเรื่องราวต่อได้ ด้านความสม่ำเสมอของภาพ Alibaba ระบุว่าโมเดลรักษาความต่อเนื่องของตัวละคร สินค้า การจัดวางพื้นที่ สไตล์ภาพ เสียง และ UI ได้แม่นยำขึ้น ลดอาการภาพเพี้ยนหรือดริฟต์ระหว่างเฟรม พร้อมเจนเสียงพูดหลายภาษาที่ซิงก์กับการขยับปากและสีหน้าได้ละเอียดขึ้น

เป้าหมายอุตสาหกรรม — ตั้งแต่หนังสั้นถึงข้อมูลเทรนหุ่นยนต์

Alibaba วางกลุ่มเป้าหมายของ Wan3.0 ไว้กว้างตั้งแต่งานผลิตภาพยนตร์ ละครสั้น คอนเทนต์โซเชียลมีเดีย งานการตลาด สื่อการศึกษา ไปจนถึงวิดีโอจำลองสำหรับเทรนระบบขับขี่อัตโนมัติและหุ่นยนต์ ตอนนี้เปิดให้สมัครทดสอบผ่าน Alibaba Cloud Model Studio และ Qwen Cloud โดยยังไม่เปิดเผยราคาหรือกำหนดวันเปิดใช้งานเต็มรูปแบบ ข่าวนี้ตอกย้ำเทรนด์ที่โมเดลเจนวิดีโอสัญชาติจีนครองอันดับต้นบนตารางเปรียบเทียบ text-to-video ของ Artificial Analysis อยู่ถึง 9 ใน 10 อันดับแรกในปัจจุบัน

มุมมองของเรา

ความยาวคลิป 30 วินาทีเดียวจบเริ่มกลายเป็นมาตรฐานใหม่ของโมเดลเจนวิดีโอชั้นนำ (เท่ากับ Seedance 2.5 ที่เปิด API ไปก่อนหน้านี้) ส่วนความสามารถแปลงเอกสาร PDF หรือสไลด์เป็นวิดีโอโดยตรงเป็นทิศทางที่น่าจับตา เพราะย่นระยะขั้นตอนระหว่างบรีฟลูกค้ากับ storyboard ได้จริง สำหรับ All-In AI Labs สิ่งที่สำคัญกว่าตัวเลขสเปกคือการเลือกโมเดลที่ให้ผลลัพธ์ควบคุมได้และภาพสมจริงที่สุดในแต่ละงาน ไม่ใช่ไล่ตามทุกโมเดลใหม่ — Wan3.0 ยังอยู่ในเฟส beta จึงต้องรอผลทดสอบจริงก่อนนำมาใช้ในโปรดักชัน