ต่อยอด Seedance — เรนเดอร์บนคลาวด์ เล็งเสียบเข้าแว่น Pico
ตามรายงาน ระบบนี้สร้างบนฐานของ Seedance และออกแบบมาให้ผู้ใช้สร้าง "โลกเสมือนแบบโต้ตอบ" สำหรับไลฟ์สตรีม ละครสั้น และเกม โดยโมเดลตอบสนองต่อคำพูดและการเคลื่อนไหวของผู้ใช้ที่ latency ประมาณ 0.05 วินาที ปล่อยภาพต่อเนื่องที่ 20fps การย้ายงานประมวลผลหนัก ๆ ไปไว้บนคลาวด์แทนที่จะรันบนตัวเครื่อง มีเป้าหมายเพื่อลดสเปกฮาร์ดแวร์และต้นทุนของอุปกรณ์ VR รุ่นถัดไป ปลายทางที่วางไว้คือเชื่อมต่อกับแว่น Pico ซึ่งเป็นแพลตฟอร์ม XR ของ ByteDance เอง Bloomberg ระบุว่าแผนเปิดตัวเร็วสุดคือเดือนตุลาคม 2026 แต่ยังไม่ฟิกซ์และอาจเปลี่ยนได้
World model = วาระ AI อันดับหนึ่งของ ByteDance ปี 2026
ByteDance จัดให้ world model เป็นลำดับความสำคัญสูงสุดด้าน AI ของปี 2026 และวางเป็นคำตอบของบริษัทต่อ Meta และ Alphabet ในการแข่งสร้างโมเดลจำลองโลก ผลทดสอบภายในช่วงต้นปี 2026 ยังตามหลังระดับ state-of-the-art ของโลกอยู่ราว 10% โดยตั้งเป้าเทียบกับ Genie ของ Google รายงานระบุว่าบริษัทเดินสองเส้นทางคู่กัน — แนวทาง vision-language-action กับการจำลองแบบ 3D — และทุ่มงบซื้อข้อมูลเทรนมากกว่าคู่แข่งราว 3–4 เท่า (เป็นเม็ดเงินหลักสิบล้านหยวน) ในภาพใหญ่ ByteDance เพิ่งได้เงินกู้ 3 หมื่นล้านดอลลาร์ และกำลังพิจารณางบลงทุนโครงสร้างพื้นฐาน AI สูงถึง 7 หมื่นล้านดอลลาร์
ต่างจาก Seedance ที่สตูดิโอใช้อยู่ตรงไหน
Seedance เวอร์ชันที่ทีมงานและสายวิดีโอ AI ใช้กันตอนนี้เป็นแบบ image-to-video / text-to-video ที่เจนคลิปสั้นออกมาเป็นไฟล์เดียวจบ คุมองค์ประกอบภาพได้เป๊ะแต่แก้สดระหว่างเจนไม่ได้ ส่วนโมเดล spatial ตัวใหม่เน้นคนละโจทย์ — โต้ตอบสดในสภาพแวดล้อมที่เดินสำรวจได้ เหมาะกับไลฟ์ เกม และคอนเทนต์ VR มากกว่างานคลิปสำเร็จรูป จึงยังไม่ใช่ของมาแทน pipeline ที่ใช้ส่งงานลูกค้าในวันนี้
มุมมองของเรา
Seedance เป็นโมเดลวิดีโอตัวหลักที่ All-In AI Labs ใช้เจนคลิปจาก keyframe อยู่แล้ว การที่ ByteDance ดัน Seedance ไปทางโลกเสมือนโต้ตอบสด บอกทิศทางของทั้งวงการว่ากำลังขยับจาก "เจนคลิปตามพรอมต์" ไปสู่ "จำลองฉากที่ปรับกล้อง จังหวะ และบทได้กลางอากาศ" ซึ่งถ้าถึงจุดที่คุมความละเอียดและความต่อเนื่องได้จริง จะเปลี่ยนขั้นตอน previz และการ pitch งานให้ลูกค้าไปมาก — ปรับฉากสดในห้องประชุมแทนการรอเจนใหม่ทีละรอบ แต่ ณ วันนี้โมเดลตัวนี้ยังเล็งไปที่ VR ไลฟ์ และเกม ไม่ใช่งานโฆษณาที่ต้องคุมทุกเฟรมให้เนี้ยบ งานส่งมอบจริงของเราจึงยังอยู่บนไปป์ไลน์ image-to-video ที่พิสูจน์แล้ว เพื่อส่งวิดีโอโฆษณาคุณภาพสูงในงบที่ถูกกว่ากองถ่าย ส่วนโมเดล real-time แบบนี้เราติดตามไว้เป็นแนวทาง R&D สำหรับเวิร์กโฟลว์ previz เร็ว ๆ
ALL-IN