ครอบคลุมโมเดลกว่า 50 ตัว ใช้ได้ 5 แพลตฟอร์ม
MCP เวอร์ชันใหม่นี้ให้แอสซิสแทนต์เรียกใช้ text-to-speech, Scribe (speech-to-text/transcript), dubbing หลายภาษา, เจนเพลงและเอฟเฟกต์เสียง, เจนภาพและแก้ภาพ ไปจนถึงเจนวิดีโอพร้อม lipsync — ทั้งหมดผ่านคอนเนกเตอร์เดียวที่ดึงโมเดลจากทั้งสต็อกของ ElevenLabs เองและพาร์ทเนอร์รวมกว่า 50 ตัว ใช้งานได้แล้วบน Claude, ChatGPT, Cursor, Grok Bot และ Hermes โดยไม่ต้องรันเซิร์ฟเวอร์เองหรือจัดการคีย์แยกทีละบริการ ผลงานที่เจนออกมาทั้งหมดจะเด้งเข้า workspace ElevenCreative อัตโนมัติ พร้อมให้ไปปรับแต่งต่อในเครื่องมือ Studio ได้ทันที
เวิร์กโฟลว์เปลี่ยนจากต่อคิวหลายแอป เหลือบรีฟเดียว
จุดที่ ElevenLabs เน้นในประกาศคือการรวมทุกโมดาลิตี้ไว้จุดเดียวทำให้ "บรีฟเดียวสามารถผลิตสคริปต์ เสียงพากย์ เพลงประกอบ ซาวด์ดีไซน์ และวิดีโอที่ห่อหุ้มทั้งหมดไว้ด้วยกันได้" — ภาพและวิดีโอทำงานคู่กับเครื่องมือเสียงในสายเดียวกัน คือเจนภาพ แก้ภาพ แล้วแอนิเมตเป็นวิดีโอ พร้อมใส่ lipsync ได้จากคอนเนกเตอร์เดียวกันทั้งหมด ไม่ต้องส่งไฟล์ข้ามแอประหว่างขั้นตอน ซึ่งตัดขั้นตอนสลับแอปที่เคยเป็นคอขวดของเวิร์กโฟลว์ production แบบเดิมออกไปมาก
ทำไมข่าวนี้สำคัญกับสายวิดีโอโปรดักชัน
สตูดิโอที่ใช้ Claude หรือ ChatGPT เป็นศูนย์กลางสั่งงาน production อยู่แล้วจะได้ประโยชน์ตรงที่ไม่ต้องพึ่งคอนเนกเตอร์แยกทีละงาน (เสียง เพลง ภาพ วิดีโอ) เหมือนก่อน แต่ก็มาพร้อมคำถามเรื่องคุณภาพเทียบกับโมเดลเฉพาะทางที่ทีมใช้อยู่ — ElevenLabs ไม่ได้เปิดเผยราคาเครดิตของฟีเจอร์ภาพ/วิดีโอใหม่ไว้ในประกาศ ทีมที่จะทดลองใช้จึงควรเช็คโครงสร้างราคาก่อนผูกเข้าเวิร์กโฟลว์จริง
มุมมองของเรา
All-In AI Labs ทำงานผ่าน Claude เป็นศูนย์กลางออร์เคสเตรตอยู่แล้ว จึงมองเทรนด์ "รวมทุกโมดาลิตี้ไว้คอนเนกเตอร์เดียว" แบบนี้ด้วยความสนใจ แต่ในงานจริงเรายังคงเลือกโมเดลเฉพาะทางแยกตามงาน (เสียงพากย์ไทยที่ต้องคุมโทน, วิดีโอที่ต้อง photoreal, ภาพที่ต้องคุมคาแรกเตอร์แม่นยำ) เพราะคุณภาพปลายทางยังสำคัญกว่าความสะดวกของการรวมเครื่องมือ — ข่าวนี้ตอกย้ำทิศทางที่ทุกค่ายกำลังแข่งกันคือทำให้ AI production เข้าถึงง่ายขึ้นเรื่อยๆ ซึ่งเป็นโอกาสให้ทีมที่มีประสบการณ์เลือกใช้เครื่องมือถูกงานจริงอย่างเราสร้างผลงานคุณภาพสูงได้เร็วและคุ้มงบกว่าที่ลูกค้าคาดไว้
ALL-IN