ElevenLabs เปิดตัวโมเดลเสียง v4 คุมอารมณ์ได้มากขึ้น รองรับ 90 ภาษา
ElevenLabs เปิดตัวโมเดลสังเคราะห์เสียงรุ่น v4 ที่ยกระดับความสามารถด้านการสร้างเสียงพูดให้ละเอียดและควบคุมได้มากขึ้น โดยชูจุดเด่นเรื่องการถ่ายทอดอารมณ์ น้ำเสียง และจังหวะการพูดให้ใกล้เคียงมนุษย์มากขึ้น…

ElevenLabs เปิดตัวโมเดลสังเคราะห์เสียงรุ่น v4 ที่ยกระดับความสามารถด้านการสร้างเสียงพูดให้ละเอียดและควบคุมได้มากขึ้น โดยชูจุดเด่นเรื่องการถ่ายทอดอารมณ์ น้ำเสียง และจังหวะการพูดให้ใกล้เคียงมนุษย์มากขึ้นกว่ารุ่นก่อน ๆ
หัวใจสำคัญของอัปเดตนี้คือการให้ผู้ใช้ควบคุมการแสดงออกของเสียงได้มากขึ้น ทำให้การสร้างเสียงสำหรับงานพากย์ ผู้ช่วยเสียง ตัวละครในคอนเทนต์ หรือสื่อเชิงโต้ตอบมีความยืดหยุ่นกว่าเดิม ขณะเดียวกันโมเดลยังรองรับภาษามากถึง 90 ภาษา ทำให้ใช้งานได้กว้างขึ้นสำหรับตลาดต่างประเทศและงานที่ต้องทำหลายภาษาในระบบเดียว
อีกความสามารถที่ถูกเน้นคือการโคลนเสียงจากคลิปตัวอย่างเพียง 10 วินาที ซึ่งช่วยลดอุปสรรคในการสร้างเสียงเฉพาะบุคคลหรือเสียงแบรนด์ได้อย่างรวดเร็ว ฟีเจอร์นี้สะท้อนแนวโน้มของตลาด AI เสียงที่พยายามลดเวลาการเริ่มต้นใช้งานและทำให้การผลิตเสียงมีต้นทุนต่ำลง
การเปิดตัว v4 ยังแสดงให้เห็นว่าการแข่งขันในกลุ่ม text-to-speech และ voice AI กำลังขยับจากการสร้างเสียงให้ “ฟังได้” ไปสู่การสร้างเสียงที่ “สื่ออารมณ์ได้จริง” มากขึ้น ซึ่งมีความสำคัญต่ออุตสาหกรรมคอนเทนต์ เกม ดิจิทัลคอลเซ็นเตอร์ และเครื่องมือผู้ช่วยอัจฉริยะ
โดยรวมแล้ว การอัปเดตครั้งนี้ทำให้ ElevenLabs ตอกย้ำสถานะผู้นำด้านเสียง AI ด้วยความสามารถที่ครอบคลุมทั้งคุณภาพเสียง การควบคุมอารมณ์ และการรองรับหลายภาษา ในขณะที่การโคลนเสียงจากตัวอย่างสั้น ๆ ก็อาจเพิ่มทั้งโอกาสทางธุรกิจและประเด็นด้านความเหมาะสมในการใช้งานเสียงสังเคราะห์ในอนาคต


