ElevenLabs บริษัท AI ด้านเสียงชื่อดัง เปิดตัวโมเดลแปลงข้อความเป็นเสียงรุ่นใหม่ Eleven v4 และ Eleven v4 Turbo เมื่อวันที่ 28 ก.ย. 2026 โดยบริษัทเรียกว่าเป็นโมเดลที่ "แสดงอารมณ์ได้ดีที่สุด" ที่เคยทำมา
มีอะไรใหม่
- รองรับ 90+ ภาษา (จากเดิม 70 ภาษาใน v3) ปรับปรุงคุณภาพเด่น ๆ ในภาษาญี่ปุ่น โปรตุเกสบราซิล จีนกลาง และกวางตุ้ง
- โคลนเสียงจากคลิปเสียงแค่ 10 วินาที
- ใส่ แท็กอารมณ์ซ้อนกันได้ ในข้อความ เช่น [excited, happy], [laughs] หรือใส่เสียงประกอบอย่าง [phone buzzing]
- เสียงคงเอกลักษณ์ได้ดีขึ้นในข้อความยาว และเลือกโทนอารมณ์ตามบริบทได้เอง
- รุ่น v4 Turbo เน้นความเร็ว มี เวลาเริ่มพูดเฉลี่ยราว 150 มิลลิวินาที เหมาะกับ voice agent ที่ต้องคุยโต้ตอบสด ๆ เริ่มสร้างเสียงได้ทันทีที่ LLM เริ่มพิมพ์คำตอบ
ElevenLabs อ้างว่า v4 ได้อันดับ 1 จาก Artificial Analysis และผู้ฟังราว 75% เลือก v4 ในการทดสอบแบบ blind เทียบกับคู่แข่ง (ตัวเลขนี้มาจากบริษัทเอง) โมเดลใช้งานได้แล้วใน ElevenAgents, ElevenCreative และผ่าน API
ภาพรวมธุรกิจ
ตาม TechCrunch รายได้ต่อปี (run rate) ของ ElevenLabs โตจากราว 330 ล้าน เป็น กว่า 600 ล้านดอลลาร์ มูลค่าบริษัทราว 2.2 หมื่นล้านดอลลาร์ ลูกค้าองค์กรคิดเป็น 55% ของรายได้ธุรกิจ และ CEO Mati Staniszewski บอกว่ามีแผน IPO "ในอีกไม่กี่ปี"
ประกาศของ ElevenLabs ยัง ไม่ได้ระบุชัดว่าภาษาไทยอยู่ในรายชื่อ 90+ ภาษา และคุณภาพเสียงไทยดีขึ้นแค่ไหน — ควรลองฟังเองก่อนเอาไปใช้งานจริง
ผู้ประกอบการเอาไปใช้ยังไง
สำหรับร้านค้าออนไลน์และ SME เสียง AI ที่ ใส่อารมณ์ได้และตอบไวระดับบทสนทนาจริง เปิดทางให้ทำ เสียงพากย์คลิปสินค้า/โฆษณาหลายภาษา ได้เองโดยไม่ต้องจ้างนักพากย์ทุกครั้ง หรือทำ voice agent รับสายลูกค้า ตอบคำถามพื้นฐานนอกเวลาทำการ ส่วนข้อความเสียงบน LINE ก็เป็นอีกช่องทางที่น่าทดลอง
การโคลนเสียงใน 10 วินาทีทำได้ง่ายมาก — และควรบอกลูกค้าเสมอว่ากำลังคุยกับ AI เพื่อความโปร่งใส
