Suno เปิดตัวฟีเจอร์ Speech สร้างเสียงพูดพร้อมดนตรี AI
Suno แพลตฟอร์มสร้างเพลงด้วย AI เปิดตัวฟีเจอร์ Speech ในรูปแบบเบต้า รองรับความยาวสูงสุด 8 นาที ทั้งบนเว็บและมือถือ

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
- Suno เปิดตัวฟีเจอร์ Speech สร้างเสียงพูดประกอบดนตรี AI
- รองรับทั้งโหมด Simple และ Advanced ปรับแต่งเสียงได้
- ความยาวสูงสุดต่อคลิปประมาณ 8 นาที เปิดให้ใช้งานแบบเบต้าแล้ว
Suno แพลตฟอร์มสร้างเพลงด้วยปัญญาประดิษฐ์ (AI) กำลังขยายขอบเขตการให้บริการไปสู่วงการเสียงพูด โดยได้เปิดตัวฟีเจอร์ใหม่ที่เรียกว่า Speech ซึ่งมีความสามารถในการสร้างเสียงพูดสังเคราะห์จากข้อความสคริปต์หรือคำอธิบายพรอมต์ โดยจุดเด่นคือการผสานเสียงบรรยายเข้ากับดนตรีพื้นหลังที่สร้างจาก AI ในแทร็กเดียวกัน
Jack Brody ประธานเจ้าหน้าที่ฝ่ายผลิตภัณฑ์ของ Suno ระบุว่าเสียงเพลงยังคงเป็นหัวใจสำคัญของบริษัทเสมอมา แต่เป้าหมายและวิสัยทัศน์ของพวกเขาต้องการขยายขอบเขตไปสู่รูปแบบการแสดงออกของมนุษย์ในด้านอื่นๆ เพิ่มเติมด้วย การเปิดตัว Speech ในครั้งนี้จึงถือเป็นโมเดลเสียงรุ่นแรกที่ผสานเสียงพูดและเสียงดนตรีเข้าด้วยกันอย่างกลมกลืน

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
แม้เทคโนโลยีการสังเคราะห์เสียงพูดด้วย AI จะไม่ใช่เรื่องใหม่ เนื่องจากมีผู้เล่นรายใหญ่อย่าง Adobe และ ElevenLabs ทำตลาดอยู่ก่อนแล้ว รวมถึง DeepMind ที่พัฒนาเทคโนโลยีนี้มานานนับทศวรรษ แต่การก้าวเข้าสู่ตลาดนี้ของ Suno ก็ถือเป็นกลยุทธ์สำคัญในการกระจายความเสี่ยงและเพิ่มความหลากหลายให้กับแพลตฟอร์ม หลังจากที่เครื่องมือสร้างเพลงของพวกเขาต้องเผชิญกับคดีความด้านลิขสิทธิ์จำนวนมาก
ผู้ใช้งานสามารถเข้าถึงฟีเจอร์ Speech ได้ผ่านทางเว็บไซต์และแอปพลิเคชันมือถือของ Suno ในช่วงเบต้าสาธารณะ โดยมีรายละเอียดการใช้งานดังนี้
- เปิดใช้งานผ่านแท็บ Create แล้วเลือกฟีเจอร์ Speech
- โหมด Simple สำหรับพิมพ์คำอธิบายสไตล์ที่ต้องการ เช่น เสียงกัปตันโจรสลัดปลุกขวัญลูกเรือ
- โหมด Advanced สำหรับใส่สคริปต์ข้อความที่ต้องการให้อ่านอย่างเจาะจง
- สามารถปรับแต่งเพศของเสียง สไตล์การพูด และตั้งค่าระยะเวลาสูงสุดได้ราว 8 นาที
การขยายตัวของ Suno ไปสู่การสร้างเสียงพูดถือเป็นก้าวสำคัญที่สะท้อนให้เห็นว่าผู้พัฒนา AI ด้านเสียงพยายามเพิ่ม Use Case ให้กว้างขึ้น นอกเหนือจากการผลิตเพลงสั้นเพื่อความบันเทิง โดยการควบรวมเสียงพูดเข้ากับดนตรีประกอบแบบอัตโนมัติอาจช่วยลดขั้นตอนการทำงานของผู้ผลิตคอนเทนต์ เช่น การทำพอดแคสต์ วิดีโอสั้น หรือสื่อการสอน แต่ในขณะเดียวกันก็ต้องจับตาดูว่าฟีเจอร์นี้จะเผชิญกับข้อจำกัดด้านลิขสิทธิ์หรือการนำไปใช้ในทางที่ผิดเหมือนกับเครื่องมือสร้างเพลงของบริษัทหรือไม่
ฟีเจอร์นี้ถูกออกแบบมาให้มีความยืดหยุ่นสูง โดยผู้ใช้สามารถกดปิดดนตรีพื้นหลังได้หากต้องการเพียงแค่เสียงพูดที่สะอาดไร้เสียงรบกวน หรือจะเปิดใช้งานร่วมกันเพื่อสร้างบรรยากาศที่เหมาะสมกับบทกวีและเสียงบรรยายเชิงดราม่า ทาง Suno ยอมรับว่าตัวระบบในตอนนี้ยังมีความไม่สมบูรณ์แบบ โดย Jack Brody ระบุติดตลกว่าบางครั้งสำเนียงอังกฤษอาจเพี้ยนไปเป็นสำเนียงออสเตรเลียได้ และการเว้นจังหวะอาจจะดูดราม่าเกินจริง พร้อมทั้งคาดหวังว่าผู้ใช้งานจะค้นพบประโยชน์ใหม่ๆ ที่ทีมพัฒนาคาดไม่ถึง
ที่มา: The Verge
พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้
ความคิดเห็น
แสดงความคิดเห็น