TechCrunch สร้างอวตารดิจิทัลอินเทอร์แรกทีฟของนักข่าว
Dominic-Madori Davis นักข่าวจาก TechCrunch ทดลองสร้างอวตารดิจิทัลอินเทอร์แรกทีฟของตัวเองกับบริษัท Synthesia ในนิวยอร์ก เพื่อพูดคุยและตอบคำถามเกี่ยวกับบทความ

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
- Synthesia สร้างอวตารดิจิทัลอินเทอร์แรกทีฟของ Dominic-Madori Davis นักข่าว TechCrunch
- อวตารถูกฝึกฝนด้วยบทความเฉพาะเรื่องสตาร์ทอัพที่สนับสนุนโดย VC
- กระบวนการสร้างใช้เวลาไม่กี่วันในสตูดิโอถ่ายทำที่สำนักงานใหม่ในนิวยอร์ก
- เทคโนโลยีขับเคลื่อนด้วยระบบเสียง วิดีโอ และภาษา AI หลายรุ่นรวมกัน
เมื่อช่วงฤดูร้อนที่ผ่านมา Alexandru Voica หัวหน้าฝ่ายกิจการองค์กรของ Synthesia สตาร์ทอัพด้านวิดีโอเจนเนอเรชัน ได้ส่งลิงก์แนะนำสมาชิกใหม่ในทีมประชาสัมพันธ์ ซึ่งก็คืออวตารเสมือนจริงแบบอินเทอร์แรกทีฟที่ถูกฝึกมาเพื่อตอบคำถามทั่วไปเกี่ยวกับบริษัท การพบเจอครั้งนั้นทำให้ Davis มองว่านี่คือขั้นสุดของการนำปัญญาประดิษฐ์มาใช้ในงานประชาสัมพันธ์
ต่อมาในเดือนกันยายน Synthesia ได้เชิญ Davis ไปเยี่ยมชมสำนักงานแห่งใหม่ในนครนิวยอร์ก สตาร์ทอัพรายนี้ก่อตั้งขึ้นครั้งแรกในสหราชอาณาจักร และปัจจุบันมีมูลค่าบริษัทแตะ 4,000 ล้าน dollar พร้อมกับรายได้ประจำปี ARR ทะลุ 100 ล้าน dollar เมื่อปีที่ผ่านมา โดยเป็นหนึ่งในบริษัทดิจิทัลอวตารชั้นนำร่วมกับ D-ID, HeyGen และ Colossyan

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
บริษัทเปิดให้องค์กรธุรกิจสร้างวิดีโอฝึกอบรมอินเทอร์แรกทีฟ รวมถึงผลิตภัณฑ์ล่าสุดอย่าง Roleplay Sessions ที่ช่วยให้พนักงานฝึกซ้อมการขายสินค้ากับอวตาร AI ได้ เมื่อทีมงานเอ่ยปากชวน Davis ทำอวตารดิจิทัลของตัวเอง เธอก็ตอบตกลงทันทีโดยไม่ลังเล ถือเป็นครั้งแรกที่ Synthesia สร้างดิจิทัลอวตารให้กับนักข่าว หรือบุคคลภายนอกนอกเหนือจาก Voica
การสร้างอวตารเริ่มต้นขึ้นเมื่อ Davis เดินทางเข้าไปในสตูดิโอถ่ายทำขนาดเล็กภายในสำนักงานของ Synthesia โดยมีการบันทึกภาพถ่ายจำนวนมากและเสียงพูดความยาวสองนาที หลังจากได้รับความยินยอม ตัวตนดิจิทัลของเธอก็ถือกำเนิดขึ้น โดยมีการสร้างอวตารส่วนตัวที่ใช้อ่านสคริปต์ และอวตารอินเทอร์แรกทีฟที่สามารถโต้ตอบรับฟังได้ ทั้งแบบใส่แว่นและไม่ใส่แว่น
"This is the first time Synthesia has made a digital avatar for a journalist (or for anyone, period, outside of Voica)."
Dominic-Madori Davis
เทคโนโลยีเบื้องหลังอวตารนี้ประกอบด้วยระบบแปลงเสียงพูดเป็นข้อความ ระบบภาษาเอเจนต์ ระบบแปลงข้อความกลับเป็นเสียง และโมเดลวิดีโอของ Synthesia นอกจากนี้ลูกค้ายังสามารถเลือกใช้บริการจากห้องทดลองอื่นเช่น Cartesia, ElevenLabs, Google หรือ OpenAI รวมถึงเลือกโฮสต์บนคลาวด์ที่ต้องการได้อีกด้วย
การนำอวตาร AI มาใช้ในวงการสื่อสารมวลชนสะท้อนถึงการเปลี่ยนผ่านที่น่าจับตา แม้เครื่องมือเหล่านี้จะช่วยเพิ่มประสิทธิภาพในการเผยแพร่ข้อมูลหรือจำลองการสัมภาษณ์ แต่ความท้าทายสำคัญที่เทคโนโลยีไม่สามารถทดแทนได้คือความน่าเชื่อถือและการสร้างความสัมพันธ์อันลึกซึ้งระหว่างมนุษย์ ซึ่งเป็นหัวใจหลักของงานสื่อสารมวลชน
หลังจากใช้เวลาสองสามวัน ทีมงานก็สร้างอวตารเสร็จสิ้น Davis ได้ทดลองใช้ทั้งแบบส่วนตัวที่ให้พูดบทสคริปต์เกี่ยวกับฤดูใบไม้ร่วงในนิวยอร์ก และแบบอินเทอร์แรกทีฟที่ถูกจำกัดให้ตอบเฉพาะคำถามเกี่ยวกับบทความเรื่องการทุจริตในสตาร์ทอัพที่สนับสนุนโดย VC เท่านั้น ประสบการณ์ครั้งนี้ทำให้เธอกลับมาขบคิดถึงอนาคตของวงการสื่อว่าอวตารอาจเข้ามาช่วยเสริมหรือเข้ามาแทนที่นักข่าวในวันข้างหน้าหรือไม่
ที่มา: TechCrunch
พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้
ความคิดเห็น
แสดงความคิดเห็น