โดมินิก-มาดอรี เดวิส ผู้สื่อข่าวอาวุโสจาก TechCrunch รายงานการทดสอบสร้างร่างอวตารดิจิทัล (Digital Twin) ของตนเองผ่านเทคโนโลยีของ Synthesia สตาร์ตอัปผู้พัฒนาปัญญาประดิษฐ์เชิงสร้างสรรค์วิดีโอ ซึ่งเพิ่งบรรลุมูลค่ากิจการที่ 4 พันล้านดอลลาร์สหรัฐเมื่อต้นปี 2026 และมีรายได้ประจำปี (ARR) ทะลุ 100 ล้านดอลลาร์สหรัฐ โดยเทคโนโลยีนี้ถูกออกแบบมาเพื่อช่วยให้องค์กรธุรกิจสามารถสร้างตัวแทนเสมือนจริงสำหรับงานบริการลูกค้า การฝึกอบรมพนักงาน และงานประชาสัมพันธ์ได้อย่างมีประสิทธิภาพ
กระบวนการสร้างอวตารเริ่มต้นจากการบันทึกภาพถ่ายความละเอียดสูงและการบันทึกเสียงตัวอย่างความยาว 2 นาทีในสตูดิโอของ Synthesia จากนั้นระบบจะประมวลผลผ่านสแต็กเทคโนโลยีที่ผสานการทำงานของโมเดลแปลงเสียงเป็นข้อความ (Voice-to-Text) โมเดลภาษาเชิงเอเจนต์ (Agentic Language Model) โมเดลแปลงข้อความเป็นเสียง (Text-to-Voice) และโมเดลสร้างวิดีโอของ Synthesia เองเพื่อขับเคลื่อนการเคลื่อนไหวของใบหน้า นอกจากนี้ แพลตฟอร์มยังเปิดกว้างให้ลูกค้าองค์กรเลือกใช้โมเดลเสียงภายนอกอย่าง Cartesia, ElevenLabs, Google หรือ OpenAI รวมถึงเลือกโฮสต์ระบบบนคลาวด์ส่วนตัวได้ตามต้องการ
อวตารโต้ตอบได้นี้ทำงานในรูปแบบกำหนดผลลัพธ์ล่วงหน้า (Deterministic) ซึ่งจะตอบคำถามเฉพาะข้อมูลที่ถูกป้อนเข้าไปในระบบเพื่อฝึกฝนเท่านั้น โดยในการทดสอบนี้ อวตารได้รับการฝึกด้วยข้อมูลจากบทความข่าวสืบสวนสอบสวนเรื่องการทุจริตในสตาร์ตอัป และจะไม่ตอบคำถามส่วนตัวหรือข้อมูลนอกเหนือจากบทความดังกล่าว เพื่อป้องกันปัญหาการสร้างข้อมูลเท็จ (Hallucination) ขณะที่ Synthesia ได้แบ่งผลิตภัณฑ์ออกเป็น 3 กลุ่มหลัก ได้แก่ แพลตฟอร์มสร้างวิดีโอจากสคริปต์ แพลตฟอร์มเอเจนต์โต้ตอบสำหรับการฝึกอบรม (Roleplay Sessions) และบริการเชื่อมต่อผ่าน API สำหรับนักพัฒนา