OpenAI ได้ประกาศเปิดตัว GPT-Live ซึ่งเป็นโมเดลเสียงรุ่นใหม่ที่ออกแบบมาเพื่อยกระดับประสบการณ์การสนทนาใน ChatGPT ให้มีความเป็นธรรมชาติและสมจริงมากยิ่งขึ้น โมเดลนี้ใช้สถาปัตยกรรมแบบ Full-Duplex ซึ่งหมายความว่าสามารถรับฟังและตอบสนองได้ในเวลาเดียวกัน ทำให้การโต้ตอบระหว่างผู้ใช้กับ AI มีความลื่นไหลและต่อเนื่อง ไม่มีการหยุดชะงัก
GPT-Live ได้รับการพัฒนาขึ้นเพื่อมอบประสบการณ์การสนทนาที่ใกล้เคียงกับการพูดคุยกับมนุษย์มากที่สุด โดยสามารถแทรกคำพูดสั้นๆ เช่น "อืม" หรือ "ครับ" ได้ในขณะที่ผู้ใช้กำลังพูด หรือจะเงียบเพื่อรอให้ผู้ใช้คิดและพูดจบก่อนก็ได้ ความสามารถนี้ช่วยลดความรู้สึกเหมือนกำลังคุยกับเครื่องจักร และทำให้การใช้งาน ChatGPT ด้วยเสียงมีความน่าสนใจและมีประสิทธิภาพมากขึ้น
โมเดลใหม่นี้กำลังทยอยเปิดให้ใช้งานใน ChatGPT แล้ว และ OpenAI ยังมีแผนที่จะนำ GPT-Live-1 และ GPT-Live-1 mini ไปยัง API ในเร็วๆ นี้ เพื่อให้นักพัฒนาและองค์กรต่างๆ สามารถนำไปประยุกต์ใช้ในผลิตภัณฑ์และบริการของตนเองได้ การอัปเกรดครั้งนี้ถือเป็นก้าวสำคัญในการพัฒนาปฏิสัมพันธ์ระหว่างมนุษย์กับ AI ผ่านช่องทางเสียง
ผู้ที่ได้ทดลองใช้งาน GPT-Live ต่างแสดงความประทับใจในความสามารถของโมเดลใหม่นี้ โดยหลายคนกล่าวว่ามันทำให้การสนทนาด้วยเสียงกับ AI รู้สึกเหมือนกำลังคุยกับคนจริงๆ และคาดว่านี่จะเป็นอนาคตของการโต้ตอบกับระบบปัญญาประดิษฐ์ขั้นสูง





