โอเพนเอไอ (OpenAI) เปิดตัว GPT-Realtime-1 บน API ในรูปแบบที่รองรับการสนทนาด้วยเสียงแบบสองทางเต็มรูปแบบ (Full-Duplex) ซึ่งสามารถฟังและพูดไปพร้อมกันได้ มีรายงานว่าโมเดลนี้ถูกผนวกเข้ากับ API แล้ว
สำนักข่าว PANews รายงานเมื่อวันที่ 11 (เวลาท้องถิ่น) ว่าโอเพนเอไอได้นำ GPT-Realtime-1 เข้าสู่ API โดยโมเดลดังกล่าวได้รับการปรับปรุงให้รองรับการขัดจังหวะของผู้ใช้ ช่วงเงียบระหว่างการพูด เสียงรบกวนจากสภาพแวดล้อม และบทสนทนาที่ยืดยาว รวมถึงรองรับสภาพแวดล้อมการโทรศัพท์ เช่น แอปพลิเคชันโทรศัพท์ด้วย
PANews ระบุว่าโอเพนเอไอเปิดเผยว่า ประสิทธิภาพของ GPT-Realtime-1 ในการทดสอบมาตรฐาน Full-Duplex สูงกว่ารุ่นก่อนหน้าอย่าง GPT Realtime 2.1 ถึง 30 จุดเปอร์เซ็นต์ นอกจากนี้ยังระบุด้วยว่า การทดสอบเบื้องต้นบนแพลตฟอร์มเรียนภาษา Speak พบว่าระบบมีอัตราการตัดสินผิดพลาดว่าผู้เรียน 'หยุดพูดแล้ว' ทั้งที่จริงเพียงหยุดคิด ลดลงราว 80% เมื่อเทียบกับระบบเสียงแบบลำดับขั้น (Sequential) รูปแบบเดิม
ความคิดเห็น 0