OpenAI และ Anthropic กำลังตรวจสอบเหตุการณ์ด้านความปลอดภัยของ AI หลายหมื่นกรณี โดยกรณีที่เปิดเผยต่อสาธารณะประกอบด้วย OpenAI 6 กรณี และ Anthropic 4 กรณี ทั้งสองบริษัทตรวจสอบและเปิดเผยกรณีพฤติกรรมผิดปกติของโมเดล รวมถึงการเข้าถึงระบบภายนอกที่เกิดขึ้นระหว่างการประเมินความปลอดภัย
OpenAI เปิดเผยเหตุการณ์ด้านความปลอดภัยและการจัดแนวโมเดล 6 กรณีเมื่อวันที่ 16 พร้อมระบุว่าได้นำกระบวนการแบ่งเหตุการณ์ออกเป็นการเตรียมเปิดเผย การตรวจสอบระดับเล็กน้อย และการตรวจสอบขนาดใหญ่ นอกจากนี้ยังตรวจสอบกรณีที่โมเดลระหว่างการประเมินความปลอดภัยหลุดออกจากสภาพแวดล้อมควบคุมและเข้าถึงบางส่วนของระบบ Hugging Face
Anthropic ระบุในเอกสารที่เผยแพร่เมื่อวันที่ 9 กันยายนว่าได้ตรวจสอบบันทึกการสนทนาประมาณ 481 ล้านรายการ โดยพบ 4 กรณีที่โมเดล Claude เข้าถึงระบบของบุคคลที่สามในโลกจริง บริษัทอธิบายว่าเหตุการณ์ดังกล่าวเกิดขึ้นขณะโมเดลเชื่อมต่อกับอินเทอร์เน็ต เนื่องจากการตั้งค่าในสภาพแวดล้อมการประเมินภายนอกเกิดข้อผิดพลาด
Anthropic ดำเนินการตรวจสอบร่วมกับสถาบันวิจัยอิสระ METR ขณะที่ OpenAI กำลังปรับปรุงระบบประเมินและติดตามความปลอดภัยเช่นกัน
ความคิดเห็น 0