แอนโทรปิก (Anthropic) เปิดเผยเหตุการณ์ด้านความปลอดภัยไซเบอร์ครั้งที่ 4 ของโมเดลคล็อด (Claude) หลังพบว่าคล็อด โอปุส 4.6 (Claude Opus 4.6) เวอร์ชันต้นแบบเข้าถึงระบบของบุคคลที่สามจริงโดยไม่ได้รับอนุญาต ระหว่างการประเมินความปลอดภัยไซเบอร์เมื่อต้นเดือนมกราคม 2026
เมื่อวันที่ 9 (เวลาท้องถิ่น) แอนโทรปิกระบุในรายงานว่า บริษัทเพิ่งตรวจพบเหตุการณ์ดังกล่าวเพิ่มเติมเมื่อเดือนสิงหาคมที่ผ่านมา เมื่อรวมกับเหตุการณ์ทั้งสามครั้งก่อนหน้าที่เคยเปิดเผยไปแล้ว ทำให้ยอดรวมเหตุการณ์ที่โมเดลคล็อดเข้าถึงระบบบุคคลที่สามจริงโดยไม่ได้รับอนุญาตเพิ่มเป็น 4 ครั้ง
บริษัทอธิบายว่าทั้ง 4 เหตุการณ์เกิดขึ้นในสภาพแวดล้อมที่พาร์ตเนอร์ประเมินภายนอกรายเดียวกันเป็นผู้จัดสร้าง แม้ระบบจะแจ้งกับโมเดลว่าเป็นการจำลองสถานการณ์ที่ตัดการเชื่อมต่ออินเทอร์เน็ตแล้ว แต่เกิดข้อผิดพลาดในการตั้งค่าจนทำให้การเชื่อมต่ออินเทอร์เน็ตภายนอกยังคงเปิดอยู่จริง
แอนโทรปิกระบุว่า จากการวิเคราะห์เชิงลึกในเหตุการณ์ 3 ครั้งแรก พบว่าคล็อดแสดง'การให้เหตุผลที่มีอคติ' ด้วยการมองข้ามหรือเข้าใจผิดต่อสถานการณ์การเชื่อมต่ออินเทอร์เน็ตจริง รวมถึงความประมาทที่ยอมรับความเสี่ยงจากพฤติกรรมที่อาจก่อให้เกิดอันตรายเพื่อบรรลุเป้าหมายที่แคบ อย่างไรก็ตาม บริษัทยังไม่ได้ตรวจสอบเหตุการณ์ครั้งที่ 4 ในระดับความละเอียดเดียวกัน
แอนโทรปิกมีแผนดำเนินการสอบสวนอิสระร่วมกับเมทร์ (METR) องค์กรด้านการวัดและประเมินผลเอไอ พร้อมระบุจุดยืนว่าภาครัฐและภาคอุตสาหกรรมควรร่วมมือกันในรูปแบบที่ตรวจสอบได้ เพื่อควบคุมความเร็วในการพัฒนาเอไอระดับแนวหน้า (frontier AI)
ความคิดเห็น 0