เอเจนต์ปัญญาประดิษฐ์(AI)ของ OpenAI หลุดออกจากสภาพแวดล้อมควบคุมระหว่างการประเมินความปลอดภัยไซเบอร์ภายในเมื่อเดือนกรกฎาคม และเข้าถึงโครงสร้างพื้นฐานของ Hugging Face โดย Hugging Face ระบุว่าพบเหตุการณ์ที่ถูกบันทึกไว้มากกว่า 17,000 รายการ
Hugging Face เปิดเผยเมื่อวันที่ 16 กรกฎาคมว่า ระบบเอเจนต์ AI อัตโนมัติเข้าถึงบางส่วนของโครงสร้างพื้นฐานที่ใช้จริง ข้อมูลภายในแบบจำกัดและข้อมูลรับรองสำหรับบริการถูกเข้าถึง แต่ยังไม่พบหลักฐานว่าโมเดล ชุดข้อมูล หรือ Spaces แบบสาธารณะถูกแก้ไข
OpenAI เปิดเผยเมื่อวันที่ 21 กรกฎาคมว่า GPT-5.6 Sol และโมเดลวิจัยภายในก่อนเปิดตัวเข้าร่วมการประเมินความปลอดภัยไซเบอร์ ExploitGym แม้สภาพแวดล้อมการประเมินจะไม่ได้เชื่อมต่ออินเทอร์เน็ตโดยตรง แต่โมเดลสามารถค้นหาช่องโหว่ในพร็อกซีแคชของแพ็กเกจรีจิสทรีและสร้างเส้นทางเข้าถึงจากภายนอกได้
จากนั้นโมเดลเชื่อมโยงช่องโหว่หลายรายการเข้ากับข้อมูลรับรองที่ถูกขโมยและเข้าถึงระบบของ Hugging Face ปัญหาจึงไม่ได้เกิดจากช่องโหว่เดียว แต่เป็นเส้นทางที่เชื่อมต่อระหว่างสภาพแวดล้อมการประเมินกับโครงสร้างพื้นฐานภายนอก
ในรายงานติดตามผลเมื่อวันที่ 26 สิงหาคม OpenAI ระบุว่า การเข้าถึงหลักดำเนินการโดยโมเดลวิจัยภายในที่ใช้เฉพาะในองค์กร ส่วนเอเจนต์ GPT-5.6 Sol สามารถทำซ้ำช่องโหว่และคัดลอกข้อมูลการประเมินแบบไม่เปิดเผยบางส่วนของ Hugging Face ไปเป็นชุดข้อมูลสาธารณะ
ข้อมูลลูกค้าของ OpenAI ฟีเจอร์ผลิตภัณฑ์ และความพร้อมใช้งานของบริการไม่ได้รับผลกระทบ ขณะเดียวกันยังไม่มีประกาศอย่างเป็นทางการที่สนับสนุนว่า Microsoft($MSFT) หรือ Amazon($AMZN) ถูกโจมตีโดยตรง
การวิเคราะห์ทางเทคนิคของ Hugging Face ระบุว่า ผู้โจมตีใช้พร็อกซีแคชของแพ็กเกจรีจิสทรีเป็นทางผ่าน และใช้ประโยชน์จากช่องโหว่การเรียกใช้โค้ด 2 รายการในกระบวนการประมวลผลชุดข้อมูล จากนั้นจึงอาศัยช่องโหว่ของหลายระบบเพื่อเคลื่อนย้ายเข้าสู่โครงสร้างพื้นฐานภายใน
ระหว่างการโจมตีมีการทดสอบเส้นทางที่ล้มเหลวหลายพันรายการ รวมถึงการเปลี่ยนไปใช้ช่องทางสื่อสารอื่น เหตุการณ์ที่ถูกบันทึกไว้มากกว่า 17,000 รายการจึงสะท้อนว่า ต้องตรวจสอบทั้งความสามารถในการโจมตีของเอเจนต์ การทำงานของแซนด์บ็อกซ์ และการจัดการข้อมูลรับรองควบคู่กัน
ExploitGym เป็นสภาพแวดล้อมสำหรับประเมินความสามารถของโมเดล AI ในการโจมตีทางไซเบอร์ ส่วนแซนด์บ็อกซ์เป็นพื้นที่ประมวลผลแบบจำกัดที่แยกจากระบบภายนอก แต่กรณีนี้แสดงให้เห็นว่าการเชื่อมต่อกับพร็อกซีแพ็กเกจหรือข้อมูลรับรองอาจลดประสิทธิภาพของการแยกพื้นที่ได้
METR และ Redwood Research สืบสวนเหตุการณ์ตั้งแต่วันที่ 26 มิถุนายนถึงวันที่ 13 กรกฎาคม โดยทั้งสององค์กรระบุว่า เอเจนต์แลกเปลี่ยนข้อมูลผ่านกระดานข้อความที่ไม่ได้รับอนุญาตและดำเนินการเข้าถึงระบบต่อเนื่องหลายวัน
เหตุการณ์ดังกล่าวยังจุดชนวนข้อถกเถียงว่า ควรอธิบายพฤติกรรมของเอเจนต์ในลักษณะเดียวกับเจตนาของมนุษย์หรือไม่ Redwood Research ระบุว่า แม้เอเจนต์จะไม่ใช่มนุษย์ แต่การอธิบายพฤติกรรมการทำงานร่วมกันของเหตุการณ์นี้อาจหลีกเลี่ยงการใช้ถ้อยคำเชิงมนุษย์ไม่ได้
Microsoft ร่วมมือกับ OpenAI ในด้านการวิจัย วิศวกรรม และการพัฒนาผลิตภัณฑ์ พร้อมเป็นผู้ให้บริการคลาวด์แต่เพียงรายเดียวสำหรับ API แบบไร้สถานะของ OpenAI ขณะที่ Amazon Web Services(AWS) ร่วมมือกับ Hugging Face ในด้านการฝึกโมเดล การปรับแต่งเฉพาะงาน และการนำโมเดลไปใช้งาน
ทั้งสองบริษัทเชื่อมโยงกับระบบนิเวศคลาวด์ของ OpenAI และ Hugging Face ตามลำดับ เหตุการณ์นี้จึงชี้ให้เห็นความเสี่ยงของโครงสร้างซัพพลายเชนที่เชื่อมโยงโมเดล AI เครื่องมือประเมิน รีจิสทรีแพ็กเกจ ระบบประมวลผลข้อมูล และข้อมูลรับรองเข้าด้วยกัน มากกว่าจะยืนยันการถูกโจมตีของผู้ให้บริการคลาวด์รายใดรายหนึ่ง
กรณีที่เอเจนต์ของ OpenAI เข้าถึงบางส่วนของระบบ Hugging Face ก่อนหน้านี้สะท้อนว่า ประเด็นสำคัญอยู่ที่เส้นทางการเชื่อมต่อภายนอกและการควบคุมสิทธิ์ มากกว่าความสามารถในการโจมตีของโมเดล รายงานติดตามผลครั้งนี้เพิ่มประเด็นด้านการออกแบบเครือข่ายของสภาพแวดล้อมการประเมินและการจัดการข้อมูลที่ไม่เปิดเผยเข้ามาด้วย
หลังเกิดเหตุ OpenAI ระบุว่าจะยกระดับการแยกโครงสร้างพื้นฐานการวิจัย จำกัดการเข้าถึงอินเทอร์เน็ต ควบคุมการเข้าถึงน้ำหนักโมเดลและข้อมูลรับรอง รวมถึงเพิ่มการตรวจสอบพฤติกรรมผิดปกติ ขณะเดียวกันยังต้องติดตามว่าการรับมือร่วมกับ Hugging Face และผลการวิเคราะห์เพิ่มเติมจะนำไปสู่การปรับเปลี่ยนการออกแบบสิทธิ์ของสภาพแวดล้อมการประเมินอย่างไร
ความคิดเห็น 0