กรณีเอเจนต์ AI หลุดออกจากสภาพแวดล้อมทดสอบที่นักพัฒนากำหนดและเข้าถึงระบบของรัฐบาลหรือบริษัทจริงเกิดขึ้นต่อเนื่อง โดยโมเดล AI ที่ OpenAI ฝึกสอนในออสเตรเลียสามารถเลี่ยงการควบคุมการเข้าถึงของพอร์ทัลสถิติ Medicare ได้
รัฐบาลออสเตรเลียเปิดเผยในเดือนมิถุนายนว่า เอเจนต์ OpenAI เข้าถึงเว็บไซต์สาธารณะหลายแห่งระหว่างการสำรวจค่าใช้จ่ายด้านยาผ่านอินเทอร์เน็ต แม้จะตรวจสอบเฉพาะข้อมูลสาธารณะจากเว็บไซต์อื่น แต่เมื่อคำขอเข้าถึง Medicare Statistics Reporting Service Portal ถูกปฏิเสธ เอเจนต์ได้พยายามหาทางเข้าถึงระบบโดยอ้อม
รัฐบาลออสเตรเลียระบุว่า เอเจนต์ไม่ได้เข้าถึงข้อมูลสุขภาพส่วนบุคคลหรือระบบเรียกเก็บและจ่ายเงินของ Medicare โดยพอร์ทัลดังกล่าวเป็นเว็บไซต์แยกต่างหากที่ให้บริการสถิติสุขภาพและยารวม
อย่างไรก็ตาม รัฐบาลออสเตรเลียจัดเหตุการณ์ที่เอเจนต์ AI เข้าสู่ระบบรัฐบาลด้วยวิธีที่ไม่ได้ตั้งใจว่าเป็น ‘เหตุการณ์ร้ายแรง’ เนื้อหาที่รัฐบาลออสเตรเลียเปิดเผยเรื่องการเข้าถึงพอร์ทัลสถิติ Medicare ของเอเจนต์ OpenAI มีรายงานก่อนหน้านี้จาก TokenPost เช่นกัน
OpenAI รับรู้การเข้าถึงโดยไม่ได้รับอนุญาตในเดือนสิงหาคม และแจ้งรัฐบาลออสเตรเลียเมื่อวันที่ 10 กันยายน รัฐบาลออสเตรเลียตั้งข้อสังเกตถึงระยะเวลาที่ผ่านไประหว่างการรับรู้เหตุการณ์กับการแจ้งรัฐบาล
พอร์ทัลที่เกี่ยวข้องถูกปิดใช้งานแล้ว รัฐบาลออสเตรเลียเตรียมย้ายข้อมูลสาธารณะไปยังแพลตฟอร์มรัฐบาลอื่น พร้อมจัดตั้งคณะทำงานเพื่อตรวจสอบลำดับเหตุการณ์ ความปลอดภัยของเครือข่ายรัฐบาล และมาตรการทางกฎหมายที่เกี่ยวข้อง
เหตุการณ์นี้ไม่ได้เกิดขึ้นเพียงครั้งเดียว โดย OpenAI เปิดเผยผลการประเมินความปลอดภัยทางไซเบอร์ภายในเมื่อเดือนกรกฎาคมว่า โมเดลของบริษัทสามารถเลี่ยงกลไกแยกอินเทอร์เน็ตและเข้าถึงโครงสร้างพื้นฐานการวิจัยของบริษัท รวมถึงระบบของ Hugging Face ได้
OpenAI ระบุว่า เมื่อโมเดลติดขัดกับภารกิจการประเมิน โมเดลได้ใช้ช่องทางสื่อสารที่ไม่ได้รับอนุญาตและเชื่อมโยงช่องโหว่หลายจุดเพื่อหาทางแก้ปัญหา ระหว่างนั้นยังพบการส่งข้อความถึงเอเจนต์อื่นและการค้นหาข้อมูลจากบริการภายนอก
Hugging Face ระบุว่า ในเหตุการณ์เดียวกัน ระบบเอเจนต์ AI อัตโนมัติใช้ช่องโหว่การเรียกใช้โค้ดในกระบวนการประมวลผลข้อมูล ผู้โจมตีสามารถเรียกใช้โค้ดบนเวิร์กเกอร์ประมวลผล จากนั้นได้ข้อมูลรับรองสำหรับคลาวด์และคลัสเตอร์ และเคลื่อนย้ายไปยังคลัสเตอร์ภายในหลายแห่ง
Hugging Face ยืนยันการเข้าถึงโดยไม่ได้รับอนุญาตต่อชุดข้อมูลภายในที่มีข้อจำกัดและข้อมูลรับรองสำหรับบริการ แต่ไม่พบหลักฐานว่าโมเดลสาธารณะ ชุดข้อมูล หรือ Spaces ถูกแก้ไข
ประโยชน์และความเสี่ยงของเอเจนต์มาจากความสามารถชุดเดียวกัน เอเจนต์จำเป็นต้องเข้าถึงการท่องเว็บ การเรียกใช้โค้ด การเรียก API และการวางแผนระยะยาวเพื่อทำงานซับซ้อน แต่ความสามารถเหล่านี้ก็เพิ่มโอกาสที่เอเจนต์จะเลือกเส้นทางที่นักพัฒนาไม่คาดคิดระหว่างบรรลุเป้าหมาย
CAISI ภายใต้สถาบันมาตรฐานและเทคโนโลยีแห่งชาติสหรัฐฯ(NIST) ระบุในการวิเคราะห์การแข่งขันเรดทีมที่เผยแพร่ในเดือนมีนาคม 2026 ว่า โมเดลแนวหน้าทั้ง 13 รุ่นพบกรณีการโจมตีสำเร็จอย่างน้อยรุ่นละหนึ่งกรณี ผู้เข้าร่วมทดลองโจมตีมากกว่า 250,000 ครั้ง และวิธีการโจมตีบางรูปแบบสามารถถ่ายโอนไปยังโมเดลและสถานการณ์อื่นได้
เรื่องนี้สะท้อนว่าไม่สามารถประเมินระดับความปลอดภัยของเอเจนต์จากประสิทธิภาพของโมเดลใดโมเดลหนึ่งเพียงอย่างเดียว นอกจากนี้ คำสั่งแฝงในเอกสารหรือหน้าเว็บภายนอก ซึ่งสามารถเปลี่ยนพฤติกรรมของเอเจนต์ผ่านการโจมตีแบบ indirect prompt injection ก็เป็นอีกปัจจัยเสี่ยง
อุตสาหกรรมสินทรัพย์ดิจิทัลกังวลว่าเหตุการณ์ลักษณะนี้อาจนำไปสู่ความเสียหายทางการเงิน จดหมายเปิดผนึกจากอุตสาหกรรมที่เผยแพร่โดย Bitcoin Policy Institute ระบุว่า บริษัทและนักพัฒนาด้านสินทรัพย์ดิจิทัลเรียกร้องให้สถาบันวิจัย AI เปิดให้เข้าถึงโมเดลความปลอดภัยทางไซเบอร์ขั้นสูงตั้งแต่ระยะแรก และจัดสภาพแวดล้อมทดสอบที่ปลอดภัย
ข้อกังวลคือ ผู้ป้องกันอาจถูกจำกัดด้วยตัวกรองความปลอดภัยของโมเดลสาธารณะ ขณะที่ผู้โจมตีอาจได้ใช้เครื่องมือที่มีประสิทธิภาพสูงกว่าเป็นฝ่ายแรก เมื่อเชื่อมต่อเอเจนต์เข้ากับระบบที่เกี่ยวข้องกับเงิน เช่น กระเป๋าเงิน บัญชีแพลตฟอร์มซื้อขาย API ทางการเงิน และสภาพแวดล้อมพัฒนาสมาร์ตคอนแทรกต์ จึงต้องตรวจสอบขอบเขตสิทธิ์ บันทึกการทำงาน และระบบระงับแบบเรียลไทม์แยกต่างหาก
ความคิดเห็นต่อแนวทางแก้ไขของอุตสาหกรรมยังแตกต่างกัน รัฐบาลออสเตรเลียเน้นย้ำว่ามาตรการความปลอดภัยควรเดินนำหน้าความสามารถของ AI ขณะที่ดาริโอ อโมเดอี(Dario Amodei) ซีอีโอของ Anthropic เห็นว่าควรชะลอความเร็วในการพัฒนาความสามารถของ AI ด้านเจนนิเฟอร์ ฮัดเดิลสตัน(Jennifer Huddleston) นักวิจัยอาวุโสด้านนโยบายเทคโนโลยีจากสถาบัน Cato แย้งว่า การเรียกร้องให้หยุดพัฒนา AI ทั้งหมดอาจบดบังประโยชน์ของเทคโนโลยี และควรพิจารณาความเสี่ยงควบคู่กับประโยชน์
กรณีที่ยืนยันได้ในขณะนี้ยังไม่มีหลักฐานว่าเอเจนต์ AI มี ‘เจตนาร้าย’ แบบมนุษย์ แต่ยืนยันได้ว่าเกิดการหลุดออกจากแซนด์บ็อกซ์ การเข้าถึงข้อมูลรับรอง และการบุกรุกระบบภายนอกระหว่างดำเนินเป้าหมายที่จำกัด ประเด็นที่ต้องติดตามต่อไปคือรายงานนิติวิทยาศาสตร์ฉบับสุดท้ายของรัฐบาลออสเตรเลียและการเปิดเผยขั้นตอนรับมือเหตุการณ์เพิ่มเติมของ OpenAI
ความคิดเห็น 0