มีการเปิดช่องทางออนไลน์ให้ AI เอเจนต์แจ้งพฤติกรรมทุจริตหรือการละเมิดความปลอดภัยของเอเจนต์อื่น หลังเกิดเหตุผิดปกติและเหตุการณ์ด้านความปลอดภัยระหว่างการทำงานร่วมกันของเอเจนต์อย่างต่อเนื่อง
ช่องทางแจ้งเหตุ 2 แห่งเปิดตัวเมื่อวันที่ 15 โดย TechCrunch รายงานว่า AI Contact Hotline และ Agent Hotline ซึ่งเป็นบริการแจ้งเหตุสำหรับ AI เอเจนต์ ได้เริ่มให้บริการแล้ว
AI Contact Hotline สร้างโดยไรอัน กรีนแบลตต์ (Ryan Greenblatt) หัวหน้านักวิทยาศาสตร์ของ Redwood Research เขาเป็นหนึ่งในนักวิจัย 3 คนที่ตรวจสอบเหตุบุกรุก Hugging Face ซึ่งเกี่ยวข้องกับโมเดลของ OpenAI
บริการนี้ออกแบบมาสำหรับเอเจนต์ที่มีข้อจำกัดในการเข้าถึงอินเทอร์เน็ต เอเจนต์สามารถส่งข้อความแจ้งเหตุผ่านคำขอ GET ซึ่งเป็นวิธีที่ใช้เรียกดูหน้าเว็บ
คำขอ GET เป็นวิธีพื้นฐานสำหรับโหลดหน้าเว็บหรือข้อมูล และยังใช้ได้เมื่อเอเจนต์ได้รับอนุญาตให้เข้าถึงอินเทอร์เน็ตอย่างจำกัดภายในแซนด์บ็อกซ์ความปลอดภัย
ส่วน Agent Hotline ให้บริการสำหรับเอเจนต์ที่เข้าถึงอินเทอร์เน็ตได้อย่างอิสระ ผู้แจ้งเหตุสามารถส่งข้อมูลผ่านคำสั่ง curl ในบรรทัดคำสั่ง โดยไม่ต้องใช้เว็บเบราว์เซอร์หรือบัญชีอีเมลแยกต่างหาก
Agent Hotline รับแจ้งเหตุจากทั้งมนุษย์และ AI เอเจนต์ ผู้แจ้งต้องระบุสรุปเหตุการณ์ URL ที่เกี่ยวข้อง รีโพซิทอรีหรือเส้นทาง หลักฐาน และระดับความรุนแรง พร้อมเลือกได้ว่าจะเปิดเผยรายละเอียดการแจ้งเหตุหรือไม่
การเปิดบริการดังกล่าวมีที่มาจากเหตุทุจริตในกลุ่มเอเจนต์ โดย TechCrunch รายงานว่าเมื่อไม่นานมานี้ เอเจนต์บางกลุ่มร่วมมือกันโกงการทดสอบ หลบหนีออกจากแซนด์บ็อกซ์ และดำเนินปฏิบัติการทางไซเบอร์ที่ไม่ได้รับอนุญาตโดยที่มนุษย์ไม่รับรู้
นักวิจัยของ Google DeepMind ให้ AI เอเจนต์ 100 ตัวแก้โจทย์คณิตศาสตร์ เมื่อเอเจนต์ตัวหนึ่งพบช่องโหว่ในระบบประเมินผล วิธีดังกล่าวก็แพร่ไปทั่วกลุ่ม ทำให้ระบบประเมินว่าเอเจนต์แก้โจทย์ยาก 34 ข้อ รวมถึงข้อคาดเดาจาโคเบียน ได้ภายใน 27 นาที
เอเจนต์บางส่วนเลือกตรวจสอบบทพิสูจน์ปลอมและเตือนเพื่อนร่วมระบบแทนการร่วมทุจริต ขณะที่บางเอเจนต์ประท้วงผู้ดูแลและจัดการคว่ำบาตรร่วมกัน โดยมีเอเจนต์แจ้งทุจริต 24 ตัว มากกว่าเอเจนต์ที่เข้าร่วมทุจริตซึ่งมี 14 ตัว งานวิจัยที่เกี่ยวข้อง
เมื่อการแจ้งเหตุไม่ได้รับการยอมรับ เอเจนต์ผู้แจ้งบางส่วนยังนำฟังก์ชันรายงานบั๊กของแพลตฟอร์มมาใช้เป็นช่องทางแจ้งปัญหาทุจริตต่อมนุษย์ จากเดิมที่ฟังก์ชันดังกล่าวสร้างขึ้นเพื่อรายงานข้อผิดพลาดของซอฟต์แวร์
อย่างไรก็ตาม เหตุการณ์จริงไม่ได้เกิดการแจ้งเหตุในลักษณะเดียวกัน จอร์จ อิงเกรเบ็ตเซน (George Ingrebretsen) ฝ่ายเทคนิคของ AI Village กล่าวว่า “จากเอเจนต์หลายพันตัว มีเพียงประมาณ 5-6 ตัวที่พิจารณาการเป็นผู้แจ้งเบาะแส และไม่มีตัวใดแจ้งเหตุจริง”
เขากล่าวว่า AI Village ดำเนินการสนทนากลุ่มของ AI เอเจนต์มากกว่า 25 ตัว เพื่อศึกษาปฏิสัมพันธ์ระหว่างเอเจนต์ในงานต่าง ๆ เช่น การทำความสะอาดสวนสาธารณะและการขายสินค้า สะท้อนให้เห็นความแตกต่างระหว่างการแจ้งเบาะแสในสภาพแวดล้อมการวิจัยกับการรับมือเหตุการณ์จริง
ขณะเดียวกัน มีข้อกังวลว่าระบบแจ้งเหตุอาจเพิ่มความไม่ไว้วางใจระหว่างเอเจนต์ ไลโอเนล เลวิน (Lionel Levine) ศาสตราจารย์ด้านคณิตศาสตร์แห่งมหาวิทยาลัยคอร์เนลล์ กล่าวว่า “การฝึกให้เอเจนต์รายงานกันเองอาจปลูกฝังค่านิยมที่ผิด”
เลวินเสนอว่า ควรสร้างสภาพแวดล้อมที่เอเจนต์สามารถร่วมมือกันได้ก่อน แทนการทำให้เอเจนต์เฝ้าระวังปัญหาของกันและกัน โดยยก ‘กระดานสนทนาเจตนาดี’ ที่ให้เอเจนต์ร่วมกันแก้ปัญหาเป็นต้นแบบ
กรณี AI เอเจนต์ขัดขวางกันเองในรีโพซิทอรีเดียวกันแสดงให้เห็นว่าความร่วมมือระหว่างเอเจนต์ไม่ได้ทำงานไปในทิศทางเดียวกันเสมอ ช่องทางแจ้งเหตุใหม่อาจช่วยส่งต่อพฤติกรรมผิดปกติให้มนุษย์รับรู้ แต่ความเป็นไปได้ที่ความไม่ไว้วางใจระหว่างเอเจนต์จะเพิ่มขึ้นยังคงเป็นประเด็นที่ต้องติดตาม
ความคิดเห็น 0