มีข้อเสนอให้รัฐบาลเข้ามามีส่วนร่วมโดยตรงในการประเมินโมเดลปัญญาประดิษฐ์ (AI) ขั้นสูงก่อนเปิดตัว เพื่อไม่ให้บริษัทเป็นผู้กำหนดระดับความเสี่ยงที่ AI ไม่ควรก้าวข้ามเพียงฝ่ายเดียว
มุสตาฟา สุไลมาน(Mustafa Suleyman) หัวหน้าฝ่าย AI ของไมโครซอฟท์($MSFT) กล่าวว่า โมเดล AI ขั้นสูงควรมี 'เส้นแดง' ที่ชัดเจน และไม่ควรมอบหมายระบบประเมินให้บริษัทเป็นผู้ดูแลเพียงฝ่ายเดียว ในจดหมายข่าวของ Bloomberg เมื่อวันที่ 24 โดยยังไม่มีการเสนอเกณฑ์ทางเทคนิคหรือกำหนดการบังคับใช้ที่ชัดเจน
ข้อเสนอนี้สอดคล้องกับการอภิปรายเรื่องการขยายการกำกับดูแล AI จากการตรวจสอบหลังเปิดตัว ไปสู่การประเมินก่อนเปิดตัว รัฐบาลอาจตรวจสอบระดับความเสี่ยงก่อนเผยแพร่โมเดล เพื่อเสริมมาตรฐานความปลอดภัยที่ผู้พัฒนากำหนดขึ้นเอง
ไมโครซอฟท์ได้ประกาศความร่วมมือกับศูนย์มาตรฐานและนวัตกรรม AI ของสหรัฐฯ (CAISI) และสถาบันความปลอดภัย AI ของสหราชอาณาจักร (AISI) เพื่อประเมินความปลอดภัยและความสามารถที่มีความเสี่ยงสูงของโมเดลแนวหน้าอยู่แล้ว ความร่วมมือทั้งสองแตกต่างจากระบบที่รัฐบาลอนุมัติการเปิดตัวโมเดลล่วงหน้า
ไมโครซอฟท์ระบุในเอกสารที่เผยแพร่เมื่อเดือนพฤษภาคมว่า บริษัทจะร่วมพัฒนาวิธีการประเมินเชิงโจมตีกับสถาบันมาตรฐานและเทคโนโลยีแห่งชาติสหรัฐฯ (NIST) การประเมินเชิงโจมตีเป็นการทดสอบพฤติกรรมที่ไม่คาดคิด ช่องทางการนำไปใช้ในทางที่ผิด และความเป็นไปได้ที่โมเดลจะล้มเหลวโดยเจตนา
การพัฒนายังครอบคลุมกรอบการทำงาน ชุดข้อมูล และขั้นตอนร่วม เพื่อเพิ่มความสามารถในการทำซ้ำผลการประเมิน และทำให้สามารถเปรียบเทียบผลการทดสอบโมเดลเดียวกันภายใต้เงื่อนไขใกล้เคียงกันได้
ความร่วมมือกับ AISI ของสหราชอาณาจักรมุ่งตรวจสอบความสามารถที่มีความเสี่ยงสูงและประสิทธิผลของมาตรการป้องกัน ขอบเขตความร่วมมือยังรวมถึงการวิจัยด้านความยืดหยุ่นทางสังคม เพื่อศึกษาว่า AI แบบสนทนามีปฏิสัมพันธ์กับผู้ใช้อย่างไรในสถานการณ์ละเอียดอ่อน
CAISI ทำหน้าที่เป็นช่องทางของรัฐบาลสหรัฐฯ สำหรับการทดสอบระบบ AI เชิงพาณิชย์และการวิจัยร่วม เมื่อเดือนพฤษภาคมที่ผ่านมา CAISI เปิดเผยผลการประเมินโมเดล AI จากจีน DeepSeek V4 Pro ในด้านความปลอดภัยไซเบอร์ วิศวกรรมซอฟต์แวร์ วิทยาศาสตร์ธรรมชาติ การให้เหตุผลเชิงนามธรรม และคณิตศาสตร์
AISI ของสหราชอาณาจักรกำลังประเมินโมเดลแนวหน้าในด้านไซเบอร์ ชีววิทยา เคมี ความเป็นอิสระ และมาตรการป้องกัน AISI ระบุว่าความสามารถด้าน AI บางส่วนพัฒนาเพิ่มขึ้นเป็นสองเท่าในเวลาประมาณ 8 เดือน พร้อมเตือนว่าผลการทดสอบแบบควบคุมอาจไม่สะท้อนทั้งประสิทธิภาพและความเสี่ยงในสภาพแวดล้อมการใช้งานจริง
กรอบการกำกับดูแลโมเดลแนวหน้าของไมโครซอฟท์ประกอบด้วยหลักการประเมินความสามารถที่มีความเสี่ยงสูง การตรวจสอบจากภายนอก การจัดประเภทความเสี่ยงของโมเดล และการเปิดเผยข้อมูลการประเมิน อย่างไรก็ตาม ข้อมูลที่มีความอ่อนไหวทางการค้าหรืออาจถูกนำไปใช้ในทางที่ผิดอาจมีข้อจำกัดในการเปิดเผย
การประเมินโดยรัฐบาลจะทำงานได้จริงก็ต่อเมื่อหน่วยงานประเมินมีความเป็นอิสระและเข้าถึงข้อมูลภายในของบริษัทได้ ขณะเดียวกัน ระดับข้อมูลที่ควรเปิดเผยต่อสาธารณะยังเป็นประเด็นที่รัฐบาลและผู้พัฒนาโมเดลต้องหารือร่วมกัน
ยังมีการหารือถึงแนวทางผสานการประเมินภายในบริษัทเข้ากับการประเมินจากภายนอก ก่อนหน้านี้ TokenPost รายงานถึง ความร่วมมือที่ให้หน่วยงานประเมิน AI เข้าไปประจำอยู่ภายใน Anthropic โดยในขณะนั้น ขอบเขตการเข้าถึงของผู้ประเมินและความเป็นอิสระทางการเงินก็เป็นประเด็นสำคัญ
ความคิดเห็นในโลกออนไลน์มีทั้งฝ่ายที่สนับสนุนการเพิ่มการกำกับดูแลของรัฐบาล และฝ่ายที่กังวลว่าบริษัทขนาดใหญ่อาจใช้กฎระเบียบเป็นเครื่องมือทำให้คู่แข่งรายเล็กเข้าสู่ตลาดได้ยากขึ้น อย่างไรก็ตาม ความคิดเห็นดังกล่าวมาจากผู้ใช้งานออนไลน์บางส่วน และไม่ควรนำไปสรุปเป็นจุดยืนของอุตสาหกรรมทั้งหมด
สำหรับบริษัท AI และผู้ใช้งานในประเทศ เกณฑ์การประเมินและขอบเขตการเปิดเผยข้อมูลอาจเป็นปัจจัยที่ต้องตรวจสอบระหว่างการนำโมเดลมาใช้งาน แต่ยังไม่มีการระบุว่าข้อเสนอนี้จะมีผลโดยตรงต่อกฎระเบียบในประเทศหรือขั้นตอนการเปิดตัวของบริษัทในประเทศ
ยังไม่มีข้อสรุปว่าคำกล่าวของสุไลมานจะนำไปสู่การออกกฎระเบียบจริงหรือไม่ หรือการประเมินโดยรัฐบาลจะกลายเป็นขั้นตอนบังคับก่อนเปิดตัวโมเดล AI หรือไม่ ต่อจากนี้ ประเด็นที่ต้องติดตามคือคำนิยามทางเทคนิคของ 'เส้นแดง' ผลผูกพันทางกฎหมายของการประเมิน และขอบเขตข้อมูลที่จะเปิดเผย
ความคิดเห็น 0