จากต้นฉบับงานวิจัยคณิตศาสตร์ 722 ฉบับที่โอเพนเอไอเผยแพร่ ปัจจุบันเหลืออยู่ในคลัง 719 ฉบับ ผลลัพธ์ระดับสูงสุดราว 42% ถูกทำให้อยู่ในรูปแบบ Lean แล้ว แต่แวดวงคณิตศาสตร์ยังอยู่ระหว่างประเมินผลลัพธ์ทั้งหมด
โอเพนเอไอระบุในประกาศว่า เมื่อวันที่ 6 ตุลาคม บริษัทเผยแพร่ผลงานวิจัยคณิตศาสตร์ที่สร้างโดยโมเดลภายในระดับแนวหน้า คลังสาธารณะจัดต้นฉบับ 722 ฉบับเป็น 372 กลุ่มผลลัพธ์ และระบุว่าให้โจทย์แก่โมเดลราว 4,000 ข้อ ประวัติการเปลี่ยนแปลงของคลังบันทึกการถอนต้นฉบับ 3 ฉบับและการแก้ไข 14 ฉบับ
ต้นฉบับครอบคลุมหลายสาขา เช่น ทฤษฎีจำนวน เรขาคณิตเชิงพีชคณิต การวิเคราะห์ และวิทยาการคอมพิวเตอร์เชิงทฤษฎี โอเพนเอไอยังเผยแพร่การทำให้ข้อพิสูจน์บางส่วนอยู่ในรูปแบบ Lean บทสรุปการให้เหตุผล 10 รายการ และค่าประมาณปริมาณการคำนวณ บริษัทระบุว่าโดยเฉลี่ยแล้วใช้ปริมาณการคำนวณต่อผลลัพธ์หนึ่งรายการเทียบเท่ากับฟังก์ชัน ‘คิด’ ของ ChatGPT Pro ราว 3 ชั่วโมง แต่ไม่ได้เปิดเผยชื่อโมเดลหรือโมเดลเอง
Lean เป็นเครื่องมือที่ใช้แสดงข้อความทางคณิตศาสตร์ในภาษารูปแบบ และให้คอมพิวเตอร์ตรวจสอบว่าขั้นตอนการพิสูจน์เป็นไปตามกฎตรรกะหรือไม่ คลังของโอเพนเอไอระบุว่าปัจจุบันผลลัพธ์ระดับสูงสุดราว 42% ถูกทำให้อยู่ในรูปแบบดังกล่าว ประวัติการเปลี่ยนแปลงบันทึกว่า ณ วันที่ 7 ตุลาคม มีผลลัพธ์ 300 รายการจากทั้งหมด 719 รายการที่ผ่านการทำให้อยู่ในรูปแบบ Lean
สัดส่วนที่ผ่านการทำให้อยู่ในรูปแบบ Lean ไม่ได้ยืนยันความถูกต้องของต้นฉบับทั้งหมด Lean ตรวจสอบขั้นตอนพิสูจน์ของข้อความที่ป้อนเข้าไป แต่ไม่ได้ตัดสินโดยอัตโนมัติว่าข้อความนั้นตรงกับผลที่บทความอ้างหรือไม่ รวมถึงสมมติฐานและขอบเขตการนำไปใช้เหมาะสมหรือไม่ โอเพนเอไอระบุในคลังด้วยว่าผลลัพธ์ที่ยังไม่ได้ทำให้อยู่ในรูปแบบ Lean อาจมีข้อผิดพลาดได้
นอกเหนือจากการตรวจสอบแล้ว ขอบเขตการเปิดเผยกระบวนการวิจัยก็เป็นประเด็นที่ต้องพิจารณา โอเพนเอไอระบุในประกาศว่าได้อ้างอิงคำแนะนำของกลุ่มที่ปรึกษาอิสระ และเผยแพร่ขั้นตอนการแก้ไขต้นฉบับและการอ้างอิง ตลอดจนข้อมูลวิธีการบางส่วนไว้ในคลัง อย่างไรก็ตาม บริษัทไม่ได้เปิดเผยโมเดลและพรอมป์ต์ทั้งหมด ทำให้นักวิจัยภายนอกทำซ้ำผลลัพธ์ภายใต้เงื่อนไขเดียวกันได้ยาก
กลุ่มที่ปรึกษาด้านคณิตศาสตร์และปัญญาประดิษฐ์ (AGMAI) ระบุในแถลงการณ์เมื่อวันที่ 6 ตุลาคมว่า การเผยแพร่ครั้งนี้เป็นจุดเริ่มต้นของกระบวนการทำความเข้าใจผลลัพธ์และนำไปต่อยอดเป็นองค์ความรู้ทางคณิตศาสตร์ กลุ่มที่ปรึกษาย้ำว่าการหารือกับโอเพนเอไอไม่ได้หมายความว่ากลุ่มได้ประเมินผลกระทบของผลลัพธ์หรือรับรองกระบวนการเผยแพร่ นอกจากนี้ยังเน้นว่านักคณิตศาสตร์ควรพัฒนาคำถามและแนวทางด้วยตนเองได้ แทนที่จะจำกัดบทบาทไว้เพียงการตรวจสอบผลจากโจทย์ที่บริษัท AI เลือก
จำนวนต้นฉบับและสัดส่วนที่ผ่านการทำให้อยู่ในรูปแบบ Lean เพียงอย่างเดียว ยังไม่เพียงพอที่จะสรุปความสำคัญหรือคุณค่าทางวิชาการของผลลัพธ์แต่ละรายการ ตอนที่โอเพนเอไอเผยแพร่ต้นฉบับ 722 ฉบับ มีเพียงข้อพิสูจน์บางส่วนที่ผ่านการทำให้อยู่ในรูปแบบ Lean และผลลัพธ์ทั้งหมดยังไม่ได้ผ่านการตรวจสอบครบถ้วน การเปลี่ยนแปลงที่ยืนยันได้ในครั้งนี้คือการถอนและแก้ไขต้นฉบับหลังเผยแพร่ รวมถึงการทำให้ข้อพิสูจน์บางส่วนอยู่ในรูปแบบ Lean
ความคิดเห็น 0