Back to top
  • 공유 แชร์
  • 인쇄 พิมพ์
  • 글자크기 ขนาดตัวอักษร
ลิงก์ถูกคัดลอกแล้ว

28% คือคะแนนที่ Ox Alpha ทำได้จากโจทย์โค้ด 175 ข้อ แม้ชูจุดขายบริบทฟรี 1 ล้านโทเคน

Ox Alpha ชูจุดขาย 'ราคาฟรี' และบริบทระดับ 1 ล้านโทเคน จนกลายเป็นประเด็นที่ชุมชนนักพัฒนาต้องพิสูจน์ให้เห็นจริง มีการอ้างว่าโมเดลนี้ทำได้ดีกว่า Claude Fable 5 แต่ผลการทดสอบที่เปิดเผยต่อสาธารณะกลับให้ผลต่างกันไปตามวิธีทดสอบ

โอเพนราวเตอร์ (OpenRouter) ระบุในหน้าโมเดล ณ วันที่ 24 (เวลาท้องถิ่น) ว่า Ox Alpha เป็นโมเดล reasoning ที่ออกแบบมาสำหรับงานเขียนโค้ด งานเอเจนต์ระยะยาว และการใช้งานจริงในระบบ production รหัสโมเดลคือ 'stealth/ox-alpha' ราคาทั้งฝั่งอินพุตและเอาต์พุตอยู่ที่ 0 ดอลลาร์ (0 วอน) ต่อ 1 ล้านโทเคน ส่วนความยาวบริบทแสดงไว้ที่ 1.05M โทเคน

โอเพนราวเตอร์ระบุว่าโมเดลนี้ถูกพัฒนาและดูแลโดยผู้ให้บริการบุคคลที่สามที่ไม่เปิดเผยตัวตน โดยยืนยันว่าตนเองทำหน้าที่เพียงส่งต่อคำขอ (routing) เท่านั้น ไม่ใช่ผู้พัฒนาหรือเจ้าของโมเดล และระบุว่าผู้ให้บริการรายนี้เป็นฝ่ายเก็บข้อมูลพรอมต์และคำตอบทั้งหมด

กระแสความสนใจไม่ได้มาจากราคาฟรีเพียงอย่างเดียว เว็บไซต์อิสระ oxalpha.com ระบุว่า Ox Alpha รองรับบริบทสูงสุด 1,048,576 โทเคน เอาต์พุตสูงสุด 131,072 โทเคน และรองรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอ

เว็บไซต์เดียวกันระบุว่า Ox Alpha แก้โจทย์เขียนโค้ดจากสถานการณ์จริงได้ 8 จาก 10 ข้อ พร้อมนำเสนอตัวเลขเปรียบเทียบ ได้แก่ Claude Fable 5 อยู่ที่ 65% GLM-5 อยู่ที่ 62% GPT-5 อยู่ที่ 52% และ Grok 4 อยู่ที่ 62%

อย่างไรก็ตาม ยังตีความผลนี้ว่าเป็นความเหนือกว่าด้านประสิทธิภาพโดยรวมไม่ได้ทันที เพราะแหล่งข้อมูล benchmark อิสระอีกแห่งหนึ่งระบุว่า จากการทดสอบด้วยชุดโจทย์ LiveCodeBench release_v6 จำนวน 175 ข้อ แบบทดลองครั้งเดียว (single-try) Ox Alpha ทำคะแนน pass@1 ได้ 28.0% หรือตอบถูก 49 ข้อ

แหล่งข้อมูลดังกล่าวยังตั้งข้อสังเกตด้วยว่า ภายใต้เงื่อนไขการทดสอบของตนเอง Ox Alpha มีลักษณะใกล้เคียงกับโมเดลขนาดเล็กมากกว่าจะเข้าข่ายตำแหน่ง 'frontier model' ตามที่ถูกวางไว้ ทั้งนี้ ตัวอย่างโจทย์ 10 ข้อกับชุดทดสอบ 175 ข้อ ใช้กลุ่มตัวอย่างและเงื่อนไขต่างกัน จึงไม่อาจสรุปไปในทิศทางเดียวกันได้เสมอไป

โมเดลที่ถูกนำมาเปรียบเทียบอย่าง Claude Fable 5 เป็นโมเดลที่แอนโทรปิก (Anthropic) เปิดตัวเมื่อวันที่ 9 มิถุนายน แอนโทรปิกประกาศในหน้าทางการว่าได้กู้คืนการเข้าถึงโมเดลนี้เมื่อวันที่ 1 กรกฎาคม พร้อมระบุราคาที่ 10 ดอลลาร์ (ประมาณ 13,850 วอน) ต่อ 1 ล้านโทเคนสำหรับอินพุต และ 50 ดอลลาร์ (ประมาณ 69,250 วอน) ต่อ 1 ล้านโทเคนสำหรับเอาต์พุต

Claude Fable 5 วางตำแหน่งตัวเองเป็นโมเดลสำหรับงานเขียนโค้ดและงานเอเจนต์ระยะยาวเป็นหลัก เมื่อ Ox Alpha เข้ามาชิงพื้นที่เดียวกัน ทั้งสองโมเดลจึงกลายเป็นคู่เปรียบเทียบโดยตรงในหมู่นักพัฒนา

ยังมีการคาดเดาต่อเนื่องเกี่ยวกับผู้อยู่เบื้องหลังโมเดลนี้ เทคครันช์ (TechCrunch) รายงานว่าช่วงแรกกระแสคาดเดาส่วนใหญ่ชี้ไปที่ตระกูล GLM ของบริษัท Z.ai จากจีน ก่อนที่ภายหลังจะมีการพูดถึงความเป็นไปได้ว่าอาจเป็นโครงการ MAI ของไมโครซอฟท์ (MSFT) ด้วยเช่นกัน

แต่คำชี้แจงอย่างเป็นทางการยังคงระบุเพียงว่าเป็น 'ผู้ให้บริการบุคคลที่สามที่ไม่เปิดเผยตัวตน' เท่านั้น แม้แต่ตลาดคาดการณ์ (prediction market) ของคอยน์เบส (COIN) ก็มีการเปิดอีเวนต์ตั้งคำถามว่า 'บริษัทใดอยู่เบื้องหลัง Ox Alpha' แต่ราคาบนตลาดคาดการณ์ไม่ถือเป็นการยืนยันอย่างเป็นทางการ

ตัวเลขปริมาณการใช้งานสะท้อนความสนใจในช่วงแรกได้ชัดเจน โดยในอันดับโมเดลสำหรับงานเขียนโค้ดของโอเพนราวเตอร์ประจำเดือนสิงหาคม 2026 Ox Alpha ขึ้นมาอยู่อันดับ 2 ด้วยปริมาณการใช้งาน 7.51 ล้านล้านโทเคน (7.51T tokens) ส่วนในรายชื่อโมเดลที่รองรับ tool-calling มีปริมาณการใช้งานอยู่ที่ 16.7 ล้านล้านโทเคน (16.7T tokens)

โอเพนราวเตอร์ระบุว่าอันดับดังกล่าวคำนวณจากปริมาณการใช้งานจริง แต่ปริมาณการใช้งานไม่ได้แปลว่าเป็นการรับรองประสิทธิภาพ และต้องพิจารณาด้วยว่าเงื่อนไข 'ให้ใช้ฟรี' อาจเป็นปัจจัยที่ดันจำนวนการเรียกใช้งานในช่วงแรกให้สูงขึ้น

แพลตฟอร์มโมเดลราวติง (model routing) คือโครงสร้างพื้นฐานที่ช่วยให้เปรียบเทียบและเรียกใช้งานโมเดล AI หลายตัวผ่าน API เส้นทางเดียวกันได้ นักพัฒนาสามารถสลับเปลี่ยนโมเดลได้ตามราคา ความยาวบริบท รูปแบบอินพุต และการรองรับการเรียกใช้เครื่องมือ (tool calling) แต่สำหรับการใช้งานจริงในระบบ production เงื่อนไขการเก็บรักษาข้อมูลและความน่าเชื่อถือของผู้ให้บริการก็สำคัญไม่แพ้ประสิทธิภาพของโมเดล

ประเด็นนี้ต่อเนื่องมาจากรายงานก่อนหน้าของสำนักข่าวที่ระบุว่า โมเดล AI นิรนามอย่าง Ox Alpha ถูกเปิดให้ทดลองใช้งานฟรีบนโอเพนราวเตอร์ หากครั้งก่อนประเด็นหลักอยู่ที่รูปแบบการเปิดตัวแบบไม่เปิดเผยตัวตนและเงื่อนไขการดำเนินงาน ครั้งนี้ทั้งคำกล่าวอ้างเรื่องประสิทธิภาพและผลการประเมินอิสระต่างถูกนำมาตรวจสอบไปพร้อมกัน

สำหรับผู้ใช้งานในไทยที่คิดจะนำโมเดลฟรีและไม่เปิดเผยตัวตนแบบนี้ไปเชื่อมต่อกับงานจริง เงื่อนไขการจัดการข้อมูลถือเป็นตัวแปรสำคัญที่สุด เมื่อโอเพนราวเตอร์ระบุชัดว่าพรอมต์และคำตอบจะถูกเก็บไว้โดยผู้ให้บริการ ในสภาพแวดล้อมที่มีโค้ดภายในองค์กรหรือข้อมูลลูกค้าไหลผ่าน จึงควรตรวจสอบเงื่อนไขการดำเนินงานก่อนพิจารณาเรื่องราคา

<ลิขสิทธิ์ ⓒ TokenPost ห้ามเผยแพร่หรือแจกจ่ายซ้ำโดยไม่ได้รับอนุญาต>

บทความที่มีคนดูมากที่สุด

บทความที่เกี่ยวข้อง

ความคิดเห็น 0

ข้อแนะนำสำหรับความคิดเห็น

ขอบคุณสำหรับบทความดี ๆ ต้องการบทความติดตามเพิ่มเติม เป็นการวิเคราะห์ที่ยอดเยี่ยม

0/1000

ข้อแนะนำสำหรับความคิดเห็น

ขอบคุณสำหรับบทความดี ๆ ต้องการบทความติดตามเพิ่มเติม เป็นการวิเคราะห์ที่ยอดเยี่ยม
1