Back to top
  • 공유 แชร์
  • 인쇄 พิมพ์
  • 글자크기 ขนาดตัวอักษร
ลิงก์ถูกคัดลอกแล้ว

โมเดล 27B ของ Qwen(อาลีบาบา) ยืนยันคือ Qwen3.6-27B ไม่ใช่ Qwen3.8-27B ตามที่ PANews เคยรายงาน

โมเดลปัญญาประดิษฐ์ระดับ 27B ที่เปิดเผยน้ำหนักโมเดลต่อสาธารณะของ Qwen ภายใต้อาลีบาบา(BABA) ได้รับการยืนยันแล้วว่าคือ Qwen3.6-27B ไม่ใช่ Qwen3.8-27B ตามที่สื่อ PANews รายงานไว้ก่อนหน้านี้ หลังชื่อรุ่นที่ปรากฏในรายงานข่าวกับข้อมูลทางการของอาลีบาบาและรายการโมเดลบน Hugging Face ไม่ตรงกัน ทำให้ประเด็นหลักของเรื่องนี้แคบลงเหลือเพียงการขยายโมเดลปัญญาประดิษฐ์แบบเปิดน้ำหนัก (open-weight) ระดับ 27B ที่รองรับข้อมูลหลายรูปแบบของอาลีบาบา

PANews รายงานเมื่อวันที่ 14 โดยอ้างอิงการประกาศอย่างเป็นทางการของทีมทงอี้เชียนเวิ่น (Tongyi Qianwen) ในเครืออาลีบาบา ว่ามีการเปิดน้ำหนักโมเดลโอเพนซอร์สของ Qwen3.8-27B แล้ว ทว่ารายละเอียดที่ระบุในรายงาน ทั้งขนาดพารามิเตอร์ 27,000 ล้านตัว โครงสร้างแบบ dense ที่รองรับหลายรูปแบบข้อมูลในตัว (native multimodal) ความยาวบริบท 262,144 โทเคน การขยายด้วยเทคนิค YaRN ไปจนถึงราว 1 ล้านโทเคน และสัญญาอนุญาต Apache 2.0 ล้วนตรงกับสเปกที่ข้อมูลทางการและ Hugging Face ระบุไว้สำหรับรุ่น Qwen3.6-27B ไม่ใช่ 3.8

ทีมงาน Qwen เปิดเผยผ่านบล็อกทางการว่า Qwen3.6-27B คือโมเดลแบบ dense ที่รองรับข้อมูลหลายรูปแบบในตัวขนาด 27,000 ล้านพารามิเตอร์ ประมวลผลได้ทั้งข้อความและรูปภาพพร้อมกัน และวางกลุ่มเป้าหมายหลักไว้ที่งานจริงอย่างการเขียนโปรแกรมและเวิร์กโฟลว์สำนักงาน

สเปกสำคัญของรุ่นนี้คือบริบทที่ 'ยาว' และการเปิดน้ำหนักโมเดลสู่สาธารณะ Qwen3.6-27B รองรับบริบทดั้งเดิมได้ถึง 262,144 โทเคน และขยายเพิ่มได้อีกถึงราว 1 ล้านโทเคนด้วยเทคนิค YaRN ส่วนสัญญาอนุญาตใช้งานคือ Apache 2.0

นักพัฒนาสามารถดาวน์โหลดไฟล์น้ำหนักโมเดลได้จากทั้ง Hugging Face และ ModelScope เพื่อนำไปติดตั้งใช้งานในระบบของตัวเอง การเปิดน้ำหนักโมเดล (open weight) คือวิธีที่บริษัทเผยแพร่ค่าพารามิเตอร์ที่ผ่านการเทรนแล้วออกสู่ภายนอก เพื่อให้นักพัฒนานำไปรันบนเซิร์ฟเวอร์หรือระบบภายในองค์กรของตัวเองได้

อย่างไรก็ตาม การเปิดน้ำหนักโมเดลไม่ได้แปลว่าเป็นโอเพนซอร์สแบบเต็มรูปแบบที่เปิดเผยทั้งชุดข้อมูลฝึกและขั้นตอนการเทรนทั้งหมด ขอบเขตการใช้งานจริงยังขึ้นอยู่กับสัญญาอนุญาต โมเดลการ์ด ไฟล์ที่เผยแพร่ และขอบเขตการรองรับของสแต็กสำหรับการอนุมานผล (inference)

เรื่องนี้เกิดขึ้นท่ามกลางแนวทางของอาลีบาบาที่แบ่งโมเดล AI ขนาดใหญ่ออกเป็นสองกลุ่ม คือผลิตภัณฑ์ที่ให้ใช้งานผ่าน API เท่านั้น กับโมเดลที่เปิดน้ำหนักสู่สาธารณะ ก่อนหน้านี้ TokenPost เคยรายงานว่าอาลีบาบานำ Qwen3.8-2.4T-A95B ไปติดตั้งใช้งานบนแพลตฟอร์ม Chaosuan Internet ของจีน

โมเดลดังกล่าวจัดอยู่ในกลุ่ม Max ขนาดใหญ่พิเศษ ซึ่งมีขนาดและวิธีเผยแพร่ต่างจากโมเดลเปิดน้ำหนักระดับ 27B ในข่าวนี้โดยสิ้นเชิง Qwen3.8-2.4T-A95B เป็นกรณีการเผยแพร่อิมเมจโมเดลที่ปรับให้เข้ากับแพลตฟอร์ม Chaosuan Internet และซอฟต์แวร์สแต็ก FlagOS ขณะที่ Qwen3.6-27B ถูกจัดอยู่ในกลุ่มโมเดลเปิดน้ำหนักที่นักพัฒนาดาวน์โหลดไปใช้งานเองได้

ตระกูล Qwen3.8 เป็นอีกสายผลิตภัณฑ์ที่แยกจากกัน โดยอาลีบาบาระบุเมื่อเดือนกรกฎาคมว่าจะเปิดให้ใช้ Qwen3.8-Max-Preview ผ่าน Token Plan, Qoder และ QoderWork ก่อนเป็นลำดับแรก ข้อมูลที่เผยแพร่ออกมาระบุขนาดพารามิเตอร์ราว 2.4 ล้านล้านตัวและมีแผนเปิดน้ำหนักโมเดลในอนาคต แต่ ณ วันที่ 15 ตามเวลาเกาหลีใต้ ยังไม่พบโมเดลการ์ดทางการหรือไฟล์น้ำหนักโมเดลที่ดาวน์โหลดได้ภายใต้ชื่อ Qwen3.8-27B แต่อย่างใด

ดังนั้น การมองเรื่องนี้ว่าเป็นการเปิดตัว Qwen3.6-27B พร้อมกับการขยายกลยุทธ์เปิดน้ำหนักโมเดลของอาลีบาบา จึงแม่นยำกว่าการสรุปว่าเป็นการเปิดตัว Qwen3.8-27B ความสับสนเรื่องชื่อรุ่นในครั้งนี้สะท้อนภาระในการตรวจสอบข้อมูลที่เกิดขึ้นในวงการโมเดล AI เมื่อชื่อเวอร์ชัน ชื่อบริการ และชื่อที่ใช้เผยแพร่ไม่ตรงกัน

บริษัทด้าน AI ของจีนหลายแห่งทยอยเปิดน้ำหนักโมเดลขนาดใหญ่ต่อสาธารณะ เพื่อขยายจุดเชื่อมต่อกับกลุ่มนักพัฒนา ก่อนหน้านี้ TokenPost เคยรายงานว่าQwen ของอาลีบาบาเปิดตัวโมเดลขนาด 2.4 ล้านล้านพารามิเตอร์พร้อมประกาศแผนเปิดน้ำหนักโมเดล

การขยายแนวทางเปิดน้ำหนักโมเดลเป็นอีกทางเลือกที่ต่างจากการใช้งานโมเดลปิดผ่านการเรียก API บนคลาวด์ ฝ่ายองค์กรสามารถพิจารณาการใช้งานภายในเครือข่ายของตัวเอง การควบคุมการนำข้อมูลออกนอกระบบ และการปรับโครงสร้างต้นทุน ส่วนฝ่ายนักพัฒนาก็สามารถตรวจสอบไฟล์โมเดลและเงื่อนไขสัญญาอนุญาตได้โดยตรงก่อนตัดสินใจเลือกสภาพแวดล้อมที่จะใช้เผยแพร่

การเปิดตัวครั้งนี้ไม่ได้เชื่อมโยงโดยตรงกับตลาดคริปโตหรือบล็อกเชน แต่ใกล้เคียงกับประเด็นด้านโครงสร้างพื้นฐาน AI และระบบนิเวศนักพัฒนามากกว่า อย่างไรก็ตาม สำหรับองค์กรที่ต้องประมวลผลข้อมูลของตัวเองเป็นสำคัญ อย่างเช่นเอ็กซ์เชนจ์ ผู้ให้บริการคัสโตดี ทีมวิเคราะห์ข้อมูลออนเชน หรือฝ่ายกำกับดูแลการปฏิบัติตามกฎระเบียบ ความเป็นไปได้ในการเผยแพร่และเงื่อนไขสัญญาอนุญาตของโมเดลเปิดน้ำหนักเช่นนี้ อาจเป็นข้อมูลประกอบการตัดสินใจเลือกใช้เทคโนโลยีได้

Qwen3.6-27B ชูจุดเด่นเรื่องโครงสร้าง dense ระดับ 27,000 ล้านพารามิเตอร์ บริบทที่ยาว และสัญญาอนุญาต Apache 2.0 เพื่อเจาะกลุ่มงานอัตโนมัติสำหรับนักพัฒนาและสภาพแวดล้อมโค้ดดิ้งเอเจนต์ ส่วนขอบเขตการเปิดน้ำหนักโมเดลของตระกูล Qwen3.8 นั้น ยังต้องรอดูไฟล์เผยแพร่จริงและเงื่อนไขสัญญาอนุญาตที่จะตามมาก่อนจึงจะประเมินได้อีกครั้ง

<ลิขสิทธิ์ ⓒ TokenPost ห้ามเผยแพร่หรือแจกจ่ายซ้ำโดยไม่ได้รับอนุญาต>

บทความที่มีคนดูมากที่สุด

บทความที่เกี่ยวข้อง

ความคิดเห็น 0

ข้อแนะนำสำหรับความคิดเห็น

ขอบคุณสำหรับบทความดี ๆ ต้องการบทความติดตามเพิ่มเติม เป็นการวิเคราะห์ที่ยอดเยี่ยม

0/1000

ข้อแนะนำสำหรับความคิดเห็น

ขอบคุณสำหรับบทความดี ๆ ต้องการบทความติดตามเพิ่มเติม เป็นการวิเคราะห์ที่ยอดเยี่ยม
1