อาลีบาบา(BABA) เตรียมเปิดตัว Qwen3.8-Flash-Next โมเดลที่ใช้สถาปัตยกรรมรุ่นใหม่ซึ่งจะเป็นแกนหลักของ Qwen4 เวอร์ชันทางการ โดยกำหนดเปิดตัวไว้ที่เวลา 22.00 น. ของวันที่ 26 สิงหาคม ตามเวลาไทย
บล็อกบีทส์ (Blockbeats) รายงานเมื่อวันที่ 26 (เวลาท้องถิ่น) ว่าหน้าเพจ 'ทีเซอร์' ของ Qwen3.8-Flash-Next ปรากฏบนแพลตฟอร์ม ModelScope แล้ว โดยระบุกำหนดเปิดตัวไว้ที่เวลา 23.00 น. ตามเวลาจีนของวันที่ 26 สิงหาคม ซึ่งตรงกับเวลา 00.00 น. ของวันที่ 27 สิงหาคม ตามเวลาเกาหลี หรือราวเวลา 22.00 น. ของวันที่ 26 สิงหาคม ตามเวลาไทย
โมเดลรุ่นนี้ถูกแนะนำในฐานะโมเดลผสมผู้เชี่ยวชาญ (Mixture of Experts หรือ MoE) แบบหลายรูปแบบ (Multimodal) ที่ใช้สถาปัตยกรรมรุ่นใหม่สำหรับขับเคลื่อน Qwen4 โดยย้ำว่านี่ไม่ใช่การเปิดตัว Qwen4 เวอร์ชันทางการ แต่เป็นการพรีวิวด้านเทคนิคที่เปิดให้นักพัฒนาและคอมมูนิตี้ได้ทดลองใช้โครงสร้างใหม่ก่อนโมเดลตระกูล Qwen4 ที่จะตามมา
โมเดลหลายรูปแบบ หมายถึงโครงสร้างที่ประมวลผลข้อมูลรูปแบบอื่นนอกจากข้อความ เช่น ภาพ ไปพร้อมกันได้ ส่วนโมเดลผสมผู้เชี่ยวชาญเป็นรูปแบบที่ไม่เปิดใช้พารามิเตอร์ทั้งหมดในทุกครั้ง แต่จะเลือกเปิดใช้เฉพาะบางส่วนที่จำเป็นต่องานนั้นๆ ซึ่งเป็นแนวทางที่ช่วยปรับต้นทุนการประมวลผลและความเร็วในการตอบสนองของโมเดลขนาดใหญ่
สิ่งที่อาลีบาบาให้น้ำหนักในครั้งนี้คือ 'โครงสร้าง' มากกว่า 'ชื่อผลิตภัณฑ์' การเปิดสถาปัตยกรรมใหม่ก่อนที่ Qwen4 เวอร์ชันทางการจะออกมา ถูกมองว่าเป็นความเคลื่อนไหวที่ต้องการร่นระยะเวลาเตรียมสภาพแวดล้อมพัฒนาและกระบวนการตรวจสอบสำหรับโมเดลตระกูลถัดไป
บล็อกบีทส์ระบุว่า ก่อนหน้านี้อาลีบาบาเคยนำโครงสร้างไฮบริดที่ผสาน Gated DeltaNet เข้ากับ Attention แบบทั่วไป มาใช้ใน Qwen3-Next มาแล้ว และโมเดลตระกูล Qwen3.5 ที่ตามมาก็ยังคงใช้การออกแบบนี้ต่อเนื่อง การประกาศครั้งนี้จึงอยู่ในทิศทางเดียวกัน คือเปิดโครงสร้างใหม่ก่อน แล้วค่อยขยายไปสู่ผลิตภัณฑ์รุ่นต่อๆ ไป
ความเร็วในการเปิดตัวโมเดลของอาลีบาบาก็เป็นอีกประเด็นที่ได้รับความสนใจ บล็อกบีทส์ระบุว่า อาลีบาบาเพิ่งเปิดตัว Qwen3.8-Max โมเดลขนาด 2.4 ล้านล้านพารามิเตอร์ไปเมื่อต้นเดือนนี้ และยังไม่ทันครบหนึ่งเดือนก็ประกาศเตรียมเปิดสถาปัตยกรรมรุ่นถัดไปแล้ว
ก่อนหน้านี้ โทเคนโพสต์เคยรายงานว่า อาลีบาบาเปิดตัวโมเดลตระกูล Qwen3.8 แบบโอเพนซอร์ส โดยในรายงานครั้งนั้น Qwen3.8-27B ถูกแนะนำในฐานะโมเดลเดนส์ (Dense) แบบหลายรูปแบบโดยกำเนิด ขนาด 2.7 หมื่นล้านพารามิเตอร์
โมเดลเดนส์คือโครงสร้างที่ใช้พารามิเตอร์ทั้งหมดอย่างสม่ำเสมอในทุกการประมวลผล ขณะที่โมเดลผสมผู้เชี่ยวชาญจะเลือกเปิดใช้งานเฉพาะเครือข่ายผู้เชี่ยวชาญบางส่วนเท่านั้น จุดเด่นของโมเดลเดนส์อยู่ที่ความง่ายในการนำไปใช้งานจริง ส่วนจุดเด่นของโมเดลผสมผู้เชี่ยวชาญอยู่ที่ประสิทธิภาพในการบริหารจัดการโมเดลขนาดใหญ่
ในระบบนิเวศโมเดลโอเพนซอร์ส นักพัฒนาไม่ได้มองแค่ตัวชี้วัดประสิทธิภาพเพียงอย่างเดียว แต่ยังพิจารณาเรื่องไลเซนส์ วิธีเปิดเผยน้ำหนักโมเดล ต้นทุนการประมวลผล การรองรับข้อความความยาวมาก และการรองรับหลายรูปแบบไปพร้อมกันด้วย ส่วน Qwen3.8-Flash-Next จะมาพร้อมไลเซนส์ น้ำหนักโมเดล และผลทดสอบเบนช์มาร์กแบบใด ต้องรอดูหลังการเปิดตัวในวันที่ 27 สิงหาคมนี้
ความคิดเห็น 0