ดีปซีค(DeepSeek) เปิดตัว V4 โปรตัวเต็มอย่างเป็นทางการบนแพลตฟอร์มซูเปอร์คอมพิวเตอร์แห่งชาติจีน (National Supercomputing Internet) พร้อมเฟรมเวิร์กสำหรับรันเอเจนต์ AI ที่ชื่อ DeepSeek Harness โดยรวมโมเดล โครงสร้างการทำงาน และทรัพยากรประมวลผลไว้ในที่เดียว เพื่อให้นำโมเดลขนาดใหญ่ไปใช้งานจริงได้ง่ายขึ้น
STAR Market Daily (科创板日报) สื่อด้านเทคโนโลยีของจีน รายงานเมื่อวันที่ 15 (เวลาท้องถิ่น) ว่าแพลตฟอร์มซูเปอร์คอมพิวเตอร์แห่งชาติจีนได้อัปโหลด DeepSeek V4 โปรตัวเต็มและ DeepSeek Harness ขึ้นระบบแล้ว ทางแพลตฟอร์มระบุว่าใช้พูลทรัพยากรประมวลผลระดับ 100,000 การ์ดกราฟิกแบบผสมผสานที่ใหญ่ที่สุดของประเทศเป็นฐาน เพื่อสนับสนุนสถาบันวิจัย บริษัทเทคโนโลยี และนักพัฒนาตลอดวงจรชีวิตของโมเดลขนาดใหญ่
โมเดลที่อัปโหลดครั้งนี้มีชื่อว่า DeepSeek-V4-Pro-0813 ตามรายงานระบุว่ารุ่นนี้เน้นพัฒนาความสามารถด้านเอเจนต์เป็นพิเศษ
เอเจนต์ (agent) หมายถึงรูปแบบการทำงานของ AI ที่รับคำสั่งจากผู้ใช้แล้วดำเนินงานต่อเนื่อง เช่น เรียกใช้เครื่องมือ เขียนโค้ด จัดการเอกสาร และทำงานหลายขั้นตอนโดยไม่ต้องสั่งซ้ำ งานลักษณะนี้ต้องอาศัยระยะเวลาทำงานที่ยาวกว่าการถาม-ตอบทั่วไป จึงไม่ได้ขึ้นอยู่กับประสิทธิภาพของโมเดลเพียงอย่างเดียว แต่ต้องพึ่งพาสภาพแวดล้อมการรันและการจัดสรรทรัพยากรประมวลผลด้วย
DeepSeek Harness เปิดเผยภายใต้สัญญาอนุญาต MIT และออกแบบตามแนวคิด 'ทุกอย่างคือปลั๊กอิน' ทำให้โมเดล เครื่องมือ สกิล และเซสชันในระบบเอเจนต์สามารถสลับและประกอบใหม่ได้ตามต้องการ โดยมีโหมดการทำงานให้เลือกสี่แบบ ได้แก่ โหมดมาตรฐาน โหมด PTC โหมดกระชับสุด และโหมดสร้างสรรค์
เอกสาร API อย่างเป็นทางการของดีปซีคระบุว่า ทั้ง V4 โปร และ V4 แฟลช รองรับบริบทสูงสุด 1 ล้านโทเคน และเอาต์พุตสูงสุด 384,000 โทเคน โดยทั้งสองโมเดลรองรับอินเทอร์เฟซ Chat Completions ของโอเพนเอไอ(OpenAI) และอินเทอร์เฟซของแอนโทรปิก(Anthropic) พร้อมฟีเจอร์เอาต์พุตแบบ JSON การเรียกใช้เครื่องมือ (tool calling) การต่อบทสนทนาแบบมีคำนำหน้า (chat prefix completion) และการเติมข้อความกลาง (FIM completion)
การ์ดโมเดล DeepSeek V4 โปร บนฮักกิ้งเฟซ(Hugging Face) ระบุว่าซอร์สโค้ดและน้ำหนักโมเดล (model weights) อยู่ภายใต้สัญญาอนุญาต MIT เช่นกัน พร้อมคำแนะนำการติดตั้งใช้งานแบบโลคัล ทำให้บริษัทและนักพัฒนามีทางเลือกมากขึ้น นอกเหนือจากการเรียกผ่าน API ของแพลตฟอร์ม คือสามารถรันหรือทดลองโมเดลในสภาพแวดล้อมของตัวเองได้
ก่อนหน้านี้เมื่อเดือนเมษายนที่ผ่านมา แพลตฟอร์มซูเปอร์คอมพิวเตอร์แห่งชาติจีนเคยอัปโหลด DeepSeek V4 พรีวิว ขึ้นสู่ชุมชน AI มาแล้ว โดยขณะนั้นระบุว่าบริษัท สถาบันวิจัย และนักพัฒนารายบุคคลสามารถดาวน์โหลดไฟล์โมเดล และใช้ชุดซอฟต์แวร์ FlagOS ของจงจื้อ (Zhongzhi) ร่วมกับอิมเมจโมเดลที่ปรับให้เข้ากับการ์ดเร่งความเร็วต่างชนิดที่ผลิตในจีน เพื่อใช้งานด้านการดีพลอย การอนุมาน (inference) และการพัฒนา
การอัปเดตตัวเต็มครั้งนี้ต่อยอดจากรายงานก่อนหน้าของโทเคนโพสต์ ที่เคยนำเสนอว่า DeepSeek V4 โปรตัวเต็มและโครงสร้างค่าบริการ API ถูกเปิดเผยออกมาแล้ว โดยรองรับบริบท 1 ล้านโทเคนและการเรียกใช้เครื่องมือ พร้อมให้ผู้ใช้เปลี่ยนไปเรียกใช้โมเดลรุ่นใหม่ผ่านที่อยู่ API เดิมได้โดยไม่ต้องเปลี่ยนระบบ
การแข่งขันด้านโมเดลภาษาขนาดใหญ่ในวงการ AI จีนไม่ได้จบแค่การเปิดเผยสเปกโมเดลเท่านั้น เพราะในขั้นตอนใช้งานจริง ความเข้ากันได้ของ API การเปิดน้ำหนักโมเดล (open weight) สัญญาอนุญาต การเข้าถึงทรัพยากรประมวลผล และเครื่องมือดีพลอย ล้วนต้องทำงานร่วมกัน
การดำเนินการของแพลตฟอร์มซูเปอร์คอมพิวเตอร์แห่งชาติจีนครั้งนี้ ถูกมองว่าเป็นความพยายามลดคอขวดเหล่านี้ให้อยู่ในแพลตฟอร์มเดียว เพราะนักพัฒนาไม่ได้เลือกแค่โมเดล แต่ต้องพิจารณาทั้งรูปแบบการรันเอเจนต์และทรัพยากรประมวลผลไปพร้อมกัน
สำหรับผู้อ่านในไทย ประเด็นที่น่าสนใจไม่ใช่แค่การแข่งขันโมเดล AI ของจีน แต่คือทิศทางโครงสร้างพื้นฐานสำหรับเอเจนต์ AI โดยรวม เพราะบริบทยาว การเรียกใช้เครื่องมือ การดีพลอยแบบโลคัล และโครงสร้างต้นทุน กำลังกลายเป็นเกณฑ์สำคัญในการออกแบบบริการของวงการ AI และคริปโตในประเทศเช่นกัน
อย่างไรก็ตาม รายงานนี้ยังไม่ปรากฏความเชื่อมโยงโดยตรงกับคริปโตเคอเรนซีหรือโปรเจกต์บล็อกเชนรายใดเป็นการเฉพาะ และยังไม่มีการเปิดเผยสัญญาจัดหาสินค้าหรือตัวเลขรายได้ที่เชื่อมโยงกับผลประกอบการของบริษัทเซมิคอนดักเตอร์แต่อย่างใด
ผลกระทบที่แท้จริงของ DeepSeek V4 โปร และ DeepSeek Harness จะประเมินได้ชัดเจนขึ้นก็ต่อเมื่อมีนักพัฒนาภายนอกนำไปใช้งานและมีกรณีใช้จริงสะสมมากพอ สิ่งที่ยืนยันได้ในขณะนี้คือ แพลตฟอร์มซูเปอร์คอมพิวเตอร์แห่งชาติจีนได้นำโมเดลตัวเต็ม เฟรมเวิร์กเอเจนต์ และพูลทรัพยากรประมวลผลระดับ 100,000 การ์ด มาไว้บนแพลตฟอร์มเดียวกันแล้ว
แหล่งตรวจสอบ: ต้นฉบับ PANews รายงานที่เกี่ยวข้องจาก STAR Market Daily เอกสาร API อย่างเป็นทางการของดีปซีค การ์ดโมเดล DeepSeek V4 Pro บนฮักกิ้งเฟซ และเพจทางการของแพลตฟอร์มซูเปอร์คอมพิวเตอร์แห่งชาติจีน
ความคิดเห็น 0