ดีปซีก วี4.1 แฟลช(DeepSeek V4.1 Flash) ทำความเร็วเอาต์พุตได้ 420 โทเคนต่อวินาทีในการทดสอบภายใน โดยใช้เวลาไม่ถึง 3 นาทีในการสร้างโทเคนต่อเนื่องมากกว่า 71,000 โทเคน
BlockBeats รายงานผลการทดสอบจริงครั้งแรกนี้เมื่อวันที่ 8 (เวลาท้องถิ่น) โดยระบุว่าโมเดลที่นำมาเปรียบเทียบคือ ดีปซีก วี4 แฟลช 0731(DeepSeek V4 Flash 0731) ซึ่งมีความเร็วเอาต์พุตผ่าน API ของดีปซีกอยู่ที่ประมาณ 128 โทเคนต่อวินาที ตามการวัดของ Artificial Analysis
อย่างไรก็ตาม ยังไม่มีการเปิดเผยว่าตัวเลขทั้งสองถูกวัดภายใต้เงื่อนไขเดียวกันหรือไม่ ทำให้การเปรียบเทียบโดยตรงมีข้อจำกัด สถิติ 420 โทเคนต่อวินาทีในครั้งนี้เป็นผลการทดสอบภายในเพียงครั้งเดียว ความเร็วจริงอาจเปลี่ยนแปลงไปตามความยาวของอินพุต วิธีการเรียกใช้ และสภาพเซิร์ฟเวอร์
'โทเคน' คือหน่วยที่โมเดลปัญญาประดิษฐ์ใช้ประมวลผลข้อความ ส่วนความเร็วเอาต์พุตหมายถึงความเร็วในการสร้างคำตอบของโมเดล ยิ่งตัวเลขสูง เวลาตอบสนองในการสร้างโค้ดหรือเอกสารยาวๆ ก็ยิ่งสั้นลงได้
วี4.1 แฟลชเป็นเวอร์ชันทดลองที่ชูจุดเด่นด้านโครงสร้างโมเดลใหม่และความสามารถแบบ 'มัลติโมดัล' ซึ่งหมายถึงการประมวลผลข้อความและภาพไปพร้อมกัน
เวอร์ชันทดลองนี้ยังคงใช้ที่อยู่ API เดิม เพียงเปลี่ยนชื่อโมเดลเป็น deepseek-v4.1-flash-expires-on-0910 เพื่อเรียกใช้งาน โดยจำกัดจำนวนคำขอพร้อมกันต่อบัญชีไว้ที่ 20 คำขอ เงื่อนไขการทดสอบภายในที่ดีปซีกเคยเปิดเผยก่อนหน้านี้ก็ใช้ที่อยู่ API เดิมและจำกัดคำขอพร้อมกันไว้ที่ 20 เช่นกัน
ยังไม่มีการยืนยันว่าตัวเลข '0910' ในชื่อโมเดลหมายถึงวันสิ้นสุดการทดสอบ หรือเชื่อมโยงกับช่วงเวลาที่จะเปลี่ยนเป็นเวอร์ชันทางการหรือไม่ รวมถึงยังไม่มีการเปิดเผยว่าจะเปิดตัวเวอร์ชันทางการหรือไม่ ระยะเวลาให้บริการ และราคาสุดท้าย
ค่าบริการของเวอร์ชันทดลองนี้เท่ากับดีปซีก วี4 แฟลชเดิม โดยเอกสารทางการของดีปซีกระบุว่าราคาของวี4 แฟลชคำนวณจากจำนวนโทเคนอินพุตและโทเคนเอาต์พุต ดังนั้นสถิติความเร็วในครั้งนี้เพียงอย่างเดียวจึงยังไม่สามารถสรุปได้ว่าต้นทุนการใช้งาน API ลดลง
ดีปซีก วี4 แฟลชเปลี่ยนเป็นเบต้าสาธารณะเมื่อวันที่ 31 กรกฎาคม โดยเอกสารทางการของดีปซีกอธิบายว่าวี4 แฟลช 0731 ในตอนนั้นยังคงโครงสร้างและขนาดเดียวกับโมเดลพรีวิวเดิม เพียงแต่ผ่านการฝึกฝนใหม่
เนื่องจากวี4.1 แฟลชชูจุดเด่นด้านโครงสร้างใหม่ การเปรียบเทียบประสิทธิภาพกับเวอร์ชันก่อนหน้าจะทำได้ก็ต่อเมื่อมีการเปิดเผยผลการทดสอบมาตรฐานอย่างเป็นทางการภายใต้เงื่อนไขเดียวกัน และยังยากที่จะตัดสินความสามารถด้านการให้เหตุผลหรือคุณภาพผลลัพธ์ของโมเดลจากความเร็วเอาต์พุตเพียงอย่างเดียว
การจะประเมินว่าโมเดลนี้พร้อมใช้งานจริงหรือไม่ ต้องพิจารณาร่วมกันทั้งจำนวนคำขอพร้อมกัน เวลาหน่วงในการตอบสนอง ความสามารถในการประมวลผลบริบทยาว คุณภาพผลลัพธ์ และต้นทุน ขณะที่ตัวเลขสำคัญที่เปิดเผยออกมาในตอนนี้มีเพียงความเร็วเอาต์พุตที่วัดได้ในการทดสอบภายในและเงื่อนไขการเรียกใช้ที่จำกัดไว้เท่านั้น
ประเด็นที่ต้องติดตามคือ เมื่อเวอร์ชันทางการเปิดตัว จะมีการเปรียบเทียบกับวี4 แฟลช 0731 ภายใต้เงื่อนไขอินพุต เซิร์ฟเวอร์ และคำขอเดียวกันหรือไม่ โดยการประเมินจะเปลี่ยนแปลงไปตามประกาศเปิดตัวอย่างเป็นทางการของดีปซีกและช่วงเวลาที่มีการเปิดเผยผลการทดสอบมาตรฐานแต่ละเงื่อนไข
ความคิดเห็น 0