โอเพนเอไอ (OpenAI) เปิดเผยผลการทดสอบประสิทธิภาพของ 'ฮาลาปิโญ' (Jalapeño) ชิปประมวลผลด้านอนุมาน (Inference Chip) แบบกำหนดเองตัวแรกที่พัฒนาร่วมกับบรอดคอม (Broadcom) โดยระบุว่าในการทดสอบกับโมเดลโอเพนซอร์ส ชิปตัวนี้ให้ปริมาณงานต่อพลังงาน (Throughput per Watt) สูงขึ้น 1.5-1.9 เท่า และลดเวลาหน่วง (Latency) แบบครบวงจรลงได้ 1.7-3.6 เท่า
โอเพนเอไอระบุในรายงานเทคนิคที่เผยแพร่เมื่อวันที่ 25 (เวลาท้องถิ่น) ว่า ฮาลาปิโญทำผลงานดังกล่าวได้กับโมเดล GPT-OSS 120B, ดีปซีก (DeepSeek) R1 และคิมิ (Kimi) K2.5 1T พร้อมระบุเพิ่มเติมว่าในภาระงานอนุมานเชิงสนทนา (Conversational Inference) ประสิทธิภาพสูงขึ้นถึง 2.1-4.1 เท่า
ฮาลาปิโญเป็นชิปเร่งความเร็ว (Accelerator) เฉพาะทางตัวแรกของโอเพนเอไอที่ออกแบบมาสำหรับงานอนุมานโมเดลภาษาขนาดใหญ่ (LLM) โดยเมื่อเดือนมิถุนายนที่ผ่านมา โอเพนเอไอและบรอดคอมเปิดตัวชิปนี้พร้อมเปิดเผยว่ากระบวนการตั้งแต่ออกแบบจนถึงการทดสอบผลิตจริง (Tape-out) ใช้เวลา 9 เดือน และโมเดลของโอเพนเอไอเองก็มีส่วนช่วยเร่งกระบวนการพัฒนาบางส่วนด้วย
โอเพนเอไอระบุว่ามีแผนเริ่มติดตั้งฮาลาปิโญในโครงสร้างพื้นฐานคอมพิวเตอร์ของบริษัทเองภายในสิ้นปีนี้ อย่างไรก็ตาม บริษัทระบุว่าจะยังคงใช้งานชิปเร่งความเร็วจากพันธมิตรรายอื่น รวมถึงเอ็นวิเดีย (NVIDIA) อย่างกว้างขวางต่อไปสำหรับงานฝึกและงานอนุมานโมเดล
ความคิดเห็น 0