มาร์เวล เทคโนโลยี(Marvell Technology·$MRVL) เตรียมชูสวิตช์ CXL แบบ 260 เลน เพื่อแก้ปัญหาคอขวดด้านหน่วยความจำและสตอเรจในโครงสร้างพื้นฐาน AI หลังภาระของศูนย์ข้อมูลไม่ได้อยู่แค่พลังประมวลผล แต่ขยายไปถึงความจุหน่วยความจำ แบนด์วิดท์ และรูปแบบการเคลื่อนย้ายข้อมูล ตามการใช้งานโมเดลภาษาขนาดใหญ่(LLM) ที่ต้องรองรับบริบทยาวขึ้น
มาร์เวลจะจัดการนำเสนอและร่วมเสวนาเกี่ยวกับหน่วยความจำและสตอเรจสำหรับโครงสร้างพื้นฐาน AI ในงาน Future of Memory and Storage 2026 ที่เมืองซานตาคลารา รัฐแคลิฟอร์เนีย สหรัฐฯ ระหว่างวันที่ 5-7 (ตามเวลาเกาหลี) โดยวาระสำคัญครอบคลุม ‘นวัตกรรมสตอเรจข้อมูลสำหรับโครงสร้างพื้นฐาน AI ที่ขยายได้’, ‘ยุคที่หน่วยความจำเป็นศูนย์กลาง: CXL และอนาคตของโครงสร้างพื้นฐาน AI ที่ขยายได้’ และ ‘CXL-PNM อเนกประสงค์: ฝ่ากำแพงหน่วยความจำของเวิร์กโหลด AI ที่ใช้หน่วยความจำเข้มข้น’
ประเด็นหลักคือ ‘AI memory wall’ หรือกำแพงหน่วยความจำของ AI เมื่อ LLM มีขนาดใหญ่ขึ้นและ context window ยาวขึ้น ความต้องการ KV cache ก็เพิ่มขึ้นตามไปด้วย KV cache คือข้อมูลที่เก็บบริบทหรือบทสนทนาก่อนหน้าไว้ เพื่อให้โมเดล AI ไม่ต้องคำนวณซ้ำ จึงกระทบโดยตรงต่อความเร็วในการอนุมานและต้นทุน
มาร์เวลประกาศสวิตช์ CXL รุ่นถัดไป ‘Structera S 30260’ เมื่อวันที่ 17 มีนาคม ผลิตภัณฑ์นี้รองรับ memory pooling ระดับแร็ก มี 260 เลน และออกแบบให้ CPU, GPU และตัวเร่งความเร็วอย่าง XPU เข้าถึงทรัพยากรหน่วยความจำแบบแยกส่วนที่อยู่นอกเซิร์ฟเวอร์ได้ โดยรองรับ CXL 3.0 และมีแบนด์วิดท์รวมสูงสุด 4 เทราไบต์ต่อวินาที
ริชี ชุกห์(Rishi Chugh) รองประธานและผู้จัดการทั่วไปฝ่ายสวิตช์ศูนย์ข้อมูลของมาร์เวล กล่าวว่า “การฝ่า AI memory wall จำเป็นต้องมีการเปลี่ยนแปลงเชิงสถาปัตยกรรมในระดับพื้นฐาน” คำกล่าวนี้ชี้ว่า หน่วยความจำไม่ควรถูกมองเป็นทรัพยากรที่ผูกติดกับเซิร์ฟเวอร์แต่ละเครื่องเท่านั้น แต่ควรถูกแชร์และจัดสรรภายในแร็กได้
จากคำอธิบายผลิตภัณฑ์ของมาร์เวล Structera S 30260 รองรับ CPU หรือ GPU ได้ 16 หรือ 32 ตัว และรองรับหน่วยความจำร่วมสูงสุด 48 เทราไบต์ ในการทดสอบภายในของมาร์เวล เมื่อให้ GPU 8 ตัวและเซิร์ฟเวอร์ CPU 2 เครื่องใช้ memory pool ขนาด 16 เทราไบต์ร่วมกัน ปริมาณงานอนุมานดีขึ้น 4.8 เท่า และเวลาสร้างโทเคนแรกสั้นลง 82.7%
สตอเรจกำลังกลายเป็นอีกแกนสำคัญของการขยายโครงสร้างพื้นฐาน AI เช่นกัน เอ็นวิเดีย(NVIDIA·$NVDA) นำเสนอแพลตฟอร์ม CMX context memory storage ที่ขับเคลื่อนด้วย BlueField-4 เพื่อจัดชั้นเก็บข้อมูลแบบแฟลชสำหรับ KV cache ที่ใช้ในการอนุมานบริบทยาว เอ็นวิเดียระบุว่าเป้าหมายคือเพิ่มอัตราประมวลผลโทเคนต่อวินาทีอย่างต่อเนื่องและประสิทธิภาพพลังงานได้สูงสุด 5 เท่าในงานที่ใช้บริบทยาวและเวิร์กโหลดแบบเอเจนต์
มาร์เวลและเอ็นวิเดียยังขยายความร่วมมือด้านโครงสร้างพื้นฐาน AI ทั้งสองบริษัทประกาศเมื่อวันที่ 31 มีนาคมว่า จะร่วมมือกันในระบบนิเวศ AI factory และ AI-RAN บนพื้นฐาน NVLink Fusion โดยมาร์เวลจะจัดหา custom XPU และเครือข่าย scale-up ที่เข้ากันได้กับ NVLink Fusion พร้อมทั้งร่วมมือกันด้านเทคโนโลยีซิลิคอนโฟโตนิกส์
การนำเสนอครั้งนี้เน้นไปที่เซมิคอนดักเตอร์ หน่วยความจำ และสตอเรจสำหรับศูนย์ข้อมูล AI มากกว่าการออกสินทรัพย์ดิจิทัลหรือโทเคน อย่างไรก็ดี ประเด็นดังกล่าวเชื่อมโยงกับกระแสที่บริษัทขุดบิตคอยน์(BTC) ใช้ไฟฟ้าและโครงสร้างพื้นฐานเดิมเพื่อขยายไปสู่ธุรกิจ AI และคอมพิวติ้งสมรรถนะสูง ส่วนความเชื่อมโยงโดยตรงกับราคาสินทรัพย์ดิจิทัลหรือความต้องการโทเคนใดเป็นการเฉพาะยังไม่ได้รับการยืนยัน
มาร์เวลระบุว่า Structera S 30260 จะเริ่มส่งตัวอย่างให้ลูกค้าในไตรมาส 3 ปี 2026 ขณะที่สวิตช์ CXL 2.0 รุ่น Structera S 20256 เดิมเข้าสู่ขั้นตอนการผลิตแล้ว ประเด็น CXL switch และ AI memory wall จึงยังเป็นหัวข้อที่อุตสาหกรรมศูนย์ข้อมูล AI ติดตามต่อไป
ความคิดเห็น 0