Back to top
  • 공유 แชร์
  • 인쇄 พิมพ์
  • 글자크기 ขนาดตัวอักษร
ลิงก์ถูกคัดลอกแล้ว

260 เลน CXL มาร์เวลเล็งแก้คอขวดหน่วยความจำ AI

อุปกรณ์ศูนย์ข้อมูลและโมดูลหน่วยความจำ / TokenPost.ai

มาร์เวล เทคโนโลยี(Marvell Technology·$MRVL) เตรียมชูสวิตช์ CXL แบบ 260 เลน เพื่อแก้ปัญหาคอขวดด้านหน่วยความจำและสตอเรจในโครงสร้างพื้นฐาน AI หลังภาระของศูนย์ข้อมูลไม่ได้อยู่แค่พลังประมวลผล แต่ขยายไปถึงความจุหน่วยความจำ แบนด์วิดท์ และรูปแบบการเคลื่อนย้ายข้อมูล ตามการใช้งานโมเดลภาษาขนาดใหญ่(LLM) ที่ต้องรองรับบริบทยาวขึ้น

มาร์เวลจะจัดการนำเสนอและร่วมเสวนาเกี่ยวกับหน่วยความจำและสตอเรจสำหรับโครงสร้างพื้นฐาน AI ในงาน Future of Memory and Storage 2026 ที่เมืองซานตาคลารา รัฐแคลิฟอร์เนีย สหรัฐฯ ระหว่างวันที่ 5-7 (ตามเวลาเกาหลี) โดยวาระสำคัญครอบคลุม ‘นวัตกรรมสตอเรจข้อมูลสำหรับโครงสร้างพื้นฐาน AI ที่ขยายได้’, ‘ยุคที่หน่วยความจำเป็นศูนย์กลาง: CXL และอนาคตของโครงสร้างพื้นฐาน AI ที่ขยายได้’ และ ‘CXL-PNM อเนกประสงค์: ฝ่ากำแพงหน่วยความจำของเวิร์กโหลด AI ที่ใช้หน่วยความจำเข้มข้น’

ประเด็นหลักคือ ‘AI memory wall’ หรือกำแพงหน่วยความจำของ AI เมื่อ LLM มีขนาดใหญ่ขึ้นและ context window ยาวขึ้น ความต้องการ KV cache ก็เพิ่มขึ้นตามไปด้วย KV cache คือข้อมูลที่เก็บบริบทหรือบทสนทนาก่อนหน้าไว้ เพื่อให้โมเดล AI ไม่ต้องคำนวณซ้ำ จึงกระทบโดยตรงต่อความเร็วในการอนุมานและต้นทุน

มาร์เวลประกาศสวิตช์ CXL รุ่นถัดไป ‘Structera S 30260’ เมื่อวันที่ 17 มีนาคม ผลิตภัณฑ์นี้รองรับ memory pooling ระดับแร็ก มี 260 เลน และออกแบบให้ CPU, GPU และตัวเร่งความเร็วอย่าง XPU เข้าถึงทรัพยากรหน่วยความจำแบบแยกส่วนที่อยู่นอกเซิร์ฟเวอร์ได้ โดยรองรับ CXL 3.0 และมีแบนด์วิดท์รวมสูงสุด 4 เทราไบต์ต่อวินาที

ริชี ชุกห์(Rishi Chugh) รองประธานและผู้จัดการทั่วไปฝ่ายสวิตช์ศูนย์ข้อมูลของมาร์เวล กล่าวว่า “การฝ่า AI memory wall จำเป็นต้องมีการเปลี่ยนแปลงเชิงสถาปัตยกรรมในระดับพื้นฐาน” คำกล่าวนี้ชี้ว่า หน่วยความจำไม่ควรถูกมองเป็นทรัพยากรที่ผูกติดกับเซิร์ฟเวอร์แต่ละเครื่องเท่านั้น แต่ควรถูกแชร์และจัดสรรภายในแร็กได้

จากคำอธิบายผลิตภัณฑ์ของมาร์เวล Structera S 30260 รองรับ CPU หรือ GPU ได้ 16 หรือ 32 ตัว และรองรับหน่วยความจำร่วมสูงสุด 48 เทราไบต์ ในการทดสอบภายในของมาร์เวล เมื่อให้ GPU 8 ตัวและเซิร์ฟเวอร์ CPU 2 เครื่องใช้ memory pool ขนาด 16 เทราไบต์ร่วมกัน ปริมาณงานอนุมานดีขึ้น 4.8 เท่า และเวลาสร้างโทเคนแรกสั้นลง 82.7%

สตอเรจกำลังกลายเป็นอีกแกนสำคัญของการขยายโครงสร้างพื้นฐาน AI เช่นกัน เอ็นวิเดีย(NVIDIA·$NVDA) นำเสนอแพลตฟอร์ม CMX context memory storage ที่ขับเคลื่อนด้วย BlueField-4 เพื่อจัดชั้นเก็บข้อมูลแบบแฟลชสำหรับ KV cache ที่ใช้ในการอนุมานบริบทยาว เอ็นวิเดียระบุว่าเป้าหมายคือเพิ่มอัตราประมวลผลโทเคนต่อวินาทีอย่างต่อเนื่องและประสิทธิภาพพลังงานได้สูงสุด 5 เท่าในงานที่ใช้บริบทยาวและเวิร์กโหลดแบบเอเจนต์

มาร์เวลและเอ็นวิเดียยังขยายความร่วมมือด้านโครงสร้างพื้นฐาน AI ทั้งสองบริษัทประกาศเมื่อวันที่ 31 มีนาคมว่า จะร่วมมือกันในระบบนิเวศ AI factory และ AI-RAN บนพื้นฐาน NVLink Fusion โดยมาร์เวลจะจัดหา custom XPU และเครือข่าย scale-up ที่เข้ากันได้กับ NVLink Fusion พร้อมทั้งร่วมมือกันด้านเทคโนโลยีซิลิคอนโฟโตนิกส์

การนำเสนอครั้งนี้เน้นไปที่เซมิคอนดักเตอร์ หน่วยความจำ และสตอเรจสำหรับศูนย์ข้อมูล AI มากกว่าการออกสินทรัพย์ดิจิทัลหรือโทเคน อย่างไรก็ดี ประเด็นดังกล่าวเชื่อมโยงกับกระแสที่บริษัทขุดบิตคอยน์(BTC) ใช้ไฟฟ้าและโครงสร้างพื้นฐานเดิมเพื่อขยายไปสู่ธุรกิจ AI และคอมพิวติ้งสมรรถนะสูง ส่วนความเชื่อมโยงโดยตรงกับราคาสินทรัพย์ดิจิทัลหรือความต้องการโทเคนใดเป็นการเฉพาะยังไม่ได้รับการยืนยัน

มาร์เวลระบุว่า Structera S 30260 จะเริ่มส่งตัวอย่างให้ลูกค้าในไตรมาส 3 ปี 2026 ขณะที่สวิตช์ CXL 2.0 รุ่น Structera S 20256 เดิมเข้าสู่ขั้นตอนการผลิตแล้ว ประเด็น CXL switch และ AI memory wall จึงยังเป็นหัวข้อที่อุตสาหกรรมศูนย์ข้อมูล AI ติดตามต่อไป

<ลิขสิทธิ์ ⓒ TokenPost ห้ามเผยแพร่หรือแจกจ่ายซ้ำโดยไม่ได้รับอนุญาต>

บทความที่มีคนดูมากที่สุด

บทความที่เกี่ยวข้อง

ความคิดเห็น 0

ข้อแนะนำสำหรับความคิดเห็น

ขอบคุณสำหรับบทความดี ๆ ต้องการบทความติดตามเพิ่มเติม เป็นการวิเคราะห์ที่ยอดเยี่ยม

0/1000

ข้อแนะนำสำหรับความคิดเห็น

ขอบคุณสำหรับบทความดี ๆ ต้องการบทความติดตามเพิ่มเติม เป็นการวิเคราะห์ที่ยอดเยี่ยม
1