Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

260 通道 CXL 交換器,Marvell 公布 AI 記憶體瓶頸方案

資料中心設備與記憶體模組 / TokenPost.ai

邁威爾科技(Marvell Technology·$MRVL)將以 260 通道 CXL 交換器公布 AI 基礎設施的記憶體與儲存瓶頸解法。隨著大型語言模型(LLM)的上下文處理量增加,資料中心壓力正從運算效能,擴大到記憶體容量、頻寬與資料搬移架構。

Marvell 將於台灣時間 5 至 7 日在美國加州聖塔克拉拉舉行的 Future of Memory and Storage 2026,進行 AI 基礎設施記憶體與儲存相關發表及座談。議程包括「可擴展 AI 基礎設施的資料儲存創新」、「以記憶體為中心的時代:CXL 與可擴展 AI 基礎設施的未來」,以及「通用 CXL-PNM:突破記憶體密集型 AI 工作負載的記憶體牆」。

這次核心主題是「AI 記憶體牆」。LLM 規模愈大、上下文視窗愈長,用來保存先前脈絡的 KV 快取需求也會上升。KV 快取是保存 AI 模型先前對話或上下文資訊的資料,可避免重複計算,並直接影響推論速度與成本。

Marvell 於 3 月 17 日發表次世代 CXL 交換器 Structera S 30260。這是一款支援機架級記憶體池化的 260 通道產品,設計目標是讓 CPU、GPU、XPU 等加速器能存取伺服器外部的分離式記憶體資源。該產品支援 CXL 3.0,最大彙整頻寬為每秒 4 TB。

里希·丘格(Rishi Chugh) Marvell 資料中心交換器事業部副總裁暨總經理表示:「若要突破 AI 記憶體牆,需要根本性的架構轉變。」這意味著記憶體不再只是固定在單一伺服器內的資源,而要轉為可在機架內共享與分配的資源。

Marvell 在產品說明中指出,Structera S 30260 支援 16 個或 32 個 CPU、GPU,以及最高 48 TB 的共享記憶體。Marvell 自行測試顯示,當 16 TB 記憶體池由 8 個 GPU 與 2 台 CPU 伺服器共享時,推論處理量提升至 4.8 倍,首個 token 生成時間減少 82.7%。

儲存也成為 AI 基礎設施擴張的另一項關鍵。輝達(NVIDIA·$NVDA)透過 BlueField-4 基礎的 CMX 上下文記憶體儲存平台,為長上下文推論所需的 KV 快取提供快閃儲存層。輝達表示,該平台目標是在長上下文與代理型工作負載中,讓持續每秒 token 處理量與電力效率最高提升 5 倍。

Marvell 與輝達也正在擴大 AI 基礎設施合作。雙方於 3 月 31 日宣布,將以 NVLink Fusion 為基礎,在 AI 工廠與 AI-RAN 生態系展開合作。Marvell 將提供客製化 XPU 與相容 NVLink Fusion 的 scale-up networking,雙方也將在矽光子技術上合作。

這次發表重點放在 AI 資料中心用半導體、記憶體與儲存基礎設施,而非加密貨幣或代幣發行。不過,這與比特幣挖礦企業利用既有電力與設備,擴展至 AI 與高效能運算業務的趨勢有所交集。特定加密貨幣價格或代幣需求與此之間的直接關聯,目前尚未確認。

Structera S 30260 的客戶樣品預計於 2026 年第 3 季開始提供。既有 Structera S 20256 CXL 2.0 交換器已進入量產階段。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1