AI 推論晶片製造商 d-Matrix 今日宣布,將採用 NVLink Fusion 技術,把其下一代 Raptor XPU 連接到 NVIDIA 的 AI 基礎設施平台。此舉使其成為越來越多採用 NVIDIA AI 平台的合作夥伴之一。
透過將 Raptor 連接到 NVIDIA NVLink 擴展(scale-up)和 Spectrum-X 擴展(scale-out)網路、NVIDIA MGX 機架架構以及更廣泛的 NVIDIA AI 平台,NVLink Fusion 為 d-Matrix 提供了一條加速且風險較低的途徑,使其客製化晶片能實現大規模部署。
d-Matrix 共同創辦人兼執行長 Sid Sheth 在昨日的記者會上表示:「對推論的需求正在飆升,但資金、時間和能源卻是有限的。」他補充說:「藉由 NVLink Fusion 和 MGX,我們可以將 Raptor XPU 整合到廣泛部署的液冷架構中,為客戶提供更快、風險更低的途徑,以部署和擴展超低延遲的推論。」
NVIDIA AI 平台是垂直整合且水平開放的。NVLink Fusion 將這種開放性擴展到 XPU 和 CPU,讓晶片公司能夠專注於處理器創新,同時利用 NVIDIA 的基礎設施將其部署到 AI 工廠規模。
打造 XPU 只是第一步。要在 AI 工廠規模部署它,需要一個完整的平台,涵蓋網路、機架架構、電源、散熱、軟體和經過驗證的供應鏈。每個步驟,從晶片採購、高速介面整合、擴展網路解決方案驗證,到機架架構設計和認證,都會增加時間、成本和風險。
NVLink Fusion 讓晶片創新者能夠直接連接到 NVIDIA 經過驗證的平台。這是一種高頻寬、低延遲的技術,用於將客製化 XPU 和 CPU 連接到 NVIDIA 的技術堆疊。
透過採用 NVLink Fusion,d-Matrix 可以利用 NVIDIA MGX 生態系統中成熟、經過驗證的機架設計、供應鏈、電源和散熱基礎設施。藉由標準化通用機架,資料中心可以一次性建置,並支援 GPU、CPU 和 XPU,而無需為每種處理器類型設計單獨的機架架構。
d-Matrix 計劃使用 NVIDIA NVLink,將其 XPU 連接到單一高頻寬、低延遲的擴展(scale-up)領域。其機架還可以與 NVIDIA Vera Rubin NVL72 等基於 NVIDIA GPU 的系統協同工作,以實現分離式推論。
d-Matrix 還計劃整合 NVIDIA Vera CPU、NVIDIA ConnectX-9 SuperNIC、NVIDIA BlueField-4 DPU 和 NVIDIA Spectrum-X 乙太網路。這些技術與 NVLink 和 MGX 結合,為 d-Matrix 提供了一個經過驗證的基礎,使其能夠在靈活、統一的 AI 工廠中,與 NVIDIA 系統並行部署專用推論。
NVLink Fusion 為 NVIDIA AI 工廠開放專用 XPU 架構。
NVIDIA 的全端 AI 工廠平台包括 NVIDIA Vera Rubin NVL72、Groq 3 LPX、Vera CPU 機架、Vera BlueField-4 STX 儲存和 Spectrum-6 SPX 乙太網路。它旨在實現完全可互換性,能夠運行所有 AI 工作負載、模型和模型架構,同時提供最佳的每瓦效能和最低的每 token 成本。
NVLink Fusion 讓客戶能夠在通用 AI 工廠平台內,為每個工作負載匹配合適的運算資源,並開放存取 NVIDIA 的網路、系統、軟體和全球供應鏈。像 d-Matrix 這樣的晶片創新者可以利用 NVLink Fusion 來提升效能、加速產品上市時間,並降低部署半客製化 AI 工廠的風險。

