AI 推理芯片公司 d-Matrix 宣布将采用 NVIDIA NVLink Fusion 技术,把其下一代 Raptor XPU 连接至 NVIDIA AI 基础设施平台。通过接入 NVIDIA NVLink 纵向扩展(scale-up)网络、Spectrum-X 横向扩展(scale-out)网络以及 MGX 机架架构,d-Matrix 希望为其定制芯片提供一条从硅片到大规模部署的加速路径。
d-Matrix 联合创始人兼首席执行官 Sid Sheth 在媒体简报会上表示:“推理需求正在激增,但资本、时间和能源仍然有限。借助 NVLink Fusion 和 MGX,我们可以将 Raptor XPU 集成到已广泛部署的液冷架构中,为客户提供更快、更低风险的超低延迟推理部署与扩展方案。”
从定制芯片到机架级部署
开发一款 XPU 只是第一步,要在 AI 工厂规模完成部署,还需要覆盖网络、机架架构、供电、散热、软件及供应链的完整平台。NVLink Fusion 是一项高带宽、低延迟互连技术,可将定制 XPU 和 CPU 直接接入 NVIDIA 技术栈。通过采用该技术,d-Matrix 能够利用 MGX 生态系统中经过验证的机架设计、供应链以及供电与散热基础设施。数据中心若统一采用通用机架标准,可在同一套架构下支持 GPU、CPU 和 XPU,无需为每种处理器单独设计机架。
Raptor XPU 如何融入 AI 工厂
d-Matrix 计划使用 NVIDIA NVLink 将其 XPU 连接成一个单一的高带宽、低延迟 scale-up 域。这些机架还能够与基于 NVIDIA GPU 的系统(如 NVIDIA Vera Rubin NVL72)协同工作,用于解耦式推理。此外,d-Matrix 还计划集成 NVIDIA Vera CPU、ConnectX-9 SuperNIC、BlueField-4 DPU 以及 Spectrum-X 以太网网络。结合 NVLink 和 MGX,这些组件可为 d-Matrix 提供一个经过验证的基础,使其能够在灵活的统一 AI 工厂内部署专用推理能力。
NVLink Fusion 向专用架构开放平台
NVIDIA 全栈 AI 工厂平台涵盖 Vera Rubin NVL72、Groq 3 LPX、Vera CPU 机架、Vera BlueField-4 STX 存储以及 Spectrum-6 SPX 以太网网络,设计目标是在统一的平台上运行各类 AI 工作负载、模型和模型架构,并追求最佳的每瓦性能与最低的每 token 成本。NVLink Fusion 使客户能够在通用 AI 工厂平台内为不同工作负载匹配合适的算力,同时接入 NVIDIA 的网络、系统、软件和全球供应链。对于 d-Matrix 等芯片创新企业而言,这意味着可借此提升性能、加快上市速度,并降低部署半定制 AI 工厂的风险。
