NVIDIA发布NVLink Fusion,将定制XPU接入其AI工厂基础设施
NVIDIA推出NVLink Fusion,允许超大规模企业和AI原生公司的定制XPU接入其NVLink互联域、MGX机架架构和软件栈,宣称可降低开发成本并加快上市时间。
AI解读:NVLink Fusion的出现,是因为像Google、亚马逊这类自研定制AI芯片(XPU)的公司,如果一切都从零开始搭建互联网络、机架和软件生态,成本极高且上市很慢。NVIDIA这次干脆把自家的NVLink高速互联、机架设计和集群管理软件开放出来,让这些XPU像插头一样接入NVIDIA的整套基础设施,同时保留各家自研芯片的计算内核。这样一来,定制芯片公司就能把精力放在自己擅长的计算部分,不用再重复造轮子。对采用者而言,最直接的变化是开发周期缩短,还能复用NVIDIA成熟的NVL72机架,甚至供应链。不过,这意味着它们的设计在互联和机架层面要遵循NVIDIA的规格。目前NVIDIA声称比以太网方案延迟低3倍,但具体性能还要等实际部署验证。对普通读者来说,这件事暂时没有直接影响,但如果你是做AI基础设施的工程师或规划者,值得评估一下这种半定制模式是否比纯自研更划算。
NVIDIA于周二发布NVLink Fusion,一套用于将定制XPU(加速处理器)接入NVIDIA AI基础设施的方案。该方案允许超大规模企业和AI-native公司的定制XPU接入NVIDIA的NVLink高速互联域、机架架构和软件栈,以减少自建AI工厂在互联、机架和生态上的重复投入。NVIDIA表示,与基于现成以太网的替代方案相比,NVLink Fusion域内XPU到XPU的端到端延迟降低3倍,数据包速率提高10倍。