AI News HubLIVE
站内改写2 分钟阅读

为Vera Rubin打造,NVIDIA Spectrum-6抵达千兆级AI工厂

NVIDIA宣布其102.4太比特每秒的Spectrum-6以太网交换机系统已开始交付,该系统作为Vera Rubin平台的一部分,专为千兆级AI工厂设计,提供两倍于上一代的带宽。CoreWeave、Microsoft、Nebius等领先AI基础设施构建者将首批部署。Spectrum-6是Spectrum-X以太网平台的新一代核心,通过智能交换、ConnectX-9 SuperNIC和全栈软件,实现高达1.6倍的AI网络性能提升和95%的网络效率。

来源NVIDIA Blog作者: Scot Schultz

人工智能已进入千兆级时代。全球最先进的AI工厂正在将数十万块GPU和CPU汇聚在一起,训练前沿模型、驱动智能代理并以前所未有的规模生成智能。在此规模下,网络成为驱动令牌生成的关键计算倍增器。

作为网络领域的里程碑,NVIDIA Spectrum-6——一款102.4太比特/秒的以太网交换机系统,提供前代系统两倍的容量,并作为NVIDIA Vera Rubin平台的一部分——正在全球千兆级AI工厂中部署。Spectrum-6是NVIDIA Spectrum-X以太网平台新一代的核心,提供运行AI工厂所需的全端到端计算系统的带宽、规模和智能。

全球领先的AI基础设施构建者——包括CoreWeave、Microsoft、Nebius、SpaceXAI和Tesla——将率先引入Spectrum-6以加速其AI工厂。对于云提供商,Spectrum-6意味着更多计算容量可作为统一的高性能资源运行,帮助客户更快地训练模型和部署推理服务。

CoreWeave产品总监Min Jun表示:“CoreWeave为最苛刻的AI工作负载而生,网络是提供规模化性能的核心。将NVIDIA Spectrum-6和液冷Spectrum-X以太网基础设施引入我们的AI工厂,将有助于提供客户训练前沿模型和加速推理所需的带宽、弹性和效率。”Nebius全球合作伙伴副总裁Laurelle Roseman补充道:“在千兆级规模,性能取决于协调:让每个GPU保持同步,以免一个慢速链接拖垮整个任务。这就是NVIDIA Spectrum-6的目标,也是我们早期引入它的原因——一个随着客户最苛刻工作负载扩展而保持快速和弹性的网络结构。”

除了硬件,Spectrum-X以太网还通过智能负载均衡、快速故障旁路和精确恢复技术优化流量。与普通以太网相比,它提供高达1.6倍的AI网络性能,并在超过10万GPU的部署中维持高达95%的网络效率。硬件加速的Spectrum-X多平面拓扑将数据中心所需的交换机数量减少1.7倍,进一步加速网络效率。结合Spectrum-X以太网光子学,可实现5倍更高的功率效率和10倍改善的平均故障间隔时间。

Spectrum-6交换机芯片与NVIDIA ConnectX-9 SuperNIC结合,构成新一代Spectrum-X以太网,并与Vera Rubin平台的其他组件(Vera CPU、Rubin GPU、NVLink 6交换机、BlueField-4 DPU)协同设计。它支持可插拔和共封装光学形式,以及液冷,实现AI工厂的全面端到端散热。

通过这种方式,NVIDIA提供了垂直集成、水平开放的方法:在支持标准以太网、开放网络操作系统和广泛生态系统的同时,协同设计芯片、系统和软件。客户无需拼凑部件并自行优化,即可获得一个完整的AI工厂平台,实现最快的训练时间和最低的每令牌成本。