AI News HubLIVE
站内改写2 分钟阅读

NVIDIA Vera Rubin:每瓦性能领先,为全球合作伙伴提供最低令牌成本

NVIDIA Vera Rubin NVL72 正加速生产,与 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴共同部署。该平台通过极致协同设计实现最高的每瓦性能和最低的令牌成本,在 DeepSeek-R1 基准测试中每兆瓦吞吐量比 Grace Blackwell NVL72 提升 10 倍。Vera Rubin 还支持欧洲开放模型时代,与微软和 Mistral 合作扩展 AI 基础设施。

来源NVIDIA Blog作者: NVIDIA Writers

NVIDIA 宣布 Vera Rubin 平台正式进入量产阶段,这是专为 AI 工厂设计的机架级超级计算机。Vera Rubin NVL72 的极速协同设计涵盖了七种全新芯片和五种机架托盘,所有组件作为一个整体系统打造,而非拼凑现成产品。该平台旨在提供最高的每瓦性能和最低的令牌成本,满足电力受限的 AI 工厂对效率的极致需求。

Vera Rubin NVL72 由 NVIDIA Vera CPU 驱动,该 CPU 采用定制的 Olympus 核心,单线程性能提升 2 倍,核心间带宽提升 3 倍,内存延迟降低 40%,成为代理型工作负载的最高效单线程 CPU。在互联方面,第六代 NVLink 扩展网络比标准以太网吞吐量提升 2 倍以上,延迟降低 3 倍,数据包速率提升 10 倍。Spectrum-X 以太网则提供 1.6 倍的 RDMA 带宽,并集成光子共封装光学器件,功耗降低 5 倍,平均无故障时间提升 10 倍。

CoreWeave 成为首个上线并验证 Vera Rubin NVL72 的 AI 云服务商,其 DeepSeek-R1 基准测试显示,相比 Grace Blackwell NVL72,每兆瓦令牌数提升 10 倍。这一指标直接决定了 AI 基础设施可盈利扩展的潜力。CoreWeave 还部署了液冷设计的 Spectrum-X 以太网交换机 SN6600-LD,提供 1.64 Pb/s 的容错交换能力。

Google Cloud 也推出基于 Vera Rubin NVL72 的 A5X 实例,伦敦初创公司 Ineffable Intelligence 率先使用。该公司正在开发新一代“超级学习器”系统,通过强化学习和大规模并行环境进行训练,对计算、内存带宽和互联提出了极高要求。A5X 实例可扩展至数万个 Rubin GPU,并支持跨站点配置连接近百万个 GPU。

在欧洲,微软和 Mistral 宣布扩大合作,以 Vera Rubin 为基础构建主权 AI 基础设施。Mistral 将增加 GPU 容量,利用数千个 Vera Rubin GPU 提供训练和推理服务。Vera Rubin NVL72 相比 GB200 NVL72,每兆瓦令牌量提升 10 倍,每百万令牌成本降低至十分之一,使欧洲能够在符合本地法规的前提下追求创新、经济性和控制权。

此外,DeepInfra 的基准测试表明,NVIDIA Vera CPU 在代理型工作负载中性能是其他 CPU 的两倍以上,可支持 1.6 倍的并发 AI 代理,并实现 2.2 倍的更快编排速度。Vera Rubin NVL72 还通过无电缆、无风扇、无软管的设计,将计算托盘组装时间从数小时缩短至一分钟。45°C 的液冷入口温度设计允许免冷冻干燥冷却器运行,为新型 AI 工厂每兆瓦每年节省数百万加仑的水。

Vera Rubin 正在全球范围内推动 AI 基础设施的下一波浪潮,从美国到欧洲,从云服务到企业级部署,其高效的协同设计为合作伙伴提供了无与伦比的性能和成本优势。