NVIDIA Vera Rubin:每瓦性能領先,為全球合作伙伴提供最低令牌成本
NVIDIA Vera Rubin NVL72 正加速生產,與 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴共同部署。該平台通過極致協同設計實現最高的每瓦性能和最低的令牌成本,在 DeepSeek-R1 基準測試中每兆瓦吞吐量比 Grace Blackwell NVL72 提升 10 倍。Vera Rubin 還支持歐洲開放模型時代,與微軟和 Mistral 合作擴展 AI 基礎設施。
NVIDIA 宣佈 Vera Rubin 平台正式進入量產階段,這是專為 AI 工廠設計的機架級超級計算機。Vera Rubin NVL72 的極速協同設計涵蓋了七種全新芯片和五種機架托盤,所有組件作為一個整體系統打造,而非拼湊現成產品。該平台旨在提供最高的每瓦性能和最低的令牌成本,滿足電力受限的 AI 工廠對效率的極致需求。
Vera Rubin NVL72 由 NVIDIA Vera CPU 驅動,該 CPU 採用定製的 Olympus 核心,單線程性能提升 2 倍,核心間帶寬提升 3 倍,內存延遲降低 40%,成為代理型工作負載的最高效單線程 CPU。在互聯方面,第六代 NVLink 擴展網絡比標準以太網吞吐量提升 2 倍以上,延遲降低 3 倍,數據包速率提升 10 倍。Spectrum-X 以太網則提供 1.6 倍的 RDMA 帶寬,並集成光子共封裝光學器件,功耗降低 5 倍,平均無故障時間提升 10 倍。
CoreWeave 成為首個上線並驗證 Vera Rubin NVL72 的 AI 雲服務商,其 DeepSeek-R1 基準測試顯示,相比 Grace Blackwell NVL72,每兆瓦令牌數提升 10 倍。這一指標直接決定了 AI 基礎設施可盈利擴展的潛力。CoreWeave 還部署了液冷設計的 Spectrum-X 以太網交換機 SN6600-LD,提供 1.64 Pb/s 的容錯交換能力。
Google Cloud 也推出基於 Vera Rubin NVL72 的 A5X 實例,倫敦初創公司 Ineffable Intelligence 率先使用。該公司正在開發新一代“超級學習器”系統,通過強化學習和大規模並行環境進行訓練,對計算、內存帶寬和互聯提出了極高要求。A5X 實例可擴展至數萬個 Rubin GPU,並支持跨站點配置連接近百萬個 GPU。
在歐洲,微軟和 Mistral 宣佈擴大合作,以 Vera Rubin 為基礎構建主權 AI 基礎設施。Mistral 將增加 GPU 容量,利用數千個 Vera Rubin GPU 提供訓練和推理服務。Vera Rubin NVL72 相比 GB200 NVL72,每兆瓦令牌量提升 10 倍,每百萬令牌成本降低至十分之一,使歐洲能夠在符合本地法規的前提下追求創新、經濟性和控制權。
此外,DeepInfra 的基準測試表明,NVIDIA Vera CPU 在代理型工作負載中性能是其他 CPU 的兩倍以上,可支持 1.6 倍的併發 AI 代理,並實現 2.2 倍的更快編排速度。Vera Rubin NVL72 還通過無電纜、無風扇、無軟管的設計,將計算托盤組裝時間從數小時縮短至一分鐘。45°C 的液冷入口温度設計允許免冷凍乾燥冷卻器運行,為新型 AI 工廠每兆瓦每年節省數百萬加侖的水。
Vera Rubin 正在全球範圍內推動 AI 基礎設施的下一波浪潮,從美國到歐洲,從雲服務到企業級部署,其高效的協同設計為合作伙伴提供了無與倫比的性能和成本優勢。