AI News HubLIVE
站內改寫2 分鐘閱讀

NVIDIA Vera Rubin:每瓦效能領先,為全球合作伙伴提供最低令牌成本

NVIDIA Vera Rubin NVL72 正加速生產,與 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴共同部署。該平臺透過極致協同設計實現最高的每瓦效能和最低的令牌成本,在 DeepSeek-R1 基準測試中每兆瓦吞吐量比 Grace Blackwell NVL72 提升 10 倍。Vera Rubin 還支援歐洲開放模型時代,與微軟和 Mistral 合作擴充套件 AI 基礎設施。

來源NVIDIA Blog作者: NVIDIA Writers

NVIDIA 宣佈 Vera Rubin 平臺正式進入量產階段,這是專為 AI 工廠設計的機架級超級計算機。Vera Rubin NVL72 的極速協同設計涵蓋了七種全新晶片和五種機架托盤,所有元件作為一個整體系統打造,而非拼湊現成產品。該平臺旨在提供最高的每瓦效能和最低的令牌成本,滿足電力受限的 AI 工廠對效率的極致需求。

Vera Rubin NVL72 由 NVIDIA Vera CPU 驅動,該 CPU 採用定製的 Olympus 核心,單執行緒效能提升 2 倍,核心間頻寬提升 3 倍,記憶體延遲降低 40%,成為代理型工作負載的最高效單執行緒 CPU。在互聯方面,第六代 NVLink 擴充套件網路比標準乙太網吞吐量提升 2 倍以上,延遲降低 3 倍,資料包速率提升 10 倍。Spectrum-X 乙太網則提供 1.6 倍的 RDMA 頻寬,並整合光子共封裝光學器件,功耗降低 5 倍,平均無故障時間提升 10 倍。

CoreWeave 成為首個上線並驗證 Vera Rubin NVL72 的 AI 雲服務商,其 DeepSeek-R1 基準測試顯示,相比 Grace Blackwell NVL72,每兆瓦令牌數提升 10 倍。這一指標直接決定了 AI 基礎設施可盈利擴充套件的潛力。CoreWeave 還部署了液冷設計的 Spectrum-X 乙太網交換機 SN6600-LD,提供 1.64 Pb/s 的容錯交換能力。

Google Cloud 也推出基於 Vera Rubin NVL72 的 A5X 例項,倫敦初創公司 Ineffable Intelligence 率先使用。該公司正在開發新一代“超級學習器”系統,透過強化學習和大規模並行環境進行訓練,對計算、記憶體頻寬和互聯提出了極高要求。A5X 例項可擴充套件至數萬個 Rubin GPU,並支援跨站點配置連線近百萬個 GPU。

在歐洲,微軟和 Mistral 宣佈擴大合作,以 Vera Rubin 為基礎構建主權 AI 基礎設施。Mistral 將增加 GPU 容量,利用數千個 Vera Rubin GPU 提供訓練和推理服務。Vera Rubin NVL72 相比 GB200 NVL72,每兆瓦令牌量提升 10 倍,每百萬令牌成本降低至十分之一,使歐洲能夠在符合本地法規的前提下追求創新、經濟性和控制權。

此外,DeepInfra 的基準測試表明,NVIDIA Vera CPU 在代理型工作負載中效能是其他 CPU 的兩倍以上,可支援 1.6 倍的併發 AI 代理,並實現 2.2 倍的更快編排速度。Vera Rubin NVL72 還透過無電纜、無風扇、無軟管的設計,將計算托盤組裝時間從數小時縮短至一分鐘。45°C 的液冷入口溫度設計允許免冷凍乾燥冷卻器執行,為新型 AI 工廠每兆瓦每年節省數百萬加侖的水。

Vera Rubin 正在全球範圍內推動 AI 基礎設施的下一波浪潮,從美國到歐洲,從雲服務到企業級部署,其高效的協同設計為合作伙伴提供了無與倫比的效能和成本優勢。