跳到主要內容
AI News HubLIVE
站內改寫2 分鐘閱讀

NVIDIA Vera Rubin:每瓦效能領先,為全球合作伙伴提供最低令牌成本

文章摘要

NVIDIA Vera Rubin NVL72 正加速生產,與 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴共同部署。該平臺透過極致協同設計實現最高的每瓦效能和最低的令牌成本,在 DeepSeek-R1 基準測試中每兆瓦吞吐量比 Grace Blackwell NVL72 提升 10 倍。Vera Rubin 還支援歐洲開放模型時代,與微軟和 Mistral 合作擴充套件 AI 基礎設施。

來源NVIDIA Blog作者: NVIDIA Writers
NVIDIA Vera Rubin:每瓦效能領先,為全球合作伙伴提供最低令牌成本
回報錯誤

更正管道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

NVIDIA 宣佈 Vera Rubin 平臺正式進入量產階段,這是專為 AI 工廠設計的機架級超級計算機。Vera Rubin NVL72 的極速協同設計涵蓋了七種全新晶片和五種機架托盤,所有元件作為一個整體系統打造,而非拼湊現成產品。該平臺旨在提供最高的每瓦效能和最低的令牌成本,滿足電力受限的 AI 工廠對效率的極致需求。

Vera Rubin NVL72 由 NVIDIA Vera CPU 驅動,該 CPU 採用定製的 Olympus 核心,單執行緒效能提升 2 倍,核心間頻寬提升 3 倍,記憶體延遲降低 40%,成為代理型工作負載的最高效單執行緒 CPU。在互聯方面,第六代 NVLink 擴充套件網路比標準乙太網吞吐量提升 2 倍以上,延遲降低 3 倍,資料包速率提升 10 倍。Spectrum-X 乙太網則提供 1.6 倍的 RDMA 頻寬,並整合光子共封裝光學器件,功耗降低 5 倍,平均無故障時間提升 10 倍。

CoreWeave 成為首個上線並驗證 Vera Rubin NVL72 的 AI 雲服務商,其 DeepSeek-R1 基準測試顯示,相比 Grace Blackwell NVL72,每兆瓦令牌數提升 10 倍。這一指標直接決定了 AI 基礎設施可盈利擴充套件的潛力。CoreWeave 還部署了液冷設計的 Spectrum-X 乙太網交換機 SN6600-LD,提供 1.64 Pb/s 的容錯交換能力。

Google Cloud 也推出基於 Vera Rubin NVL72 的 A5X 例項,倫敦初創公司 Ineffable Intelligence 率先使用。該公司正在開發新一代“超級學習器”系統,透過強化學習和大規模並行環境進行訓練,對計算、記憶體頻寬和互聯提出了極高要求。A5X 例項可擴充套件至數萬個 Rubin GPU,並支援跨站點配置連線近百萬個 GPU。

在歐洲,微軟和 Mistral 宣佈擴大合作,以 Vera Rubin 為基礎構建主權 AI 基礎設施。Mistral 將增加 GPU 容量,利用數千個 Vera Rubin GPU 提供訓練和推理服務。Vera Rubin NVL72 相比 GB200 NVL72,每兆瓦令牌量提升 10 倍,每百萬令牌成本降低至十分之一,使歐洲能夠在符合本地法規的前提下追求創新、經濟性和控制權。

此外,DeepInfra 的基準測試表明,NVIDIA Vera CPU 在代理型工作負載中效能是其他 CPU 的兩倍以上,可支援 1.6 倍的併發 AI 代理,並實現 2.2 倍的更快編排速度。Vera Rubin NVL72 還透過無電纜、無風扇、無軟管的設計,將計算托盤組裝時間從數小時縮短至一分鐘。45°C 的液冷入口溫度設計允許免冷凍乾燥冷卻器執行,為新型 AI 工廠每兆瓦每年節省數百萬加侖的水。

Vera Rubin 正在全球範圍內推動 AI 基礎設施的下一波浪潮,從美國到歐洲,從雲服務到企業級部署,其高效的協同設計為合作伙伴提供了無與倫比的效能和成本優勢。

展開要點與分析

文章情報

工程師進階

要點

  • Vera Rubin NVL72 生產加速,覆蓋全球 30 個國家 350 多個工廠站點
  • 每兆瓦吞吐量比上一代提升 10 倍,令牌成本降低至十分之一
  • 七晶片、五機架托盤的極端協同設計,實現無電纜、無風扇、無軟管
  • CoreWeave、Google Cloud、微軟 Azure 和 OCI 為首批部署合作伙伴
  • 支援歐洲主權 AI,與微軟和 Mistral 合作提供開放模型基礎設施

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。