NVIDIA Vera Rubin、パフォーマンス・パーワットを向上、パートナー向けに最低トークンコストを実現
NVIDIA Vera Rubin NVL72の生産が本格化し、CoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructureの各パートナーと連携しています。このプラットフォームは極限の共同設計により最高のパフォーマンス・パーワットと最低のトークンコストを実現し、DeepSeek-R1ベンチマークではGrace Blackwell NVL72と比較してメガワットあたりのスループットが10倍向上しました。また、MicrosoftとMistralの提携により欧州のオープンモデル時代を支援します。
NVIDIAは、Vera Rubinプラットフォームが量産段階に入り、AIファクトリー向けのラックスケールスーパーコンピュータとして本格稼働を開始したと発表しました。Vera Rubin NVL72は、7つの新しいチップと5つのラックトレイにわたる極限の共同設計により、すべてのコンポーネントを単一のシステムとして統合し、最高のパフォーマンス・パーワットと最低のトークンコストを実現します。
Vera Rubin NVL72の中核をなすNVIDIA Vera CPUは、カスタム設計のOlympusコアを搭載し、シングルスレッド性能を2倍、コア間帯域幅を3倍、メモリレイテンシを40%削減し、エージェント型ワークロードで最も効率的なシングルスレッドCPUです。相互接続では、第6世代NVLinkスケールアップが標準イーサネットに比べスループットを2倍以上向上、レイテンシを3分の1に削減します。Spectrum-Xイーサネットは1.6倍のRDMA帯域幅を提供し、共同パッケージ光学系により消費電力を5分の1、MTBIを10倍向上します。
CoreWeaveはVera Rubin NVL72を最初に立ち上げ、DeepSeek-R1ベンチマークでGrace Blackwell NVL72と比較してメガワットあたりのトークン数が10倍向上したことを報告しました。CoreWeaveはまた、液冷設計のSpectrum-XイーサネットスイッチSN6600-LDを導入し、ラックあたり1.64 Pb/sの容量を実現しています。
Google CloudはVera Rubin NVL72を搭載したA5Xインスタンスを発表し、ロンドンのスタートアップIneffable Intelligenceが最初に利用しています。同社は強化学習と大規模並列環境による「スーパーラーナー」システムを開発しており、Vera Rubinはそのエージェントトレーニングに最適なプラットフォームです。A5Xインスタンスは数万個のRubin GPUにスケール可能で、複数サイト構成では最大100万個のGPUを接続できます。
欧州では、MicrosoftとMistralが提携を拡大し、Vera Rubinを基盤とする主権AIインフラを構築しています。Mistralは数千個のVera Rubin GPUを追加し、トレーニングと推論のためのコンピューティング能力を増強します。Vera Rubin NVL72はGB200 NVL72と比較してメガワットあたりのトークン量を10倍、100万トークンあたりのコストを10分の1に削減し、欧州のデータ管理と自律性の要件を満たします。
DeepInfraのベンチマークでは、NVIDIA Vera CPUが他のCPUと比較してエージェントオーケストレーション速度を2.2倍向上、同時エージェント数を1.6倍サポートしました。Vera Rubin NVL72はケーブル、ファン、ホースを排除した設計により、計算トレイの組み立て時間を1分に短縮。45°Cの液冷入口温度設計により、チラーフリーのドライクーラー運用が可能となり、新しいAIファクトリーではメガワットあたり年間数百万ガロンの水を節約します。
Vera Rubinは、米国から欧州まで、クラウドから企業展開まで、世界中のAIインフラの次なる波を推進し、その効率的な共同設計によりパートナーに比類のない性能とコスト優位性を提供しています。