本文にスキップ
AI News HubLIVE
サイト内リライト2 分で読了

IBM Cloud と NVIDIA でエンタープライズ推論キャパシティを拡大

記事の要約

Together AI は IBM および NVIDIA と協力し、IBM Cloud 上で初となる専用大規模 NVIDIA B300 GPU 推論クラスタを Spectrum-X Ethernet ネットワーキングで構築し、エンタープライズ級オープンモデル推論を拡大する。

IBM Cloud と NVIDIA でエンタープライズ推論キャパシティを拡大
誤りを報告

訂正窓口はまだ利用できません。記事情報をコピーして保存できます。

訂正案内
本文へ

Together AI は、IBM および NVIDIA と協力してエンタープライズ向け AI 推論の規模を拡大すると発表した。まずは IBM Cloud 上で、NVIDIA B300 GPU の大規模クラスタを構築し、NVIDIA Spectrum-X Ethernet ネットワーキングで支える。これは IBM Cloud におけるこの種の専用大規模推論クラスタとしては初めてであり、Together AI が最初の顧客となる。著者 Kai Mak による 2026 年 10 月 6 日公開のブログ記事で明らかにされた。

実際に進められているのは、推論専用に設計された NVIDIA B300 GPU クラスタを IBM Cloud 上で稼働させることだ。役割分担は、Together AI が推論レイヤーを運用し、IBM がクラウドを提供し、NVIDIA がシリコンとネットワーキングを担う。Together AI は、トークン需要が放物線的に増加することを見据え、将来に向けた計画を進めているという。記事では、40 以上のモデルが本番環境で採用されていることにも触れている。

Together AI は、AI の未来を少数のクローズドなラボが所有すべきではないという信念から設立された。この賭けは予想以上に早く成果を上げており、毎月数百兆トークンを 100 万人以上の開発者に提供し、需要はさらに増え続けている。企業や AI ネイティブ企業がオープンモデルを選ぶ理由は単純だ。主権データを自社のまま保持でき、クローズドモデルよりはるかに低いコストでフロンティア級の性能を得られる。利用規模が大きくなるほど、この計算は有利になる。

今回の協業では、NVIDIA が高スループット推論向けに設計された B300 GPU と Spectrum-X Ethernet ネットワーキングを提供する。IBM は世界最大級の企業向けにミッションクリティカルなインフラを数十年にわたり運用してきた実績を提供する。Together AI は推論プラットフォームを提供し、本番環境でオープンモデルを動かすための最速かつ最も効率的な方法として、世界で最も厳しい AI ワークロードによって鍛えられてきた。これらを組み合わせることで、大規模なエンタープライズ級推論、すなわちより多くの本番品質トークンを、企業が期待する信頼性、セキュリティ、ガードレールとともに実現することを目指す。

ブログは、オープンソース AI はあらゆる場所で、大規模に、クローズドなものと同等の速度と信頼性で動作しなければならないと強調する。Together AI はここ数年、それを可能にする取り組みを続けており、今回の協業はその方向への大きな一歩だと位置づけている。

要点と分析を開く

記事インテリジェンス

エンジニア上級

要点

  • Together AI は IBM Cloud 上の初の専用大規模 NVIDIA B300 推論クラスタの最初の顧客となる。
  • IBM Cloud、NVIDIA B300 GPU と Spectrum-X ネットワーキング、Together AI の推論プラットフォームを組み合わせる。
  • 増大するトークン需要に対応し、データ主権と低コストでフロンティア級性能を企業に提供する狙い。

要点と分析は自動生成され、誤りを含む場合があります。原典をご確認ください。

IBM Cloud と NVIDIA でエンタープライズ推論キャパシティを拡大 | AI News Hub