Together AI は、IBM および NVIDIA と協力してエンタープライズ向け AI 推論の規模を拡大すると発表した。まずは IBM Cloud 上で、NVIDIA B300 GPU の大規模クラスタを構築し、NVIDIA Spectrum-X Ethernet ネットワーキングで支える。これは IBM Cloud におけるこの種の専用大規模推論クラスタとしては初めてであり、Together AI が最初の顧客となる。著者 Kai Mak による 2026 年 10 月 6 日公開のブログ記事で明らかにされた。
実際に進められているのは、推論専用に設計された NVIDIA B300 GPU クラスタを IBM Cloud 上で稼働させることだ。役割分担は、Together AI が推論レイヤーを運用し、IBM がクラウドを提供し、NVIDIA がシリコンとネットワーキングを担う。Together AI は、トークン需要が放物線的に増加することを見据え、将来に向けた計画を進めているという。記事では、40 以上のモデルが本番環境で採用されていることにも触れている。
Together AI は、AI の未来を少数のクローズドなラボが所有すべきではないという信念から設立された。この賭けは予想以上に早く成果を上げており、毎月数百兆トークンを 100 万人以上の開発者に提供し、需要はさらに増え続けている。企業や AI ネイティブ企業がオープンモデルを選ぶ理由は単純だ。主権データを自社のまま保持でき、クローズドモデルよりはるかに低いコストでフロンティア級の性能を得られる。利用規模が大きくなるほど、この計算は有利になる。
今回の協業では、NVIDIA が高スループット推論向けに設計された B300 GPU と Spectrum-X Ethernet ネットワーキングを提供する。IBM は世界最大級の企業向けにミッションクリティカルなインフラを数十年にわたり運用してきた実績を提供する。Together AI は推論プラットフォームを提供し、本番環境でオープンモデルを動かすための最速かつ最も効率的な方法として、世界で最も厳しい AI ワークロードによって鍛えられてきた。これらを組み合わせることで、大規模なエンタープライズ級推論、すなわちより多くの本番品質トークンを、企業が期待する信頼性、セキュリティ、ガードレールとともに実現することを目指す。
ブログは、オープンソース AI はあらゆる場所で、大規模に、クローズドなものと同等の速度と信頼性で動作しなければならないと強調する。Together AI はここ数年、それを可能にする取り組みを続けており、今回の協業はその方向への大きな一歩だと位置づけている。