跳到主要内容
AI News HubLIVE
站内改写1 分钟阅读

携手 IBM Cloud 与 NVIDIA 扩展企业级推理容量

文章摘要

Together AI 正与 IBM 和 NVIDIA 合作,在 IBM Cloud 上部署首个专用大规模 NVIDIA B300 GPU 推理集群,并采用 Spectrum-X 以太网网络,以扩展企业级开放模型推理。

携手 IBM Cloud 与 NVIDIA 扩展企业级推理容量
报告错误

纠错通道尚未开通,可先复制下方文章信息留存。

查看更正说明
直接读正文

Together AI 宣布,正在与 IBM 和 NVIDIA 合作,扩大企业级 AI 推理规模。此次合作的起点,是在 IBM Cloud 上部署一个大规模 NVIDIA B300 GPU 集群,并由 NVIDIA Spectrum-X 以太网网络提供支撑。这是 IBM Cloud 上首个此类专用的大规模推理集群,而 Together AI 则成为该集群的首个客户。相关消息由作者 Kai Mak 在 2026 年 10 月 6 日发布的博文中披露。

具体来看,这套基础设施由专用 NVIDIA B300 GPU 集群组成,专门面向推理任务,并运行在 IBM Cloud 上。分工上,Together AI 负责运营推理层,IBM 提供云平台,NVIDIA 提供芯片与网络能力。Together AI 还表示,随着 token 需求呈抛物线式增长,公司已经在为未来做规划。文章也提到,已有 40 多个模型被用于生产环境。

Together AI 解释,之所以启动这家公司,是因为相信 AI 的未来不应被少数闭源实验室所拥有。这一判断正在加速兑现:公司每月服务数百兆 token,覆盖超过一百万开发者,而且需求仍在持续攀升。企业和 AI 原生公司选择开放模型,原因主要有两点:一是主权数据仍然归自己所有,二是能够以远低于闭源模型的成本获得前沿级性能。使用规模越大,这种成本效益就越明显。

在合作中,NVIDIA 提供为高吞吐推理而设计的 B300 GPU 和 Spectrum-X 以太网网络;IBM 带来数十年为全球大型企业运行关键任务基础设施的经验;Together AI 则提供推理平台,号称是在生产环境中运行开放模型最快、最高效的方式,并经过全球一些最严苛 AI 工作负载的打磨。三者结合后,目标很明确:实现大规模企业级推理,带来更多生产级 token,同时具备企业所期望的可靠性、安全性和防护机制。

文章强调,开源 AI 必须像闭源方案一样,能够在各种环境中大规模、快速且可靠地运行。Together AI 表示,过去几年一直在确保这一点,而此次合作正是朝这个方向迈出的重要一步。

展开要点与分析

文章情报

工程师进阶

要点

  • Together AI 成为 IBM Cloud 上首个专用大规模 NVIDIA B300 推理集群的首个客户。
  • 合作结合 IBM Cloud、NVIDIA B300 GPU 与 Spectrum-X 网络,以及 Together AI 的推理平台。
  • 目标是在 token 需求飙升之际,为企业提供兼具数据主权、低成本和前沿性能的开放模型推理。

要点与分析由自动化流程生成,可能有误,请结合原始来源核实。