AI News HubLIVE
站内改写2 分钟阅读

Cerebras与Upstage将超快AI带入韩国

Cerebras与韩国领先AI公司Upstage合作,在Cerebras晶圆级引擎上运行Upstage的Solar 31B模型,实现高达每秒2000 token的推理速度。此次合作旨在为韩国及全球的金融、医疗、制造等行业提供超快、生产就绪的AI体验,使开发者能够构建实时、多语言的AI应用。

2026年7月10日

Cerebras与韩国领先AI公司Upstage今日宣布合作,共同探索如何利用Cerebras Inference为全球用户带来超快、生产就绪的AI体验。基于Cerebras晶圆级引擎,Upstage的Solar 31B模型推理速度可达每秒2000 token。

Upstage已构建了涵盖大语言模型、文档智能和AI工作流自动化的强大企业AI产品组合。其Solar模型系列专为企业级语言智能设计,注重速度、准确性和实际部署。

Upstage CEO Sung Kim表示:“我们很高兴与Cerebras合作,为开发者提供行业领先推理速度的Solar模型。我们将共同助力构建大规模、快速、生产就绪的AI应用。”

通过将Upstage的Solar模型部署在Cerebras Inference Cloud上,开发者无需改变现有应用开发工作流即可获得领先的推理速度。Cerebras首席营销官Julie Choi指出:“韩国处于AI创新前沿,我们很高兴与Upstage合作,帮助韩国及全球的开发者和企业解锁新的推理性能。”

将快速推理扩展到韩国

Upstage为韩国主要行业(包括金融、保险、医疗和制造业)构建关键任务企业AI。Cerebras提供推理基础设施,使高级AI应用运行更快、实时响应并轻松扩展。双方合作将超快推理带到全球最先进的AI市场之一,赋能开发者构建多语言、实时的AI应用。

构建实时AI体验

现代AI应用越来越多地需要检索信息、跨上下文推理、生成结构化输出并与用户实时交互。Cerebras Inference专为此类工作负载设计。通过兼容OpenAI的API,开发者只需少量代码更改即可开始构建,并享受晶圆级计算的速度。对于企业,Cerebras提供生产级推理,包括专属支持、自定义模型能力和高容量部署基础设施。

例如,Solar 31B可以处理246个信息来源并执行深度研究查询,而类似查询在Sonnet 4.6上需要8分钟。通过结合Upstage的模型和应用专长与Cerebras的超快推理基础设施,我们正努力实现更强大、响应更迅速的AI应用。

速度为何重要

对于许多AI应用,更快的推理不仅是性能指标,它改变了产品的能力。搜索体验可以综合更多来源;语音代理更自然;研究助手能推理更多上下文;业务工作流在数秒而非数分钟内完成;AI产品变得足够交互,用户日常依赖。

随着公司从AI演示转向生产系统,延迟成为原型与实际产品之间的最大障碍之一。模型生成高质量响应越快,开发者就有更多空间在相同用户体验预算内构建更丰富、更强大的应用。这种转变使推理速度成为AI堆栈的关键部分。

未来展望

这只是与Upstage合作的开始。团队正密切合作,识别高影响力用例,评估技术机会,并探索快速推理如何为开发者、企业和最终用户解锁更好的AI体验。我们期待继续与Upstage合作,将更多模型带到Cerebras平台,为韩国及全球开发者提供世界最快的推理体验。