AI News HubLIVE
站內改寫2 分鐘閱讀

Cerebras與Upstage將超快AI帶入韓國

Cerebras與韓國領先AI公司Upstage合作,在Cerebras晶圓級引擎上執行Upstage的Solar 31B模型,實現高達每秒2000 token的推理速度。此次合作旨在為韓國及全球的金融、醫療、製造等行業提供超快、生產就緒的AI體驗,使開發者能夠構建即時、多語言的AI應用。

2026年7月10日

Cerebras與韓國領先AI公司Upstage今日宣佈合作,共同探索如何利用Cerebras Inference為全球使用者帶來超快、生產就緒的AI體驗。基於Cerebras晶圓級引擎,Upstage的Solar 31B模型推理速度可達每秒2000 token。

Upstage已構建了涵蓋大語言模型、文件智慧和AI工作流自動化的強大企業AI產品組合。其Solar模型系列專為企業級語言智慧設計,注重速度、準確性和實際部署。

Upstage CEO Sung Kim表示:“我們很高興與Cerebras合作,為開發者提供行業領先推理速度的Solar模型。我們將共同助力構建大規模、快速、生產就緒的AI應用。”

透過將Upstage的Solar模型部署在Cerebras Inference Cloud上,開發者無需改變現有應用開發工作流即可獲得領先的推理速度。Cerebras首席營銷官Julie Choi指出:“韓國處於AI創新前沿,我們很高興與Upstage合作,幫助韓國及全球的開發者和企業解鎖新的推理效能。”

將快速推理擴充套件到韓國

Upstage為韓國主要行業(包括金融、保險、醫療和製造業)構建關鍵任務企業AI。Cerebras提供推理基礎設施,使高階AI應用執行更快、即時響應並輕鬆擴充套件。雙方合作將超快推理帶到全球最先進的AI市場之一,賦能開發者構建多語言、即時的AI應用。

構建即時AI體驗

現代AI應用越來越多地需要檢索資訊、跨上下文推理、生成結構化輸出並與使用者即時互動。Cerebras Inference專為此類工作負載設計。透過相容OpenAI的API,開發者只需少量程式碼更改即可開始構建,並享受晶圓級計算的速度。對於企業,Cerebras提供生產級推理,包括專屬支援、自定義模型能力和高容量部署基礎設施。

例如,Solar 31B可以處理246個資訊來源並執行深度研究查詢,而類似查詢在Sonnet 4.6上需要8分鐘。透過結合Upstage的模型和應用專長與Cerebras的超快推理基礎設施,我們正努力實現更強大、響應更迅速的AI應用。

速度為何重要

對於許多AI應用,更快的推理不僅是效能指標,它改變了產品的能力。搜尋體驗可以綜合更多來源;語音代理更自然;研究助手能推理更多上下文;業務工作流在數秒而非數分鐘內完成;AI產品變得足夠互動,使用者日常依賴。

隨著公司從AI演示轉向生產系統,延遲成為原型與實際產品之間的最大障礙之一。模型生成高質量響應越快,開發者就有更多空間在相同使用者體驗預算內構建更豐富、更強大的應用。這種轉變使推理速度成為AI堆疊的關鍵部分。

未來展望

這只是與Upstage合作的開始。團隊正密切合作,識別高影響力用例,評估技術機會,並探索快速推理如何為開發者、企業和終端使用者解鎖更好的AI體驗。我們期待繼續與Upstage合作,將更多模型帶到Cerebras平臺,為韓國及全球開發者提供世界最快的推理體驗。