Kimi K3 登入 Fireworks:觸手可及的前沿智慧
Kimi K3 是首個達到 2.8 萬億引數的開源模型,效能媲美甚至超越 Fable 5、Opus 5 和 GPT 5.5 等閉源模型。Fireworks 提供美國伺服器託管、零資料保留的推理與訓練服務,使用者可按需使用,無需管理 GPU 基礎設施。
Kimi K3 今日正式在 Fireworks 平臺上線,成為首個達到 2.8 萬億引數的開源模型,為開發者帶來前沿級別的智慧。作為全球最強的開源模型,Kimi K3 在多個獨立基準測試中取得了頂尖成績,包括前端程式碼 Arena 第一名(1679 分,超越 Fable 5)、DeepSWE 第三名、Artificial Analysis 智慧指數第三名,以及在寫作、法律分析(Harvey LAB 基準上以 26.7% 的全透過率領先 Fable 5 近兩倍)、客戶服務(Sierra Tau3-Banking 基準得分 33.4%)、多模態(複雜圖表和文件分析前兩名)和網路安全等領域表現突出。
Kimi K3 採用創新的 Kimi Delta Attention 架構和 Stable Latent MoE 技術,啟用 896 個專家中的 16 個,實現了相比 K2 提升 2.5 倍的擴充套件效率。即使擁有 2.8T 總引數,啟用引數僅為 104B,有效降低了推理成本。在 Fireworks 上,使用者無需管理 GPU 叢集,只需按 token 付費即可使用,大幅降低入門門檻。
Fireworks 為 K3 提供多重部署選項:無伺服器推理支援超過 10 倍的預設速率限制提升,優先無伺服器保證可靠性,批次模式可節約 50% 成本。同時,Fireworks 推出了僅限美國的無伺服器端點,適用於金融、醫療等受監管行業,並預設實施零資料保留政策,確保使用者隱私安全。
此外,K3 還支援透過 Fireworks 的無伺服器訓練進行微調。使用者可在筆記型電腦上啟動訓練,透過簡單的 API 呼叫即可迭代模型,無需預留 GPU 資源,按 token 付費。這一特性讓團隊能夠根據自身需求定製模型,最佳化特定任務的效能和成本。
Kimi K3 的釋出標誌著開源模型在智慧水平上達到新的高度,以遠低於閉源模型的成本提供同等甚至更優的效能。Fireworks 平臺使任何團隊都能輕鬆擁有、部署和最佳化這一前沿模型,將 AI 能力整合到自身業務中。