跳到主要內容
AI News HubLIVE
站內改寫1 分鐘閱讀

Kimi K3 登入 Fireworks:觸手可及的前沿智慧

文章摘要

Kimi K3 是首個達到 2.8 萬億引數的開源模型,效能媲美甚至超越 Fable 5、Opus 5 和 GPT 5.5 等閉源模型。Fireworks 提供美國伺服器託管、零資料保留的推理與訓練服務,使用者可按需使用,無需管理 GPU 基礎設施。

Kimi K3 登入 Fireworks:觸手可及的前沿智慧
回報錯誤

更正管道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

Kimi K3 今日正式在 Fireworks 平臺上線,成為首個達到 2.8 萬億引數的開源模型,為開發者帶來前沿級別的智慧。作為全球最強的開源模型,Kimi K3 在多個獨立基準測試中取得了頂尖成績,包括前端程式碼 Arena 第一名(1679 分,超越 Fable 5)、DeepSWE 第三名、Artificial Analysis 智慧指數第三名,以及在寫作、法律分析(Harvey LAB 基準上以 26.7% 的全透過率領先 Fable 5 近兩倍)、客戶服務(Sierra Tau3-Banking 基準得分 33.4%)、多模態(複雜圖表和文件分析前兩名)和網路安全等領域表現突出。

Kimi K3 採用創新的 Kimi Delta Attention 架構和 Stable Latent MoE 技術,啟用 896 個專家中的 16 個,實現了相比 K2 提升 2.5 倍的擴充套件效率。即使擁有 2.8T 總引數,啟用引數僅為 104B,有效降低了推理成本。在 Fireworks 上,使用者無需管理 GPU 叢集,只需按 token 付費即可使用,大幅降低入門門檻。

Fireworks 為 K3 提供多重部署選項:無伺服器推理支援超過 10 倍的預設速率限制提升,優先無伺服器保證可靠性,批次模式可節約 50% 成本。同時,Fireworks 推出了僅限美國的無伺服器端點,適用於金融、醫療等受監管行業,並預設實施零資料保留政策,確保使用者隱私安全。

此外,K3 還支援透過 Fireworks 的無伺服器訓練進行微調。使用者可在筆記型電腦上啟動訓練,透過簡單的 API 呼叫即可迭代模型,無需預留 GPU 資源,按 token 付費。這一特性讓團隊能夠根據自身需求定製模型,最佳化特定任務的效能和成本。

Kimi K3 的釋出標誌著開源模型在智慧水平上達到新的高度,以遠低於閉源模型的成本提供同等甚至更優的效能。Fireworks 平臺使任何團隊都能輕鬆擁有、部署和最佳化這一前沿模型,將 AI 能力整合到自身業務中。

展開要點與分析

文章情報

工程師進階

要點

  • Kimi K3 擁有 2.8T 引數,啟用率僅 1.14%,在多項基準測試中領先。
  • 在程式設計、寫作、法律分析、客服和多模態任務上表現卓越。
  • Fireworks 提供無伺服器推理和訓練,支援美國本地部署與零資料保留。

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。