AI News HubLIVE
站内改写1 分钟阅读

Kimi K3 登录 Fireworks:触手可及的前沿智能

Kimi K3 是首个达到 2.8 万亿参数的开源模型,性能媲美甚至超越 Fable 5、Opus 5 和 GPT 5.5 等闭源模型。Fireworks 提供美国服务器托管、零数据保留的推理与训练服务,用户可按需使用,无需管理 GPU 基础设施。

Kimi K3 今日正式在 Fireworks 平台上线,成为首个达到 2.8 万亿参数的开源模型,为开发者带来前沿级别的智能。作为全球最强的开源模型,Kimi K3 在多个独立基准测试中取得了顶尖成绩,包括前端代码 Arena 第一名(1679 分,超越 Fable 5)、DeepSWE 第三名、Artificial Analysis 智能指数第三名,以及在写作、法律分析(Harvey LAB 基准上以 26.7% 的全通过率领先 Fable 5 近两倍)、客户服务(Sierra Tau3-Banking 基准得分 33.4%)、多模态(复杂图表和文档分析前两名)和网络安全等领域表现突出。

Kimi K3 采用创新的 Kimi Delta Attention 架构和 Stable Latent MoE 技术,激活 896 个专家中的 16 个,实现了相比 K2 提升 2.5 倍的扩展效率。即使拥有 2.8T 总参数,激活参数仅为 104B,有效降低了推理成本。在 Fireworks 上,用户无需管理 GPU 集群,只需按 token 付费即可使用,大幅降低入门门槛。

Fireworks 为 K3 提供多重部署选项:无服务器推理支持超过 10 倍的默认速率限制提升,优先无服务器保证可靠性,批量模式可节约 50% 成本。同时,Fireworks 推出了仅限美国的无服务器端点,适用于金融、医疗等受监管行业,并默认实施零数据保留政策,确保用户隐私安全。

此外,K3 还支持通过 Fireworks 的无服务器训练进行微调。用户可在笔记本电脑上启动训练,通过简单的 API 调用即可迭代模型,无需预留 GPU 资源,按 token 付费。这一特性让团队能够根据自身需求定制模型,优化特定任务的性能和成本。

Kimi K3 的发布标志着开源模型在智能水平上达到新的高度,以远低于闭源模型的成本提供同等甚至更优的性能。Fireworks 平台使任何团队都能轻松拥有、部署和优化这一前沿模型,将 AI 能力整合到自身业务中。