跳到主要内容
AI News HubLIVE
公开文章 51采集文章 54可信度 84刷新频率 120 分钟
健康状态 健康来源类型 官方原文权限 官方原文最近入库 2026-09-25ID fireworks-blog运行状态 已启用

Official AI inference and model platform blog; confirm reuse terms before full body display.

最新公开文章

待翻译:Every byte counts: ARCv3 and the case for cross-region RL

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Every byte counts: ARCv3 and the case for cross-region RL Join us for our inaugural conference, Forge 2026 Blog Arcv3 And The Case For Cross Region Rl Every byte counts: ARCv3 and the case for cross-region RL PUBLISHED…

Fireworks AI Blog站内正文待翻译:Every byte counts: ARCv3 and the case for cross-region RL

待翻译:Introducing Ember-1

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Introducing Ember-1 Join us for our inaugural conference, Forge 2026 Blog Ember 1 Introducing Ember-1 PUBLISHED 9/23/2026 Table of Contents Ember-1: half the tokens, same answers How Fireworks Research built Ember-1 The…

Fireworks AI Blog站内正文待翻译:Introducing Ember-1

待翻译:Introducing The Specialized Intelligence Index

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Join us for our inaugural conference, Forge 2026 Blog Introducing The Specialized Intelligence Index Introducing The Specialized Intelligence Index PUBLISHED 9/22/2026 Table of Contents The measure of real work Develope…

Fireworks AI Blog站内正文待翻译:Introducing The Specialized Intelligence Index

待翻译:The frontier isn’t a model. It’s a router.

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:The frontier isn’t a model. It’s a router. Join us for our inaugural conference, Forge 2026 Blog The Frontier Isnt A Model Its A Router The frontier isn’t a model. It’s a router. PUBLISHED 9/21/2026 Table of Contents Ho…

Fireworks AI Blog站内正文待翻译:The frontier isn’t a model. It’s a router.

待翻译:Phylo brings frontier AI to more scientists with open models on Fireworks

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Phylo brings frontier AI to more scientists with open models on Fireworks Join us for our inaugural conference, Forge 2026 Blog Phylo Brings Frontier AI To More Scientists With Open Models On Fireworks Phylo brings fron…

Fireworks AI Blog站内正文待翻译:Phylo brings frontier AI to more scientists with open models on Fireworks

待翻译:Making the leap to specialized intelligence

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Making the leap to specialized intelligence Join us for our inaugural conference, Forge 2026 Blog Making The Leap To Specialized Intelligence Making the leap to specialized intelligence PUBLISHED 9/10/2026 Table of Cont…

Fireworks AI Blog站内正文待翻译:Making the leap to specialized intelligence

待翻译:Gen-1 Slides: Opus 5-level decks at a fraction of the cost

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Gen-1 Slides: Opus 5-level decks at a fraction of the cost Join us for our inaugural conference, Forge 2026 Blog Gen 1 Slides Opus 5 Level Decks At A Fraction Of The Cost Gen-1 Slides: Opus 5-level decks at a fraction o…

Fireworks AI Blog站内正文待翻译:Gen-1 Slides: Opus 5-level decks at a fraction of the cost

待翻译:Training API now generally available | Fireworks

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Training API now generally available | Fireworks Join us for our inaugural conference, Forge 2026 Blog Train Past The Frontier Training API Now Generally Available Train past the frontier: Training API now generally ava…

Fireworks AI Blog站内正文待翻译:Training API now generally available | Fireworks

待翻译:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5 Training API now generally available Blog Deepseekv4pro Fable5 DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5 PUBLISHED 8/26…

Fireworks AI Blog站内正文待翻译:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5

待翻译:Post-training Kimi K3 with Harvey for long-horizon legal work

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Post-training Kimi K3 with Harvey for long-horizon legal work DeepSeek-V4-Pro-0813 available now on Fireworks Blog Post Training Kimi K3 With Harvey For Long Horizon Legal Work Post-training Kimi K3 with Harvey for long…

Fireworks AI Blog站内正文待翻译:Post-training Kimi K3 with Harvey for long-horizon legal work

待翻译:Fireworks AI

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Fireworks AI DeepSeek-V4-Pro-0813 available now on Fireworks Blog Deepseek V4 Pro Security DeepSeek V4 Pro is Redefining Security Agent Economics PUBLISHED 8/26/2026 TLDR; DeepSeek V4 Pro 0813 recorded zero refusals acr…

Fireworks AI Blog站内正文待翻译:Fireworks AI

待翻译:Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:DeepSeek-V4-Pro-0813 available now on Fireworks Blog J Lens Kimi K3 Qwen Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B PUBLISHED 8/12/2026 Table of…

Fireworks AI Blog站内正文待翻译:Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B

待翻译:Fireworks AI

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Fireworks AI Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Meta Muse Glimmer Muse Glimmer from Meta on Fireworks: Ideal for your Always-On Agents PUBLISHED 8/10/2026 Table of Contents Inside the Architect…

Fireworks AI Blog站内正文待翻译:Fireworks AI

待翻译:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Voyage AI Models Now On Fireworks Your AI performance stack is Fireworks + Voyage AI P…

Fireworks AI Blog站内正文待翻译:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings

待翻译:Three Tests to Run Before You Switch from LoRA to FullFT

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Three Tests to Run Before You Switch from LoRA to FullFT Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Three Tests To Run Before You Switch From Lora To Fullft Three Tests to Run Before You Switch from Lo…

Fireworks AI Blog站内正文待翻译:Three Tests to Run Before You Switch from LoRA to FullFT

Trilogy 利用 Kimi K3 实现开放权重网络安全的策略手册

Trilogy 人工智能卓越中心发布了基于 Fireworks 平台 Kimi K3 的网络安全策略手册。该手册强调开放权重模型在防御型人工智能中的优势,能够支持连续、高容量的安全工作流程,无需依赖受限或昂贵的模型。手册详细介绍了实用参考堆栈:确定性工具负责结构化和事实提取,Kimi K3 负责判断,并采用路径为中心的审计方法。Fireworks 提供托管推理服务,使团队可以独立扩展,同时保留对审计工作流的控制。

Fireworks AI Blog站内正文Trilogy 利用 Kimi K3 实现开放权重网络安全的策略手册

Fireworks Nexus:即插即用的开放前沿智能,专为有预算限制的团队打造

Fireworks AI 推出 Fireworks Nexus,帮助工程团队在不改变工作流程的情况下,通过智能路由将日常任务分配给经济高效的开源模型,从而显著降低 AI 支出。初步测试显示,它能将每合并 PR 的成本降低三分之一,混合 Token 费率约为封闭模型实验室的四分之一。

Fireworks AI Blog站内正文Fireworks Nexus:即插即用的开放前沿智能,专为有预算限制的团队打造

Fireworks AI 推出 Kimi K3 的 LoRA 训练:前沿智能,触手可及

Fireworks AI 为其巨大的 MoE 模型 Kimi K3(约 2.8 万亿参数)推出了无服务器 LoRA 训练。LoRA 适配器训练成本低,服务灵活,可将细微调整成本降至几乎为零。通过两个任务示例(Countdown 和 Frozen Lake)展示了小适配器如何快速教模型新目标或工具使用循环。文章还强调了奖励设计的重要性,以及数据飞轮效应。

Fireworks AI Blog站内正文Fireworks AI 推出 Kimi K3 的 LoRA 训练:前沿智能,触手可及

Kimi K3 登录 Fireworks:触手可及的前沿智能

Kimi K3 是首个达到 2.8 万亿参数的开源模型,性能媲美甚至超越 Fable 5、Opus 5 和 GPT 5.5 等闭源模型。Fireworks 提供美国服务器托管、零数据保留的推理与训练服务,用户可按需使用,无需管理 GPU 基础设施。

Fireworks AI Blog站内正文Kimi K3 登录 Fireworks:触手可及的前沿智能

2026年最佳开源大语言模型:我们评测了7个模型

本文评测了截至2026年中期的9个开源大语言模型,从基准测试、上下文窗口、多模态支持和许可证等方面进行比较。文章指出Kimi K3性能领先,但权重尚未完全开放;GLM 5.2是目前在Fireworks上可用的最佳开源模型。DeepSeek-V4-Pro、MiniMax M3和gpt-oss-120b等模型针对特定用例进行评估。

Fireworks AI Blog站内正文2026年最佳开源大语言模型:我们评测了7个模型

Heidi x Fireworks:缩小前沿模型性能差距

Heidi Health与Fireworks AI合作,通过监督微调(SFT)和强化微调(RFT)技术,在临床试验笔记数据集上超越了Gemini Pro等前沿模型。合作伙伴关系不仅将延迟从25秒降至7秒,还实现了3.5倍的性能提升。成功的关键在于高质量数据过滤和大批量训练(有效批量大小达150万token),有效消除了噪声并提升了模型质量。

Fireworks AI Blog站内正文Heidi x Fireworks:缩小前沿模型性能差距

Kimi K3 与 Fable 竞争;Kimi K3 + Fable 达到 SOTA

Fireworks AI 发布新研究,开源模型 Kimi K3 与闭源模型 Fable 5 在约 1000 个智能体任务上对比,通过任务路由两者结合可实现 93% 准确率,成本降低最高达 50 倍,表明最佳 AI 来自模型组合而非单一模型。

Fireworks AI Blog站内正文Kimi K3 与 Fable 竞争;Kimi K3 + Fable 达到 SOTA

在NVIDIA Blackwell上优化MiniMax M3稀疏注意力

Fireworks AI团队为MiniMax M3稀疏注意力开发了Blackwell(SM100)内核,采用KV-固定执行路径,每个KV块只加载一次,实现了约980 TFLOP/s的吞吐量和4.1 TB/s的HBM带宽,相比查询固定基线(FlashInfer)加速1.9–2.4倍,相比开源MSA内核加速约1.6倍。本文详细介绍了算法、内核设计、优化及I/O成本模型。

Fireworks AI Blog站内正文在NVIDIA Blackwell上优化MiniMax M3稀疏注意力

Fireworks完成15亿美元D轮融资

Fireworks宣布完成15.05亿美元D轮融资,估值达175亿美元,公司年经常性收入突破10亿美元,每日处理超过40万亿个token,其中95%以上来自客户专有数据优化的模型。

Fireworks AI Blog站内正文Fireworks完成15亿美元D轮融资

Gumloop借助Fireworks AI在3周内将开源模型使用量提升7倍

Gumloop通过与Fireworks AI合作,在三周内将开源模型代理对话量提升7倍,成本降低高达72%,同时保持输出质量不变。

Fireworks AI Blog站内正文Gumloop借助Fireworks AI在3周内将开源模型使用量提升7倍

开放、前沿、属于你:LangChain Deep Agents 在 NVIDIA Nemotron 3 Ultra 上运行于 Fireworks

LangChain 为 NVIDIA Nemotron 3 Ultra 调优了 Deep Agents 框架,实现了开源模型中领先的智能体性能,成本仅为闭源替代方案的十分之一。该模型在 Fireworks 上运行,支持后训练定制,帮助企业构建专属智能。

Fireworks AI Blog站内正文开放、前沿、属于你:LangChain Deep Agents 在 NVIDIA Nemotron 3 Ultra 上运行于 Fireworks

如何用 GLM 5.2 Fast 在四天内完成一个月的工程工作量

作者使用 FireConnect 上的 GLM 5.2 Fast 模型,在 Claude Code 的辅助下,仅用四天时间和 218 美元的推理成本,完成了一项通常需要一个月才能完成的 GPU 调度器回收功能。文章详细介绍了问题背景、工作流程(设计、规划、实现)以及成功的关键因素:快速推理消除了上下文切换成本,低成本消除了对 token 使用的顾虑,模型质量保证了复杂逻辑的正确性。

Fireworks AI Blog站内正文如何用 GLM 5.2 Fast 在四天内完成一个月的工程工作量

GLM 5.2 Fast 现已在 Fireworks 上线

GLM 5.2 Fast 在 Fireworks 平台上线,提供 Opus 级别的智能和开源价格,无需合同,按 token 付费。该模型专为智能体循环优化,支持 1M token 上下文窗口,快速推理速度达 446 tok/sec,并具有主动提示缓存和结构化输出支持。Fireworks 通过优化 MoE 和稀疏注意力架构实现了高性能,同时保持质量不变。

Fireworks AI Blog站内正文GLM 5.2 Fast 现已在 Fireworks 上线

Factory 如何在六个月内通过 Fireworks 将开源模型使用量提升 2-3 倍

Factory 是一家构建智能体原生软件开发的公司,其 Droid 智能体覆盖整个软件开发生命周期。通过采用 Fireworks 的开源模型推理平台,Factory 在六个月内将开源模型使用量提升了 2-3 倍,同时将任务成本降至前沿模型的 6%-20%,吞吐量提升了 5-15 倍。这得益于 Fireworks 提供的模型全覆盖、零日可用、高可靠性和低延迟。

Fireworks AI Blog站内正文Factory 如何在六个月内通过 Fireworks 将开源模型使用量提升 2-3 倍

Cursor Composer 2 + Fireworks AI

Cursor 发布了 Composer 2,这是一款为 Cursor 开发环境优化的编码模型。它基于 Kimi 2.5,结合持续预训练和大规模强化学习,实现了前沿的编码性能,同时推理成本降低 6-10 倍。Fireworks AI 提供分布式推理基础设施,使强化学习规模化成为可能。

Fireworks AI Blog站内正文Cursor Composer 2 + Fireworks AI

全部来源