跳到主要內容
AI News HubLIVE
公開文章 51採集文章 54可信度 84刷新頻率 120 分鐘
健康狀態 健康來源類型 官方原文權限 官方原文最近入庫 2026-09-25ID fireworks-blog運行狀態 已啟用

Official AI inference and model platform blog; confirm reuse terms before full body display.

最新公開文章

待翻譯:Every byte counts: ARCv3 and the case for cross-region RL

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Every byte counts: ARCv3 and the case for cross-region RL Join us for our inaugural conference, Forge 2026 Blog Arcv3 And The Case For Cross Region Rl Every byte counts: ARCv3 and the case for cross-region RL PUBLISHED…

Fireworks AI Blog站內正文待翻譯:Every byte counts: ARCv3 and the case for cross-region RL

待翻譯:Introducing Ember-1

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Introducing Ember-1 Join us for our inaugural conference, Forge 2026 Blog Ember 1 Introducing Ember-1 PUBLISHED 9/23/2026 Table of Contents Ember-1: half the tokens, same answers How Fireworks Research built Ember-1 The…

Fireworks AI Blog站內正文待翻譯:Introducing Ember-1

待翻譯:Introducing The Specialized Intelligence Index

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Join us for our inaugural conference, Forge 2026 Blog Introducing The Specialized Intelligence Index Introducing The Specialized Intelligence Index PUBLISHED 9/22/2026 Table of Contents The measure of real work Develope…

Fireworks AI Blog站內正文待翻譯:Introducing The Specialized Intelligence Index

待翻譯:The frontier isn’t a model. It’s a router.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:The frontier isn’t a model. It’s a router. Join us for our inaugural conference, Forge 2026 Blog The Frontier Isnt A Model Its A Router The frontier isn’t a model. It’s a router. PUBLISHED 9/21/2026 Table of Contents Ho…

Fireworks AI Blog站內正文待翻譯:The frontier isn’t a model. It’s a router.

待翻譯:Phylo brings frontier AI to more scientists with open models on Fireworks

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Phylo brings frontier AI to more scientists with open models on Fireworks Join us for our inaugural conference, Forge 2026 Blog Phylo Brings Frontier AI To More Scientists With Open Models On Fireworks Phylo brings fron…

Fireworks AI Blog站內正文待翻譯:Phylo brings frontier AI to more scientists with open models on Fireworks

待翻譯:Making the leap to specialized intelligence

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Making the leap to specialized intelligence Join us for our inaugural conference, Forge 2026 Blog Making The Leap To Specialized Intelligence Making the leap to specialized intelligence PUBLISHED 9/10/2026 Table of Cont…

Fireworks AI Blog站內正文待翻譯:Making the leap to specialized intelligence

待翻譯:Gen-1 Slides: Opus 5-level decks at a fraction of the cost

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Gen-1 Slides: Opus 5-level decks at a fraction of the cost Join us for our inaugural conference, Forge 2026 Blog Gen 1 Slides Opus 5 Level Decks At A Fraction Of The Cost Gen-1 Slides: Opus 5-level decks at a fraction o…

Fireworks AI Blog站內正文待翻譯:Gen-1 Slides: Opus 5-level decks at a fraction of the cost

待翻譯:Training API now generally available | Fireworks

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Training API now generally available | Fireworks Join us for our inaugural conference, Forge 2026 Blog Train Past The Frontier Training API Now Generally Available Train past the frontier: Training API now generally ava…

Fireworks AI Blog站內正文待翻譯:Training API now generally available | Fireworks

待翻譯:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5 Training API now generally available Blog Deepseekv4pro Fable5 DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5 PUBLISHED 8/26…

Fireworks AI Blog站內正文待翻譯:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5

待翻譯:Post-training Kimi K3 with Harvey for long-horizon legal work

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Post-training Kimi K3 with Harvey for long-horizon legal work DeepSeek-V4-Pro-0813 available now on Fireworks Blog Post Training Kimi K3 With Harvey For Long Horizon Legal Work Post-training Kimi K3 with Harvey for long…

Fireworks AI Blog站內正文待翻譯:Post-training Kimi K3 with Harvey for long-horizon legal work

待翻譯:Fireworks AI

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Fireworks AI DeepSeek-V4-Pro-0813 available now on Fireworks Blog Deepseek V4 Pro Security DeepSeek V4 Pro is Redefining Security Agent Economics PUBLISHED 8/26/2026 TLDR; DeepSeek V4 Pro 0813 recorded zero refusals acr…

Fireworks AI Blog站內正文待翻譯:Fireworks AI

待翻譯:Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:DeepSeek-V4-Pro-0813 available now on Fireworks Blog J Lens Kimi K3 Qwen Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B PUBLISHED 8/12/2026 Table of…

Fireworks AI Blog站內正文待翻譯:Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B

待翻譯:Fireworks AI

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Fireworks AI Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Meta Muse Glimmer Muse Glimmer from Meta on Fireworks: Ideal for your Always-On Agents PUBLISHED 8/10/2026 Table of Contents Inside the Architect…

Fireworks AI Blog站內正文待翻譯:Fireworks AI

待翻譯:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Voyage AI Models Now On Fireworks Your AI performance stack is Fireworks + Voyage AI P…

Fireworks AI Blog站內正文待翻譯:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings

待翻譯:Three Tests to Run Before You Switch from LoRA to FullFT

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Three Tests to Run Before You Switch from LoRA to FullFT Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Three Tests To Run Before You Switch From Lora To Fullft Three Tests to Run Before You Switch from Lo…

Fireworks AI Blog站內正文待翻譯:Three Tests to Run Before You Switch from LoRA to FullFT

Trilogy 利用 Kimi K3 實現開放權重網路安全的策略手冊

Trilogy 人工智慧卓越中心釋出了基於 Fireworks 平臺 Kimi K3 的網路安全策略手冊。該手冊強調開放權重模型在防禦型人工智慧中的優勢,能夠支援連續、高容量的安全工作流程,無需依賴受限或昂貴的模型。手冊詳細介紹了實用參考堆疊:確定性工具負責結構化和事實提取,Kimi K3 負責判斷,並採用路徑為中心的審計方法。Fireworks 提供託管推理服務,使團隊可以獨立擴充套件,同時保留對審計工作流的控制。

Fireworks AI Blog站內正文Trilogy 利用 Kimi K3 實現開放權重網路安全的策略手冊

Fireworks Nexus:即插即用的開放前沿智慧,專為有預算限制的團隊打造

Fireworks AI 推出 Fireworks Nexus,幫助工程團隊在不改變工作流程的情況下,透過智慧路由將日常任務分配給經濟高效的開源模型,從而顯著降低 AI 支出。初步測試顯示,它能將每合併 PR 的成本降低三分之一,混合 Token 費率約為封閉模型實驗室的四分之一。

Fireworks AI Blog站內正文Fireworks Nexus:即插即用的開放前沿智慧,專為有預算限制的團隊打造

Fireworks AI 推出 Kimi K3 的 LoRA 訓練:前沿智慧,觸手可及

Fireworks AI 為其巨大的 MoE 模型 Kimi K3(約 2.8 萬億引數)推出了無伺服器 LoRA 訓練。LoRA 介面卡訓練成本低,服務靈活,可將細微調整成本降至幾乎為零。透過兩個任務示例(Countdown 和 Frozen Lake)展示了小介面卡如何快速教模型新目標或工具使用迴圈。文章還強調了獎勵設計的重要性,以及資料飛輪效應。

Fireworks AI Blog站內正文Fireworks AI 推出 Kimi K3 的 LoRA 訓練:前沿智慧,觸手可及

Kimi K3 登入 Fireworks:觸手可及的前沿智慧

Kimi K3 是首個達到 2.8 萬億引數的開源模型,效能媲美甚至超越 Fable 5、Opus 5 和 GPT 5.5 等閉源模型。Fireworks 提供美國伺服器託管、零資料保留的推理與訓練服務,使用者可按需使用,無需管理 GPU 基礎設施。

Fireworks AI Blog站內正文Kimi K3 登入 Fireworks:觸手可及的前沿智慧

2026年最佳開源大語言模型:我們評測了7個模型

本文評測了截至2026年中期的9個開源大語言模型,從基準測試、上下文視窗、多模態支援和許可證等方面進行比較。文章指出Kimi K3效能領先,但權重尚未完全開放;GLM 5.2是目前在Fireworks上可用的最佳開源模型。DeepSeek-V4-Pro、MiniMax M3和gpt-oss-120b等模型針對特定用例進行評估。

Fireworks AI Blog站內正文2026年最佳開源大語言模型:我們評測了7個模型

Heidi x Fireworks:縮小前沿模型效能差距

Heidi Health與Fireworks AI合作,透過監督微調(SFT)和強化微調(RFT)技術,在臨床試驗筆記資料集上超越了Gemini Pro等前沿模型。合作伙伴關係不僅將延遲從25秒降至7秒,還實現了3.5倍的效能提升。成功的關鍵在於高質量資料過濾和大批次訓練(有效批次大小達150萬token),有效消除了噪聲並提升了模型質量。

Fireworks AI Blog站內正文Heidi x Fireworks:縮小前沿模型效能差距

Kimi K3 與 Fable 競爭;Kimi K3 + Fable 達到 SOTA

Fireworks AI 釋出新研究,開源模型 Kimi K3 與閉源模型 Fable 5 在約 1000 個智慧體任務上對比,透過任務路由兩者結合可實現 93% 準確率,成本降低最高達 50 倍,表明最佳 AI 來自模型組合而非單一模型。

Fireworks AI Blog站內正文Kimi K3 與 Fable 競爭;Kimi K3 + Fable 達到 SOTA

在NVIDIA Blackwell上最佳化MiniMax M3稀疏注意力

Fireworks AI團隊為MiniMax M3稀疏注意力開發了Blackwell(SM100)核心,採用KV-固定執行路徑,每個KV塊只載入一次,實現了約980 TFLOP/s的吞吐量和4.1 TB/s的HBM頻寬,相比查詢固定基線(FlashInfer)加速1.9–2.4倍,相比開源MSA核心加速約1.6倍。本文詳細介紹了演算法、核心設計、最佳化及I/O成本模型。

Fireworks AI Blog站內正文在NVIDIA Blackwell上最佳化MiniMax M3稀疏注意力

Fireworks完成15億美元D輪融資

Fireworks宣佈完成15.05億美元D輪融資,估值達175億美元,公司年經常性收入突破10億美元,每日處理超過40萬億個token,其中95%以上來自客戶專有資料最佳化的模型。

Fireworks AI Blog站內正文Fireworks完成15億美元D輪融資

Gumloop藉助Fireworks AI在3周內將開源模型使用量提升7倍

Gumloop透過與Fireworks AI合作,在三週內將開源模型代理對話量提升7倍,成本降低高達72%,同時保持輸出質量不變。

Fireworks AI Blog站內正文Gumloop藉助Fireworks AI在3周內將開源模型使用量提升7倍

開放、前沿、屬於你:LangChain Deep Agents 在 NVIDIA Nemotron 3 Ultra 上執行於 Fireworks

LangChain 為 NVIDIA Nemotron 3 Ultra 調優了 Deep Agents 框架,實現了開源模型中領先的智慧體效能,成本僅為閉源替代方案的十分之一。該模型在 Fireworks 上執行,支援後訓練定製,幫助企業構建專屬智慧。

Fireworks AI Blog站內正文開放、前沿、屬於你:LangChain Deep Agents 在 NVIDIA Nemotron 3 Ultra 上執行於 Fireworks

如何用 GLM 5.2 Fast 在四天內完成一個月的工程工作量

作者使用 FireConnect 上的 GLM 5.2 Fast 模型,在 Claude Code 的輔助下,僅用四天時間和 218 美元的推理成本,完成了一項通常需要一個月才能完成的 GPU 排程器回收功能。文章詳細介紹了問題背景、工作流程(設計、規劃、實現)以及成功的關鍵因素:快速推理消除了上下文切換成本,低成本消除了對 token 使用的顧慮,模型質量保證了複雜邏輯的正確性。

Fireworks AI Blog站內正文如何用 GLM 5.2 Fast 在四天內完成一個月的工程工作量

GLM 5.2 Fast 現已在 Fireworks 上線

GLM 5.2 Fast 在 Fireworks 平臺上線,提供 Opus 級別的智慧和開源價格,無需合同,按 token 付費。該模型專為智慧體迴圈最佳化,支援 1M token 上下文視窗,快速推理速度達 446 tok/sec,並具有主動提示快取和結構化輸出支援。Fireworks 透過最佳化 MoE 和稀疏注意力架構實現了高效能,同時保持質量不變。

Fireworks AI Blog站內正文GLM 5.2 Fast 現已在 Fireworks 上線

Factory 如何在六個月內透過 Fireworks 將開源模型使用量提升 2-3 倍

Factory 是一家構建智慧體原生軟體開發的公司,其 Droid 智慧體覆蓋整個軟體開發生命週期。透過採用 Fireworks 的開源模型推理平臺,Factory 在六個月內將開源模型使用量提升了 2-3 倍,同時將任務成本降至前沿模型的 6%-20%,吞吐量提升了 5-15 倍。這得益於 Fireworks 提供的模型全覆蓋、零日可用、高可靠性和低延遲。

Fireworks AI Blog站內正文Factory 如何在六個月內透過 Fireworks 將開源模型使用量提升 2-3 倍

Cursor Composer 2 + Fireworks AI

Cursor 釋出了 Composer 2,這是一款為 Cursor 開發環境最佳化的編碼模型。它基於 Kimi 2.5,結合持續預訓練和大規模強化學習,實現了前沿的編碼效能,同時推理成本降低 6-10 倍。Fireworks AI 提供分散式推理基礎設施,使強化學習規模化成為可能。

Fireworks AI Blog站內正文Cursor Composer 2 + Fireworks AI

全部來源