Factory 如何在六個月內通過 Fireworks 將開源模型使用量提升 2-3 倍
Factory 是一家構建智能體原生軟件開發的公司,其 Droid 智能體覆蓋整個軟件開發生命週期。通過採用 Fireworks 的開源模型推理平台,Factory 在六個月內將開源模型使用量提升了 2-3 倍,同時將任務成本降至前沿模型的 6%-20%,吞吐量提升了 5-15 倍。這得益於 Fireworks 提供的模型全覆蓋、零日可用、高可靠性和低延遲。
Factory 正在構建一種全新的軟件開發方式:由智能體(稱為 Droid)自主完成從問題分類、規劃、代碼生成、驗證、發佈到監控的整個生命週期,只在關鍵環節引入人工判斷。Adobe、Adyen、Chainguard、Clari、Nvidia、Writer 等眾多工程團隊已在其平台上進行開發。
與傳統的單模型編碼工具不同,Factory 遵循模型獨立和自主部署兩大原則。模型獨立意味着 Droid 能夠運行在來自 Anthropic、OpenAI 等前沿實驗室以及最強開源模型的每種可信編碼模型上,並針對每種模型進行調優。自主部署則允許客户在完全託管的 SaaS 或空氣間隙環境中運行該能力。這兩者使企業能夠採用自主性,同時不放棄對模型、基礎設施或數據的控制。
然而,提供多種模型選擇的最大挑戰在於交付。每種新模型在統一 API 後面的行為都不同,具有自己的推理和追蹤格式、工具模式、對話處理以及處理 PR 或未暫存 git 狀態的細節。Factory 必須吸收所有這些,並讓每個模型在同一個框架中可靠運行。速度也使難度加倍,因為一個模型從發佈到產生大量需求可能只需幾個小時,而 Factory 的用户期望模型在發佈當天就能在 Droid 上使用。
經過對多家推理提供商的試用,Factory 最終選擇了 Fireworks 作為其開源模型的標準推理平台。Fireworks 在以下方面勝出:全覆蓋且零日可用、精確的模型保真度、全面可靠且快速、基礎設施不在關鍵路徑上。
結果令人矚目:路由到正確開源模型的任務成本僅為前沿模型的 6%-20%,而 Kimi K2.7 執行一個任務的成本大約是前沿模型的 20%,MiniMax 則約為 6%。Factory Router(目前處於私人預覽)通過將每個任務分配給最成本效益高且通過可靠性標準的模型,將每個任務的平均成本降低了 30-40%。路由數據顯示客户之間大致平分:三分之一的任務足夠難,需要最新的前沿模型;三分之一的任務足夠常規,可以使用最成本效益的模型;另外三分之一介於兩者之間。
吞吐量方面的收益同樣顯著。例如,一個票據分類自動化系統在 Kimi 2.6 上相同花費可以處理大約五倍的工作量,在最成本效益的選項中(如 MiniMax)最多可處理 15 倍。在 Terminal-Bench 基準測試中,Factory 的框架在所有運行的模型上持續優於 Claude Code。
模型選擇已成為 Factory 在企業市場中最明顯的差異化因素之一,推動了月環比近兩倍的增長。Factory Router 即將廣泛可用,將自動、成本效益高的模型選擇擴展到每一位用户,而無需用户熟悉每個新發布。方向由經濟性決定:智能體工作流程會大規模消耗令牌,而通過 Fireworks 交付的開源模型是使軟件工廠願景在企業規模上經濟可行的關鍵。
大型企業和小團隊將獲得同樣的結果:更多工作自動化、成本可控、不依賴任何可能後期改變規則的單一供應商。Fireworks 將這一願景變為現實:零日訪問每一個開源模型,快速可靠地交付,並將 GPU 層從 Factory 的盤中移除。