Factory 如何在六个月内通过 Fireworks 将开源模型使用量提升 2-3 倍
Factory 是一家构建智能体原生软件开发的公司,其 Droid 智能体覆盖整个软件开发生命周期。通过采用 Fireworks 的开源模型推理平台,Factory 在六个月内将开源模型使用量提升了 2-3 倍,同时将任务成本降至前沿模型的 6%-20%,吞吐量提升了 5-15 倍。这得益于 Fireworks 提供的模型全覆盖、零日可用、高可靠性和低延迟。
Factory 正在构建一种全新的软件开发方式:由智能体(称为 Droid)自主完成从问题分类、规划、代码生成、验证、发布到监控的整个生命周期,只在关键环节引入人工判断。Adobe、Adyen、Chainguard、Clari、Nvidia、Writer 等众多工程团队已在其平台上进行开发。
与传统的单模型编码工具不同,Factory 遵循模型独立和自主部署两大原则。模型独立意味着 Droid 能够运行在来自 Anthropic、OpenAI 等前沿实验室以及最强开源模型的每种可信编码模型上,并针对每种模型进行调优。自主部署则允许客户在完全托管的 SaaS 或空气间隙环境中运行该能力。这两者使企业能够采用自主性,同时不放弃对模型、基础设施或数据的控制。
然而,提供多种模型选择的最大挑战在于交付。每种新模型在统一 API 后面的行为都不同,具有自己的推理和追踪格式、工具模式、对话处理以及处理 PR 或未暂存 git 状态的细节。Factory 必须吸收所有这些,并让每个模型在同一个框架中可靠运行。速度也使难度加倍,因为一个模型从发布到产生大量需求可能只需几个小时,而 Factory 的用户期望模型在发布当天就能在 Droid 上使用。
经过对多家推理提供商的试用,Factory 最终选择了 Fireworks 作为其开源模型的标准推理平台。Fireworks 在以下方面胜出:全覆盖且零日可用、精确的模型保真度、全面可靠且快速、基础设施不在关键路径上。
结果令人瞩目:路由到正确开源模型的任务成本仅为前沿模型的 6%-20%,而 Kimi K2.7 执行一个任务的成本大约是前沿模型的 20%,MiniMax 则约为 6%。Factory Router(目前处于私人预览)通过将每个任务分配给最成本效益高且通过可靠性标准的模型,将每个任务的平均成本降低了 30-40%。路由数据显示客户之间大致平分:三分之一的任务足够难,需要最新的前沿模型;三分之一的任务足够常规,可以使用最成本效益的模型;另外三分之一介于两者之间。
吞吐量方面的收益同样显著。例如,一个票据分类自动化系统在 Kimi 2.6 上相同花费可以处理大约五倍的工作量,在最成本效益的选项中(如 MiniMax)最多可处理 15 倍。在 Terminal-Bench 基准测试中,Factory 的框架在所有运行的模型上持续优于 Claude Code。
模型选择已成为 Factory 在企业市场中最明显的差异化因素之一,推动了月环比近两倍的增长。Factory Router 即将广泛可用,将自动、成本效益高的模型选择扩展到每一位用户,而无需用户熟悉每个新发布。方向由经济性决定:智能体工作流程会大规模消耗令牌,而通过 Fireworks 交付的开源模型是使软件工厂愿景在企业规模上经济可行的关键。
大型企业和小团队将获得同样的结果:更多工作自动化、成本可控、不依赖任何可能后期改变规则的单一供应商。Fireworks 将这一愿景变为现实:零日访问每一个开源模型,快速可靠地交付,并将 GPU 层从 Factory 的盘中移除。