Anthropic以13倍价格补贴我们的AI编程。这能持续多久?
Upbound公司使用Anthropic团队计划,工程师通过Claude Code编程,发现按token计费的实际成本是捆绑座位费的13倍。类似情况也出现在Uber和Tesla等公司。文章建议转向开放权重模型以控制成本。
Anthropic正在补贴我们的AI编程,补贴倍数高达13倍。这能持续多久?
在Upbound,我们使用Anthropic的团队计划,几乎全员使用AI。所有工程师每天通过Claude Code编写代码,享受捆绑座位,每月固定价格,有使用限制,但看不到具体的token消耗。
直到一位工程师改用opencode并通过API直接使用Opus 4.8。几周后我查看他的使用情况,发现他每月平均消耗约5500美元。同样的人,同样的工作,仅仅因为改用API计费,费用就从125美元飙升。
这让我想知道,如果所有员工都从捆绑座位转向按token计费,成本会是多少。这不是假设性问题。Anthropic今年早些时候已将其企业客户转为基于使用量的计费模式,在座位费基础上按token收费,并关闭了其他编程代理对捆绑座位的使用。随着实验室开始优化利润率,这种廉价的捆绑协议不会持续太久,我想知道我们的风险有多大。
捆绑计划的token用量难以查看。分析仪表板不报告token消耗,而能报告token的API需要企业账户。幸运的是,Claude Code会在本地记录每个会话的token数量,保留最近约30天。我们写了一个脚本读取这些日志,按模型汇总token,并按Anthropic的公布价格计算成本。脚本只输出计数和成本,不包含提示或代码,因此可以安全共享。
我们统计了6月份20位工程师的数据。按列表价格计算,工程师们的Claude Code使用量从低于10美元到6470美元不等,其中超过90%是Opus 4.8。这些数字是下限,因为本地日志在查看时已经删除了部分月份数据。与Anthropic高级座位每月125美元相比,平均使用量是座位费的13倍。中位数工程师约7倍,最重度用户达到52倍。我称之为补贴倍数:捆绑计划中消耗的token按列表价格除以座位费。
需要注意:所有价格均为列表价,而非大客户协商价。大量使用是来自长时间代理会话的缓存读取,成本仅为输入价格的十分之一。捆绑计划也非无限使用:超出包含限制后,要么被限速,要么按API费率支付超额费用。即使如此,整体趋势不变。
这不是个例。Uber的CTO告诉The Information,他们的Claude Code使用导致整个2026年AI预算在四个月内耗尽,工程师平均每月花费150-250美元,重度用户500-2000美元。Uber随后将每位工程师的使用上限设为每月1500美元。Tesla也采取了类似措施,将员工每周使用上限设为200美元。Meta、Amazon和Walmart也调整了策略。
这些数字并非异常,而是Claude Code正常工作的结果。一旦基于使用量的计费使每次提示的成本对个人可见,账单就会出现,然后开源节流。我们的13倍就是同一堵墙,只是我们在别人强制之前就测量了它。
解决方案是使用开放权重模型。开放权重模型正以超出预期的速度接近前沿,开发者正用token投票:在Vercel的AI网关上,开放权重模型的使用量从4月的11%增长到6月的29%,而花费仅占4%。我们开始研究运行自己的模型,这样成本是我们控制的算力,而不是别人设定的token价格。同时,这也能保护我们的提示和上下文。正如Satya Nadella所言,使用别人的模型等于“付两次智能费用,一次用钱,另一次用更有价值的东西:你必须透露的专有知识。”
AI领域即将迎来重大调整,因此我们开源了Modelplane,一个推理控制平面。我很好奇你的补贴倍数是多少。