AI News HubLIVE
站內改寫2 分鐘閱讀

Anthropic以13倍價格補貼我們的AI程式設計。這能持續多久?

Upbound公司使用Anthropic團隊計劃,工程師透過Claude Code程式設計,發現按token計費的實際成本是捆綁座位費的13倍。類似情況也出現在Uber和Tesla等公司。文章建議轉向開放權重模型以控制成本。

來源Hacker News AI作者: bassamtabbara

Anthropic正在補貼我們的AI程式設計,補貼倍數高達13倍。這能持續多久?

在Upbound,我們使用Anthropic的團隊計劃,幾乎全員使用AI。所有工程師每天透過Claude Code編寫程式碼,享受捆綁座位,每月固定價格,有使用限制,但看不到具體的token消耗。

直到一位工程師改用opencode並透過API直接使用Opus 4.8。幾周後我檢視他的使用情況,發現他每月平均消耗約5500美元。同樣的人,同樣的工作,僅僅因為改用API計費,費用就從125美元飆升。

這讓我想知道,如果所有員工都從捆綁座位轉向按token計費,成本會是多少。這不是假設性問題。Anthropic今年早些時候已將其企業客戶轉為基於使用量的計費模式,在座位費基礎上按token收費,並關閉了其他程式設計代理對捆綁座位的使用。隨著實驗室開始最佳化利潤率,這種廉價的捆綁協議不會持續太久,我想知道我們的風險有多大。

捆綁計劃的token用量難以檢視。分析儀表板不報告token消耗,而能報告token的API需要企業賬戶。幸運的是,Claude Code會在本地記錄每個會話的token數量,保留最近約30天。我們寫了一個指令碼讀取這些日誌,按模型彙總token,並按Anthropic的公佈價格計算成本。指令碼只輸出計數和成本,不包含提示或程式碼,因此可以安全共享。

我們統計了6月份20位工程師的資料。按列表價格計算,工程師們的Claude Code使用量從低於10美元到6470美元不等,其中超過90%是Opus 4.8。這些數字是下限,因為本地日誌在檢視時已經刪除了部分月份資料。與Anthropic高階座位每月125美元相比,平均使用量是座位費的13倍。中位數工程師約7倍,最重度使用者達到52倍。我稱之為補貼倍數:捆綁計劃中消耗的token按列表價格除以座位費。

需要注意:所有價格均為列表價,而非大客戶協商價。大量使用是來自長時間代理會話的快取讀取,成本僅為輸入價格的十分之一。捆綁計劃也非無限使用:超出包含限制後,要麼被限速,要麼按API費率支付超額費用。即使如此,整體趨勢不變。

這不是個例。Uber的CTO告訴The Information,他們的Claude Code使用導致整個2026年AI預算在四個月內耗盡,工程師平均每月花費150-250美元,重度使用者500-2000美元。Uber隨後將每位工程師的使用上限設為每月1500美元。Tesla也採取了類似措施,將員工每週使用上限設為200美元。Meta、Amazon和Walmart也調整了策略。

這些數字並非異常,而是Claude Code正常工作的結果。一旦基於使用量的計費使每次提示的成本對個人可見,賬單就會出現,然後開源節流。我們的13倍就是同一堵牆,只是我們在別人強制之前就測量了它。

解決方案是使用開放權重模型。開放權重模型正以超出預期的速度接近前沿,開發者正用token投票:在Vercel的AI閘道器上,開放權重模型的使用量從4月的11%增長到6月的29%,而花費僅佔4%。我們開始研究執行自己的模型,這樣成本是我們控制的算力,而不是別人設定的token價格。同時,這也能保護我們的提示和上下文。正如Satya Nadella所言,使用別人的模型等於“付兩次智慧費用,一次用錢,另一次用更有價值的東西:你必須透露的專有知識。”

AI領域即將迎來重大調整,因此我們開源了Modelplane,一個推理控制平面。我很好奇你的補貼倍數是多少。