你並未得到你付費的AI模型
這篇文章探討了AI模型供應商在API呼叫中進行的隱性模型替換、精度降級和權重漂移現象。這些做法引發了嚴重的合同、法律和證據認證問題。作者分析了三種模型身份斷裂的方式,並指出當前法律框架無法適應這種動態路由,提議透過可驗證的模型簽名來解決身份認證問題。
當你呼叫API傳遞“claude-fable-5”模型引數,卻收到返回的“model”欄位值為“claude-opus-4-8”時,你實際上並未得到你付費的模型。這種替換並非錯誤,而是供應商設計的行為。Anthropic在Fable 5重新上線時明確記載:被攔截的請求會被轉給Opus 4.8,並在響應中如實告知。但其他供應商可能不會如此透明。
Cursor推出的Router系統基於超過60萬個即時請求訓練的分類器,根據查詢上下文、複雜度和領域選擇最合適的模型,聲稱能節省30%–50%的成本,但並未公佈每個任務型別對應的具體模型。而OpenRouter則在文件中警告,某些供應商以較低價格提供量化權重版本,其輸出可能與全精度版本不同,且日誌不會記錄這一差異。
模型身份正沿著三條獨立軸發生裂變:
- 替換:不同架構、不同權重,由分類器決定。例如Fable 5被替換為Opus 4.8,Cursor Auto每次可能選擇不同模型。
- 降級:同一模型以降低精度執行。OpenRouter的量化引數允許使用者控制,但預設情況下請求按價格排序分配給最便宜的供應商。
- 漂移:相同模型名稱指向悄悄更新的權重。生產環境中每個“-latest”別名都是未經版本控制的依賴。
工程界將這些視為可靠性問題,但它們本質上是身份問題——而身份正是合同、擔保、披露和證據規則的基礎。
法律層面,如果API呼叫被視為貨物銷售,統一商法典第2-313(1)(b)條要求描述構成明示擔保。但託管軟體通常被視為服務,從而繞開擔保法,進入普通合同領域。合同是否被違反取決於文件具體表述和買方談判時的意圖。如果合同鎖定了模型ID,替換即構成違約;如果鎖定的是能力,則需要“前沿質量”的定義——而目前無人能提供。
聯邦貿易委員會關於欺騙行為的法規要求對消費者有實質誤導性的陳述才可追責。Anthropic明確披露了替換機制,而其他供應商的披露可能深埋於文件中且預設啟用,這符合監管機構在其他消費領域稱為“暗黑模式”的行為。
在證據規則方面,聯邦證據規則901(b)(9)要求描述產生結果的系統或流程。如果律師提交的簡報包含捏造的引用,法院需要詢問哪個模型產生了它。但路由打斷證據鏈:供應商日誌可能顯示不同模型,且模型本身可能已被淘汰。路由器日誌中子請求的模型分配成為關鍵證據,但目前供應商並無保留義務。
解決方案並非合同條款,而是執行時簽名:每次響應返回繫結了模型識別符號、權重雜湊、精度和系統提示雜湊的簽名,這些宣告透過硬體認證金鑰驗證。當前響應物件已包含實際執行模型名稱,但缺乏法律屬性——無法防止錯誤宣告,且買方無法不依賴賣方進行驗證。雜湊響應頭可以為模型身份提供類似聯邦規則902(14)的可驗證性。
路由是好工程,但它現在是一個未記錄、未簽名、無法驗證的替換。模型ID已悄然成為法律識別符號。是時候決定它標識什麼了。