Anthropic主張測試而非禁令,OpenAI和Google支持開放權重
Anthropic CEO Dario Amodei明確表示公司不主張禁止開放權重AI模型,而是提議對每個足夠強大的模型在發佈前進行強制性安全測試。這一立場引發行業關注,已有50家機構簽署支持開放權重的信件,而Anthropic和亞馬遜尚未加入。
Anthropic公司CEO達里奧·阿莫迪(Dario Amodei)今日明確表態,其公司並不主張禁止開放權重(open-weight)AI模型。這一聲明是在經歷了一週的批評之後作出的。相反,他提議對所有達到足夠能力的模型在發佈前進行強制性安全測試。然而,關鍵在於“足夠能力”的定義尚未明確,而這將決定未來開放權重模型是否能夠繼續可用。
阿莫迪在公開信中寫道:“Anthropic從未主張禁止開放權重模型。”他將不具備危險能力的模型稱為“公共產品”,其成本僅在於運行所需的計算資源。
他的提案包含三部分:加強對先進芯片及芯片製造設備的出口管制;嚴厲打擊工業規模的模型蒸餾行為;以及對所有足夠能力的模型在發佈前進行安全評估。前兩項針對華盛頓的政策制定者,第三項則直接影響準備發佈模型的開發者。
阿莫迪稱,測試的想法已接近共識,並指出特朗普政府已朝此方向邁進,最近的行業提案也將要求無論模型來源或許可證類型,都需進行測試,同時“完全豁免能力較低的模型,例如來自初創公司和學術界的模型”。這一豁免至關重要,但“初創公司”的定義同樣難以精確界定。一旦部分模型被豁免而其他模型不豁免,該政策本質上就變成了一個能力門檻。
那麼,這個門檻劃在哪裏?沒有人明確説明。信中未提及由誰設定標準或由誰執行測試。模型能力可以通過基準測試結果、訓練計算量或針對特定風險類別的評估得分來衡量。而選擇的指標將決定模型類型。選擇指標的人也在為每個發佈權重的實驗室設定發佈時機。
這是一個快速發展的故事。名為“開放權重與美國AI領導力”的公開信已有50位簽署人,包括OpenAI和谷歌,以及微軟、英偉達、Meta、AMD、思科、Cloudflare、GitHub和Ollama。Anthropic和亞馬遜尚未加入。
週一,英偉達推出了開放安全AI聯盟(Open Secure AI Alliance),擁有超過35個創始成員,包括微軟、IBM、Hugging Face、Palantir、Red Hat、CrowdStrike和Linux基金會。Anthropic不在其中。英偉達認為,防禦者需要開放的前沿模型來調查安全事件,並引用了最近一個案例:封閉工具阻礙了對Hugging Face事件的取證工作,而Hugging Face轉而使用開放權重模型進行了分析。
值得肯定的是,阿莫迪直接回應了明顯的批評。他表示,美國的禁令主要會保護國內AI公司免受競爭,而對阻止惡意行為者作用甚微。“這會保護美國AI公司免受競爭,但這從來不是我的目標。”這話沒錯,但也需要注意的是,Anthropic本身並不發佈開放權重模型,因此這一聲明略顯空洞。
阿莫迪承認,測試“必須是全球性的,這意味着連CCP(中國共產黨)也需要參與”,他認為這或許是可能的。這可能是這個故事中最大的未解問題。出口管制和反蒸餾措施是華盛頓可以單方面實施的政策,而全球能力測試製度則不同。直接影響開放權重模型的提案依賴於尚未存在(且可能永遠不會存在)的廣泛國際協議。