AI News HubLIVE
站內改寫2 分鐘閱讀

Anthropic主張測試而非禁令,OpenAI和Google支援開放權重

Anthropic CEO Dario Amodei明確表示公司不主張禁止開放權重AI模型,而是提議對每個足夠強大的模型在釋出前進行強制性安全測試。這一立場引發行業關注,已有50家機構簽署支援開放權重的信件,而Anthropic和亞馬遜尚未加入。

來源The New Stack AI作者: Matthew Burns

Anthropic公司CEO達里奧·阿莫迪(Dario Amodei)今日明確表態,其公司並不主張禁止開放權重(open-weight)AI模型。這一宣告是在經歷了一週的批評之後作出的。相反,他提議對所有達到足夠能力的模型在釋出前進行強制性安全測試。然而,關鍵在於“足夠能力”的定義尚未明確,而這將決定未來開放權重模型是否能夠繼續可用。

阿莫迪在公開信中寫道:“Anthropic從未主張禁止開放權重模型。”他將不具備危險能力的模型稱為“公共產品”,其成本僅在於執行所需的計算資源。

他的提案包含三部分:加強對先進晶片及晶片製造裝置的出口管制;嚴厲打擊工業規模的模型蒸餾行為;以及對所有足夠能力的模型在釋出前進行安全評估。前兩項針對華盛頓的政策制定者,第三項則直接影響準備釋出模型的開發者。

阿莫迪稱,測試的想法已接近共識,並指出特朗普政府已朝此方向邁進,最近的行業提案也將要求無論模型來源或許可證型別,都需進行測試,同時“完全豁免能力較低的模型,例如來自初創公司和學術界的模型”。這一豁免至關重要,但“初創公司”的定義同樣難以精確界定。一旦部分模型被豁免而其他模型不豁免,該政策本質上就變成了一個能力門檻。

那麼,這個門檻劃在哪裡?沒有人明確說明。信中未提及由誰設定標準或由誰執行測試。模型能力可以透過基準測試結果、訓練計算量或針對特定風險類別的評估得分來衡量。而選擇的指標將決定模型型別。選擇指標的人也在為每個釋出權重的實驗室設定釋出時機。

這是一個快速發展的故事。名為“開放權重與美國AI領導力”的公開信已有50位簽署人,包括OpenAI和谷歌,以及微軟、輝達、Meta、AMD、思科、Cloudflare、GitHub和Ollama。Anthropic和亞馬遜尚未加入。

週一,輝達推出了開放安全AI聯盟(Open Secure AI Alliance),擁有超過35個創始成員,包括微軟、IBM、Hugging Face、Palantir、Red Hat、CrowdStrike和Linux基金會。Anthropic不在其中。輝達認為,防禦者需要開放的前沿模型來調查安全事件,並引用了最近一個案例:封閉工具阻礙了對Hugging Face事件的取證工作,而Hugging Face轉而使用開放權重模型進行了分析。

值得肯定的是,阿莫迪直接回應了明顯的批評。他表示,美國的禁令主要會保護國內AI公司免受競爭,而對阻止惡意行為者作用甚微。“這會保護美國AI公司免受競爭,但這從來不是我的目標。”這話沒錯,但也需要注意的是,Anthropic本身並不釋出開放權重模型,因此這一宣告略顯空洞。

阿莫迪承認,測試“必須是全球性的,這意味著連CCP(中國共產黨)也需要參與”,他認為這或許是可能的。這可能是這個故事中最大的未解問題。出口管制和反蒸餾措施是華盛頓可以單方面實施的政策,而全球能力測試製度則不同。直接影響開放權重模型的提案依賴於尚未存在(且可能永遠不會存在)的廣泛國際協議。