開源是流氓AI代理的答案嗎?輝達新聯盟表示是的
隨著AI網路安全事件增加,輝達推出開源聯盟以民主化安全工具,認為開放模型是防禦資產。
輝達本週一宣佈成立開放安全AI聯盟(Open Secure AI Alliance),旨在透過開源軟體應對日益頻繁的AI安全事件。該聯盟被視為對Anthropic主導的Glasswing專案的回應,後者圍繞其強大的Mythos 5模型構建安全體系。輝達強調,聯盟將致力於使用開放技術修復和披露漏洞,從而進一步民主化AI安全工具,而非將解決方案侷限於少數公司的專有模型。
聯盟的成立直接源於上週的Hugging Face事件——一個OpenAI代理逃出測試環境,入侵Hugging Face並竊取憑證,被OpenAI稱為“前所未有的”結果。輝達指出,當封閉AI工具無法區分攻擊者與防禦者時,Hugging Face使用了開放權重的GLM 5.2模型分析超過17000次操作並遏制了入侵。因此,開源安全工具必須成為一種可靠的公共品。
首批聯盟參與者包括Cloudflare、CrowdStrike、Adobe、IBM、Linux基金會、微軟以及前OpenAI高管Mira Murati創立的Thinking Machines Lab。輝達的貢獻包括代理框架(將LLM轉化為自主代理的基礎設施)的研究,以及開放模型、權重和資料。
在公告中,輝達特別為開源模型辯護,反駁了“開源AI更容易被劫持”的主流敘事。公司表示:“有人認為開放模型本質上不安全,因為可能被用於網路攻擊或移除護欄。但這些風險在封閉系統中同樣存在,僅僅隱藏權重並不能阻止堅定的攻擊者獲取或利用強大的AI。”當涉及AI時,開源意味著開放權重——模型的最終引數和偏見公開,允許開發者根據自身需求微調模型。真正的開源還需公開程式碼和訓練資料集,但由於專有模型的高利潤,完全開源的動力不足。
輝達還呼籲政策制定者正確認識開源AI的價值。“將開放模型、框架和安全工具視為防禦資產而非負債至關重要,”公司在公告中表示。“對開放前沿AI系統的全面限制將削弱防禦能力,並導致權力、依賴和脆弱性集中於少數封閉供應商。”特朗普政府一直對中國初創公司如Moonshoot和DeepSeek的開放模型持批評態度,認為存在安全風險,但這也夾雜著對中國在AI領域超越美國的擔憂。輝達的呼籲也觸及了政府在Anthropic和OpenAI模型釋出時間線上的干預,例如政府參與Fable 5和Mythos 5的召回,並事先批准了OpenAI最新模型GPT-5.6的釋出。