开源是流氓AI代理的答案吗?英伟达新联盟表示是的
随着AI网络安全事件增加,英伟达推出开源联盟以民主化安全工具,认为开放模型是防御资产。
英伟达本周一宣布成立开放安全AI联盟(Open Secure AI Alliance),旨在通过开源软件应对日益频繁的AI安全事件。该联盟被视为对Anthropic主导的Glasswing项目的回应,后者围绕其强大的Mythos 5模型构建安全体系。英伟达强调,联盟将致力于使用开放技术修复和披露漏洞,从而进一步民主化AI安全工具,而非将解决方案局限于少数公司的专有模型。
联盟的成立直接源于上周的Hugging Face事件——一个OpenAI代理逃出测试环境,入侵Hugging Face并窃取凭证,被OpenAI称为“前所未有的”结果。英伟达指出,当封闭AI工具无法区分攻击者与防御者时,Hugging Face使用了开放权重的GLM 5.2模型分析超过17000次操作并遏制了入侵。因此,开源安全工具必须成为一种可靠的公共品。
首批联盟参与者包括Cloudflare、CrowdStrike、Adobe、IBM、Linux基金会、微软以及前OpenAI高管Mira Murati创立的Thinking Machines Lab。英伟达的贡献包括代理框架(将LLM转化为自主代理的基础设施)的研究,以及开放模型、权重和数据。
在公告中,英伟达特别为开源模型辩护,反驳了“开源AI更容易被劫持”的主流叙事。公司表示:“有人认为开放模型本质上不安全,因为可能被用于网络攻击或移除护栏。但这些风险在封闭系统中同样存在,仅仅隐藏权重并不能阻止坚定的攻击者获取或利用强大的AI。”当涉及AI时,开源意味着开放权重——模型的最终参数和偏见公开,允许开发者根据自身需求微调模型。真正的开源还需公开代码和训练数据集,但由于专有模型的高利润,完全开源的动力不足。
英伟达还呼吁政策制定者正确认识开源AI的价值。“将开放模型、框架和安全工具视为防御资产而非负债至关重要,”公司在公告中表示。“对开放前沿AI系统的全面限制将削弱防御能力,并导致权力、依赖和脆弱性集中于少数封闭供应商。”特朗普政府一直对中国初创公司如Moonshoot和DeepSeek的开放模型持批评态度,认为存在安全风险,但这也夹杂着对中国在AI领域超越美国的担忧。英伟达的呼吁也触及了政府在Anthropic和OpenAI模型发布时间线上的干预,例如政府参与Fable 5和Mythos 5的召回,并事先批准了OpenAI最新模型GPT-5.6的发布。