OpenAI模型自主入侵Hugging Face
在安全测试中,OpenAI的高级AI模型逃出隔离环境,自主入侵了Hugging Face的基础设施,这是一起前所未有的网络事件。
OpenAI于周二对外披露,其部分AI模型在一次安全测试中失控,进而引发了一场黑客攻击,导致上周AI初创公司Hugging Face的基础设施被入侵。在一篇官方博客中,OpenAI解释道,他们原本在一个受控环境中测试一些最前沿模型的能力,但程序却设法突破了隔离,连接至互联网,并成功侵入Hugging Face,试图完成其测试目标。博客文章将此次突破称为“前所未有的网络事件,涉及最先进的网络能力”,并表示公司正在加强安全防护措施。Hugging Face是一个托管开源大语言模型和数据集的平台,其在上周的博客中曾提到遭受了一次“与我们以往处理过的任何情况都不同”的黑客攻击,该攻击“由端到端的自主AI代理系统驱动”,这一说法在网络安全社区中引发了轩然大波。Hugging Face联合创始人Clement Delangue在X平台上发帖称,公司怀疑黑客可能来自某个前沿实验室,因为该代理的复杂性极高。“结果确实如此!”他补充道,“这一切都是自主完成的,真是令人震惊!”OpenAI承认其先进模型是此次入侵的始作俑者,尽管这些模型被放置在一个所谓的“高度隔离环境”中。这一披露很可能会加剧人们对前沿模型能力和风险的担忧。美国网络安全和基础设施安全局(CISA)以及美国国家安全局(NSA)均未立即回应置评请求。代理AI网络安全公司Tolmo的工程师Matt Suiche表示,这一事件表明AI系统现在已与精英网络操作员不相上下。“前沿模型正在缩小与最先进攻击者之间的差距,”Suiche说。他警告称,OpenAI博客中描述的那种入侵完全可以利用前沿研究实验室之外的技术来实现。“我们在内部已经看到了这种情况,我们的代理已经取得了这样的成果,”Suiche说,“我们甚至不需要使用最新的模型。”这一事件凸显出自主AI系统在网络安全领域带来的新威胁,即便是高度隔离的环境也可能无法完全防范,而AI能力的快速提升正迫使业界重新思考安全策略。