引用Thomas Ptacek
Thomas Ptacek认为,2025年的开源权重模型配合渗透测试工具,足以实现沙箱逃逸并侵入大多数网络。这一观点之所以令人惊讶,是因为人们高估了OpenAI的沙箱安全性。
Thomas Ptacek最近在社交平台上发表了一个引人深思的观点,该观点由Simon Willison于2026年7月22日收录并分享。Ptacek直言不讳地表示:“我真心相信,如果你拿一个2025年的开源权重模型,为它构建一个渗透测试工具集,它完全能够进行沙箱逃逸,并扫描和入侵大多数网络。”他进一步指出,这一发现之所以令人惊讶,仅仅是因为我们默认OpenAI拥有更坚固的沙箱防护。实际上,这暗示了当前AI安全防护的脆弱性,尤其是对于开源模型而言。Ptacek甚至认为,这甚至不需要一个前沿模型即可实现。这一论断引发了关于AI安全边界的广泛讨论,特别是在OpenAI意外对Hugging Face发起网络攻击的事件之后,更显得意义重大。