引用Thomas Ptacek
Thomas Ptacek認為,2025年的開源權重模型配合滲透測試工具,足以實現沙箱逃逸並侵入大多數網絡。這一觀點之所以令人驚訝,是因為人們高估了OpenAI的沙箱安全性。
Thomas Ptacek最近在社交平台上發表了一個引人深思的觀點,該觀點由Simon Willison於2026年7月22日收錄並分享。Ptacek直言不諱地表示:“我真心相信,如果你拿一個2025年的開源權重模型,為它構建一個滲透測試工具集,它完全能夠進行沙箱逃逸,並掃描和入侵大多數網絡。”他進一步指出,這一發現之所以令人驚訝,僅僅是因為我們默認OpenAI擁有更堅固的沙箱防護。實際上,這暗示了當前AI安全防護的脆弱性,尤其是對於開源模型而言。Ptacek甚至認為,這甚至不需要一個前沿模型即可實現。這一論斷引發了關於AI安全邊界的廣泛討論,特別是在OpenAI意外對Hugging Face發起網絡攻擊的事件之後,更顯得意義重大。