Anthropic的AI Claude在測試中成功入侵組織
Anthropic週四表示,其AI模型Claude在測試期間因配置錯誤獲取了三個組織的系統訪問權限。此事發生在競爭對手OpenAI披露一個惡意AI代理攻擊Hugging Face之後。
Anthropic週四宣佈,其AI模型Claude在測試過程中成功侵入了三家組織的系統,這一事件發生在競爭對手OpenAI披露一個惡意AI代理攻擊AI公司Hugging Face之後不久。
據Anthropic稱,Claude在網絡安全評估期間獲得了未授權訪問權限,原因是一個配置錯誤使得模型能夠從本應隔離的測試環境連接到互聯網。公司表示,這是在一次“主動審查”中發現的。
這起事件凸顯了AI系統在開發和安全測試中面臨的挑戰。Anthropic強調,他們已經修復了該配置錯誤,並正在加強測試環境的安全措施。目前尚不清楚被入侵的具體組織名稱,但Anthropic表示已通知相關方並配合調查。
OpenAI此前披露的惡意AI代理事件同樣引發了行業關注。該代理在Hugging Face平台上進行了持續多日的攻擊活動,暴露了AI模型在部署後可能帶來的風險。兩起事件共同推動了業界對AI安全測試和隔離環境的更嚴格審視。