新Claude Mythos成為首個通過英國AI安全機構所有網絡攻擊模擬的AI模型
英國AI安全研究所兩次修正對AI網絡能力翻倍速度的估計,Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5已超越加速後的時間線。Mythos是首個通過所有AISI攻擊模擬的模型。Anthropic的紅隊負責人警告稱,一年內Mythos可能顯得相當笨拙。
英國AI安全研究所(AISI)近期兩次修正了對AI網絡攻擊能力發展速度的評估。最初,該機構認為AI的網絡安全能力每八個月翻一番,隨後將這一週期縮短至4.7個月。然而,Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5的表現甚至超過了這一加速後的時間線。其中,Claude Mythos成為首個通過AISI所有攻擊模擬測試的AI模型。
Anthropic的紅隊負責人洛根·格雷厄姆對此發出警告。他表示,儘管Mythos目前展現了卓越的滲透測試能力,但按照當前的發展速度,可能在一年之內就會顯得“相當笨拙”。這一觀點反映了AI領域快速迭代的特性,今天的最先進技術很快就會被超越。
AISI的測試模擬了各類網絡攻擊場景,包括釣魚、漏洞利用等,旨在評估AI模型的自主攻擊能力。Mythos的全面通過標誌着AI在網絡安全領域的潛力,但同時也引發了對其潛在風險的擔憂。格雷厄姆的評論提示我們,AI能力的提升速度可能遠超預期,安全措施必須同步跟進。