AI News HubLIVE
站內改寫2 分鐘閱讀

AI安全機構報告稱Anthropic的Mythos進化速度超出預期

僅在其首次發佈一個月後,Anthropic著名的Mythos模型就突破了新的測試界限。

來源ZDNet AI

據英國AI安全研究所(AISI)週三發佈的博客,Anthropic的Claude Mythos模型——該公司認為其過於強大而不宜公開發布——已經展現出新的能力。AISI對Mythos的更新版本進行了測試,結果顯示其不僅超越了早前的版本,還超過了OpenAI的GPT-5.5,而距離Mythos最初發布僅過去一個月。

AISI在博文中寫道:“新的Mythos Preview檢查點完成了我們的兩個網絡範圍,在10次嘗試中,有6次成功解決了‘The Last Ones’範圍,並首次以3/10的成功率攻克了此前未解的‘Cooling Tower’範圍。這是模型首次完成我們兩個網絡範圍中的第二個。”當Anthropic上個月首次宣佈Mythos Preview和Project Glasswing——一個由競爭對手科技公司和AI實驗室組成的網絡安全測試聯盟,並向其提供Mythos的有限訪問權限——時,AISI進行了評估,發現該模型“代表着前沿模型在網絡安全性能已經迅速提升的背景下又邁上了一個台階。”這一第三方視角有助於平衡關於Mythos的兩種極端説法:要麼純屬營銷炒作,要麼預示着AI能力的災難性轉變。該模型的實際能力很可能介於兩者之間。

AISI的更新測試也表明,能力提升並不侷限於單個模型版本,而是可以在同一模型的不同版本內部發生。AI模型在處理網絡安全任務方面的能力正在迅速提升,這對網絡安全具有重大影響,尤其是考慮到Mythos在檢測軟件漏洞方面的特長。博文作者寫道:“2026年2月,我們內部估計,自2024年底以來,AI模型能夠完成的網絡安全任務長度每4.7個月翻一番——這已經比我們2025年11月估計的8個月加速了。此後,AISI報告了兩種新模型,Claude Mythos Preview和OpenAI的GPT-5.5,它們都大幅超過了這兩種翻倍趨勢。”作者補充説,尚不清楚這一趨勢是否會持續,或者這些發現是否只是暫時的異常。Mythos和GPT-5.5可能只是模型進化總體模式中的顯著例外。

不過,AISI澄清説,其測試存在若干未知因素。測試將任務限制在250萬token以內,以便研究人員更好地比較隨時間變化的性能結果。但這本身就“低估了前沿模型的能力”,他們寫道。“由於在我們的狹窄網絡套件中最長任務上的成功率接近100%,即使有250萬token的限制,Mythos Preview和GPT-5.5也擁有很大的上界誤差條。我們的任務長度也不足以確定模型在更高任務長度下的可靠性會如何急劇下降。這使得一些最新模型處於我們狹窄測試套件所能測量的極限。”雖然這使得模型失敗點難以測量,但也意味着如果沒有token上限,模型在這些任務上的成功率會高得多——事實上,高到“時間線變得無法計算”。擁有更多token訪問權限和複雜代理基礎設施的模型將具有更強的能力。博文補充道:“250萬token的限制相對較低——在我們的網絡範圍實驗中,我們使用高達1億token,並發現性能在這種預算下可能仍然會提高,尤其是對於近期模型,它們能從更高的token限制中不成比例地受益。”