AI News HubLIVE
站內改寫2 分鐘閱讀

Anthropic 擴大對 Claude Mythos AI 模型的公開訪問

Anthropic 宣佈將透過 Project Glasswing 擴大對 Claude Mythos 模型的訪問,預計在 6-12 個月內實現廣泛可用。該模型能發現漏洞並生成利用鏈,但目前僅限合作伙伴使用。

來源Hacker News AI作者: divija_07

人工智慧公司 Anthropic 宣佈將擴大對其備受爭議的 Claude Mythos 模型的訪問許可權。該模型因其強大的漏洞發現和利用能力而被限制釋出,但 Anthropic 表示將在未來幾個月內逐步向更多合作伙伴開放。

Mythos 是 Anthropic 開發的大型語言模型,不僅能以前所未有的水平發現軟體中的漏洞,還能生成完整的利用鏈,有時甚至能將低嚴重性的缺陷組合成高嚴重性的威脅。這種能力促使 Anthropic 最初僅透過 Project Glasswing 向約 50 個精心挑選的合作伙伴(包括思科、甲骨文和微軟等科技巨頭)提供訪問許可權。

Anthropic 在週五的宣告中表示:“我們將與關鍵合作伙伴——包括美國及盟國政府——合作,將 Project Glasswing 擴充套件到更多合作伙伴。在不久的將來,一旦我們開發出更強大的安全措施,我們期待透過公開發布提供 Mythos 級別的模型。”

該公司強調,攻擊者擁有同等工具只是時間問題。“我們相信 Mythos 級別的模型將在未來 6-12 個月內廣泛可用。”

合作伙伴已透過 Mythos 發現了超過 10,000 個高危或嚴重漏洞,其中 6,202 個存在於開源軟體中。Anthropic 表示,第三方審查了 1,752 個漏洞,確認其中 91% 是真實缺陷,三分之二的嚴重性評級正確。

英國 AI 安全研究所上個月報告稱,Mythos 在受控評估中能夠自主執行多階段攻擊並利用漏洞,這些任務通常需要人類專業人員數天時間。但該研究所指出,未模擬典型的企業防禦環境,因此無法確定 Mythos 是否能攻擊防禦良好的系統。

隨著漏洞發現速度加快,軟體維護者面臨大量報告,包括 AI 輔助研究者使用相同 LLM 導致的重複報告。微軟旗下的 GitHub 已調整其漏洞賞金計劃,以應對“不展示真實安全影響的提交”激增。

Cloudflare 作為 Glasswing 參與者分享了經驗:將模型視為漏洞發現工具而非聊天介面,透過狹窄指令、多代理協同工作可提高效率。Anthropic 將向經過審查的安全團隊提供自定義指令、程式碼對映工具和威脅模型構建器,以幫助優先處理漏洞。

儘管如此,專家指出漏洞修補速度存在理論限制,組織需要測試和部署補丁,而架構設計仍是未解問題。Cloudflare 首席安全官 Grant Bourzikas 表示:“原則是使攻擊者更難利用漏洞,即使漏洞存在,也要縮小從披露到修補之間的差距。”