AI News HubLIVE
站内改写1 分钟阅读

新Claude Mythos成为首个通过英国AI安全机构所有网络攻击模拟的AI模型

英国AI安全研究所两次修正对AI网络能力翻倍速度的估计,Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5已超越加速后的时间线。Mythos是首个通过所有AISI攻击模拟的模型。Anthropic的红队负责人警告称,一年内Mythos可能显得相当笨拙。

来源The Decoder作者: Matthias Bastian

英国AI安全研究所(AISI)近期两次修正了对AI网络攻击能力发展速度的评估。最初,该机构认为AI的网络安全能力每八个月翻一番,随后将这一周期缩短至4.7个月。然而,Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5的表现甚至超过了这一加速后的时间线。其中,Claude Mythos成为首个通过AISI所有攻击模拟测试的AI模型。

Anthropic的红队负责人洛根·格雷厄姆对此发出警告。他表示,尽管Mythos目前展现了卓越的渗透测试能力,但按照当前的发展速度,可能在一年之内就会显得“相当笨拙”。这一观点反映了AI领域快速迭代的特性,今天的最先进技术很快就会被超越。

AISI的测试模拟了各类网络攻击场景,包括钓鱼、漏洞利用等,旨在评估AI模型的自主攻击能力。Mythos的全面通过标志着AI在网络安全领域的潜力,但同时也引发了对其潜在风险的担忧。格雷厄姆的评论提示我们,AI能力的提升速度可能远超预期,安全措施必须同步跟进。