AI News HubLIVE
站内改写1 分钟阅读

研究人员称AI刚刚打破所有自主网络能力基准

英国AI安全研究所和Palo Alto Networks的最新研究发现,Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5在自主网络安全任务上的表现大幅超越了此前已加速的进度,甚至超出了预期趋势。

来源Hacker News AI作者: lschueller

周三,英国AI安全研究所(AISI)和Palo Alto Networks分别发布的研究结果显示,两个最先进的人工智能模型——Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5——在自主网络安全任务上的完成速度显著超越了已经加速的进程。

AISI代表英国政府对前沿AI模型进行部署前评估,该机构表示,Claude Mythos Preview和GPT-5.5均大大超出了该研究所自2024年底以来追踪的加倍趋势。目前尚不清楚这些结果是代表了孤立的能力跃升,还是新加速轨迹的开始。

今年早些时候,AISI估计前沿模型的80%可靠网络时间线(衡量人类专家完成任务所需时间,用作AI自主性的代理指标)大约每五个月翻一番。这本身已是该研究所2025年11月估计的八个月加倍时间的一半。而现在,Mythos Preview和GPT-5.5的表现又超出了该研究所测量的任何趋势线。

“前沿AI的自主网络和软件能力正在快速提升:前沿模型能自主完成的网络任务长度已以月为单位翻倍,而非年,”AISI写道。