研究者、AIが自律的サイバー能力のあらゆるベンチマークを打破したと報告
英国AI安全保障研究所(AISI)とPalo Alto Networksが発表した最新の調査結果によると、AnthropicのClaude Mythos PreviewとOpenAIのGPT-5.5という2つの最先端AIモデルが、自律的サイバーセキュリティタスクにおいて、すでに加速していたペースを大幅に上回った。
水曜日に英国AI安全保障研究所(AISI)とPalo Alto Networksがそれぞれ発表した調査結果によると、AnthropicのClaude Mythos PreviewとOpenAIのGPT-5.5という2つの最も先進的なAIモデルが、自律的サイバーセキュリティタスクにおいて、すでに加速していたペースを大幅に上回った。
英国政府に代わってフロンティアAIモデルの展開前評価を実施しているAISIは、Claude Mythos PreviewとGPT-5.5が、同研究所が2024年末から追跡してきた倍増傾向を大幅に超えたと述べている。この結果が孤立した能力の飛躍を表すのか、新たなより速い軌道の始まりなのかはまだ明らかではない。
AISIは今年初め、フロンティアモデルの80%信頼性サイバー時間軸(人間の専門家がタスクを完了するのにかかる時間の尺度で、AIの自律性の代理指標として使用)が約5カ月ごとに倍増していたと推定していた。これは、同研究所が2025年11月に推定した8カ月の倍加時間の約半分であった。そして今、Mythos PreviewとGPT-5.5は、同研究所が測定したどの傾向線も上回っている。
「フロンティアAIの自律的サイバーおよびソフトウェア能力は急速に進歩している。フロンティアモデルが自律的に完了できるサイバータスクの長さは、年単位ではなく月単位で倍増している」とAISIは記している。