微软发布AI安全工具,声称性能超越竞争对手平台
微软宣布推出两款AI安全工具:MAI-Cyber-1-Flash在CyberGYM基准测试中获得96%的分数,高于Anthropic、Google Gemini和OpenAI GPT;Project Perception能自动执行红蓝绿队任务,以更低成本完成90%的工作。两款工具目前处于预览阶段,需要谨慎评估。
微软于本周一正式发布了两款新型AI安全工具,宣称在性能与成本效益上全面超越现有竞争对手。其中,名为MAI-Cyber-1-Flash的工具在标准基准测试CyberGYM中取得了96%的评分,这一成绩比Anthropic的Mythos高出12个百分点,同时也优于Google Gemini和OpenAI GPT。更值得注意的是,微软表示这款新工具的使用成本仅为之前版本的一半,为企业提供了极具吸引力的性价比。
另一款工具则是Project Perception,它是一个由多个专门AI代理组成的系统,能够自动化执行红队(漏洞发现)、蓝队(风险调查)和绿队(修复行动)的网络安全任务。微软解释称,该平台会根据具体任务自动选择最合适的模型,决策依据包括模型的有效性以及对客户的最终成本。这些选择基于“持续的前沿与专业模型研究、基准测试和评估”。微软声称,Project Perception能够以低于竞争对手的价格完成90%的常规任务,这意味着客户仅需将剩余10%的高难度任务委托给更昂贵的替代方案。
微软指出,这些新工具的推出正值网络安全领域面临重大变革之际。随着AI技术加速网络攻击的速度与规模,防御团队不得不采用为传统环境设计的方法来保护日益复杂的数字基础设施。安全分析师常常需要从海量数据中手动提取信号、背景信息和风险洞察,这导致他们难以跟上不断涌现的新威胁。微软认为,MAI-Cyber-1-Flash和Project Perception将帮助组织快速响应并有效防御攻击。
然而,鉴于近期OpenAI事件引发的争议(该事件被比作反乌托邦科幻小说中的场景),这些目前仍处于预览阶段的工具需要谨慎对待。微软在公告中并未提及任何风险警告,但专家建议在使用前进行严格审查和评估。另一方面,完全拒绝此类工具也伴随着明显的安全风险。如何在利用AI代理的便利与避免潜在威胁之间取得平衡,目前尚无明确答案,仍是一个持续探索的过程。