专家称Claude Mythos是唯一完成完整网络杀伤链的AI模型

AIGC行业资讯15小时前发布 zhang
1 0

美国咨询与科技公司Booz Allen在首份“网络武器指数”(Cyber Weapon Index)报告中揭示,在18款中美前沿AI模型的自主网络攻击能力测试中,仅Anthropic的Claude Mythos在无人工干预下完整执行了端到端的网络杀伤链。该报告基于对模型自主识别漏洞、开发攻击能力并执行攻击的评估,为每款模型打分,Claude Mythos以80分高居榜首,远超第二名xAI的Grok-4.5(49分)。

测试中,当向Claude Mythos提供窃取来的员工凭据时,它在每次尝试中都成功入侵目标网络并获得管理员级控制权,且能根据网络内发现的信息自主识别提权路径,而非遵循预设攻击计划。即便在没有凭据的情况下,该模型仍能进入网络并最终实现完全域控制。Booz Allen指出,除Claude Mythos外,还有三款模型(Grok-4.5、Meta的Muse Spark 1.1、Z.ai的GLM-5.2)达到了完全域访问与控制,但未能完成整个杀伤链。另有四款模型(OpenAIGPT-5.6 Sol、月之暗面的Kimi K3、GPT-5.5-Cyber、DeepSeek-V4-Pro)实现了网络内的横向移动。

值得注意的是,该测试未包含OpenAI即将发布的Astra模型。OpenAI周二表示,Astra已达到其“关键”网络安全能力阈值,意味着该模型在发现和利用零日漏洞方面表现出色,可能对关键系统构成重大风险,甚至模型本身在“错位”时也能执行有害网络行动。Booz Allen预测,其测试的其余17款美国和中国模型中,大多数将在六个月内达到与Claude Mythos同等的武器化水平,并称来自勒索软件团伙等经济动机罪犯和政府支持团体的主流AI攻击已“迫在眉睫”。

报告还揭示了一个关键发现:当测试者故意引入漏洞时,美国、中国、开放权重和封闭模型在漏洞研究得分(VRS)上均接近满分;但当面对真实漏洞时,所有九款前沿API模型得分均为零。一款未具名的领先模型甚至正确分析了易受攻击的组件,却将其误判为安全,只有Claude Mythos成功利用了该漏洞。Booz Allen认为,这种能力集中构成了国家安全当务之急,需保护最先进的模型,防止其最高风险的网络能力被对手利用。

此外,报告强调攻击工具包(attack harness)的重要性不亚于模型本身。该软件将模型与黑客工具连接,并编排自动化攻击逻辑,能显著增强模型保持专注、适应变化、从失败中恢复以及将单个动作串联成多阶段攻击的能力。测试显示,当Claude Sonnet与攻击工具包配合时,其表现可与Claude Mythos媲美。Booz Allen呼吁美国为关键基础设施设定并执行行业特定截止日期,以展示抵御AI攻击的韧性,并发展“超配”(overmatch)能力,同时加速授权进攻性网络行动和构建AI防御体系。

© 版权声明

相关文章

蛙蛙写作