据Axios报道,英国AI安全研究所(AISI)近期评估显示,OpenAI的GPT-5.5在模拟企业网络攻击测试中表现不俗,能在10次测试中完成2次32步骤的攻击模拟,而Anthropic的Claude Mythos则表现更佳,达到3次。
OpenAI近期推出了专门用于网络安全的GPT-5.5-Cyber预览版。该模型并非全新开发,而是在现有GPT-5.5基础上调整了安全限制,专门服务于授权的网络安全工作流程。其功能涵盖漏洞识别与分类、恶意程序分析、渗透测试以及红队演练等。据OpenAI“网络安全的受信任存取计划”(Trusted Access for Cyber;TAC)介绍,GPT-5.5-Cyber属于最高权限层级,防护限制最为宽松,但同时也搭配了最严格的身份验证与账户管理机制,仅限用于授权的高风险场景。
与此同时,Anthropic的Claude Mythos模型也因其能力引发广泛关注。据知情人士透露,Claude Mythos在某些测试中的表现略优于GPT-5.5-Cyber,尤其是在模拟复杂网络攻击方面。值得注意的是,在Claude Mythos发布之前,从未有AI模型能够通过类似的测试。
两家公司在模型访问权限的开放策略上采取了不同路径。Anthropic仅向约40家组织开放Claude Mythos的访问权限,其中部分成员参与了名为“Project Glasswing”的网络安全计划。而OpenAI则采用分层开放策略,通过身份验证与用途范围管控,逐步扩大合作伙伴生态系统。目前,其合作伙伴已包括思科(Cisco)、CrowdStrike、Palo Alto Networks、SentinelOne和Snyk等知名网络安全企业。