Anthropic宣布重组其网络安全验证计划(CVP),将其与Project Glasswing合并为一个分为三个级别的方案,以访问其能力最强的模型。此举源于一个双重问题:帮助防御者发现并修复漏洞的模型,也可能提供对攻击者有用的能力。
公开提供的Claude模型,包括Claude Opus 5.5、Sonnet 5.5和Fable 5.1,配备了可阻止大多数网络安全活动的控制措施。而在新计划中,三个级别涵盖Opus 5.5、Sonnet 5.5、Mythos 5.1及未来模型,但每个级别的验证要求和运行控制措施各不相同。
网络安全使用的三个级别
Defense Access专用于安全运营中心运营和事件响应、恶意软件逆向工程,以及漏洞分析与验证。为自身系统提供防御的安全团队、关键基础设施运营方、小型安全公司、开源项目维护者,以及拥有漏洞报告记录的个人研究人员均可申请。Anthropic表示,其目标是在几天内回复申请。
Red Team Access则增加了经授权的渗透测试和红队演练,但相关操作必须限于申请人获准测试的系统。可能造成身体伤害或大范围中断的行动,例如部署勒索软件,仍会被实时禁止。该级别仅向组织开放,预计审核需要数周;符合条件的申请人将暂时获得Defense Access权限。
Specialized Access受到的网络安全限制最少,但仅限少数获授权测试敏感系统的组织,例如电网、航空系统、电信网络和银行间转账基础设施。Anthropic将与美国政府合作审核该级别的申请,而现有Glasswing成员将转入该级别。
计划影响的指标
Anthropic表示,Glasswing合作伙伴在4月至7月期间发现了至少129,000个经过验证的漏洞,而该公司在4月至10月期间开展的开源扫描又发现了5,500个漏洞。其中超过33,000个被评定为高危或严重级别。该公司估计,实际影响可能至少高出五倍,因为这些数字仅覆盖参与者中的一部分样本。
实际会发生什么变化?
新设计将网络安全能力的访问权限从相互独立的例外安排转变为统一路径,该路径取决于机构身份、授权范围以及目标系统的敏感程度。另一方面,参与组织必须同意保留数据,以便Anthropic监控滥用行为。该公司计划在秋季晚些时候提供Enterprise Frontier Safeguards,使符合条件的客户能够将数据存储在由其控制的云基础设施中。在此之前,拥有对Fable 5.1或Mythos 5.1的无数据保留访问权限的组织,可以在该设置下使用CVP。
CVP可在Claude Platform、Google Cloud Vertex AI和Microsoft Foundry上使用;在Amazon Bedrock上的可用范围则仅限符合Enterprise Frontier Safeguards资格的客户。现有成员将自动接受新模型访问权限评估,同时保留其针对旧模型的当前设置。