网络安全

Anthropic扩大网络安全验证计划,为防御方提供三个访问级别

Anthropic宣布扩大网络安全验证计划(Cyber Verification Program),通过三个访问级别,为经过验证的安全团队提供先进网络安全能力和较低限制的安全防护措施。公司测试显示,受限访问仍使大多数攻击场景保持拦截状态,同时允许获授权的测试团队使用更强大的能力。

2026-10-06
1 分钟阅读
3 浏览量
certi.news Editorial Team
Anthropic扩大网络安全验证计划,为防御方提供三个访问级别

Anthropic于2026年10月6日宣布扩大网络安全验证计划(Cyber Verification Program,CVP),使符合条件的安全机构能够根据其工作性质,使用先进网络安全能力和限制较少的分类防护措施。该计划涵盖Claude Opus 5.5、Claude Sonnet 5.5和Claude Mythos 5.1模型,以及未来模型。

根据工作类型划分的三个级别

该计划从用于防御行动的防御访问(Defense Access)级别开始,包括安全运营中心和事件响应任务、恶意软件逆向工程,以及漏洞分析与验证。潜在参与方包括企业、大学和政府机构的安全团队,关键基础设施运营商,小型安全公司,开源项目维护者,以及拥有经验证漏洞报告记录的个人研究人员。Anthropic预计将在数日内回复申请。

而红队访问(Red Team Access)则增加渗透测试和攻击模拟团队,但前提是测试必须仅限于申请人获准测试的系统。部署勒索软件、破坏实体系统或测试高风险安全系统等行为仍会被即时禁止。该级别目前仅面向机构,审核可能需要数周;符合条件的申请人将暂时纳入防御访问级别。

专项访问(Specialized Access)则保留给少数经过验证、获准测试相关系统的机构,这些系统一旦中断可能影响人员生命或市场,例如飞机运行系统、电网、通信系统、银行间转账基础设施和政府网络。Anthropic将与美国政府合作,对该级别的每个机构进行审核。目前Project Glasswing的成员将直接转入新级别,无需重新认证现有模型。

测试效用与限制之间的平衡

Anthropic通过CyScenarioBench测试了Claude Opus 5.5。该评估用于衡量模型在现实条件下规划并执行多阶段网络行动的能力。在没有CVP访问权限的情况下,十项任务在首次尝试时全部被拦截。在防御访问级别中,50次尝试里有46次曾在某个阶段被拦截,另有4次尝试成功。而在红队访问级别中,没有发生拦截,模型完成了50项任务中的34项;这与其在没有安全防护措施时运行的结果大致相同,成功率为67.6%。

实际发生了什么变化?

核心变化并非向所有人开放网络安全能力,而是通过多级验证,将这些能力与普遍可用的模型区分开来,并根据授权类型和所需控制措施匹配模型能力。通用模型仍适合代码审查、修补已知问题、发现自有代码中的漏洞,以及对安全警报进行分类。

Anthropic表示,Project Glasswing合作伙伴在2026年4月至7月期间发现了至少129,000个有记录的软件漏洞;与此同时,公司开展的开源扫描行动在4月至10月期间又发现了5,500个漏洞。截至目前,其中超过33,000个被分类为严重或高风险。公司同时提醒称,由于这些数字部分依赖对部分合作伙伴样本进行扫描的数据,因此可能低于实际数量。

加入该计划需要保留数据,以监测网络安全滥用行为。Anthropic表示,符合条件的机构之后将能够使用Enterprise Frontier Safeguards,该方案结合了零数据保留与防护控制,并将数据存储在由机构控制的云基础设施中。在该方案推出之前,部分使用Claude Fable 5.1或Claude Mythos 5.1且采用零数据保留政策的用户,可以按照这一政策使用CVP。

certi.news解读:该计划体现了应对人工智能模型双重用途难题的一种实际尝试:在阻止普遍攻击性使用的同时,不剥夺防御团队使用可能加快漏洞发现的工具。不过,测试结果由Anthropic自行发布,而进入更高访问级别需要机构验证和持续监管;此外,EFS的上线时间以及详细的资格评估机制仍是尚待明确的问题。

新闻来源
Anthropic Newsroom
查看原始来源 ↗
c
作者

certi.news Editorial Team

同一分类

你可能还喜欢

查看所有新闻