网络安全

OpenAI公布Astra:其首个达到“关键网络能力”门槛的模型

OpenAI表示,Astra能够发现未知漏洞并开发利用方法,并在ExploitBench测试中取得满分。公司在因增加安全控制措施而推迟部分开发流程后,将逐步向测试用户开放其网络安全能力,但目前尚无独立验证。

2026-09-02
1 分钟阅读
6 浏览量
certi.news
OpenAI公布Astra:其首个达到“关键网络能力”门槛的模型

OpenAI公布了人工智能模型Astra的新细节,并准备很快开放该模型。公司表示,Astra是其首个达到Preparedness Framework中“关键网络能力”水平的模型。根据公司的描述,这意味着在获得适当工具和访问权限的情况下,该模型能够发现此前未知的安全漏洞,并开发利用这些漏洞的方法。

这项进展并不仅涉及模型分析代码或提出修复建议的能力,还涉及其执行漏洞利用链高级阶段的能力。因此,OpenAI推迟了Astra的部分开发和发布,同时在最近几周致力于降低其被用于恶意网络攻击或执行未经授权操作的可能性。

漏洞利用测试中的强劲表现

OpenAI表示,Astra在ExploitBench测试中取得了100%的成绩。该测试用于衡量开发已知漏洞利用软件的能力。公司还进行了一项内部评估,涵盖2026年6月至8月期间公布的20个高严重性漏洞。

根据OpenAI提供的结果,在这项评估中,Astra执行远程代码的成功率高于GPT-5.6 Sol模型,同时使用的令牌单元数量更少。公司表示,在测试期间,该模型在漏洞利用链中发现并利用了两个“零日”漏洞,并已开始通知相关软件开发者。

专家开展的其他测试还包括评估Astra在受保护的浏览器中利用未知漏洞、随后逃离隔离环境并在主机系统上执行命令的能力。根据OpenAI的说法,在操作系统测试中,该模型能够将多个漏洞串联起来,从未经授权的用户权限提升至root权限。

有限开放与额外控制措施

OpenAI计划分阶段开放Astra最先进的网络安全能力。第一阶段将仅面向一组参与测试的用户,之后再通过Daybreak Blue计划扩大面向防御性用途的访问范围。

公司表示,已提高Astra拒绝恶意网络安全请求的比例,并将对其认定为高风险的账户施加更严格的限制。公司还将增加用于发现未经授权行为的监控机制,并加入多层推理和监督措施,以监管模型执行的操作。

为什么这条消息很重要?

实际发生的变化是,一个通用模型达到了能够根据公司测试结果,通过多步骤流程协助发现和利用漏洞的水平。如果使用范围继续限定在获得授权的环境中,这可能有利于防御团队和安全研究人员;但与此同时,它也提高了访问控制和监控的重要性,因为同样的能力可能降低开发复杂攻击所需的努力。

这里也凸显了现有信息的局限性。上述数字和结果均来自OpenAI,目前尚无对Astra安全水平或其滥用缓解措施的独立验证。此外,根据文章内容,完整系统和详细评估结果要到正式发布时才会公布。因此,对模型能力和风险的实际判断,将取决于其公布的安全系统以及开放后的独立测试结果,而不能仅依据最初的性能声明。

新闻来源
c
作者

certi.news

同一分类

你可能还喜欢

查看所有新闻