模型发布
OpenAI 即将推出 Astra:网络安全基准满分,发现两个零日漏洞
OpenAI 网络安全模型 Astra 在 ExploitBench 取得 100% 成绩,发现两枚零日漏洞并组成可利用…
2026.09.02 · 周三约 2 分钟阅读
OpenAI 即将推出面向网络安全场景的大模型 Astra。该模型在内部基准 ExploitBench 上取得 100% 的成绩,并在 OpenAI 自建的更新版基准上,发现了近期披露的高危漏洞,并将其转化为可执行的利用链。不过,Astra 的网络安全能力在正式发布时将受到限制。
基准测试成绩亮眼
根据 OpenAI 的披露,Astra 在 ExploitBench 上达到 100% 通过率,并在与 GPT‑5.6 Sol 的对比评估中,实现了「显著更高」的任意代码执行成功率。这意味着 Astra 在自动化漏洞利用任务上,相较前代模型有明显的代际提升。
新基准与真实漏洞发现
为检验模型对较新漏洞的实战能力,OpenAI 构建了一个名为「ExploitBench – Internal Port」的内部基准,包含 20 个近期披露的 V8 高危漏洞。在该基准上,Astra 同样表现优异,并完成了以下两项关键工作:
- 识别出 2 个此前未被公开的零日漏洞;
- 将这 2 个零日漏洞转化为完整的可执行利用链(exploit chain)。
这一结果说明 Astra 不仅能在已知漏洞上复现攻击路径,还能对尚未公开披露的真实漏洞进行挖掘与武器化。
发布节奏与能力边界
OpenAI 表示 Astra「即将推出」,但其网络安全相关能力在公开版本里会被有意收敛。这一限制与该模型潜在的滥用风险直接相关:能够自动发现并利用零日漏洞的模型,一旦被恶意使用,将对软件供应链和关键基础设施构成现实威胁。OpenAI 通过对能力范围设限,试图在推动能力进步与控制安全风险之间取得平衡。
后续 Astra 的具体开放形态、是否提供分层的能力权限、以及面向安全研究者的协作渠道,仍有待 OpenAI 进一步说明。
