OpenAI 周二表示,未发布的 Astra 模型已经跨越了其准备框架下网络安全能力的“关键”门槛,这是该公司首次将该模型归入该类别。

这意味着 Astra(许多人认为它是 GPT-6 而不是附加模型)可以发现以前未知的安全漏洞,并在许多强化系统上构建有效的漏洞,而无需有人一步步指导。

OpenAI 写道:“我们现在相信 Astra 满足了我们的准备框架下的关键网络安全能力阈值。” “这是我们在这个级别指定的第一个模型,在开发过程中和发布之前需要更强的保障措施。”

在该框架下,如果一个模型能够在许多强化的现实系统中独立开发功能性零日漏洞,或者如果它能够从一个高级目标开始针对一个艰难的目标规划和执行整个网络攻击,那么它就达到了关键的水平。早期的 OpenAI 模型,包括 GPT-5.6 Sol,在该框架的较低“高”层中名列前茅。

在 ExploitBench 基准测试中,Astra 达到了完美的 100%。ExploitBench 是一个测试模型是否可以将已知的软件漏洞转化为可用漏洞的基准测试,并将其评分为直接通过率。

为了排除记忆答案导致分数过高的情况,OpenAI 使用 6 月至 8 月期间披露的 Google V8 JavaScript 引擎中的 20 个高严重性漏洞进行了第二次测试。 Astra 在任意代码执行率上也击败了 GPT-5.6 Sol,使用的输出代币少得多,并且在此过程中它发现了两个零日漏洞并将其链接在一起,OpenAI 仍在向受影响的维护人员披露。

GPT-5.6 Sol是目前OpenAI最好的模型。

在针对强化浏览器和强化操作系统的实际测试中,Astra 构建了一个完整的妥协链,该链突破了浏览器沙箱,只需打开恶意 HTML 文件即可在主机上运行命令。它还在强化操作系统中发现了多个缺陷,并将它们串入从普通用户帐户到 root 的权限升级路径中。

OpenAI 表示,该模型在其自己的测试中拒绝了 91.5% 的网络越狱尝试,高于 GPT-5.6 Sol 的 59%。对 Astra 最先进的网络安全功能的访问从一小群 alpha 测试人员开始,随后通过 OpenAI 的 Daybreak Blue 计划进行更广泛的访问,以进行防御性安全工作。

此次披露是在整个行业经历了数周的紧张情绪之后进行的。就在几天前,OpenAI 在 Astra 模型的网络和编码技能快速进步后暂停了该模型的开发,紧随其后的是一个单独的、未发布的 OpenAI 系统,该系统在玩弄安全基准时链接了漏洞来破坏 Hugging Face。 OpenAI 表示 Astra 与该事件无关。

交易员已经消化了快速周转的情况。 跟踪的 Myriad 上的预测市场显示,即使在 OpenAI 8 月初暂停之后,内部代号为 GPT-6 的 Astra 在 9 月 30 日之前公开发布的可能性仍为 72%,而 OpenAI 仍未确定公开发布日期。这些可能性发生了 55% 的变化,支持在 2026 年 11 月之前发布。

这个时机让阿斯特拉面临着一个新的竞争对手。 Anthropic 于周二发布了 Fable 5.1 和 Mythos 5.1,Mythos 5.1 与早期的 Mythos 5 一样,是为经过审查的网络安全和生命科学组织而不是公众保留的。

在 6 月份报道称,OpenAI 的 GPT-5.5-Cyber​​ 在 Cyber​​Gym 上的得分已经超过了 Mythos 5,Cyber​​Gym 是一个针对来自真实开源项目的 1,500 多个已知漏洞运行 AI 代理的基准测试,并根据正确重现的数量对其进行评分。

此前有传言称,两家公司将在同一时间推出新的前沿车型,现在他们已经做到了。 Fable 5.1 于 9 月 1 日登陆,OpenAI 表示 Astra 即将推出,其最强大的网络工具将首先支持 alpha access,然后是 Daybreak Blue。