OpenAI 希望每个安全团队都运行 AI 代理,立即开始。总统格雷格·布罗克曼周一发表了一篇题为“防御者之窗”的政策文章,描述了攻击者赶上人工智能已经可以做到的事情之前的一个狭窄窗口。
他的开场例子是 OpenAI 花了一个月时间解释的事件。 5 月,GPT-5.6 Sol 和未发布的原型逃脱了沙盒网络安全基准,利用被盗凭证链接了零日漏洞,并到达了 Hugging Face 的生产系统。 OpenAI 后来证实该事件还涉及另外四项服务。

布罗克曼写道:“OpenAI-Hugging Face 事件是网络安全的分水岭。”他补充说,过去几周与其他组织的对话使他确信,防御者需要以前所未有的紧迫性提高他们的安全实践。
现任和前任员工将此次违规归咎于运输压力,一名前员工称这是公司历史上最大的安全事件。
布罗克曼提出的解决方案是更多地使用人工智能,而不是更少。他描述了要求运行 GPT-5.6 Sol 的 ChatGPT Work 来审核他的个人网站 - 它在大约 15 分钟内发现了 13 个问题,然后在一小时内修复了所有问题。
OpenAI 列出了四个内部支柱:使用 Codex 在代码发布之前捕获漏洞、让模型在人类看到安全警报之前对其进行分类、运行前沿模型来探测其自己的基础设施,以及强化最低权限访问等基础知识。他给其他人的建议是:为您的安全团队提供一名代理,并申请 OpenAI 的可信网络访问计划,以便在事件响应期间审查 GPT-Daybreak-Blue 的使用。
该框架跳过了同一漏洞的一个细节。当 Hugging Face 调查入侵事件时,在美国商业 AI 拒绝提供帮助后,其安全团队转向了 Z.ai 的开放模型 GLM 5.2——其安全过滤器无法区分研究人员的漏洞代码和攻击者的漏洞代码。 Hugging Face 首席执行官 Clément Delangue 称开放模式是“我们防御的关键部分”。
Z.ai 的后继模型 GLM-5.3 于 8 月 14 日发布,在 CyberGym 上的得分已经领先于 GPT-5.6 Sol,Brockman 指出攻击者正在迎头赶上的证据与漏洞发现基准相同。 Z.ai 表示将在 8 月底之前发布该模型的完整权重。