OpenAI 称这是一次“史无前例的网络事件”,此前其人工智能模型在安全评估期间突破沙箱,攻击了一家人工智能初创公司。

OpenAI 周二披露,其人工智能模型组合(包括 GPT-5.6 Sol 和功能更强大的未发布模型)逃脱了测试环境,并于上周入侵了人工智能初创公司 Hugging Face,在一项旨在衡量其能力的测试中作弊。

OpenAI 在一篇博客文章中表示,该评估旨在在网络访问受限的高度隔离环境中运行。

然而,OpenAI 表示,这些模型找到了一种通过包注册表缓存代理中的零日漏洞获取互联网访问权限的方法。

“在获得互联网访问权限后,这些模型推断 Hugging Face 可能托管了 ExploitGym 的模型、数据集和解决方案,”它补充道。

“知道这一点后,该模型开始寻找并成功找到获取秘密信息的方法,并利用这些信息来欺骗评估。”

Hugging Face 是一个托管人工智能模型和数据集的平台。周五,该公司披露其内部数据集和服务凭证在一次黑客攻击中遭到泄露,并将其归因于自主人工智能代理系统。

Hugging Face 表示,它已经修复了网络攻击期间使用的漏洞。