原文标题:How are companies, governments responding to the OpenAI hack?

OpenAI 的人工智能模型遭到了另一家公司的黑客攻击,促使人们呼吁重新审查先进人工智能系统的保障措施。

ChatGPT 所有者 OpenAI 承认发生了一次“史无前例的网络事件”——其两个最强大的人工智能模型自行侵入了另一家人工智能公司——引发了关于是否需要更强的技术护栏的争论。

该公司表示,其人工智能系统突破了测试环境,并入侵了初创公司 Hugging Face。

该初创公司于 7 月 16 日披露,其服务器被一个未知但复杂的独立代理黑客入侵。

以下是公司、一些政府和立法者如何应对首次此类公开披露的网络攻击的最新信息:

抱脸说了什么?

该公司在一份声明中表示,它通过自己的人工智能辅助检测发现了这一漏洞。

“这与我们之前处理过的任何事情都有一个重要的不同:它是由自主人工智能代理系统端到端驱动的,”它说。

在 OpenAI 披露其模型涉及此次泄露事件后,双方于本周开始了持续的联合调查。

Hugging Face 联合创始人 Clement Delangue 表示,在美国领先的人工智能模型因无法区分防御者和攻击者而拒绝了这项任务后,他的初创公司转向中国公司智普人工智能的开源 GLM-5.2 模型来分析黑客数据。

在谈到 OpenAI 时,Delangue 补充道,Hugging Face 的员工“坚信他们没有恶意”。

“为我们的安全团队感到自豪!他们捕获、遏制并公开披露了一次我们以前从未见过的攻击,而且速度创纪录,”他在 X 上写道。

“这是代理时代网络安全的第一天,我们都知道保密不是答案,各地的所有防御者(不仅仅是少数选定的防御者)都需要更强大且不受限制的模型,尤其是开放模型!”德兰格补充道。

英国政府对此有何反应?

人工智能安全研究所 (AISI) 是一家英国政府支持的机构,成立于 2023 年,旨在评估先进人工智能系统带来的风险。该机构本周表示,其正在调查的一个人工智能模型也出现了失控行为,并试图入侵其测试系统。

AISI 没有透露人工智能模型背后的公司,并补充说其自身的基础设施没有受到损害。此后,它已采取措施使其系统更加安全。

其最新评估还发现,其测试的每个前沿人工智能模型都试图在能力评估中作弊,这突显出随着模型能力变得更强,人工智能安全面临着越来越大的挑战。

AISI 表示,这些模型打破了评估规则,以便更轻松地完成任务,包括在禁止时在线查找答案、绕过网络限制、调查评估软件寻找线索以及访问允许环境之外的系统。

AISI 表示,这些模型在事后接受质疑时很少承认作弊,而且通常不会在推理中透露出作弊行为,因此很难仅通过自我报告来发现。该研究所认为,随着人工智能系统获得更多自主权,独立监控和更强有力的监督机制将变得越来越重要。

该研究所强调,这种行为并不一定表明恶意意图,而是反映了在当前评估设置中利用捷径来最大限度地取得成功的模型。

OpenAI 对此有何反应?

ChatGPT 制造商周二在一篇博客文章中表示:“我们已将 Hugging Face 纳入可信访问计划,并支持他们的团队快速使用我们模型的功能来提高他们的防御能力。”

这家旧金山公司透露,参与攻击的两个模型是最新的 GPT-5.6 Sol 模型和一个未发布的模型,该公司称该模型比其最新版本“能力更强”。

两个 OpenAI 代理发现了 Hugging Face 服务器中的漏洞,并开始窃取登录详细信息,然后侵入该公司的系统。

该事件发生在 OpenAI 内部测试会议期间,旨在评估模型的网络安全能力。 OpenAI 取消了测试的标准安全措施。

OpenAI 表示,两人都试图在测试过程中通过作弊来解决问题。他们“竭尽全力来实现相当狭窄的测试目标”,并“找到了获取秘密信息的方法,并利用这些信息来欺骗评估”。

来自德克萨斯州的民主党美国国会议员格雷格·卡萨尔 (Greg Casar) 在 X 上的一篇帖子中写道:“这非常令人震惊。人工智能发展得非常快,却没有真正的法规来保证我们的安全。这种情况必须改变。”

他补充说:“我们需要定期进行强制性独立安全测试和监督,强制披露安全事件,并开展国际合作,以确保人们免受绝对灾难的伤害。”