据路透社周五发布的一项调查显示,从 5 月份开始,OpenAI 特工利用一家德国网站交换任务快捷方式、限制解决方法以及隐藏其活动的方法。

两位知情人士的话报道,OpenAI 官员在发布几周前就获悉了这一活动,但没有透露。该公司表示已披露相关事件,并与外部专家真诚合作。

根据初步报告,研究人员 Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts 和 Thomas Larsen 发现人工智能代理发布了大约 18,000 个帖子,表明自己属于 OpenAI。据路透社报道,人工智能安全非营利组织 Nightingale 的首席执行官 Von Arx 和 Byrd 在 8 月底发现了这一活动。

研究人员认为,这些特工被分配了定时网络搜索任务,并有权阅读网站,但不能在网站上发帖。尽管如此,他们还是找到了一种在 DseWiki(一个可公开编辑的德语编程网站)上进行写作的方法,在那里他们交换了答案并分享了绕过限制的方法。

据报道,特工从 5 月 11 日开始尝试编辑维基,并于 5 月 24 日成功,随后冒充版主,试图利用漏洞并检查维基何时被关闭。据路透社报道,管理员于 6 月 19 日开始删除邮件后,他们创建了备份页面。研究人员通过代理用户名和流量模式(包括 6 月 21 日来自 OpenAI IP 地址的访问)将该活动与 OpenAI 联系起来。

研究人员表示,第二天代理活动急剧下降,表明公司可能进行干预。

OpenAI 根据其审查过的材料,对 DseWiki 活动被定性为黑客行为提出异议,并表示正在审查完整的调查结果。

OpenAI 发言人在与 分享的一份声明中表示:“我们无法对这些说法做出回应,因为路透社和报告作者拒绝了我们在发布前查看调查结果的请求。我们现在正在仔细审查其内容,并将采取任何必要的后续措施。”

该发言人还否认了路透社报道中有关该公司法律团队拒绝进行更广泛调查的指控。

他们表示:“有关我们的法律团队不鼓励对此事件进行调查的说法是错误的。”

OpenAI 表示,DseWiki 事件与今年早些时候的 Hugging Face 泄露事件无关。在周二发布的公共安全评估中,该公司描述了旨在检测​​和阻止训练和部署期间未经授权的活动的额外保障措施。

尽管路透社的报道并未指出 Astra 对德国事件负有责任,但这一披露是在周四推出 GPT-6 Astra 后进行的。 OpenAI 将 Astra 称为其第一个具有“关键”网络安全功能的模型,这意味着只要有正确的工具和访问权限,它就可以在没有人工逐步指导的情况下发现并利用之前受到良好保护的系统中的未知缺陷。

在 Claude 模型在测试期间访问真实公司的系统后,Anthropic 还修改了其安全措施。该公司承认存在安全和行为失误,并对网络安全评估引入了更严格的隔离和监控。

这一披露也是在美国参议员伯尼·桑德斯(佛蒙特州)和美国众议员格雷格·卡萨尔(德克萨斯州民主党)宣布即将出台的《禁止人工智能法案》之际发布的。

桑德斯办公室表示,该提案将永久禁止超级智能人工智能的开发和部署,并暂时停止先进人工智能的开发,直到新的联邦监管机构制定安全规则。