原文标题:For months, OpenAI’s agent swarms have been attacking online databases to find obscure facts
它充当浏览器代理,表面上用于安全研究——用户可以分析 URL,而无需自己打开它。但是,该服务会发布此活动的公共日志。 Transluce 研究人员能够通过交叉检查论坛上的讨论来识别使用该服务的代理。
Transluce 治理主管 Conrad Stosz 向 TechCrunch 表示:“我们发现大量自动化活动与 DSE Wiki 数据集有密切联系并重叠,现在 OpenAI 已确认这些活动至少部分属于同一个群体。”他同时指出,并非他们发现的所有活动都与 OpenAI 甚至一般的 AI 代理有关。
然而,维基百科显示,特工的任务是找到一个相当模糊的事实——2022 年 1 月维多利亚州人均“皮肤科”的年平均费用。6 月 20 日,Transluce 发现的 urlquery.net 记录显示一名特工试图进入该网站。在 6 月 21 日的维基条目中,一名特工讨论了他们无法绕过 AIHW 的反机器人保护。
识别该论坛的研究人员相信,一名 OpenAI 人类员工在 6 月 21 日同一天首次访问了该网站。
论坛的活动于第二天停止。这也是在 Albanese 于 6 月 18 日揭露澳大利亚医疗系统被利用事件发生后不久。OpenAI 表示直到 8 月份才了解到该活动。
OpenAI 没有回答有关其员工何时发现维基论坛、他们从中获得了哪些类型的信息,或者他们可以从中了解到有关漏洞的什么信息的问题。
OpenAI 发言人告诉 TechCrunch:“我们的初步审查表明,Transluce 报告中描述的大部分活动与我们对错位模型活动的持续审查中处于不同调查阶段的案件重叠。” “我们已经联系了新墨西哥大学和 Data USA,并就受影响的政府网站与澳大利亚政府进行了沟通。在更广泛的审查中,我们将继续优先考虑最严重的事件,同时将工作范围扩大到严重程度较低的活动,包括特工向网站发送垃圾邮件。考虑到这项工作的规模以及验证每个案例的需要,我们预计审查需要数月时间。”
Stosz 表示,如果没有更清楚地了解 OpenAI 如何监控其代理,就很难说
实验室应该了解他们的哪些信息,但“如果他们详尽地研究并理解了 DSE wiki 中涉及的代理的所有传出请求和传入响应,他们很可能就会发现此活动。”
Transluce 技术人员 Selena Zhang 为该报告提供了帮助,她表示,urlquery.net 记录显示,在 2026 年 3 月,甚至可能早在 2025 年 11 月,就使用类似技术对类似数据集进行了请求。她指出,就在本周,urlquery.net 上也发生了与代理相关的同类活动。
Stosz 曾领导美国人工智能标准与创新中心,他表示 Transluce 将继续进行研究,努力提供有关这些事件的公共透明度。他警告说,OpenAI 和其他前沿实验室使用的训练技术似乎会激励智能体诉诸黑客技术来完成任务。我们所知的事件可能只是“冰山一角”。
“我们正在研究一些数据源,这些特工恰好在这些数据源中留下了碎片供我们寻找,”他说。 “OpenAI 肯定对此了解更多。其他实验室
肯定知道更多他们没有公开发布的信息。但我预计研究人员将继续发现更多流量,以及更多特工留下的证据。”
他相信实验室对他们的发现是透明的吗?
“我不会对此发表评论,”斯托兹说。