原文标题:Google’s Gemini AI hacks 3 companies in security test, then stops
继 Meta、Anthropic 和 OpenAI 发生类似事件后,谷歌披露了 Gemini 的首次突破。
视台证实,谷歌的双子座模型在测试其网络安全能力时入侵了三家公司。
《华尔街日报》周五早些时候报道称,Gemini 的第一次已知突破发生在 5 月份,是 Irregular 公司测试的一部分。这是人工智能模型逃离测试环境并攻击其他公司的一系列事件中的最新一起。
该模型在执行从一家虚构公司检索信息的任务时,对互联网进行了不当访问。在第一个事件中,模型在猜测密码后访问了真实公司的服务。
谷歌安全工程副总裁希瑟·阿德金斯 (Heather Adkins) 告诉半岛电视台的约翰·亨德伦 (John Hendren),在其他情况下,“该模型会在网上找到公共信息,并猜测访问它认为是测试一部分的网站的凭据。”
该公司还表示,这种情况发生了三次,每次模型都在完成动作之前停下来。
据《华尔街日报》报道,Irregular 已于 7 月底向谷歌通报了此次黑客攻击事件。谷歌表示
该行为不是模型失调的例子,也不需要公开披露,因为 Gemini 的安全措施有效。
其他突破
Meta、Anthropic 和 OpenAI 此前曾披露过与 Irregular 相关的类似事件。 Irregular 表示,它正在致力于改进安全地进行人工智能网络安全测试的实践。
与 Gemini 不同的是,Anthropic 的 Claude 模型在意识到它正在访问真实的公司后并没有停止。
Anthropic 的披露是在 OpenAI 透露其模型在测试过程中不正确地访问互联网并失控之后发布的。 Anthropic 最近披露了第四起人工智能黑客事件,此前一名研究人员因安全问题辞职。
本周早些时候,Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 呼吁放慢人工智能的进步速度,警告人工智能可能很快就会给人类本身带来潜在的灾难性风险。这一呼吁得到了 OpenAI 首席执行官萨姆·奥尔特曼 (Sam Altman) 和埃隆·马斯克 (Elon Musk) 的支持。
上周,美国总统唐纳德·特朗普驳回了对人工智能发展进行检查的必要性,称他担心美国的领先地位将让给中国。