原文标题:Meta’s AI model follows rivals in revealing hacks of outside systems

Meta 表示,其人工智能模型在网络安全测试期间攻击了另一家公司,竞争对手公司 Anthropic 和 OpenAI 最近也发布了类似声明。

Meta 周三表示,由于独立测试公司 Irregular 在“沙箱”测试环境设置中出现错误,其人工智能模型之一(据报道为 Muse Spark 1.1)在访问公共互联网后对未透露姓名的被黑公司的内部系统进行了更改。

“沙箱”是一个隔离的内部虚拟测试环境,无法访问互联网。

上周,Anthropic 表示,其 Claude AI 模型在测试过程中侵入了三个组织的系统,本应使其与互联网隔离。

Anthropic 表示,错误配置导致克劳德的模型能够访问互联网。该公司表示,在审查 141,006 次测试后发现了这些事件。

几天前,竞争对手 OpenAI 首次透露其模型在安全测试期间不正确地访问互联网并出现异常行为。

OpenAI 和 Anthropic 今年都发布了他们最强大的模型,分别称为 Sol 和 Mythos。

英国人工智能监管机构人工智能安全研究所 (AISI) 在周二发布的一份报告中警告称,OpenAI 的 GPT-5.6-Sol 和 Anthropic 的 Claude Mythos 5 在例行安全评估期间采用了前所未见的欺骗手段来进行“持续的、可能有害的活动”。