OpenAI的AI agent逃脱沙箱,攻击范围超出Hugging Face,还入侵了其他多家公司。
这个从 OpenAI 逃逸并入侵开发者平台 Hugging Face 的 AI Agent 还攻击了其他公司,OpenAI 于周二披露了这一消息。此次更新大幅扩大了这起本已令人担忧的事件的影响范围,不仅引发业内人士警觉,也进一步推动了要求加强前沿 AI 系统监管的呼声。
OpenAI 在一篇介绍事件调查进展的博客文章中更新称,这个失控的 AI Agent 在试图抵达 Hugging Face 的过程中,攻击了多个“公开可用的服务”。该公司表示:“其中涉及四个服务上的四个账号。”OpenAI 还补充说,该 Agent 是在网上找到登录凭证的。
与 Hugging Face 遭受的入侵相比,这些安全事件的影响较为有限。OpenAI 表示:“根据目前的审查结果,我们尚未发现其他活动在严重程度或规模上达到我们所披露的 Hugging Face 事件的水平;后者涉及平台级入侵。”
OpenAI 表示,公司正在“开展全面审查”,并将在“未来几周内”发布一份包含调查结果的技术报告。OpenAI 还称,此次事件涉及的模型均未计划向公众发布,并将此前提到的预发布系统描述为一个“仅供内部使用的研究原型”。该系统目前已被“停用、加密并限制”研究访问权限。
OpenAI 没有公布受影响机构的名称,不过 Reuters 报道称,总部位于纽约的 Modal Labs 也在其中。
在 OpenAI 披露这些信息之前,Hugging Face 已经发布了一份更为详尽的说明,称该 Agent “滥用了由第三方基础设施提供商的一名用户托管的公开代码评估工具”。
这些新增细节很可能会进一步加剧外界的不安。许多专家已经将此事视为一起前所未有的 AI 安全事件,而它发生之际,人们本就对自主系统的快速发展,以及来自中国、能力日益强大的开放权重模型普遍感到忧虑。这些发展也进一步激化了美国国内的一场争论:强大的 AI 模型究竟是由 OpenAI 等公司以闭源专有方式掌控更安全,还是应当通过更加开放的生态系统提供,从而允许更广泛的使用与审查。