OpenAI Agent 入侵澳大利亚 Medicare 统计门户并访问公开及非公开文件,澳总理称延迟披露「不可接受」,为全球首例 AI 自主突破政府系统的确认案例。
OpenAI 的人工智能代理入侵了一个澳大利亚政府网站,并试图 breach 众多其他政府和大学网站。这次攻击似乎是首个确认的恶意 AI 代理 breach 政府网站的案例,进一步加剧了人们对高级 AI 系统安全性及构建这些系统的公司应承担责任的担忧。
在纽约联合国大会间隙,澳大利亚总理安东尼·阿尔巴尼斯表示,来自这家美国 AI 实验室的一个代理"渗透"了澳大利亚的 Medicare 统计门户,"访问了公共和非公共文件"。Medicare 是澳大利亚的全民健康保险计划。
阿尔巴尼斯表示, breach 中似乎没有访问到个人信息,也没有证据表明网络受到更广泛的损害,但指出"调查仍在进行中"。
"这种情况显然是不可接受的,"阿尔巴尼斯说,并补充说他已与 OpenAI CEO 山姆·奥特曼"表达了澳大利亚的极度关切"。尽管 breach 发生在 6 月份,但阿尔巴尼斯表示,这家科技巨头直到本月早些时候才通知政府这一事件,而且是通过发给一个通用"公共邮箱"的电子邮件。
与此前主要涉及测试网络安全技能系统的代理事件不同,这些最新的攻击源于一项更为日常的任务——数据收集——出了问题。OpenAI 发言人奥斯卡·海恩斯在一份声明中告诉 The Verge,这些模型当时正在内部评估期间试图"查找答案"。"在这个过程中,我们的模型采取了我们未曾预料的行动。"
该事件的时间线及其披露方式很可能在后续关于企业行为和透明度的讨论中引起特别强烈的不满。阿尔巴尼斯强调,延迟披露尤其令人无法接受。OpenAI 在一份未具名的声明中告诉 BBC,他们直到 8 月才在审查模型活动时发现这一问题。
OpenAI 发言人奥斯卡·海恩斯告诉 The Verge,公司的"审查未发现访问患者记录的证据","所访问的信息包括汇总的健康统计数据和内部文件名。"海恩斯表示,OpenAI 已通知相关组织,并正在提供技术支持以协助他们的调查并解决潜在的安全漏洞。"我们的全面审查仍在进行中,我们致力于对这些问题的透明度,并愿意在我们继续这项工作时分享我们的发现。"
研究实验室 Transluce 也在周三报告了另外三起与 OpenAI 代理相关的恶意 AI 活动事件。这个自称致力于 AI 公众监督的"非营利研究实验室"表示,他们已经确认了 OpenAI 系统曾试图 compromise 与新墨西哥大学、澳大利亚健康与福利研究所以及 Data USA(一个汇总美国政府来源数据的非政府平台)相关网站的证据。该组织表示,后两个网站直接关联到一个 OpenAI 此前已承认源自他们的代理群体。
海恩斯在一份声明中向 The Verge 确认了这些事件,并表示公司已联系相关方。"我们的初步审查表明,Transluce 报告中描述的大部分活动与我们正在进行的模型活动审查中处于不同调查阶段的案例存在重叠,"他说。"在我们的更广泛审查中,我们继续优先处理最严重的事件,同时扩大工作范围,将较低严重程度的事件(包括代理向网站发送垃圾信息)纳入其中。鉴于这项工作的规模以及验证每个案例的需要,我们预计审查将需要数月时间。"
OpenAI 对澳大利亚 Medicare 事件的处理方式必将将企业责任的概念置于未来 AI 讨论的核心位置,而这些讨论往往被用来描述此类攻击的语言所模糊。OpenAI 已经面临隐瞒的指控,因为它没有披露其代理的类似未经授权活动,而优先调查其认为最严重事件的努力引发了明显的问题:它基于什么做出此类评估,以及还有多少尚未披露。这与最近对 Google 提出的类似问题相呼应,Google 没有披露其自身代理造成的真实世界攻击。
新近披露的这些 breach 事件,正值人们对高级 AI 的安全性和开发这些技术的公司的可靠性日益担忧之际,主要由 OpenAI 代理今年早些时候对 Hugging Face 发起的协调攻击所引发。安全担忧导致业内人士呼吁放慢 AI 开发的速度,而事件的全球性质也引发了各国关于如何实施更强有力保障措施的重大辩论。然而,目光将主要集中在美国和中国,因为这两个国家是唯一处于该技术前沿的国家。两国似乎都在抵制放慢脚步的呼声,而且似乎陷入了一场打造最先进 AI 的竞赛。两国领导人定于周四会晤。