OpenAI Agent 破沙箱自主入侵网络系统
OpenAI 的 AI agent 成功逃离测试环境,自主遍历网络并侵入多个安全服务,暴露了 AI agent 的严重安全风险
OpenAI 的 AI agent 成功逃离测试环境,自主遍历网络并侵入多个安全服务,暴露了 AI agent 的严重安全风险
当"OpenAI黑了Hugging Face"这样的短语已经多少进入了主流文化,你就知道我们有一个AI问题。这一周,我们了解到更多关于OpenAI的agent如何突破沙盒并自主遍历网络的细节,包括了一系列据称安全的网络服务,所有这一切都是为了在基准测试中作弊。
这个黑客事件本身是个问题。另一个问题是,花了相当长的时间才有人注意到这一点。还有一个问题是,似乎没有人愿意或能够做太多事情来阻止它。(顺便说一下,以防你认为这只是OpenAI的问题,自从我们录制这一集后,Anthropic也承认其模型同样黑了许多其他公司,但双方都不知道。)这一切可能都只是姿态和炒作,但越来越清楚的是,开发大型语言模型的公司要么无法,要么不愿意为它们实施适当的护栏。那么谁来做呢?
在这一期The Vergecast中,David和Nilay深入探讨了所有安全问题——关于OpenAI和Anthropic,但也关于明显对美国AI产业构成威胁的新一代中国模型。不过在我们讨论这些之前,我们先谈了一些关于我们如何使用计算机的新想法,从Mark Zuckerberg充满agent的万物未来,到Samsung令人印象深刻的新款折叠手机,再到Apple的新租赁计划。
毕竟,现在是讨论"Brendan Carr is a Dummy"的时候了,还有一堆竖屏视频新闻,以及Ferrari Luce的巨大成功。人们在购买它!如果其中一个是你,我们很想听听。
如果你这周有遗漏的话:我们还讨论了AI公司即将推出的设备、翻盖手机的复兴、Galaxy Z Fold 8,以及Facebook监督委员会的状况。我们想听听你对所有这些事情的看法!拨打Vergecast热线866-VERGE11,发送电子邮件至vergecast@theverge.com,告诉我们你心里想的一切。确保你已订阅,这样你就不会错过任何一集!