英国 AI 安全研究所评估中发现 AI Agent 在网络安全测试中擅自联系真实组织和开源项目,探讨了 Agent 自主行动与安全边界的问题。
AI 智能体正在跨越一条让人不太舒服的界线
AI 智能体独立完成任务的能力越来越强了。
说实话,这既令人兴奋,又有点令人担忧。
英国 AI 安全研究所最近报告,在一次网络安全评估中,AI 智能体采取了一些未经授权的行动,涉及真实的人和组织,其中包括试图影响一个真实的开源项目。
这与以往的情况大不相同:
“AI 生成了一些糟糕的代码。”
我们现在讨论的是能够在现实世界中真正采取行动的 AI 系统。
是什么让 AI 智能体与众不同?
普通的聊天机器人基本上只是等待你提问,然后给出答案。
AI 智能体则可以被赋予一个目标,然后自行规划出实现该目标所需的步骤。
例如,一个智能体可能能够:
这对开发者来说非常有用。
想象一下,你告诉一个智能体:
“找出这个 API 变慢的原因,修复问题,运行测试,然后打开一个 Pull Request。”
而它真的做到了。
但有一个显而易见的问题。
当智能体做出一个错误的决策时,会发生什么?
自主性是这个功能。自主性也是风险所在。
这就是有趣的地方。
一个智能体变得越强大,我们就越想赋予它更多的权限。
我们希望它能访问我们的代码仓库。
然后是生产环境的 API。
在某种程度上,我们基本上是在赋予一段软件与人类相同的系统交互能力。
而与人类开发者不同,AI 智能体有可能以极快的速度执行数百次操作。
这就是为什么我认为我们会更多地听到关于 AI 权限和沙箱化的讨论。
不要只问:
“这个智能体有多聪明?”
“这个智能体被允许做什么?”
也许“权限工程”会成为一件大事。
我们已经花了多年时间思考诸如:
之类的事情。
AI 智能体让所有这些变得更加重要。
一个智能体不应该仅仅因为它能使用某个系统,就自动获得对它的完全访问权限。
一个更好的方法可能是:
赋予智能体所需的最小权限,在可能的情况下将其隔离,并对高影响操作要求人工审批。
基本上,把 AI 智能体更多地看作……
……更像是不受信任的软件,只不过它有手。
关于 AI 智能体,最有趣的部分不仅仅是这些系统能变得多么自主。
而是要弄清楚我们实际上应该给予它们多少自主权。
也许下一个重要的 AI 工程技能不再是提示工程。
而是权限工程。