Sam Altman改变立场,表示愿意放缓AI发展,源于OpenAI的安全事件引发的强烈担忧。
OpenAI CEO Sam Altman 表示,也许是时候为 AI 的发展“控制节奏”了,以便让全世界做好迎接它的准备。
“我们可能必须控制 AI 的发展速度,给社会留出足够的时间,使其能够适应并抵御这些新能力水平带来的冲击,”他在 Invest Like the Best 播客中告诉主持人 Patrick O’Shaughnessy。与此同时,还要“设法找到一种不会让任何人觉得这是监管俘获、也不会让人觉得前沿实验室之间存在合谋的做法”。
OpenAI 和 Anthropic 都公开支持了一份由前沿实验室员工发起的请愿书,呼吁美国政府“支持一项国际行动,开发有助于主动控制前沿自动化 AI 发展节奏的技术与治理工具”。
Altman 此前一直拒绝参与呼吁放缓 AI 发展的行动。对于 2023 年一封提出类似减速主张的公开信,他曾批评称,其中“几乎完全忽略了我们应该在哪里暂停所涉及的技术细节”。
显然,他对这一想法的态度已经有所软化。部分原因是此前发生的一起事件:OpenAI 的一个先进模型利用多个零日漏洞,成功突破安全计算环境,并入侵了在线模型数据库 Hugging Face。
在播客中,这位 OpenAI 联合创始人将其称为“一起极具科幻色彩的网络安全事件……这是第一起让我切身感受到强烈冲击的安全事件”。
OpenAI 的研究人员已经暂停了该模型的训练,同时研究如何确保其 sandbox 的安全。不过 Altman 表示,随着模型能力不断增强,为其开发“控制节奏”可能会成为安全部署的关键。
模型安全与 alignment 一直是 AI 领域关注的问题,但 Anthropic 能力强大的 Mythos 模型在今年早些时候问世后,原本停留在假设层面的问题已经变成了现实难题。
然而,这个行业存在信任问题,同时也面临颇具挑战的经济现实。这让主要参与者有动力以专家并不认同的方式夸大其系统的危险性——例如,对于 Anthropic 的 Fable 模型是否应该被短暂禁用,专家们就存在分歧。同样,当中国开发的大型 open-weight 模型 Kimi K3 发布时,OpenAI 战略未来负责人 Dean W. Ball 表示,它威胁到了前沿实验室的经济模式,使人们很难将这些实验室对安全问题的担忧与其经济利益区分开来。
“我认为,许多有关安全风险的讨论确实有充分依据;但其中也有很多人只是非常想集中权力——哪怕这种想法多少出于潜意识,”Altman 思索道。这番话读起来像是在影射他的竞争对手、签署了请愿书的 Anthropic CEO Dario Amodei。“我害怕这样一个世界:人们利用对 AI 真实存在的恐惧,宣称‘只有这一小群人可以掌握它,因为它太危险了,而且只有他们理解它。不过别担心,他们会替我们所有人做出正确决定。’我不相信这种说法。”
尽管如此,OpenAI 一直反对为 AI 模型制定政府规则的行动,转而倾向于由行业主导的方案:由 AI 实验室建立表面上独立的组织,评估模型的安全性,以及模型开发者采用的安全方案。无论是这种监管方式,还是任何放缓 AI 发展的行动,面临的挑战都是如何让行业内的各方达成一致——无论是美国彼此竞争的前沿实验室,还是来自中国的竞争对手。
本文已更新,加入了 OpenAI 和 Anthropic 对“Pacing the Frontier”请愿书的支持。