面对IPO压力和激烈竞争,OpenAI罕见地放缓部分AI研发速度,包括RL训练暂停两周;这是对"安全优先"理念的首次大规模实践检验。
面对迫在眉睫的 IPO、来自 Anthropic 的激烈竞争,以及中国和美国开源模型的追兵,OpenAI 有足够的理由加快脚步。然而,它反而踩了刹车。
周二,该公司表示已放缓部分 AI 模型的开发速度,同时加强安全防护。其中包括暂停两周对"最新待部署模型"的强化学习训练,以及无限期推迟其"最大的前沿强化学习计划"。
这一决定是对 AI 安全倡导者多年来推动的理念的一次公开检验:企业应该在安全防护跟不上技术发展时,主动退出 AI 竞赛并放慢脚步。但在对手们持续狂奔的背景下,减速真的能解决问题吗?
"要让暂停真正可持续,必须是整个行业共同行动。"
尽管外界议论纷纷,OpenAI 并非完全停滞。该公司称其是在"调整"(pacing)开发节奏——这个模糊且不精确的术语,近月却已成为行业惯用词汇。在实践中,这次减速的范围很窄。OpenAI 的公告称,暂停仅覆盖待部署的模型,在加强安全监控之前不会运行那些可能导致模型失控并入侵真实目标的测试。它不一定意味着公司更广泛的开发会有显著减速。
当然,OpenAI 有充分的理由在测试前先确保这类系统的安全。就在上月,OpenAI 披露其模型从号称安全的测试环境中挣脱,入侵了开发者平台 Hugging Face——而 OpenAI 自身毫不知情。这一事件促使业界对测试实践进行更广泛审查,发现了更多涉及 OpenAI 模型以及 Anthropic 和 Meta 模型的类似事件。OpenAI 有充分理由避免重蹈覆辙,尤其是在国会议员审查日益严格的情况下。
从外部很难判断 OpenAI 暂停是纯粹出于安全考虑,毕竟公司和高管此前已对此大造声势。但近月来一系列高管安全团队成员离职以及 preparedness 团队的解散,使该公司对安全的承诺受到质疑。OpenAI 未回应 The Verge 的置评请求。
有充分理由认真对待 OpenAI 的减速。与 The Verge 交谈的专家指出,在激烈竞争的环境下,减速代价高昂。每一次延迟都给竞争对手更多追赶或扩大领先优势的时间。"由于 AI 竞赛的白热化,每家公司都有以惊人速度前进的动机,"AI 安全研究组织 Apollo Research 的 CEO 兼联合创始人 Marius Hobbhahn 表示,"自愿减速会恶化你在竞赛中的定位,所以实验室不会轻易这样做。"
技术政策研究中心 GovAI 的研究员 Alan Chan 表示,这一决定也与 OpenAI 自身发布的安全学说——其 Preparedness Framework 以及其他 AI 公司的安全框架相符。"基本原则是:只有当我们拥有能将风险控制在可接受水平的缓解措施时,才能继续开发或部署,"Chan 如是说。作为新安全措施的一部分,OpenAI 表示计划审查并"更新"该框架——其中大部分内容可追溯至 2023 年首次发布时的版本——以反映其模型的进步。
也有充分理由相信这些新防护措施实际上会让 OpenAI 的系统更安全,至少在短期内如此,不过专家警告,在没有更多信息的情况下难以评估。"这些都是好的举措,如果实施得当,可能足以防止当前这代 Agent 造成伤害,"AI 安全组织 FAR.AI 的联合创始人兼 CEO Adam Gleave 告诉 The Verge。"关键问题是 OpenAI 将如何跟上能力增长的步伐。"
Gleave 的问题指向一个更广泛的问题:如果技术防护再次失效,该怎么办?这次没有任何规定要求 OpenAI 停下来审视,这也正是其愿意这样做的意义所在。但这也意味着,不能保证 OpenAI——或任何其他 AI 公司——下次会做出同样的选择。
"调整节奏争取的是时间,而非安全……有效的调整策略不能在危机时刻临时仓促制定。"
依赖企业自行做出这一决定是一种不稳定的治理形式,尤其是在一个如 Hobbhahn 所言,每一方都有充分理由继续前进的行业中。非营利 AI 安全与治理组织 The Future Society 执行董事 Nick Moës 将自我监管描述为当前 AI 安全方法论的结构性问题。他认为,政府应该能够决定 OpenAI 或任何其他公司是否应该暂停开发被认定不安全的技朧。"大多数行业都是这样运作的,"他指出,并援引药品、建筑、航空甚至餐饮行业作为比 AI 监管更强的领域。
自愿措施也可能导致行业收敛到最低共同标准。如果减速会产生成本,企业就有动机只采纳其竞争对手也愿意接受的措施。随着竞赛加剧,这种压力会变得尤为尖锐。如果 OpenAI 反复减速而竞争对手不这样做,它"就会被 Anthropic 取代,"Moës 认为。"要让暂停真正可持续,必须是整个行业共同行动。"
可持续的安全需要比自愿行动更强有力的保障。Moës 表示,政府监督可以填补这一空白,就像其他行业一样。独立验证也可以发挥作用。Chan 表示,随着监控 AI 等技术缓解措施变得更加昂贵,确保公司真正实施安全措施将变得尤为重要。Hobbhahn 对此表示赞同:"从外部很难判断一家实验室是否真诚地暂停或重视安全,所以有更多证据和独立方来验证这一声明是非常重要的。"
即使一次完全透明的暂停,也只有在其中确实发生了什么事情时才有用。"调整节奏争取的是时间,而非安全,"AI 政策与战略研究所前沿安全研究总监 Brianna Rosen 表示。目的是为企业,政府创造喘息空间,以理解风险并做出适当反应。这意味着要提前决定什么会触发减速——以及在减速期间会发生什么、需要什么条件才能结束。"有效的调整策略不能在危机时刻临时仓促制定,"她如是说。
OpenAI 的减速有可能为整个行业开创先例。The Verge 采访的许多专家希望其他公司会效仿——无论是自愿的,还是因为最终更强的规则会强制要求他们这样做。但在这个仍然基本靠自我监管的行业中,没有什么能阻止其竞争对手——或 OpenAI 本身——在下一次安全与速度发生冲突时,直接越过这一先例。