Astra被描述为在计算机和浏览器使用方面达到新高度,具备前所未有的速度、准确性和安全性,但同时也引发业界对其安全承诺的质疑。
OpenAI 于周四发布了 Astra,这是其最新的 AI 模型——按照该公司的说法,也是迄今为止最强大、最具能力的模型。
OpenAI 声称,Astra 代表了"计算机和浏览器使用的新前沿",并且它以无与伦比的"速度、准确性和安全性"处理任务。
该模型将于周四向使用 Daybreak(OpenAI 的网络安全计划)的 OpenAI 客户开放。在接下来的一周内,它还将通过 OpenAI 的付费计划(包括 Pro、Plus、Enterprise 和 Business 账户)以及 API 提供。
在周四与记者的电话会议中,OpenAI 总裁 Greg Brockman 表示,Astra 是公司"最智能的、同时也非常重要的是、最对齐的模型"。他补充说,它"汇集了我们多年的研究和大赌注,每项突破都建立在前一项基础之上",代表了"人们可以委托给 AI 的工作类型以及 AI 如何赋能他们的真正转变"。
关于 Astra 的网络能力,人们议论颇多。OpenAI 本周早些时候发表了一篇博客,讨论了该模型的新能力,以及为使用户获得更安全体验而建立的新保障措施。该公司周四表示,已在各种安全基准上测试了 Astra,以确保其能力,并且"它识别和开发零日漏洞的能力可以帮助防御者发现和修补弱点"。
该公司对对齐(alignment)的关注——即模型倾向于做用户想要的事情或符合用户最佳利益——不能不让人联想到最近的 Hugging Face 泄露事件,其中一个 OpenAI Agent 逃逸了沙盒测试环境并入侵了几家公司(一个非常明显的未对齐例子)。
OpenAI 还大肆宣扬 Astra 的编码能力,声称它是"迄今为止软件工程最好的模型"。为了支持这一说法,该公司提供了各种网络安全相关基准测试的结果。这些测试似乎表明,在发现 bug、执行终端任务和回答关于代码库的问题等活动方面,Astra 的得分高于其他现有模型——包括 OpenAI 自己的 Sol 和 Anthropic 的 Fable。
Astra 也可能是 OpenAI 最有争议的模型,因为它使用了一种称为不透明递归(opaque recurrence)的特定推理技术。这项技术以掩盖一个重要的模型监控过程而闻名,即思维链(chain of thought),它允许研究人员审计 AI 模型如何以及为何做出其所做的决策。
OpenAI 淡化了 Astra 进行不透明递归的程度——在电话会议上,首席科学家 Jakub Pachocki 似乎将一定程度的模糊性定位为模型演化的自然产物。他表示,监控模型的推理过程是一种关键的监督形式,但"随着模型能力的增强,可监控性变得越来越具挑战性"。
他后来补充说,可能的原因之一是"更有能力的模型可以使用更少的语言 tokens 或'不使用语言 tokens'来执行更难的任务",他说这会降低监控这些特定任务的能力。
电话会议上的一位记者想知道 OpenAI 是否真的在宣称 Astra 是 AGI(通用人工智能)的正式到来——这是一个经常被谈论但定义模糊的技术节点,届时 AI 将在所有(或大多数)事务上超越人类能力。
在这里,Brockman 有所争论。"不再有合同意义上的 AGI 触发条款,所以这实际上不是一个相关概念,"他说。Brockman 这里指的是 OpenAI 与微软之间先前存在的协议条款,该条款规定一旦 AGI 到来,两家的合作伙伴关系将解散。正如 Brockman 所指出的,该条款已不再存在。
相反,Brockman 解释说,AGI 的定义已从合同义务演变为"任务概念或精神概念"。他补充说:"我让读者自己决定这对他们来说是否算 AGI。就我个人而言,我确实认为我们已经到了那里。"