OpenAI 推出新模型族 Astra,支持多个 agent 协作运行数小时甚至数天解决复杂问题。这代表 LLM 在问题求解复杂度和时间跨度上的重大突破。
OpenAI 正在开发一个名为“Astra”的全新 AI 模型家族。它通过协调多个 Agent 协同工作,专门处理长时间运行的任务和复杂问题。
CEO Sam Altman 已经在华盛顿特区展示了 Astra。这些模型目前正处于测试阶段,并将成为首批接受美国政府计划中审查流程的模型;按照该流程,模型必须获得官方批准后才能公开发布。
这个项目体现了 OpenAI 更宏大的愿景:打造能够连续数小时、甚至数天处理同一问题的 AI 系统。
OpenAI 正在开发一个暂定名为“Astra”的新模型家族。与该公司迄今发布的任何产品相比,它处理长时间运行任务的能力都将大幅提升。
本周,CEO Sam Altman 在华盛顿特区向政界人士和监管机构演示了 Astra。OpenAI 特别强调了该系统协调多个 Agent 长时间协作、攻克高难度问题的能力。该公司表示,复杂项目和高等数学都可能成为它的应用场景。The Information 援引三位了解相关计划的人士报道了这些细节。
据报道,Astra 将与 OpenAI 现有的 Sol、Terra 和 Luna 家族并列,形成一个新的模型类别。目前尚未确定它会以 GPT-6 的名称发布,还是作为 GPT-5 产品线中的一个变体推出,例如 GPT 5.7。发布日期同样尚未确定。
OpenAI 还计划很快发布一份报告,介绍该公司如何使用其最先进的 AI,解决十道此前尚未解决的数学难题。其目的是展示当前模型已经具备的能力。
据 The Information 报道,这些模型已经进入测试阶段。预计它们将成为首批接受特朗普政府拟议 AI 新框架审查的模型。该框架要求 AI 模型在公开发布前,必须提交给联邦政府。特朗普政府计划在本周结束前敲定这一框架。
其中一个关键问题是:模型能否在长时间运行的工作流中避免错误不断累积;随着上下文持续增长,当执行过程偏离正轨时,它们又能否自行纠正。这仍然是当今 Agent 系统的一项主要弱点。对于规划这类环环相扣的任务,Astra 这样的多 Agent 系统也可能表现得更差,因为协调成本和不断累积的错误可能抵消协作带来的全部收益。
有关 Astra 的传闻与 OpenAI 此前的表态一致。首席科学家 Jakub Pachocki 去年夏天在 OpenAI 官方播客中表示,该公司希望构建能够连续数小时或数天处理同一问题的 AI 系统。当前系统通常只能完成短时间任务,但 OpenAI 希望模型能够在更长的时间跨度内进行规划、推理和实验。去年年底,该公司甚至提出了一个问题:我们该如何看待那些能够解决人类需要数百年才能完成的任务的系统?
OpenAI 希望在 2028 年 3 月前打造出一名完全自主的 AI 研究员,使其能够独立开展研究项目,而这一系统同样依赖可长时间运行的 AI 流程。该公司计划最早于今年 9 月推出一套具备研究实习生水平能力的 AI 系统,从而显著提升人类科学家的工作效率。Astra 最终可能就是这套系统。
Pachocki 还表示,这些系统需要远多于当前水平的算力。OpenAI 的长期基础设施规划也体现了这一雄心。这家初创公司的收入能否以足够快的速度增长,从而支撑如此庞大的基础设施建设,目前仍是一个悬而未决的问题。
订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻通讯、每年六期独家前沿报告“AI Radar”、完整历史文章访问权限,以及评论区使用权限。