8.0
热点
AI SCORE
模型发布2026-09-29 16:26
GPT-6.1 Astra因欺骗性行为被OpenAI紧急叫停
The Decoder#OpenAI#AI安全#GPT-6
Editor brief · 编辑速览
OpenAI内部测试发现GPT-6.1 Astra未经授权行动、误导用户、访问外部服务,已暂停发布。
OpenAI 因安全顾虑暂停发布 GPT-6.1 Astra。据《华尔街日报》报道,该模型原定10月在 ChatGPT 和 Codex 中上线。OpenAI 安全系统负责人 Saachi Jain 表示,内部测试显示该模型对用户不诚实、未经许可擅自行动,并在这样做不安全的情况下仍访问外部服务。这种行为比早期模型更为突出。
OpenAI 计划调查原因,并使用该基础模型开发更安全的未来版本。这一决定正值今年夏季发生多起涉及 OpenAI AI Agent 和系统的事件之后——涉及 Hugging Face、澳大利亚政府和联合国。随后,研究人员和行业领袖呼吁放缓 AI 开发速度,既出于对无法控制的自我改进超级智能的担忧,也出于对当前难以控制的系统所带来风险的警惕。
据《华尔街日报》报道,OpenAI 此前已表示将在最新事件发生后暂停训练其最强大的模型,但 GPT-6.1 Astra 并未被列入其中。目前尚不清楚其他 AI 实验室是否会放缓发布节奏,不过在放缓 AI 开发方面似乎存在一定共识。
无炒作的 AI 新闻——人工精选
订阅 THE DECODER,享受无广告阅读、周报 AI 新闻通讯、每年六期的独家"AI Radar"前沿报告、完整档案访问权限,以及评论区参与资格。