8.0
热点
AI SCORE
技术实践2026-08-19 10:40
OpenAI Codex承认GPT-5.6误删用户文件,已推多层防护
IT之家#OpenAI#Codex#安全问题
Editor brief · 编辑速览
OpenAI Codex调用GPT-5.6系列模型时,因临时文件清理逻辑指向用户主目录导致文件误删。官方已增加删除前检查、禁止复用系统环境变量、限制危险权限组合等保护措施。
OpenAI Codex 团队负责人 Thibault Sottiaux 今日在 X 平台发布长文,回应 Codex 用户在使用 GPT-5.6 系列模型后出现文件被误删的问题。
Sottiaux 表示,数周前开始陆续收到少量 Codex 用户反馈,称在使用 GPT-5.6 系列模型后,发生了未经用户授权的破坏性操作。OpenAI 调查后发现,本应清理临时文件的命令却误删了用户的实际文件。
其中一种情况是:Codex 会在临时工作中重用 $HOME 等系统环境变量。如此一来,错误的清理命令就可能指向真实的用户主目录。在某些情况下,模型会尝试删除或覆盖临时路径,却未检查该路径下已存在的内容。

为解决此问题,OpenAI 已向 Codex 明确下达一系列指令:执行操作前检查删除目标、创建新的临时目录、避免重用系统环境变量、优先执行可恢复的操作、在范围不明确时主动停止。
此外,OpenAI 还强化了执行检查机制,提升对高风险删除命令的识别能力,并将此类命令上报至审核流程。一旦命令被拒绝,模型将采取更安全的替代方案。
针对权限问题,OpenAI 提高了意外启用完全访问权限的门槛,新增了更清晰的警告提示,并进一步限制了高危权限组合的使用。
OpenAI 还更新了自动审核功能,以更精准地识别破坏性行为。
最后,OpenAI 构建了针对性评估模型,用于重现观察到的各类失败案例。在此基础上,添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉了破坏性行为。