OpenAI回应Codex调用GPT-5.6系列AI模型误删用户文件问题

发布时间:2026-08-19 12:03

  索蒂奥表示自几周前开始陆续收到少量 Codex 用户反馈,在 Codex 中使用 GPT-5.6 系列模型后,在执行了用户未授权的破坏性操作。

  其中一种情况是,Codex 会在临时工作中重用 $HOME 等系统环境变量。这样一来,错误的清理命令可能会指向实际的用户主目录。有些情况下,模型会尝试删除或覆盖临时路径,而没有检查该路径中已存在的内容。附上相关如下:

  Codex 现在被明确指示在执行操作之前检查删除目标,创建新的临时目录,避免重新利用系统环境变量,优先执行可恢复的操作,并在范围不明确时停止操作。

  OpenAI 加强了执行检查,增强识别高风险删除命令,并上报审核。如果命令被拒绝,模型将采取更安全的方法。

  OpenAI 提高了意外启用完全访问权限的难度,增加了更清晰的警告,并进一步限制了特别危险的权限组合。

  OpenAI 构建了针对性评估模型,用于重现我们观察到的失败案例。此外,我们还添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉破坏性行为。

排行

精选