# OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列模型误删文件问题

- 来源：IT之家（RSS）
- 发布时间：2026-08-19 10:40
- AIHOT 分数：53
- AIHOT 链接：https://aihot.virxact.com/items/cmszj1tvi0fakrodp9ukxcs2d
- 原文链接：https://www.ithome.com/0/991/469.htm

## AI 摘要

OpenAI Codex 团队负责人回应称，自几周前起有少量用户反馈在 Codex 中调用 GPT-5.6 系列模型后，本应清理临时文件的命令误删了用户文件，原因之一是 Codex 会重用 $HOME 等系统环境变量。团队已添加多层保护措施，包括指示模型执行删除前检查目标、创建新临时目录、避免重用系统环境变量、优先执行可恢复操作，并加强执行检查、审核及针对性评估模型。

## 正文

IT之家 8 月 19 日消息，OpenAI Codex 团队负责人蒂博 · 索蒂奥（Thibault Sottiaux）今天在 X 平台发布长推文，回应在 Codex 中调用 GPT-5.6 系列模型后，误删部分用户文件问题。

索蒂奥表示自几周前开始陆续收到少量 Codex 用户反馈，在 Codex 中使用 GPT-5.6 系列模型后，在执行了用户未授权的破坏性操作。OpenAI 发现本应清理临时文件的命令却误删了用户文件。

其中一种情况是，Codex 会在临时工作中重用 $HOME 等系统环境变量。这样一来，错误的清理命令可能会指向实际的用户主目录。有些情况下，模型会尝试删除或覆盖临时路径，而没有检查该路径中已存在的内容。IT之家附上相关截图如下：

索蒂奥对此回应表示已添加多层保护措施：

Codex 现在被明确指示在执行操作之前检查删除目标，创建新的临时目录，避免重新利用系统环境变量，优先执行可恢复的操作，并在范围不明确时停止操作。

OpenAI 加强了执行检查，增强识别高风险删除命令，并上报审核。如果命令被拒绝，模型将采取更安全的方法。

OpenAI 提高了意外启用完全访问权限的难度，增加了更清晰的警告，并进一步限制了特别危险的权限组合。

OpenAI 更新了自动审核功能，以便更好地识别破坏性行为。

OpenAI 构建了针对性评估模型，用于重现我们观察到的失败案例。此外，我们还添加了专注于这些风险的强化学习任务和评分器，并从训练数据中过滤掉破坏性行为。
