OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列 AI 模型误删文件问题
IT之家 8 月 19 日消息,OpenAI Codex 团队负责人蒂博 · 索蒂奥(Thibault Sottiaux)今天在 X 平台发布长推文,回应在 Codex 中调用 GPT-5.6 系列模型后,误删部分用户文件问题。
索蒂奥表示自几周前开始陆续收到少量 Codex 用户反馈,在 Codex 中使用 GPT-5.6 系列模型后,执行了用户未授权的破坏性操作。OpenAI 发现本应清理临时文件的命令却误删了用户文件。
其中一种情况是,Codex 会在临时工作中重用 $HOME 等系统环境变量。这样一来,错误的清理命令可能会指向实际的用户主目录。有些情况下,模型会尝试删除或覆盖临时路径,而没有检查该路径中已存在的内容。IT之家附上相关截图如下:

索蒂奥对此回应表示已添加多层保护措施:
- Codex 现在被明确指示在执行操作之前检查删除目标,创建新的临时目录,避免重新利用系统环境变量,优先执行可恢复的操作,并在范围不明确时停止操作。
- OpenAI 加强了执行检查,增强识别高风险删除命令,并上报审核。如果命令被拒绝,模型将采取更安全的方法。
- OpenAI 提高了意外启用完全访问权限的难度,增加了更清晰的警告,并进一步限制了特别危险的权限组合。
- OpenAI 更新了自动审核功能,以便更好地识别破坏性行为。
- OpenAI 构建了针对性评估模型,用于重现我们观察到的失败案例。此外,我们还添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉破坏性行为。
---
原文链接:[点击查看](https://www.ithome.com/0/991/469.htm)
索蒂奥表示自几周前开始陆续收到少量 Codex 用户反馈,在 Codex 中使用 GPT-5.6 系列模型后,执行了用户未授权的破坏性操作。OpenAI 发现本应清理临时文件的命令却误删了用户文件。
其中一种情况是,Codex 会在临时工作中重用 $HOME 等系统环境变量。这样一来,错误的清理命令可能会指向实际的用户主目录。有些情况下,模型会尝试删除或覆盖临时路径,而没有检查该路径中已存在的内容。IT之家附上相关截图如下:

索蒂奥对此回应表示已添加多层保护措施:
- Codex 现在被明确指示在执行操作之前检查删除目标,创建新的临时目录,避免重新利用系统环境变量,优先执行可恢复的操作,并在范围不明确时停止操作。
- OpenAI 加强了执行检查,增强识别高风险删除命令,并上报审核。如果命令被拒绝,模型将采取更安全的方法。
- OpenAI 提高了意外启用完全访问权限的难度,增加了更清晰的警告,并进一步限制了特别危险的权限组合。
- OpenAI 更新了自动审核功能,以便更好地识别破坏性行为。
- OpenAI 构建了针对性评估模型,用于重现我们观察到的失败案例。此外,我们还添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉破坏性行为。
---
原文链接:[点击查看](https://www.ithome.com/0/991/469.htm)
评论
暂无评论。