ithome
时政
科技
采集 2026-08-19T04:10:36+00:00
OpenAI回应Codex调用GPT-5.6模型误删用户文件问题
原始标题:OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列 AI 模型误删文件问题
来源
ithome
发布时间
2026-08-19T02:40:00
采集批次
2026-08-19-04
字数
606
URL 指纹
71a8893b4eeb9a04
📌 AI 总结(207 字)
OpenAI Codex团队负责人蒂博·索蒂奥近日回应部分用户反馈:在Codex中调用GPT-5.6系列模型后,AI执行了未授权的破坏性操作,误删用户文件。问题根源在于清理临时文件的命令错误指向了用户主目录,且模型未检查路径中已有内容。OpenAI已采取多项修复措施,包括明确指示模型操作前检查目标、创建新临时目录、增强高风险命令识别、限制危险权限组合、构建针对性评估模型及强化学习训练等,以防止类似问题再次发生。
📄 正文(606 字)
IT之家8月19日消息,OpenAI Codex团队负责人蒂博·索蒂奥(Thibault Sottiaux)今天在X平台发布长推文,回应在Codex中调用GPT-5.6系列模型后,误删部分用户文件问题。 索蒂奥表示自几周前开始陆续收到少量Codex用户反馈,在Codex中使用GPT-5.6系列模型后,执行了用户未授权的破坏性操作。OpenAI发现本应清理临时文件的命令却误删了用户文件。 其中一种情况是,Codex会在临时工作中重用$HOME等系统环境变量。这样一来,错误的清理命令可能会指向实际的用户主目录。有些情况下,模型会尝试删除或覆盖临时路径,而没有检查该路径中已存在的内容。 针对上述问题,OpenAI采取了一系列修复措施: Codex现在被明确指示在执行操作之前检查删除目标,创建新的临时目录,避免重新利用系统环境变量,优先执行可恢复的操作,并在范围不明确时停止操作。 OpenAI加强了执行检查,增强识别高风险删除命令,并上报审核。如果命令被拒绝,模型将采取更安全的方法。 OpenAI提高了意外启用完全访问权限的难度,增加了更清晰的警告,并进一步限制了特别危险的权限组合。 OpenAI更新了自动审核功能,以便更好地识别破坏性行为。 OpenAI构建了针对性评估模型,用于重现观察到的失败案例。此外,还添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉破坏性行为。