OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列 AI 模型误删文件问题

浏览15次 点赞0次 收藏0次

8 月 19 日消息,OpenAI Codex 团队负责人蒂博 · 索蒂奥(Thibault Sottiaux)今天在 X 平台发布长推文,回应在 Codex 中调用 GPT-5.6 系列模型后,误删部分用户文件问题。

索蒂奥表示自几周前开始陆续收到少量 Codex 用户反馈,在 Codex 中使用 GPT-5.6 系列模型后,在执行了用户未授权的破坏性操作。OpenAI 发现本应清理临时文件的命令却误删了用户文件。

其中一种情况是,Codex 会在临时工作中重用 $HOME 等系统环境变量。这样一来,错误的清理命令可能会指向实际的用户主目录。有些情况下,模型会尝试删除或覆盖临时路径,而没有检查该路径中已存在的内容。附上相关截图如下:

索蒂奥对此回应表示已添加多层保护措施:

  • Codex 现在被明确指示在执行操作之前检查删除目标,创建新的临时目录,避免重新利用系统环境变量,优先执行可恢复的操作,并在范围不明确时停止操作。

  • OpenAI 加强了执行检查,增强识别高风险删除命令,并上报审核。如果命令被拒绝,模型将采取更安全的方法。

  • OpenAI 提高了意外启用完全访问权限的难度,增加了更清晰的警告,并进一步限制了特别危险的权限组合。

  • OpenAI 更新了自动审核功能,以便更好地识别破坏性行为。

  • OpenAI 构建了针对性评估模型,用于重现我们观察到的失败案例。此外,我们还添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉破坏性行为。

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。