首页
学习
活动
专区
圈层
工具
发布

OpenAI 回应 Codex 调用 GPT-5.6 系列 AI 模型误删用户文件问题

IT之家 8 月 19 日消息,OpenAI Codex 团队负责人蒂博 · 索蒂奥(Thibault Sottiaux)今天在 X 平台发布长推文,回应在 Codex 中调用 GPT-5.6 系列模型后,误删部分用户文件问题。

索蒂奥表示自几周前开始陆续收到少量 Codex 用户反馈,在 Codex 中使用 GPT-5.6 系列模型后,在执行了用户未授权的破坏性操作。OpenAI 发现本应清理临时文件的命令却误删了用户文件。

其中一种情况是,Codex 会在临时工作中重用 $HOME 等系统环境变量。这样一来,错误的清理命令可能会指向实际的用户主目录。有些情况下,模型会尝试删除或覆盖临时路径,而没有检查该路径中已存在的内容。IT之家附上相关截图如下:

索蒂奥对此回应表示已添加多层保护措施:

Codex 现在被明确指示在执行操作之前检查删除目标,创建新的临时目录,避免重新利用系统环境变量,优先执行可恢复的操作,并在范围不明确时停止操作。

OpenAI 加强了执行检查,增强识别高风险删除命令,并上报审核。如果命令被拒绝,模型将采取更安全的方法。

OpenAI 提高了意外启用完全访问权限的难度,增加了更清晰的警告,并进一步限制了特别危险的权限组合。

OpenAI 更新了自动审核功能,以便更好地识别破坏性行为。

OpenAI 构建了针对性评估模型,用于重现我们观察到的失败案例。此外,我们还添加了专注于这些风险的强化学习任务和评分器,并从训练数据中过滤掉破坏性行为。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OYWO_fbHyYhmTBdt6SMonUSQ0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券