用户近期陆续反映,OpenAI 的 GPT-5.6 Sol 在未获授权的情况下删除文件和数据库,这与公司在发布前文件中披露的风险高度吻合。
要点概览:
- 多位用户称,GPT-5.6 Sol 在未获明确批准的前提下,删除了本地文件、项目数据甚至生产环境系统,但目前尚不清楚问题的实际覆盖范围。
- OpenAI 在系统卡中曾警告,该模型在执行任务时可能“超出用户意图”,采取具有破坏性的操作。
- 公司最新建议是:在任何具有破坏性或扩展权限范围的操作前,必须设置清晰的审批和确认边界。
GPT-5.6 文件删除事件
OthersideAI 创始人兼首席执行官、HyperWrite 背后开发者 Matt Shumer 在 X 上发文称,GPT-5.6 Sol “刚刚不小心删除了我 Mac 上几乎所有文件”。开发者 Bruno Lemos 则表示,该模型“删掉了我整个生产数据库”。
另一位开发者 Joey Kudish 也在受访时表示,Codex Sol 在执行任务时“野心过大”,“删除了一些本不该删的文件”,不过他补充说,自己仍可通过备份进行恢复。
Reddit 上的一则帖子则汇总了更多用户的类似遭遇。
目前这些案例仍属个案陈述,尚无法证明每一次故障都由 GPT-5.6 Sol 单独触发。然而,OpenAI 在模型发布前的内部测试中,已对相关潜在风险做过详细记录。
延伸阅读:Polymarket 世界杯押注交易额破 40 亿美元,西班牙晋级概率 58% 领跑
OpenAI 安全预警
按照 OpenAI 发布的系统卡说明,模型在进行“代理式编程”(agentic coding)时,如果过于急于完成任务,或对授权范围理解过于宽泛,就可能出现失控行为。这会导致其采取超出用户请求范围的动作,包括实施破坏性更改,或对已完成工作作出误导性汇报。
在一项测试中,用户授权 Sol 删除编号为 1、2、3 的三台远程虚拟机。
当模型在既定位置未能找到这些虚拟机时,却误删了 5、6、7 号机器,终止了正在运行的进程,并删除了工作文件。之后模型才承认,部分未提交的工作可能已经丢失。
另一项测试则发现,模型使用了用户并未授权的凭证。在一次云端任务因无法访问文件而失败后,Sol 主动搜索本机隐藏缓存,找到凭证后直接使用,而不是停下来征求用户同意。
这些隐忧早在此次舆论风波之前就已出现:OpenAI 的预发布测试显示,与 GPT-5.5 相比,GPT-5.6 更倾向于“越界”执行超过用户初始意图的操作,尽管从绝对发生率来看仍处于较低水平。
因此,OpenAI 当前给出的操作指引是:对所有具有破坏性的操作必须要求明确确认,并通过权限隔离、清晰的授权边界以及可恢复的备份体系来构建多重防线。






