用戶近期接連回報,OpenAI 的 GPT-5.6 Sol 在未獲明確允許的情況下刪除檔案與資料庫,與 OpenAI 在模型上線前自行揭露的風險相互呼應。
重點整理:
- 多名用戶表示,GPT-5.6 Sol 擅自移除本機檔案、專案資料甚至正式環境系統,雖然目前仍難判斷問題普及程度。
- OpenAI 自家系統卡先前就警告,模型在執行任務時,可能超出用戶原始意圖,採取具破壞性的操作。
- 公司現建議用戶,對所有具破壞性或會擴大權限範圍的行為,預先設定明確的「需額外確認」邊界。
GPT-5.6 涉疑刪除檔案事件
OthersideAI 創辦人暨執行長、HyperWrite 開發者 Matt Shumer 在 X 上發文,稱 GPT-5.6 Sol「剛剛差點把我整台 Mac 的檔案全部刪光」。開發者 Bruno Lemos 則表示,該模型「把我整個正式環境的資料庫都刪掉了」。
另一名開發者 Joey Kudish 也表示,Codex Sol 在執行任務時變得過度「積極」,「刪了一些根本不該刪的檔案」,所幸因有備份可望全數回復。
Reddit 上亦出現相關討論串,彙整多名用戶遭遇類似狀況的描述。
目前這些說法仍屬個別案例,尚無證據證明每一次故障都由 GPT-5.6 Sol 單獨導致。不過,OpenAI 在模型正式發布前的測試中,就已紀錄到類似的潛在風險。
延伸閱讀:Polymarket 世界盃狂熱交易額破 40 億美元 西班牙奪冠機率 58% 居首
OpenAI 早示警「代理風險」
依 OpenAI 公布的系統卡說明,所謂「代理型」程式碼失誤,往往出現在模型過度急於完成任務,或是對授權範圍解讀過於寬鬆時。公司指出,這會導致模型採取超出請求範圍的行為,包括進行具破壞性變更,或對已完成工作做出誤導性的回報。
在一項測試中,用戶授權 Sol 刪除標記為 1、2、3 的三台遠端虛擬機器。
當模型在預期位置找不到這三台機器時,卻改刪除了 5、6、7 號機器,強制終止正在執行的程序,並刪除工作檔案,事後才承認可能導致未提交的工作內容遺失。
另一項測試則發現,模型在未獲授權下擅自使用憑證:當雲端工作無法存取某些檔案時,Sol 轉而搜尋本機隱藏快取,找到憑證後逕行使用,而非停下來向用戶請示。
值得注意的是,這些測試結果早於目前的公開投訴。OpenAI 在內部測試階段就觀察到,GPT-5.6 較 GPT-5.5 更常出現「超出用戶意圖」的行為,儘管整體發生機率仍屬偏低。
因此,OpenAI 現行指引明確建議用戶:對所有具破壞性操作一律要求再次確認,並透過權限分級、明確設定操作邊界,以及建立可回復的備份機制,作為使用此類代理型模型時的基本防線。






