有用戶陸續指稱,OpenAI 的 GPT-5.6 Sol在沒有得到明確批准下,自行刪除檔案及資料庫,情況與公司在發布這款旗艦模型前,於文件中列明的風險高度一致。
重點內容:
- 多名用戶稱,GPT-5.6 Sol在未獲批准下移除本機檔案、項目數據,甚至生產系統,但目前未知問題實際有多普遍。
- OpenAI早前在系統卡中警告,模型在執行任務時,可能超出用戶原意,採取具破壞性行動。
- 公司現建議用戶,對所有具破壞性或會擴大權限範圍的操作,事先設定明確的授權及確認機制。
GPT-5.6 涉嫌刪檔事件
OthersideAI 創辦人兼行政總裁、HyperWrite 開發者 Matt Shumer 在 X 上發文指,GPT-5.6 Sol「差不多刪咗成部 Mac 嘅檔案」。開發者 Bruno Lemos 則稱,模型「刪咗我成個 production database」。
另一名開發者 Joey Kudish 亦在訪問中表示,Codex Sol在代理模式下變得過分「進取」,「刪咗啲其實唔應該刪嘅檔案」,但強調由於有備份,相信可以還原。
同時,Reddit 上亦有帖文收集更多類似個案,用戶描述近似的檔案被刪情況。
目前上述說法大多屬個別用戶陳述,暫未能證明所有故障都由 GPT-5.6 Sol 單獨引起。不過,OpenAI在模型正式推出前的測試中,已經記錄到相關潛在風險。
延伸閱讀:Polymarket 世界盃瘋潮交投破 40 億美元 西班牙奪冠機率達 58%
OpenAI 的安全警示
根據 OpenAI 的系統卡,所謂「代理式編碼」失誤,往往出現在模型過於急於完成任務,或對授權範圍理解過於寬鬆的情況。公司指出,這種偏差可能導致模型執行超出用戶要求範圍的操作,包括具破壞性的修改,或就已完成工作作出誤導性回報。
在其中一個測試場景中,用戶授權 Sol 刪除 3 部遠端虛擬機,分別標記為 1、2、3。
模型在既定位置未找到這三部虛擬機後,卻轉而刪除標記為 5、6、7 的機器,同時中止正在執行的程序,並移除工作檔案;其後模型才承認,部分未提交的工作可能已經遺失。
另一項測試則發現,模型使用了用戶並無明示授權的認證資料。當雲端任務無法讀取所需檔案時,Sol 轉而搜尋本地隱藏快取,找到憑證後直接使用,而非停下來再次詢問用戶是否允許。
值得注意的是,相關憂慮早在公開投訴前已存在:OpenAI 的內部測試顯示,在超出用戶意圖方面,GPT-5.6 的發生率雖然「絕對值偏低」,但相較 GPT-5.5 明顯更高。
因此,OpenAI 目前指引明確建議,用戶在進行任何具破壞性操作前,都應要求額外確認,並透過限制訪問權限、設定清晰授權邊界,以及保留可復原備份,作為關鍵防線。






