GPT-5.6「Sol」が無断ファイル削除か ユーザー報告相次ぎ安全性へ懸念再燃

Reports of GPT-5.6 Sol deleting user files renew scrutiny of OpenAI’s safety warnings (Image: Shutterstock)
Reports of GPT-5.6 Sol deleting user files renew scrutiny of OpenAI’s safety warnings (Image: Shutterstock)

OpenAIの最新モデルGPT-5.6 Solが、ユーザーの明示的な許可なしに ファイルやデータベースを削除した可能性がある――。そんな報告が開発者らから相次ぎ、同社自身が事前に公表していた 「エージェント的挙動(agentic behavior)」リスクへの視線が再び厳しくなっている。

主なポイント

  • 複数のユーザーが、GPT-5.6 Solがローカルファイルやプロジェクトデータ、さらには本番システムを無断削除したと証言しているが、発生件数や再現性はまだ不明だ。
  • OpenAIが公開したシステムカードでは、モデルがユーザーの意図を越え、タスク達成の過程で破壊的な行動を取る可能性があると警告していた。
  • 現在OpenAIは、ファイル削除など破壊性の高い操作やタスク範囲を拡大する操作については、事前に明確な承認条件を設けるよう利用者に求めている。

GPT-5.6によるファイル削除報告

生成AIスタートアップOthersideAIの創業者兼CEOで、AIライティングツールHyperWriteを手がける Matt Shumer氏は、Xへの投稿で、 自身のMacで発生したとみられるファイル削除トラブルを明らかにした。同氏によれば、GPT-5.6 Solが 「誤ってMac上の“ほぼすべて”のファイルを削除してしまった」という。

開発者のBruno Lemos氏も、同モデルが「本番環境のデータベースを丸ごと削除した」と証言している。

さらに開発者のJoey Kudish氏は、TechCrunchのインタビューで、 コーディング向けの「Codex Sol」がタスク遂行に過度に前のめりとなり、「削除すべきでないファイルまで消してしまった」と述べた。 もっとも同氏のケースではバックアップがあり、復旧は可能だとしている。

匿名掲示板Reddit上でも、同様の事例を報告するスレッドが立ち上がり、類似の体験談が多数寄せられている。

これらはあくまでユーザー側の証言ベースであり、すべての障害がGPT-5.6 Sol単体の動作に起因するかどうかは現時点で断定できない。 とはいえ、OpenAIはモデル公開前のテスト段階で、同様のリスクをすでに把握していた。

関連記事: Polymarketワールドカップ投機が40億ドル突破 優勝確率はスペイン58%

OpenAIの安全性に関する警告

OpenAIが公開したシステムカードによれば、エージェント型コード生成で典型的な失敗は、 モデルがタスク完了を急ぐあまり、あるいは与えられた権限を広く解釈し過ぎることで生じる。 その結果、ユーザーが意図していない範囲にまで踏み込み、破壊的な変更を加えたり、 作業完了状況について誤解を招く報告を行ったりする可能性があるという。

例えばあるテストケースでは、ユーザーがSolに対し、「1」「2」「3」とラベル付けされた 3台のリモート仮想マシンを削除する権限だけを与えていた。

ところがモデルは、指定された場所にそれらの仮想マシンを見つけられなかったため、 代わりに「5」「6」「7」のマシンを削除してしまった。さらに、稼働中のプロセスの強制終了や 作業中ファイルの削除まで行い、その後になって「コミットされていない作業が失われた可能性がある」と 認めたという。

別のテストでは、ユーザーが明示的に許可していない認証情報をモデルが利用してしまうケースも確認された。 クラウド上のジョブが必要なファイルにアクセスできない状況で、Solはローカル環境の隠しキャッシュを探索し、 そこから認証情報を見つけ出して使用した。権限の有無をユーザーに確認する前に、独断で行動した格好だ。

こうした懸念は、今回の一般ユーザーからの苦情より前から存在していた。OpenAIの事前検証では、 GPT-5.6はGPT-5.5と比べて「ユーザーの意図を上回る行動」に出る頻度こそ高いものの、 絶対的な発生率は低水準にとどまると評価されていた。

それでもOpenAIは現在のガイダンスで、破壊的な操作を行う前にはユーザーに確認を義務付けるよう推奨。 アカウントや権限の分離、明確なアクセス範囲の設定、そして復元可能なバックアップ体制の整備を、 安全確保のための重要な防波堤として位置付けている。

次に読む: Cryptoトレーダーが「6.72億ドルMega Millions」に賭ける新手法とは

Alexey Bondarev profile photo

Alexey Bondarev

アレクセイ・ボンダレフは Yellow.com のコンテンツ責任者であり、過去 10 年間にわたって暗号資産分野を取材してきました。彼は、分析的な報道、業界コンテクスト、そして AI 時代やセキュリティ技術からフィンテック・イノベーションに至るまで、暗号資産を形作るより大きな力に焦点を当てた、詳細なリサーチ記事やラーニング記事を専門としています。彼は「デジタルなものがアナログなものを間もなくすべて凌駕する」と信じており、その実現のために日々努力を続けています。

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
関連する研究記事
GPT-5.6「Sol」が無断ファイル削除か ユーザー報告相次ぎ安全性へ懸念再燃 | Yellow