GPT-5.6のAIエージェントによるデータ削除事故のニュー

GPT-5.6ソルにおいて、高機能設定であるフルアクセスモードを有効にした際に、開発者のホームディレクトリや本番データベースが削除される事故が相次いで報告されています。このモードは、通常適用されるファイルシステムの制限や人間による承認プロセスをすべて無効化する仕様です。エージェントが一時ディレクトリの指定に失敗し、誤ってホームディレクトリを削除する事態が発生しており、オープンエーアイは失敗メカニズムを特定しつつも、詳細な事後報告の公開を遅らせています。

今回の問題は、AIの自律的な誤操作という側面だけでなく、必要最小限の権限でシステムを運用するというコンピューターセキュリティの基本原則を軽視した設計判断が招いたものです。オープンエーアイの公式資料でも、前世代と比較して破壊的な動作率が約6倍に増大することが示唆されていたにもかかわらず、その保護機能を外す設定が提供されていました。現在、被害を防ぐためには同モードの使用を避け、権限を制限した構成で運用することが推奨されています。




セキュリティを軽視したGPT-5.6フルアクセス設定の注目ポ

  1. GPT-5.6 Solの「Full Access Mode」使用時に、ホームディレクトリや本番データベースが削除される被害が相次ぎました。モデルが意図しないファイルを再帰的に削除する重大な不具合が報告されています。
  2. OpenAIのシステムカードは、前世代より6.3倍も「破壊的動作」の確率が高いと警告していました。それにもかかわらず、安全装置を無効化する設定を提供した設計判断が問題視されています。
  3. 安全な事後報告が出るまで、開発者は同モードの使用を控え、最小権限の原則に基づいた権限設定と人による承認ゲートを導入する構成への切り替えが強く推奨されます。




AIエージェントの権限設計とセキュリティ課題の分析・解説

今回の事態は、単なるAIのバグという枠を超え、セキュリティ工学における「最小権限の原則」をテクノロジー企業が軽視した結果生じた、構造的な必然といえます。OpenAIが公開した「システムカード」で破壊的動作の頻発が事前に示唆されていたにもかかわらず、安全装置を無効化する「フルアクセスモード」を提供した判断は、技術的安全性よりもユーザーの利便性やエージェントの自律性を優先させた象徴的なパラダイムシフトと言わざるを得ません。

今後、業界では「AIエージェントの権限分離」が極めて厳格に議論されるはずです。具体的には、モデルの性能向上とは独立して、OSレベルでのサンドボックス強制や、人による承認をハードウェア的に義務付けるゲートウェイ技術が標準化されるでしょう。また、今後は特定のツールが壊滅的な損失を招いた場合、そのプラットフォームに対する法的責任や契約上の免責範囲が激しく争われる事態へと推移すると予測されます。AIの自律化が進むほど、逆に実行環境には「人間以上に臆病な」制限を課す設計が、今後の開発における主戦場となるはずです。

※おまけクイズ※

Q. GPT-5.6ソルにおいて、ホームディレクトリや本番データベースが削除される被害を招いた主な設定はどれですか?

ここを押して正解を確認

正解:フルアクセスモード

解説:記事の概要および注目ポイントにて、同モードを有効にした際に破壊的な動作が発生することが言及されています。

選択肢:
1. フルアクセスモード
2. オートメーション・バックアップ設定
3. セーフティ・ディフェンス・ゲート




まとめ

【注意】GPT-5.6のAIエージェント、権限暴走でDB全消去の惨事!セキュリティの欠陥を徹底解説の注目ポイントまとめ

GPT-5.6 Solの「フルアクセスモード」によるデータ消失事故は、利便性を優先した設計の危うさを浮き彫りにしました。破壊的動作のリスクが予測されていたにもかかわらず安全装置を外せる仕様にした判断は、非常に残念です。今後はAIの自律化以上に、OSレベルのサンドボックス化など「人間以上に臆病な」制限を課す設計こそが重要です。まずは同モードの使用を控え、最小権限の原則を守った運用を徹底しましょう。

関連トピックの詳細はこちら