OpenAIが、ChatGPTに新しいセキュリティ機能「ロックダウンモード(Lockdown Mode)」を追加しました。プロンプトインジェクション攻撃による機密データの外部流出を抑えるための任意設定で、有効にするとWebや外部サービスへ接続する機能の多くが制限されます。Free・Go・Plus・Proの個人向け各プランとBusinessアカウントに順次展開され、厳格な情報保護を求める利用者を主な対象としています。

「ロックダウンモード」とは

ロックダウンモードは、6月6日(現地時間)に提供が始まったChatGPT向けの追加的なセキュリティ機能です。もともとは2月に発表されていたもので、今回正式に使えるようになりました。

狙いはシンプルで、プロンプトインジェクション攻撃を受けたときに、機密データが外部へ持ち出されるリスクを下げることにあります。OpenAIはプロンプトインジェクションを「フロンティアの研究課題」と位置付け、複数の防御層を組み合わせて対策していると説明しています。ロックダウンモードは、その上にもう一枚重ねる追加の防御層という位置付けです。

プロンプトインジェクションという攻撃

プロンプトインジェクションは、Webページやアップロードしたファイルなどに第三者が悪意ある指示を仕込み、AIをだまして本来許可されていない動作をさせる攻撃手法です。たとえば、機密情報をこっそり外部へ送信させるといった被害が想定されます。

ロックダウンモードが守るのは、この「データを外部へ送り出す」段階です。攻撃者が用意したサーバーへ機密データが送信される経路を、ネットワークリクエストを制限することで遮断します。ただし注入そのものを止める機能ではありません。OpenAIもFAQで、データ流出のリスクを大幅に減らすことが目的であり、流出が起きないと保証するものではないと明記しています。

有効化すると制限される機能

安全性を高める代わりに、有効にするとChatGPTの一部機能が使えなくなったり、絞られたりします。

ライブのWebブラウジングはキャッシュ済みのコンテンツへのアクセスに限られ、検索結果が古くなる場合があります。応答内でのWeb画像の表示や取得もできません。高度な調査機能「Deep Research」と自律実行の「Agent Mode」は無効になり、「Canvas」で生成したコードのネットワークアクセスも承認できなくなります。データ分析のために外部ファイルを自動でダウンロードする動作も止まります。

一方で、コーディング支援の「Codex」のネットワークアクセスには影響しないとされています。普段使う機能が一通り絞られるため、利便性と引き換えになる点は押さえておきたいところです。

設定方法と想定ユーザー

個人ユーザーは、「設定」から「セキュリティ」、「高度なセキュリティ」と進み、「ロックダウンモード」のトグルで切り替えられます。有効にすると入力欄の上に状態が表示され、特定のチャットだけ一時的にオフにすることもできます。なお、ロックダウンモードと開発者モードは同時に使えず、片方をオンにするともう片方は自動的にオフになります。

OpenAIは、この機能がすべての人に必要なわけではないとしています。想定しているのは、機密性の高いデータを扱い、プロンプトインジェクションによる流出に対してより強い保護を求める個人や組織です。一般的な用途であれば通常のまま使い、扱う情報の機微さに応じて切り替えるのが現実的でしょう。

まとめ

ロックダウンモードは、Webブラウジングやエージェント系の便利な機能を一部手放す代わりに、プロンプトインジェクションによる機密データの外部流出リスクを抑える任意のオプションです。個人向けプランとBusinessアカウントへ順次提供され、Codexの動作には影響しません。AIの自律的な動きが広がるなかで、OpenAIがプロンプトインジェクションを継続的な課題ととらえ、利用者が自分のリスク許容度に合わせて防御の強さを選べるようにした一手だと言えそうです。

参考リンク

OpenAI公式発表: https://openai.com/index/introducing-lockdown-mode-and-elevated-risk-labels-in-chatgpt/

OpenAIヘルプセンター(Lockdown Mode): https://help.openai.com/en/articles/20001061-lockdown-mode