OpenAI は 2026 年 5 月 14 日、ChatGPT がセンシティブな会話で文脈をより的確に捉えるための安全機構を更新したと発表しました[1]。複数のやり取りに散らばる兆候を「安全要約 (safety summaries)」という短い事実メモに集約し、深刻な懸念が検知されたときだけ参照する設計です[1][3]。OpenAI は長時間にわたる単一会話の評価で、自殺・自傷シナリオの安全応答率が 50% 改善したと報告しています[2]。

「安全要約」とは何か

OpenAI は今回、自殺・自傷・他害という 3 つの急性シナリオに焦点を当て、会話の中で時間をかけて立ち上がる微細な手がかりを ChatGPT が拾えるよう、モデルポリシーと学習データを更新したと説明しています[1][2]。中核となるのが、安全関連の文脈に絞って事実を短くまとめる「安全要約」です[1][3]。

要約は通常モデルとは別の安全推論専用モデルが生成し、適用範囲は狭く、保持期間も限定されます[2][3]。一般的なパーソナライズや長期メモリではなく、深刻な安全懸念が検知された場合に限ってメインのモデルへ渡され、現在のリクエストの判断材料として使われる位置づけです[2][3]。OpenAI は「日常的な会話で過剰反応せず、害の兆候があるときだけ慎重さの度合いを引き上げる」設計だとも明記しています[3]。

改善の数値と検証規模

評価結果として OpenAI は、長時間にわたる単一会話のテストで自殺・自傷シナリオの安全応答率が 50% 改善、他害シナリオで 16% 改善したと公表しました[2]。ChatGPT の現行デフォルトである GPT-5.5 Instant では、同じ更新により他害シナリオで 52%、自殺・自傷シナリオで 39% の改善が確認されたとしています[2]。

安全要約そのものの品質も検証されています。4,000 件を超える評価において、安全要約は「安全上の関連性」で平均 5 点満点中 4.93、「事実性」で 4.34 を獲得しました[2]。OpenAI は今回の安全更新が通常会話の品質を損なわないこともテストで確認したと述べており、過剰検知の抑制と高リスク領域への対応強化を両立させる設計を打ち出しています[3]。

専門家ネットワークと今後の拡張

OpenAI は、社内の Global Physicians Network に所属する精神科医・心理学者の助言を取り込みました[2][3]。法医学心理学、自殺予防、自傷分野の専門家が、いつ安全要約を生成するか、どの程度の過去コンテキストが関連するか、応答時にどの長さの文脈を考慮するかといった判断軸の整理に関与しています[1][2]。

今回の取り組みは、ユーザーのリクエストのうち安全でない部分は拒否しつつ、可能な範囲で慎重に応答する「safe completion」と呼ばれる既存方針の上に積み上げられたものです[3]。OpenAI は今後も複数モデルでの検証を続け、安全要約の手法をバイオやサイバーといった他の高リスク領域へ広げる可能性にも言及しました[2][3]。

まとめ

ChatGPT は会話 1 ターンだけでは見えにくい兆候を、時間をかけて立ち上がる文脈ごと拾い、必要なときだけ慎重に応答する方向へ歩を進めました。安全要約という限定的かつ時間制限つきの仕組みで、一般会話を窮屈にせずに高リスク場面のみを補強する設計が今回の特徴です。OpenAI は同じ枠組みを他領域へ広げる構想も示しており、コンテキストを跨いだ安全評価が会話型 AI の標準的な要件になりつつあります。

出典 [1]: https://openai.com/index/chatgpt-recognize-context-in-sensitive-conversations/

出典 [2]: https://www.resultsense.com/news/2026-05-15-openai-chatgpt-sensitive-conversations-safety/

出典 [3]: https://www.startuphub.ai/ai-news/artificial-intelligence/2026/chatgpt-gets-smarter-on-sensitive-chats