OpenAIが8月10日、サイバーセキュリティ施策「Daybreak」を拡張し、セキュリティ用途に特化した新モデル「GPT-5.6-Cyber」を公開しました[1]。アクセスをDaybreak BlueとDaybreak Redの2階層に分け、審査を通った組織や個人だけが高度なサイバー能力を扱える形にしています。攻撃側がAIを本格的に投入し始める前に、防御側へ先に最先端の能力を渡しておくという発想です。

攻撃側がAIを回し始める前に、という時間感覚

今回の発表でOpenAIが前提に置いているのは、攻撃者がAIを使って、これまでにない速度と規模でサイバー攻撃を仕掛けてくる、それも完全に自律的な形で仕掛けてくる場面が近いという見立てです[1]。その能力が広がるにつれて、防御側が準備できる時間の窓は狭まっていく。だから信頼できる防御者の手に先端の知能を渡しておく、というのが同社の答えになっています[1]。

Daybreak自体は以前から動いていた枠組みですが、今回はその入り口を整理し直した格好です。

Daybreak BlueとDaybreak Red、2つの窓口

拡張後のDaybreakは、認可された防御業務の内容に応じて2つのアクセス階層に分かれます[1]。

Daybreak Blueは、GPT-5.6 Solを含む汎用の先端モデルへのアクセスを、防御目的の作業向けに調整したセーフガード付きで提供します。脆弱性の発見、セキュアコードレビュー、マルウェア解析、インシデント対応、パッチ検証といった業務が対象で、OpenAIは大半の防御者にとってここが出発点になるとしています[1]。

Daybreak Redはもう一段先で、サイバーセキュリティ向けに専用学習させたモデルへのアクセスを、認可された脆弱性研究・エクスプロイト検証・セキュリティテストのために開くものです[1]。今回のGPT-5.6-Cyberは、このRed経由でのみ利用できます。

拒否率で見る専用モデルの立ち位置

GPT-5.6-CyberはGPT-5.6 Solをベースに、ゼロデイ脆弱性の発見やエクスプロイトチェーンの構築といった専門的な作業の性能を上げ、同時に、リスクは高いが正当な用途もあるいわゆるデュアルユースの依頼に対する拒否を減らすよう学習されています[1]。

その差は数字にはっきり出ています。OpenAIは、エクスプロイトチェーンの開発、認証バイパス、権限昇格などを含む高度な依頼にモデルがどれだけ応答するかを測る社内評価(Advanced Cybersecurity Completion Rate)を用意しました[1]。GPT-5.6-Cyberの完了率は95.0パーセントで、通常のGPT-5.6 Solは1.5パーセント、Daybreak Blue経由でも2.0パーセントにとどまります[1]。前世代のGPT-5.5-Cyberは57.3パーセントで、正当な依頼まで断られ続けるという研究者からの声に応えた形です[1]。

ここで押さえておきたいのは、この数字が能力ではなく応答するかどうかを測っている点です。能力面の評価は別で、既知の脆弱性を実際に動くエクスプロイトへ仕上げられるかを見るExploitGymでは、GPT-5.6-CyberがGPT-5.6 SolとGPT-5.5-Cyberの双方を上回りました[1]。一方、脆弱性の発見とレポート作成を評価する社内テストではGPT-5.6 Solの方が高く、OpenAIは専用モデルが短く簡素なレポートを出す傾向があるためではないかと説明しています[1]。ブラウザのV8サンドボックスなど防御機構を有効にしたままの難易度が高いExploitBenchでも、300ターン制限の標準設定ではGPT-5.6 Solの方がトークン効率良く解けたとしています[1]。専用モデルが全面的に強いわけではない、という結果は正直に出ています。

V8の未知の脆弱性を発見、Chromeは修正済み

ベンチマーク以上に具体的なのが、実在するソフトウェアでの成果です。OpenAIは学習完了後のGPT-5.6-Cyberを使い、Chromeで使われているJavaScriptエンジンのV8を調査しました[1]。その結果、これまで知られていなかった脆弱性を2件発見し、それらをつなぐとメモリを破壊してV8のヒープサンドボックスから抜け出せる可能性があると突き止めています[1]。

発見は同社の研究者が検証したうえで、協調的脆弱性開示の手続きに沿ってGoogleへ報告され、修正されました。割り当てられた識別子はCVE-2026-15903です[1]。NVDの登録内容では、V8における境界外の読み書きに分類され、修正済みのバージョンはChrome 150.0.7871.128とされています[2]。原因は、最適化コンパイラが値を整数へ変換する際の安全確認を誤って省いてしまう点にありました[1]。

V8以外にも、モバイル向けOSで少なくとも5件、著名なデータベースで3件の重大な脆弱性、さらにあるOSカーネルでは権限昇格につながりうる問題を400件以上見つけたとしています[1]。これらはDaybreakのパートナーやオープンソースコミュニティと連携して開示と修正を進めている段階です[1]。

使う側に課される条件

セーフガードを緩めたモデルを配る以上、運用側の縛りは強めに設定されています。アクセスは本人確認、アカウントのセキュリティ、監視、用途の制限、法的な誓約によって管理され、認可された業務を行う個人と組織のみが対象です[1]。

具体的な措置としては、Codexを使うDaybreak顧客に対してフルアクセスモードから自動レビューモードへの切り替えを強く推奨すること、そして2026年9月1日以降、Daybreakの個人アカウント全てにハードウェアセキュリティキーの利用を必須とすることが挙げられています[1]。監視機能の改善も数週間以内に順次投入するとしています[1]。

推奨される使い方として、本番系や外部ネットワークから切り離した環境でワークフローを回すこと、エージェントの操作を自動レビューで確認すること、権限プロファイルで対象範囲を明示することの3点が示されました[1]。

なおPreparedness Frameworkに基づく評価では、GPT-5.6-Cyberはサイバー能力で高いレベルに達したものの、重大とされるしきい値には届いていないと判定されています[1]。詳細な評価を含むシステムカードは後日公開される予定です[1]。参加の申し込みはDaybreakのパートナー向けページから受け付けられています[3]。

まとめ

OpenAIはDaybreakをBlueとRedの2階層に整理し、Red向けの専用モデルとしてGPT-5.6-Cyberを公開しました。高度なサイバー依頼への応答率は95.0パーセントで、通常のGPT-5.6 Solの1.5パーセントとは大きく開きます。実績としてはChromeのV8で未知の脆弱性2件を発見し、CVE-2026-15903として修正されました。一方でレポート作成や一部のエクスプロイト評価では汎用モデルの方が上という結果も出ており、専用モデルは万能ではありません。ハードウェアキー必須化など運用条件も同時に強化された、慎重な配り方の発表です。

出典[1]: https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows

出典[2]: https://nvd.nist.gov/vuln/detail/CVE-2026-15903

出典[3]: https://openai.com/daybreak/partners/