OpenAI 於 8 月 10 日擴充資安計畫 Daybreak,並發表專為安全工作打造的新模型 GPT-5.6-Cyber[1]。存取權限被劃分為 Daybreak Blue 與 Daybreak Red 兩個層級,只有通過審核的組織與個人才能接觸最進階的資安能力。背後的想法是,在攻擊方大規模投入攻擊型 AI 之前,先把前沿能力交到防禦方手上。
趕在攻擊方用上 AI 之前
這次發表的前提判斷是,威脅行為者將愈來愈頻繁地運用 AI,以前所未有的速度與規模發動網路攻擊,甚至是完全自主的攻擊[1]。隨著這類能力擴散,防禦方能夠準備的時間視窗持續縮小。OpenAI 的答案,就是先讓可信任的防禦者取得前沿智慧[1]。
Daybreak 本身已運作一段時間,這次調整的重點在於重新整理了進場的方式。
Daybreak Blue 與 Daybreak Red
擴充後的 Daybreak 依照獲授權防禦工作的性質,分為兩種存取層級[1]。
Daybreak Blue 提供包含 GPT-5.6 Sol 在內的前沿通用模型存取權,並針對獲授權的防禦性安全工作調整了安全防護。適用範圍涵蓋漏洞挖掘、安全程式碼審查、惡意軟體分析、事件應變與修補驗證,OpenAI 表示這是多數防禦者的建議起點[1]。
Daybreak Red 更進一步,向獲授權的漏洞研究、漏洞利用驗證與安全測試開放專門訓練的資安模型[1]。GPT-5.6-Cyber 僅透過 Red 提供。
拒答率數字究竟量的是什麼
GPT-5.6-Cyber 以 GPT-5.6 Sol 為基礎訓練,目標是提升挖掘零日漏洞、建構漏洞利用鏈等專業任務的表現,同時降低對高風險但具正當用途的雙重用途請求的拒答[1]。
差距在數字上相當明顯。OpenAI 建立了一項內部評估 Advanced Cybersecurity Completion Rate,用來衡量模型對涉及漏洞利用鏈開發、身分驗證繞過、權限提升等進階請求的回應比例[1]。GPT-5.6-Cyber 的完成率為 95.0%,標準的 GPT-5.6 Sol 僅 1.5%,透過 Daybreak Blue 存取時為 2.0%[1]。上一代 GPT-5.5-Cyber 為 57.3%,這次的改進回應了資安研究人員長期反映正當請求屢遭拒絕的問題[1]。
要留意的是,這個數字量的是模型會不會回應,而非能力高低。能力另有評估。在檢驗代理程式能否把已知漏洞做成可用利用程式的 ExploitGym 上,GPT-5.6-Cyber 同時勝過 GPT-5.6 Sol 與 GPT-5.5-Cyber[1]。不過在漏洞挖掘與報告撰寫的內部評估中,GPT-5.6 Sol 分數更高,OpenAI 認為原因在於專用模型有時會產出較短、細節較少的報告[1]。在難度更高、保留 V8 沙箱等防護機制的 ExploitBench 上,標準的 300 回合設定下 GPT-5.6 Sol 的 token 效率更好[1]。專用模型並非全面領先,結果也照實呈現。
找出 V8 兩個未知漏洞,Chrome 已修補
比基準測試更具體的,是模型在實際軟體上的發現。訓練完成後,OpenAI 以 GPT-5.6-Cyber 研究 Chrome 所使用的 JavaScript 引擎 V8[1],找出兩個先前未知的漏洞,兩者串接後可破壞記憶體並逃脫 V8 的堆積沙箱[1]。
OpenAI 研究人員驗證這些發現後,依協同漏洞揭露流程通報 Google,Google 已完成修補,編號為 CVE-2026-15903[1]。NVD 的登錄資訊將其歸類為 V8 的越界讀寫,修正版本為 Chrome 150.0.7871.128[2]。根本原因在於最佳化編譯器將數值轉換為整數時,錯誤地略過了一道安全檢查[1]。
除了 V8,OpenAI 表示該模型還在某款主流行動作業系統中找出至少 5 個漏洞、在某款主流資料庫中找出 3 個嚴重漏洞,並在某款廣泛使用的作業系統核心中找出 400 個以上可導致權限提升的問題[1]。這些問題正與 Daybreak 夥伴及開源社群協同揭露與修補[1]。
對使用方設下的條件
放寬防護後釋出模型,營運面的約束也跟著收緊。存取權限透過身分驗證、帳號安全、監控、用途限制與法律聲明來管控,僅開放給執行獲授權工作的個人與組織[1]。
具體措施包括:強烈建議使用 Codex 的 Daybreak 客戶,從完全存取模式切換為自動審查模式;自 2026 年 9 月 1 日起,Daybreak 所有個人帳號都必須使用硬體安全金鑰[1]。監控功能的改進也將在未來數週陸續推出[1]。
建議做法可歸納為 3 點:在與正式環境和公開網路隔離的沙箱中執行安全工作流程;透過自動審查模式檢視代理程式的操作;以限定範圍的權限設定明確授權邊界[1]。
依 Preparedness Framework 的評估,GPT-5.6-Cyber 的資安能力達到高(High)門檻,但未觸及關鍵(Critical)門檻[1]。內容更完整的系統卡預計日後公布[1]。申請則透過 Daybreak 夥伴頁面受理[3]。
總結
OpenAI 把 Daybreak 重整為 Blue 與 Red 兩個層級,並發表支撐 Red 的專用模型 GPT-5.6-Cyber。它對進階資安請求的完成率為 95.0%,遠高於標準 GPT-5.6 Sol 的 1.5%。實際成果方面,它在 Chrome 的 V8 中找出兩個未知漏洞,現已以 CVE-2026-15903 修補完成。同時,通用模型在報告撰寫與部分漏洞利用評估上仍然分數較高,專用模型並非全面升級。硬體金鑰強制等更嚴格的營運條件也同步上路。
來源[1]: https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows
