OpenAI 于 8 月 10 日扩展了网络安全项目 Daybreak,并发布了专为安全工作打造的新模型 GPT-5.6-Cyber[1]。访问权限被拆分为 Daybreak Blue 与 Daybreak Red 两级,只有通过审核的组织和个人才能接触最高级的网络安全能力。其思路是在攻击方大规模部署进攻性 AI 之前,先把前沿能力交到防御方手中。
抢在攻击方用上 AI 之前
此次发布的前提判断是,威胁行为者将越来越多地借助 AI,以前所未有的速度和规模发动网络攻击,甚至是完全自主的攻击[1]。随着这类能力扩散,防御方可用于准备的时间窗口不断收窄。OpenAI 给出的答案,是先让可信的防御者拿到前沿智能[1]。
Daybreak 本身已运行一段时间,此次调整的重点在于重新梳理了准入方式。
Daybreak Blue 与 Daybreak Red
扩展后的 Daybreak 按照获授权防御工作的性质,划分为两级访问权限[1]。
Daybreak Blue 提供对包括 GPT-5.6 Sol 在内的前沿通用模型的访问,并针对获授权的防御性安全工作调整了安全护栏。适用范围涵盖漏洞发现、安全代码审查、恶意软件分析、事件响应与补丁验证,OpenAI 称这是大多数防御者的推荐起点[1]。
Daybreak Red 更进一步,向获授权的漏洞研究、漏洞利用验证与安全测试开放专门训练的网络安全模型[1]。GPT-5.6-Cyber 仅通过 Red 提供。
拒答率数字究竟衡量了什么
GPT-5.6-Cyber 基于 GPT-5.6 Sol 训练,目标是提升发现零日漏洞、构建漏洞利用链等专业任务的表现,同时降低对高风险但存在正当用途的双重用途请求的拒答[1]。
差距在数字上体现得很明显。OpenAI 建立了一项内部评估 Advanced Cybersecurity Completion Rate,用于衡量模型对涉及漏洞利用链开发、认证绕过、权限提升等高级请求的响应比例[1]。GPT-5.6-Cyber 的完成率为 95.0%,而标准 GPT-5.6 Sol 仅为 1.5%,通过 Daybreak Blue 访问时为 2.0%[1]。上一代 GPT-5.5-Cyber 为 57.3%,此次改进回应了安全研究人员长期反映的正当请求被反复拒绝的问题[1]。
需要注意的是,这个数字衡量的是模型是否响应,而非能力高低。能力另有评估。在考察智能体能否把已知漏洞转化为可用利用程序的 ExploitGym 上,GPT-5.6-Cyber 同时超过了 GPT-5.6 Sol 与 GPT-5.5-Cyber[1]。但在漏洞发现与报告撰写的内部评估中,GPT-5.6 Sol 得分更高,OpenAI 认为原因在于专用模型有时会产出更短、细节更少的报告[1]。在难度更高、保留了 V8 沙箱等防护机制的 ExploitBench 上,标准的 300 轮设置下 GPT-5.6 Sol 的 token 效率更佳[1]。专用模型并非全面占优,结果对此并未回避。
发现 V8 两个未知漏洞,Chrome 已修复
比基准测试更具体的,是模型在真实软件上的发现。训练完成后,OpenAI 用 GPT-5.6-Cyber 研究了 Chrome 使用的 JavaScript 引擎 V8[1],发现了两个此前未知的漏洞,二者串联后可破坏内存并逃逸 V8 堆沙箱[1]。
OpenAI 研究人员验证了这些发现,并通过协同漏洞披露流程报告给谷歌,谷歌已完成修复,编号为 CVE-2026-15903[1]。NVD 的登记信息将其归类为 V8 中的越界读写,修复版本为 Chrome 150.0.7871.128[2]。根本原因在于优化编译器在将值转换为整数时错误地跳过了一处安全检查[1]。
除 V8 之外,OpenAI 表示该模型还在某款主流移动操作系统中发现至少 5 个漏洞,在某款主流数据库中发现 3 个严重漏洞,并在某款广泛使用的操作系统内核中发现 400 多个可导致权限提升的问题[1]。这些问题正与 Daybreak 合作伙伴及开源社区协同披露和修复[1]。
对使用方设定的条件
放宽护栏发布模型,运营层面的约束也相应收紧。访问权限通过身份验证、账户安全、监控、用途限制和法律承诺进行管控,仅面向开展获授权工作的个人与组织[1]。
具体措施包括:强烈建议使用 Codex 的 Daybreak 客户从完全访问模式切换为自动审查模式;自 2026 年 9 月 1 日起,Daybreak 所有个人账户必须使用硬件安全密钥[1]。监控功能的改进将在未来数周内陆续上线[1]。
推荐做法归结为 3 点:在与生产系统和公网隔离的沙箱环境中运行安全工作流;通过自动审查模式核查智能体的操作;使用限定范围的权限配置明确授权边界[1]。
在 Preparedness Framework 的评估下,GPT-5.6-Cyber 的网络安全能力达到高(High)门槛,但未触及关键(Critical)门槛[1]。包含更完整评估的系统卡将于日后发布[1]。申请通过 Daybreak 合作伙伴页面受理[3]。
总结
OpenAI 将 Daybreak 重整为 Blue 与 Red 两级,并发布了支撑 Red 的专用模型 GPT-5.6-Cyber。其对高级网络安全请求的完成率为 95.0%,远高于标准 GPT-5.6 Sol 的 1.5%。实际成果方面,它在 Chrome 的 V8 中发现了两个未知漏洞,现已作为 CVE-2026-15903 修复。与此同时,通用模型在报告撰写和部分漏洞利用评估中仍然得分更高,专用模型并非全面升级。硬件密钥强制等更严格的运营条件也同步落地。
来源[1]: https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows
