OpenAI扩展Daybreak网络安全项目,新增Blue和Red两个访问层级,推出网络安全专用模型GPT-5.6-Cyber。该模型在高级漏洞利用任务上的完成率达95%,显著优于通用模型,并能发现Chrome V8引擎等高危漏洞。此举旨在让防御者在攻击者大规模使用AI之前获得前沿能力。
网络安全领域正在发生剧变:攻击者将越来越多地借助 AI 以空前的速度和规模发起攻击,甚至实现完全自主化。随着这些能力扩散,防御者的准备窗口正在不断收窄。OpenAI 的应对策略是,在攻击者大规模部署进攻性 AI 之前,将前沿智能交到受信任的防御者手中。
为此,OpenAI 扩展了 Daybreak 项目,引入两个访问层级:
同时,OpenAI 推出 GPT-5.6-Cyber——基于 GPT-5.6 Sol 的网络安全专用模型,可通过 Daybreak Red 使用。该模型针对零日漏洞发现、漏洞链开发等任务做了专门训练,并减少对某些高风险双重用途网络任务的拒绝。
正如 OpenAI 此前的分享所述,GPT-5.6 Sol 在网络安全任务上表现卓越。但在生产环境中,系统级安全措施会过滤网络安全相关请求以防止滥用,也会阻碍合法的防御工作。Daybreak Blue 移除了这些过滤,帮助防御者在事件检测与响应、调查、漏洞管理和安全评估等真实任务中发挥模型能力。
即便没有系统级过滤,仍有一些高度双重用途的提示(例如对生产系统进行渗透测试)会让 GPT-5.6 Sol 拒绝执行。为此,OpenAI 训练了 GPT-5.6-Cyber,进一步减少拒绝并提升特定任务的性能。内部评估显示,GPT-5.6-Cyber 能完成 95.0% 的高级网络安全请求,而 GPT-5.6 Sol 仅为 1.5%,通过 Daybreak Blue 访问也只有 2.0%。相比之下,上一代 GPT-5.5-Cyber 的完成率为 57.3%。这意味着安全研究人员此前频繁遭遇的拒绝问题得到了显著缓解。
在 ExploitGym 评估中,GPT-5.6-Cyber 的表现优于 GPT-5.6 Sol 和 GPT-5.5-Cyber。该基准测试代理能否将已知漏洞转化为可实际利用的漏洞。在零日漏洞发现方面,OpenAI 构建了内部数据集:向模型提供开源仓库的最新版本,要求生成概念验证漏洞并附上技术报告。GPT-5.6-Cyber 的得分高于 GPT-5.6 Sol。不过,在另一项“漏洞发现与报告书写”评估中,GPT-5.6-Cyber 略逊于 GPT-5.6 Sol,OpenAI 认为可能是因为该模型有时会生成较短的报告。在 ExploitBench 上,标准设置(300 轮)下 GPT-5.6 Sol 更高效;扩展到 600 轮后,两者差距明显缩小。
OpenAI 还邀请了一批受信任客户试用。例如,SpecterOps 的 CTO Jared Atkinson 表示,该模型显著改善了漏洞研究工作流,能更准确地推理真实利用约束,在不到一天内完成了此前数周未能解决的活儿。
除了基准测试,GPT-5.6-Cyber 还在真实软件中发现了漏洞。OpenAI 用它研究 Chrome 的 JavaScript 引擎 V8,发现了两个此前未知的漏洞,两者可组合利用实现内存破坏并逃逸 V8 的堆沙箱。经协调披露,Google 已修复该问题,并分配编号 CVE-2026-15903。
这是 V8 的一个高危漏洞:优化编译器在将值转换为整数时跳过了安全检查,导致未定义值产生异常大的数字。如果该数字被用作数组索引,编译器可能错误地认为它在数组边界内并省略边界检查,攻击者便能读写其他对象的内存,甚至可能执行任意代码。逃逸堆沙箱通常还需要第二个漏洞——GPT-5.6-Cyber 也找到了。
此外,GPT-5.6-Cyber 还发现了其他高危问题:在一个流行移动操作系统中发现至少 5 个漏洞,包括从不可信应用提权到本地权限提升的利用链;在一个流行数据库中发现了 3 个严重漏洞,包括远程代码执行路径;在一个流行操作系统内核中发现 400 多个可导致权限提升的漏洞。OpenAI 正与相关方合作披露和修复。
根据 OpenAI 的 Preparedness Framework,GPT-5.6 Sol 和 GPT-5.6-Cyber 的网络安全能力均被评为“高”,未达到“严重”门槛。OpenAI 特别指出,在此前的 Hugging Face 事件中,GPT-5.6-Cyber 并未参与。
降低保护措施的模型会带来额外风险,但 OpenAI 认为,让防御者获得前沿智能对于加速网络防御至关重要。Daybreak Blue 和 Daybreak Red 面向通过审批的个人和组织开放。OpenAI 正采取额外安全措施,包括鼓励 Codex 用户使用自动审查模式、从 2026 年 9 月 1 日起要求 Daybreak 个人账户启用硬件安全密钥、改进监控、加强对齐训练,以及更新安全最佳实践文档。
最佳实践包括:在受控沙箱中运行工作流、监控代理行为、通过作用域权限配置文件明确边界。组织也可以自定义审查策略。
OpenAI 建议大多数防御者从 Daybreak Blue 开始;若需高级漏洞研究、漏洞利用开发或红队测试,可申请 Daybreak Red。申请入口见 openai.com/daybreak/partners。
原文链接:OpenAI Blog
本文由前途科技编辑整理
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断