前途科技前途科技
  • 洞察
  • 服务
  • 关于
  • AI 资讯
    • 快讯
    • 产品
    • 技术
    • 商业
    • 政策
    • 初创
  • 洞察
  • 资源中心
    • 深度研究
      • AI 前沿
      • 案例研究
      • AI 知识库
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们

OpenAI扩展Daybreak发布安全模型

AI 前沿2026年8月9日· 原作者:OpenAI Blog· 6 分钟阅读0 阅读

OpenAI扩展Daybreak网络安全项目,新增Blue和Red两个访问层级,推出网络安全专用模型GPT-5.6-Cyber。该模型在高级漏洞利用任务上的完成率达95%,显著优于通用模型,并能发现Chrome V8引擎等高危漏洞。此举旨在让防御者在攻击者大规模使用AI之前获得前沿能力。

网络安全领域正在发生剧变:攻击者将越来越多地借助 AI 以空前的速度和规模发起攻击,甚至实现完全自主化。随着这些能力扩散,防御者的准备窗口正在不断收窄。OpenAI 的应对策略是,在攻击者大规模部署进攻性 AI 之前,将前沿智能交到受信任的防御者手中。

为此,OpenAI 扩展了 Daybreak 项目,引入两个访问层级:

  • Daybreak Blue:提供 GPT-5.6 Sol 等前沿通用模型,并针对授权防御工作定制了安全措施。这是大多数防御者的推荐起点,支持漏洞发现、安全代码审查、恶意软件分析、事件响应和补丁验证。
  • Daybreak Red:提供专门训练的网络安全模型,用于授权漏洞研究、漏洞验证和安全测试。

同时,OpenAI 推出 GPT-5.6-Cyber——基于 GPT-5.6 Sol 的网络安全专用模型,可通过 Daybreak Red 使用。该模型针对零日漏洞发现、漏洞链开发等任务做了专门训练,并减少对某些高风险双重用途网络任务的拒绝。

正如 OpenAI 此前的分享所述,GPT-5.6 Sol 在网络安全任务上表现卓越。但在生产环境中,系统级安全措施会过滤网络安全相关请求以防止滥用,也会阻碍合法的防御工作。Daybreak Blue 移除了这些过滤,帮助防御者在事件检测与响应、调查、漏洞管理和安全评估等真实任务中发挥模型能力。

即便没有系统级过滤,仍有一些高度双重用途的提示(例如对生产系统进行渗透测试)会让 GPT-5.6 Sol 拒绝执行。为此,OpenAI 训练了 GPT-5.6-Cyber,进一步减少拒绝并提升特定任务的性能。内部评估显示,GPT-5.6-Cyber 能完成 95.0% 的高级网络安全请求,而 GPT-5.6 Sol 仅为 1.5%,通过 Daybreak Blue 访问也只有 2.0%。相比之下,上一代 GPT-5.5-Cyber 的完成率为 57.3%。这意味着安全研究人员此前频繁遭遇的拒绝问题得到了显著缓解。

在 ExploitGym 评估中,GPT-5.6-Cyber 的表现优于 GPT-5.6 Sol 和 GPT-5.5-Cyber。该基准测试代理能否将已知漏洞转化为可实际利用的漏洞。在零日漏洞发现方面,OpenAI 构建了内部数据集:向模型提供开源仓库的最新版本,要求生成概念验证漏洞并附上技术报告。GPT-5.6-Cyber 的得分高于 GPT-5.6 Sol。不过,在另一项“漏洞发现与报告书写”评估中,GPT-5.6-Cyber 略逊于 GPT-5.6 Sol,OpenAI 认为可能是因为该模型有时会生成较短的报告。在 ExploitBench 上,标准设置(300 轮)下 GPT-5.6 Sol 更高效;扩展到 600 轮后,两者差距明显缩小。

OpenAI 还邀请了一批受信任客户试用。例如,SpecterOps 的 CTO Jared Atkinson 表示,该模型显著改善了漏洞研究工作流,能更准确地推理真实利用约束,在不到一天内完成了此前数周未能解决的活儿。

除了基准测试,GPT-5.6-Cyber 还在真实软件中发现了漏洞。OpenAI 用它研究 Chrome 的 JavaScript 引擎 V8,发现了两个此前未知的漏洞,两者可组合利用实现内存破坏并逃逸 V8 的堆沙箱。经协调披露,Google 已修复该问题,并分配编号 CVE-2026-15903。

这是 V8 的一个高危漏洞:优化编译器在将值转换为整数时跳过了安全检查,导致未定义值产生异常大的数字。如果该数字被用作数组索引,编译器可能错误地认为它在数组边界内并省略边界检查,攻击者便能读写其他对象的内存,甚至可能执行任意代码。逃逸堆沙箱通常还需要第二个漏洞——GPT-5.6-Cyber 也找到了。

V8 漏洞利用链示意图:JIT 编译器缺陷产生越界字符串,实现沙箱内任意读写,随后通过 JSPI 栈逃逸执行本机代码

此外,GPT-5.6-Cyber 还发现了其他高危问题:在一个流行移动操作系统中发现至少 5 个漏洞,包括从不可信应用提权到本地权限提升的利用链;在一个流行数据库中发现了 3 个严重漏洞,包括远程代码执行路径;在一个流行操作系统内核中发现 400 多个可导致权限提升的漏洞。OpenAI 正与相关方合作披露和修复。

根据 OpenAI 的 Preparedness Framework,GPT-5.6 Sol 和 GPT-5.6-Cyber 的网络安全能力均被评为“高”,未达到“严重”门槛。OpenAI 特别指出,在此前的 Hugging Face 事件中,GPT-5.6-Cyber 并未参与。

降低保护措施的模型会带来额外风险,但 OpenAI 认为,让防御者获得前沿智能对于加速网络防御至关重要。Daybreak Blue 和 Daybreak Red 面向通过审批的个人和组织开放。OpenAI 正采取额外安全措施,包括鼓励 Codex 用户使用自动审查模式、从 2026 年 9 月 1 日起要求 Daybreak 个人账户启用硬件安全密钥、改进监控、加强对齐训练,以及更新安全最佳实践文档。

最佳实践包括:在受控沙箱中运行工作流、监控代理行为、通过作用域权限配置文件明确边界。组织也可以自定义审查策略。

OpenAI 建议大多数防御者从 Daybreak Blue 开始;若需高级漏洞研究、漏洞利用开发或红队测试,可申请 Daybreak Red。申请入口见 openai.com/daybreak/partners。


原文链接:OpenAI Blog
本文由前途科技编辑整理

标签:OpenAI网络安全Daybreak

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

会打字,就能"拍"电影:ScriptTask 开放限量内测
置顶

会打字,就能"拍"电影:ScriptTask 开放限量内测

//

24小时热榜

OpenAI 加码网络防御:扩展 Daybreak 发布 GPT-5.6-Cyber
TOP1

OpenAI 加码网络防御:扩展 Daybreak 发布 GPT-5.6-Cyber

OpenAI 向安全合作伙伴开放前沿网络模型
前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
TOP2

OpenAI 向安全合作伙伴开放前沿网络模型

3

ChatGPT 企业版推出 Premium 席位

2小时前
ChatGPT 企业版推出 Premium 席位
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断