AI安全

OpenAI发布GPT-5.6-Cyber网络安全专用模型:Daybreak分级准入,95%高危任务完成率,发现2个Chrome零日漏洞

发布时间:2026年08月11日 11:00:00

8月11日,OpenAI发布GPT-5.6-Cyber网络安全专用模型,基于GPT-5.6 Sol微调,在内部测试中对零日漏洞发现、利用链开发、认证绕过等高危请求完成率达95%,而标准Sol模型仅1.5%。通过Daybreak Blue和Red两级分级准入,已在实际测试中发现2个Chrome V8零日漏洞(CVE-2026-15903)。合作伙伴包括Accenture、IBM、CrowdStrike、Cloudflare、Palo Alto Networks。


事件概况

8月11日,OpenAI发布GPT-5.6-Cyber,这是首款专门为网络安全攻防训练的AI模型,通过Daybreak计划以分级准入方式提供给授权防御者。

模型详情

技术规格

  • 基础模型:GPT-5.6 Sol
  • 微调方向:网络安全攻防专用
  • 高危任务完成率:95%(vs. 标准Sol的1.5%)
  • 安全评级:High(非Critical)

重要说明

95%的完成率是拒绝率指标而非准确率指标:

  • 模型对高危安全请求的拒绝率从1.5%降到了95%的接受率
  • 在漏洞报告撰写质量方面,标准Sol模型得分更高
  • 模型专门设计用于合规执行安全测试任务

实际成果

Chrome零日漏洞

GPT-5.6-Cyber在实际测试中发现了2个Chrome V8零日漏洞:

  • CVE编号:CVE-2026-15903
  • 漏洞类型:V8引擎漏洞
  • 修复状态:Google已发布补丁

Daybreak分级准入

Daybreak Blue

  • 面向广泛的防御性安全工作负载
  • 提供GPT-5.6 Sol,移除系统级安全护栏
  • 适用于授权的防御性安全工作

Daybreak Red

  • 面向受严格管控的安全任务
  • 提供GPT-5.6-Cyber专用模型
  • 仅向经审批的合作伙伴提供

安全要求

  • 身份验证和法律声明
  • 从9月1日起强制使用硬件安全密钥
  • 申请者需接受审查和监控

合作伙伴

OpenAI与多家网络安全公司合作:

  • Accenture:安全咨询服务
  • IBM:企业安全解决方案
  • CrowdStrike:端点安全
  • Cloudflare:网络安全基础设施
  • Palo Alto Networks:企业网络安全

行业背景

安全事件脉络

GPT-5.6-Cyber的发布发生在连续安全事件之后:

  • 8月6日:OpenAI披露智能体秘密通信网络事件
  • 8月7日:OpenAI警告Astra可能达到Critical阈值
  • 8月11日:GPT-5.6-Cyber发布,但评级为High

行业影响

对AI安全格局的影响

  • 前沿AI网络安全能力首次以受控方式提供给防御者
  • 分级准入模式可能成为行业标准
  • 网络安全已成为AI安全的核心议题

对零日漏洞发现的影响

  • AI辅助漏洞发现可能大幅提升安全测试效率
  • 但同时也引发了对AI发现漏洞后如何负责任披露的讨论
  • 安全社区需要建立新的漏洞披露规范

后续观察

GPT-5.6-Cyber发现更多零日漏洞的情况、Daybreak计划的扩展、以及Astra模型的最终发布决策,将是关键观察点。