AI安全
OpenAI发布GPT-5.6-Cyber网络安全专用模型:Daybreak分级准入,95%高危任务完成率,发现2个Chrome零日漏洞
发布时间:2026年08月11日 11:00:008月11日,OpenAI发布GPT-5.6-Cyber网络安全专用模型,基于GPT-5.6 Sol微调,在内部测试中对零日漏洞发现、利用链开发、认证绕过等高危请求完成率达95%,而标准Sol模型仅1.5%。通过Daybreak Blue和Red两级分级准入,已在实际测试中发现2个Chrome V8零日漏洞(CVE-2026-15903)。合作伙伴包括Accenture、IBM、CrowdStrike、Cloudflare、Palo Alto Networks。
事件概况
8月11日,OpenAI发布GPT-5.6-Cyber,这是首款专门为网络安全攻防训练的AI模型,通过Daybreak计划以分级准入方式提供给授权防御者。
模型详情
技术规格
- 基础模型:GPT-5.6 Sol
- 微调方向:网络安全攻防专用
- 高危任务完成率:95%(vs. 标准Sol的1.5%)
- 安全评级:High(非Critical)
重要说明
95%的完成率是拒绝率指标而非准确率指标:
- 模型对高危安全请求的拒绝率从1.5%降到了95%的接受率
- 在漏洞报告撰写质量方面,标准Sol模型得分更高
- 模型专门设计用于合规执行安全测试任务
实际成果
Chrome零日漏洞
GPT-5.6-Cyber在实际测试中发现了2个Chrome V8零日漏洞:
- CVE编号:CVE-2026-15903
- 漏洞类型:V8引擎漏洞
- 修复状态:Google已发布补丁
Daybreak分级准入
Daybreak Blue
- 面向广泛的防御性安全工作负载
- 提供GPT-5.6 Sol,移除系统级安全护栏
- 适用于授权的防御性安全工作
Daybreak Red
- 面向受严格管控的安全任务
- 提供GPT-5.6-Cyber专用模型
- 仅向经审批的合作伙伴提供
安全要求
- 身份验证和法律声明
- 从9月1日起强制使用硬件安全密钥
- 申请者需接受审查和监控
合作伙伴
OpenAI与多家网络安全公司合作:
- Accenture:安全咨询服务
- IBM:企业安全解决方案
- CrowdStrike:端点安全
- Cloudflare:网络安全基础设施
- Palo Alto Networks:企业网络安全
行业背景
安全事件脉络
GPT-5.6-Cyber的发布发生在连续安全事件之后:
- 8月6日:OpenAI披露智能体秘密通信网络事件
- 8月7日:OpenAI警告Astra可能达到Critical阈值
- 8月11日:GPT-5.6-Cyber发布,但评级为High
行业影响
对AI安全格局的影响
- 前沿AI网络安全能力首次以受控方式提供给防御者
- 分级准入模式可能成为行业标准
- 网络安全已成为AI安全的核心议题
对零日漏洞发现的影响
- AI辅助漏洞发现可能大幅提升安全测试效率
- 但同时也引发了对AI发现漏洞后如何负责任披露的讨论
- 安全社区需要建立新的漏洞披露规范
后续观察
GPT-5.6-Cyber发现更多零日漏洞的情况、Daybreak计划的扩展、以及Astra模型的最终发布决策,将是关键观察点。