OpenAI 发布安全专用模型 GPT-5.6-Cyber,Daybreak 计划拆成 Blue/Red 两层访问
OpenAI 于 2026-08-10 发布以 GPT-5.6 Sol 为底座、专攻漏洞研究与攻击链验证的 GPT-5.6-Cyber,并把 Daybreak 防御者计划扩大为 Blue/Red 两层访问。官方自述高级安全请求响应率 95%(不拒答率,非正确率),定级 High 未达 Critical,定价尚未公布,9 月起强制硬件安全密钥。
OpenAI 于 2026 年 8 月 10 日发布网络安全专用模型 GPT-5.6-Cyber,并同步把既有的 Daybreak 安全防御者计划扩大为两层访问。该模型以 GPT-5.6 Sol 为底座,专为漏洞研究(寻找 zero-day)与攻击链(exploit chain)验证做过专项训练。本文事实以多方报道交叉佐证。
Blue 与 Red:同一个计划、两类对象
- Daybreak Blue:GPT-5.6 Sol 去掉系统层安全护栏的版本。OpenAI 建议多数防御方使用这一层,用于代码审计、恶意软件分析与事件响应。
- Daybreak Red:GPT-5.6-Cyber 本体,保留给漏洞研究、攻击程序开发与红队演练。
访问门槛分三条路径:个人须在 chatgpt.com/cyber 完成身份验证;组织走企业申请表;安全厂商走 Daybreak Cyber Partner Program,目前已放行 Accenture、IBM、CrowdStrike、Cisco、Palo Alto Networks、Cloudflare 与 Sophos,可将模型集成进自家安全产品与托管服务。所有申请都须通过身份验证与法律声明、限定核准用途;OpenAI 建议在沙箱中使用、与生产环境隔离,并自 2026 年 9 月 1 日起强制使用硬件安全密钥。
95% 是“不拒答率”,不是“正确率”
OpenAI 自行公布的数字显示,面对高级安全请求,GPT-5.6-Cyber 的响应率达 95%,对照 GPT-5.6 Sol 仅 1.5%、Daybreak Blue 约 2%、上一代 GPT-5.5-Cyber 为 57.3%。这里必须读清楚:这是“请求响应率/不拒答率”,衡量的是模型愿不愿意接手这类敏感任务,并非答案的正确率。OpenAI 同时披露了代价——Cyber 在“漏洞报告质量”与 300 回合的 ExploitBench 上表现不如 Sol,而且消耗更多 token。至于实战战绩,官方称在预发布测试期间找出两个此前未知、且可相互串接的 Chrome V8 引擎漏洞。定价方面,官方价目表中 Cyber 的费率栏仍为空白、尚未公布。
定级 High,未达 Critical
依 OpenAI 的 Preparedness Framework,GPT-5.6-Cyber 被判为网络安全能力 High:可自动化端到端操作对抗加固过的目标、能发现具实战意义的漏洞,但未达 Critical 门槛。这一点与尚未出货、须通过美国政府 30 日国安审查的 Astra 不同,两者不应混为一谈。脉络上,上一代是 2025 年的 GPT-5.5 与 GPT-5.5-Cyber(Trusted Access for Cyber)。
对管理者的意义
这则新闻真正的信号不是“又多一个模型”,而是攻守双方的工具正在同步升级,且防守方得先过身份验证、法律声明与 9 月起的硬件密钥才拿得到。对企业管理者,值得先确认三件事:
- 安全外包或托管服务的供应商,是否在已放行的伙伴名单上。
- 内部若要试用,是否备妥隔离沙箱与明确的用途授权,而非直接接上生产环境。
- 关键系统的补丁节奏,能否跟上“漏洞被更快找出来”的新节奏。
会不会用工具是一回事;能不能通过门槛拿到、拿到之后管不管得住,才是管理课题。