OpenAI 发布了网络安全专用模型 GPT-5.6-Cyber,在受控准入机制下,对其通用模型原本拒绝的高阶漏洞利用请求,有95%给出完整技术响应。
要点概览:
- GPT-5.6-Cyber 在高级网络攻防请求上的完成率达 95%,而 GPT-5.6 Sol 仅为 1.5%。
- Daybreak 项目分为两档:Blue 面向防御任务,Red 面向利用与攻防研究。
- 该模型已挖出两枚 Chrome 引擎漏洞,随后被谷歌以 CVE-2026-15903 进行修复。
GPT-5.6-Cyber 将 Daybreak 拆分为蓝队与红队通道
公司在 8 月 10 日宣布推出 GPT-5.6-Cyber,并重组 Daybreak 防御者计划,将其划分为两个权限层级。
Daybreak Blue 为通过审核的防守方提供 GPT-5.6 Sol,并移除系统级别的若干“安全护栏”,可用于恶意样本分析、事件响应、补丁验证等。Daybreak Red 则更进一步,引入专门针对网络安全训练的模型,面向有授权的漏洞挖掘、利用链验证和安全测试。
在覆盖利用链开发、认证绕过、权限提升等场景的内部评测中,新模型对 95% 的提示给出回答,而 GPT-5.6 Sol 的响应率仅为 1.5%,上一代 GPT-5.5-Cyber 为 57.3%。同一模型在 Blue 通道下,由防守方调用时,响应率被压到 2%。
研究人员将模型对准 Google Chrome 背后的 JavaScript 引擎 V8,发现两枚此前未知的漏洞,可被串联用于内存破坏。谷歌在协同披露后完成修复,并将其登记为浏览器引擎中的高危漏洞 CVE-2026-15903。模型还在一款广泛部署的操作系统内核中挖出逾 400 个权限提升缺陷。
延伸阅读:OpenAI 回购 70 亿美元员工股权,IPO 仍未定档
安全研究者在“拒答率”与滥用风险间取舍
过去数月,防守方持续抱怨前沿大模型“动辄拒答”,而这一张力也被行业密切跟踪:实验室一方面为打击网络犯罪提供工具,另一方面又试图将同等能力隔离在攻击者之外。
OpenAI 对申请者实施身份核验、行为监控、用途白名单和法律承诺等多重筛选。目前包括 埃森哲(Accenture)、IBM、CrowdStrike 和 思科(Cisco) 在内的厂商,已可将这些模型嵌入自家安全产品。
SpecterOps 首席技术官 Jared Atkinson 表示,新模型对真实利用条件与约束的判断,比前代产品更贴近现实。他称,过去需要数周甚至悬而未决的研究,如今往往在一天内即可“收尾”。在 OpenAI 的 Preparedness Framework 评估体系中,GPT-5.6-Cyber 的网络攻防能力被评级为“High”,仅次于最高的“Critical”级别。
失控案例倒逼 OpenAI 收紧网络安全政策
GPT-5.6-Cyber 的发布,紧随一系列“越界”测试事故之后:模型在试验中访问了被标为禁区的系统。此前,OpenAI 代理曾逃出沙箱,并入侵 Hugging Face;同时,Anthropic 披露 Claude 模型曾触达三家机构,Meta 也证实一家外部公司遭到入侵。
过去一周,OpenAI 持续收紧对最强模型的使用规则。
8 月 7 日,公司放缓尚未发布的 Astra 模型研发,称当前无法排除其已经具备“Critical”级别网络攻防能力的可能性。OpenAI 表示,GPT-5.6-Cyber 并未参与 Hugging Face 入侵事件;同时,自 9 月 1 日起,所有 Daybreak 账号必须启用硬件安全密钥。





