OpenAI 最新發表 GPT-5.6-Cyber,一款專攻網絡安全攻防的模型,透過嚴格審批的存取層提供服務, 可完成 95% 一般 GPT 系統會拒絕的高階漏洞利用與攻擊鏈請求,專供合資格防守方及安全研究用途。
重點摘要
- GPT-5.6-Cyber 可完成約 95% 進階網絡安全相關請求;對比之下,GPT-5.6 Sol 僅約 1.5%。
- Daybreak 現設兩層:Blue 主打防守工作,Red 主打漏洞與攻擊研究。
- 模型協助發現兩個 Chrome 引擎漏洞,Google 已納入 CVE-2026-15903 並完成修補。
GPT-5.6-Cyber 把 Daybreak 一分為二:Blue 與 Red
OpenAI 在 8 月 10 日公布 GPT-5.6-Cyber, 同時重組 Daybreak 防禦者計劃,改為兩級存取架構。Daybreak Blue 向通過審批的防守方開放 GPT-5.6 Sol, 移除系統層面的部分安全護欄,涵蓋惡意程式分析、事故應變及修補驗證等工作。 Daybreak Red 則更進一步,加入專門訓練的網安模型,開放予獲授權的漏洞研究、攻擊驗證及安全測試。
在一套涵蓋攻擊鏈開發、繞過認證及權限提升的內部基準測試中,新模型可回應 95% 提示, 遠高於 GPT-5.6 Sol 的 1.5%,亦優於上一代 GPT-5.5-Cyber 的 57.3%。同一模型在 Blue 存取模式下, 因加入更多防護限制,回應率僅約 2%。
研究人員把 GPT-5.6-Cyber 指向 Google Chrome 背後的 JavaScript 引擎 V8, 模型成功找出兩個先前未被披露的漏洞,並可串連起來進行記憶體破壞攻擊。 Google 在合作披露後已修補相關問題, 登記為 CVE-2026-15903,屬瀏覽器引擎的高危漏洞。模型亦在一個廣泛部署的作業系統核心中, 挖出逾 400 個與權限提升相關的漏洞。
延伸閱讀:OpenAI 回購 70 億美元員工股份,IPO 時點仍未明朗
安全研究界權衡「拒絕率」與實際風險
過去數月,網安防守方一直不滿前沿模型拒絕請求過於頻密, 業界亦持續關注這種拉鋸: 一方面要支援防守方,另一方面又要避免同樣能力落入不法之徒。
OpenAI 目前會透過身份驗證、使用監控、用途白名單及法律聲明等程序篩選申請者; 包括 Accenture、IBM、CrowdStrike 及 Cisco 在內的企業,已可把這些模型整合進自家安全產品。
SpecterOps 技術總監 Jared Atkinson 表示,GPT-5.6-Cyber 對真實攻擊條件與限制的判斷, 比前代模型貼近現實。他指模型把以往要花數星期才能釐清的研究,在不足一日內收尾。 在 OpenAI 的 Preparedness Framework 內部評級中,GPT-5.6-Cyber 的網安能力被列為「High」, 僅次於最高的「Critical」級別。
一連串「失控 AI」事件重塑 OpenAI 網安政策
是次推出,背景是多宗測試事故暴露模型可觸及受限制系統的風險。 有報道指 OpenAI 的代理系統曾逃離沙盒環境, 並入侵 Hugging Face; Anthropic 亦承認 Claude 模型曾觸及三間機構的系統,Meta 則確認一間外判公司遭到入侵。
過去一星期,OpenAI 連番收緊旗下最高能力模型的使用規則。
8 月 7 日,OpenAI 宣布因安全憂慮而放慢尚未發佈模型 Astra 的研發步伐, 指目前無法排除其具備「Critical」級別網安能力的可能性。 公司同時強調,GPT-5.6-Cyber 並未涉及 Hugging Face 入侵事件, 並將於 9 月 1 日起,強制所有 Daybreak 帳戶啟用硬件保安金鑰。





