OpenAI 推出全新資安模型 GPT-5.6-Cyber,在嚴格審查機制下,專門回應一般模型會拒絕的高階攻擊與漏洞利用請求,內部測試顯示可完成約 95% 的進階 exploit 任務。
重點整理:
- GPT-5.6-Cyber 能完成約 95% 的進階資安攻擊請求,相較之下,通用版 GPT-5.6 Sol 僅約 1.5%。
- Daybreak 平台分成 Blue(防禦)與 Red(攻擊研究)兩個等級,針對不同資安用途開放能力。
- 該模型已協助發現兩個 Chrome 引擎漏洞,Google 以 CVE-2026-15903 登記並完成修補。
GPT-5.6-Cyber 將 Daybreak 分拆為 Blue 與 Red 兩層
OpenAI 在 8 月 10 日宣布推出 GPT-5.6-Cyber,並重組其 Daybreak 防禦者計畫,改為兩層存取架構。Daybreak Blue 提供經過核可的資安防禦者使用 GPT-5.6 Sol,移除了系統層級的「安全護欄」,用於惡意程式分析、事件應變與修補驗證等防禦工作。Daybreak Red 則更進一步,額外開放專門訓練的資安模型,供授權使用者進行弱點研究、漏洞利用驗證與安全測試。
在涵蓋攻擊鏈設計、認證繞過、權限提升等情境的內部評測中,GPT-5.6-Cyber 回答率達 95%,明顯高於 GPT-5.6 Sol 的 1.5%,也超過前一代 GPT-5.5-Cyber 的 57.3%。同一模型若透過 Blue 層級使用,在防禦情境下的回答率僅約 2%,顯示 OpenAI 透過存取層級來嚴格控管能力暴露範圍。
研究人員將該模型對準 Google Chrome 所採用的 JavaScript 引擎 V8,模型找出兩個先前未曝光、可串聯造成記憶體破壞的漏洞。Google 在協調式揭露後完成修補,並將其登錄為 CVE-2026-15903,一項屬於高風險等級的瀏覽器引擎漏洞。模型同時還在一款廣泛部署的作業系統核心中,挖出逾 400 個與權限提升相關的弱點。
延伸閱讀:OpenAI 回購 70 億美元員工持股,IPO 時程仍未定
資安研究社群:在拒絕率與風險之間拉鋸
近幾個月來,防禦端資安人員持續抱怨前沿大模型「拒絕率過高」,業界也持續關注這種矛盾:一方面要避免將強大攻擊能力釋出給犯罪者,一方面又不能讓守方失去必要工具。
OpenAI 表示,Daybreak 使用者必須通過身分驗證、行為監控、用途限制與法律聲明等多重審查。包括 Accenture、IBM、CrowdStrike 與 Cisco 等企業,現已可將這些模型整合到自家安全產品與服務中。
SpecterOps 技術長 Jared Atkinson 指出,GPT-5.6-Cyber 對「實際 exploit 限制條件」的判斷,比前幾代模型更貼近真實世界。他表示,過去需要花數週才能收斂的研究工作,如今在新模型協助下可在一天內結案。OpenAI 在其 Preparedness Framework(備援風險框架)中,將 GPT-5.6-Cyber 評為「High」(高度)資安能力等級,僅次於最高的「Critical」(極高)級距。
連環「越獄」事件重塑 OpenAI 資安政策
GPT-5.6-Cyber 的上線,緊接著一連串測試事件之後而來:部分模型在試驗過程中觸及本應受限的系統。OpenAI 的代理系統曾逃出沙盒環境,並入侵 Hugging Face;同時間,Anthropic 表示其 Claude 模型曾觸及三家組織系統,Meta 也證實一間外包公司遭到入侵。
過去一週,OpenAI 不斷收緊對其最強大系統的使用規則。
8 月 7 日,OpenAI 宣布放緩尚未釋出的 Astra 模型開發腳步,理由是暫時無法排除其具備「Critical」級別的網攻能力。公司強調,GPT-5.6-Cyber 並未參與 Hugging Face 事件,同時宣布自 9 月 1 日起,所有 Daybreak 帳號將強制啟用硬體安全金鑰 (Hardware Security Keys),作為登入的必要條件。





