OpenAI 推出新資安模型 GPT-5.6-Cyber,鎖定經審核的專業防禦與攻擊研究場景,在特別管控的權限層級下,能回答其通用模型會拒絕的進階攻擊與漏洞利用請求,覆蓋率高達 95%。
重點整理:
- GPT-5.6-Cyber 能完成約 95% 進階資安與 exploit 請求,GPT-5.6 Sol 僅約 1.5%。
- Daybreak 架構切成兩層:Blue 主攻防禦作業,Red 專供攻擊與漏洞研究。
- 該模型已協助發現兩項 Chrome 引擎弱點,Google 以 CVE-2026-15903 修補。
GPT-5.6-Cyber 將 Daybreak 一分為二:Blue 與 Red
根據 OpenAI 在 8 月 10 日的公告,公司重新調整 Daybreak 防禦計畫架構,改採雙層級存取設計。Daybreak Blue 提供經核准的防禦者使用 GPT-5.6 Sol,移除系統層級的部分資安防護限制,支援惡意程式分析、事件應變與修補驗證等工作。Daybreak Red 則更進一步,開放專門訓練的資安模型,用於授權範圍內的弱點研究、exploit 驗證與安全測試。
在涵蓋攻擊鏈設計、身分驗證繞過與權限提升等項目的內部評測中,新模型對測試提示的回應率達 95%,遠高於 GPT-5.6 Sol 的 1.5%,也優於上一代 GPT-5.5-Cyber 的 57.3%。同一模型若經由 Blue 層級、防禦情境運行,回應率則大幅降至約 2%,反映在不同存取政策下的嚴格限縮。
研究團隊將模型指向 Google Chrome 背後的 JavaScript 引擎 V8,成功找出兩個先前未曝光的弱點,能被串連用來破壞記憶體。Google 在協調式揭露流程後修補這組問題,並登錄為 CVE-2026-15903,屬於瀏覽器引擎的高嚴重性漏洞。模型同時在一套廣泛部署的作業系統核心中揭露逾 400 個潛在權限提升缺陷。
延伸閱讀:OpenAI 回購 70 億美元員工持股,IPO 時程仍未定
資安社群在「拒絕率」與「風險」間拉鋸
近月來,高階 AI 模型頻頻遭防禦社群批評「過度拒絕」資安相關請求,產業也持續關注,實驗室如何在防止犯罪濫用與滿足防禦需求之間取得平衡。
OpenAI 表示,Daybreak 的高權限存取對象須通過身分驗證、使用行為監控、用途限制與法律聲明等多重審查。目前包括 Accenture、IBM、CrowdStrike 與 Cisco 等公司,已開始將相關模型整合至自家資安產品與服務。
SpecterOps 技術長 Jared Atkinson 指出,新模型在判斷真實 exploit 條件與限制方面,比前代系統更貼近實務。他表示,以往可能需花上數週的研究,如今在 GPT-5.6-Cyber 協助下可於一天內收斂。OpenAI 依自家 Preparedness Framework 評估,將 GPT-5.6-Cyber 的網攻能力標為「High」,僅次於最高等級「Critical」。
一連串「走偏」事件,推動 OpenAI 收緊資安政策
GPT-5.6-Cyber 的問世,緊接在一系列測試事件之後——這些事件顯示模型曾觸及原先應屬封閉的系統。OpenAI 智能代理曾逃出沙箱環境,並入侵 Hugging Face;Anthropic 則通報 Claude 模型曾意外觸及三家組織,Meta 也證實一家外包公司遭入侵。
OpenAI 過去一週內持續強化對最強大模型的使用規範。
8 月 7 日,該公司因「無法排除達到 Critical 級資安能力的風險」,宣布放緩尚未發布模型 Astra 的開發進度。OpenAI 強調,GPT-5.6-Cyber 並未參與 Hugging Face 入侵事件,同時規定自 9 月 1 日起,所有 Daybreak 帳號必須啟用實體硬體安全金鑰。





