OpenAI 推出全新網絡安全模型 GPT-5.6-Cyber,專門處理高階攻擊與漏洞開發相關請求,在受控權限下,能完成約 95% 一般系統會拒絕的進階 exploit 要求。
重點摘要:
- GPT-5.6-Cyber 可回應約 95% 的高階網絡安全請求,而 GPT-5.6 Sol 只約 1.5%。
- Daybreak 平台現分為 Blue(防禦)及 Red(攻擊研究)兩大權限層。
- 模型已發現兩個 Chrome 引擎漏洞,並被 Google 以 CVE-2026-15903 修補。
GPT-5.6-Cyber 將 Daybreak 分拆為 Blue 與 Red 兩層
OpenAI 於 8 月 10 日公布 GPT-5.6-Cyber,同時重組 Daybreak 防禦者計劃,改為兩級權限架構。Daybreak Blue 為獲批防禦人員提供 GPT-5.6 Sol,移除系統層面的網安「保險欄」,集中處理惡意程式分析、事故應變及修補驗證等工作。Daybreak Red 則再進一步,加入專門訓練的網安模型,供獲授權人員作漏洞研究、exploit 驗證及滲透/安全測試。
於涵蓋 exploit chain 開發、繞過驗證及提權等場景的內部基準測試中,新模型在紅隊權限下可回答約 95% 提示,而 GPT-5.6 Sol 僅約 1.5%,早前版本 GPT-5.5-Cyber 則約 57.3%。同一模型在 Blue 層級(防禦模式)運行時,回答率只約 2%,反映 OpenAI 以權限分層方式收緊攻擊用途。
研究人員亦將模型對準 Google Chrome 背後的 JavaScript 引擎 V8,發現兩個此前未公開的漏洞,可串連起來造成記憶體破壞。Google 於協調披露後完成修補,並將相關問題記錄為 CVE-2026-15903,一宗屬高嚴重程度的瀏覽器引擎漏洞。模型亦在一個廣泛使用的作業系統核心中,挖出逾 400 個提權相關漏洞。
延伸閱讀:OpenAI 回購 70 億美元員工股份,IPO 時間表仍未明朗
安全研究社群:拒答率與風險如何取捨?
過去數月,安全防禦社群持續抱怨最前沿模型的「拒絕回答」比例過高。實務上,安全團隊需要模擬真實攻擊路徑,但實驗室一方面又要防止同樣能力落入犯罪分子之手,這種拉扯已被業界廣泛關注。
OpenAI 指出,會透過身分驗證、持續監控、用途限制及法律聲明等流程對申請人進行審核。包括 Accenture、IBM、CrowdStrike 和 Cisco 等大型企業,現可將這些模型嵌入自家安全產品和服務。
SpecterOps 技術總監 Jared Atkinson 表示,新模型在判斷 exploit 實際可行性方面,較以往版本貼近真實攻擊約束。他稱,以前可能要花數星期研究仍未收斂的問題,如今可在不足一日內結案。OpenAI 依據其 Preparedness Framework(備戰框架)評級,將 GPT-5.6-Cyber 的網安能力列為「High」,只比最高級別「Critical」低一級。
失控事件倒逼 OpenAI 收緊網安政策
GPT-5.6-Cyber 的推出,緊接一連串測試期間模型「越界」事件而來。此前,有 OpenAI 代理程式逃出沙盒環境,並入侵 Hugging Face 的系統;Anthropic 亦稱 Claude 模型曾接觸到三間外部機構,而 Meta 則證實一間合作公司遭受入侵。
過去一星期,OpenAI 陸續收緊對最高能力模型的使用規則。
8 月 7 日,公司宣布放慢尚未發布模型 Astra 的研發步伐,理由是未能排除其具備「Critical」級別的網絡攻擊能力。OpenAI 強調,GPT-5.6-Cyber 並未牽涉到 Hugging Face 入侵事件,而從 9 月 1 日起,所有 Daybreak 帳戶都必須使用硬件保安金鑰作為登入門檻。





