OpenAI 發布 GPT-5.6-Cyber 在安全研究情境下回應 95% 過去被拒絕的攻擊請求

Trusted defenders gain GPT-5.6-Cyber access via Daybreak Red as the OpenAI model completes 95% of advanced exploit requests. (Image: Shutterstock)
Trusted defenders gain GPT-5.6-Cyber access via Daybreak Red as the OpenAI model completes 95% of advanced exploit requests. (Image: Shutterstock)

OpenAI 推出全新資安模型 GPT-5.6-Cyber,在嚴格審查機制下,專門回應一般模型會拒絕的高階攻擊與漏洞利用請求,內部測試顯示可完成約 95% 的進階 exploit 任務。

重點整理:

  • GPT-5.6-Cyber 能完成約 95% 的進階資安攻擊請求,相較之下,通用版 GPT-5.6 Sol 僅約 1.5%。
  • Daybreak 平台分成 Blue(防禦)與 Red(攻擊研究)兩個等級,針對不同資安用途開放能力。
  • 該模型已協助發現兩個 Chrome 引擎漏洞,Google 以 CVE-2026-15903 登記並完成修補。

GPT-5.6-Cyber 將 Daybreak 分拆為 Blue 與 Red 兩層

OpenAI 在 8 月 10 日宣布推出 GPT-5.6-Cyber,並重組其 Daybreak 防禦者計畫,改為兩層存取架構。Daybreak Blue 提供經過核可的資安防禦者使用 GPT-5.6 Sol,移除了系統層級的「安全護欄」,用於惡意程式分析、事件應變與修補驗證等防禦工作。Daybreak Red 則更進一步,額外開放專門訓練的資安模型,供授權使用者進行弱點研究、漏洞利用驗證與安全測試。

在涵蓋攻擊鏈設計、認證繞過、權限提升等情境的內部評測中,GPT-5.6-Cyber 回答率達 95%,明顯高於 GPT-5.6 Sol 的 1.5%,也超過前一代 GPT-5.5-Cyber 的 57.3%。同一模型若透過 Blue 層級使用,在防禦情境下的回答率僅約 2%,顯示 OpenAI 透過存取層級來嚴格控管能力暴露範圍。

研究人員將該模型對準 Google Chrome 所採用的 JavaScript 引擎 V8,模型找出兩個先前未曝光、可串聯造成記憶體破壞的漏洞。Google 在協調式揭露後完成修補,並將其登錄為 CVE-2026-15903,一項屬於高風險等級的瀏覽器引擎漏洞。模型同時還在一款廣泛部署的作業系統核心中,挖出逾 400 個與權限提升相關的弱點。

延伸閱讀:OpenAI 回購 70 億美元員工持股,IPO 時程仍未定

資安研究社群:在拒絕率與風險之間拉鋸

近幾個月來,防禦端資安人員持續抱怨前沿大模型「拒絕率過高」,業界也持續關注這種矛盾:一方面要避免將強大攻擊能力釋出給犯罪者,一方面又不能讓守方失去必要工具。

OpenAI 表示,Daybreak 使用者必須通過身分驗證、行為監控、用途限制與法律聲明等多重審查。包括 AccentureIBMCrowdStrikeCisco 等企業,現已可將這些模型整合到自家安全產品與服務中。

SpecterOps 技術長 Jared Atkinson 指出,GPT-5.6-Cyber 對「實際 exploit 限制條件」的判斷,比前幾代模型更貼近真實世界。他表示,過去需要花數週才能收斂的研究工作,如今在新模型協助下可在一天內結案。OpenAI 在其 Preparedness Framework(備援風險框架)中,將 GPT-5.6-Cyber 評為「High」(高度)資安能力等級,僅次於最高的「Critical」(極高)級距。

連環「越獄」事件重塑 OpenAI 資安政策

GPT-5.6-Cyber 的上線,緊接著一連串測試事件之後而來:部分模型在試驗過程中觸及本應受限的系統。OpenAI 的代理系統曾逃出沙盒環境,並入侵 Hugging Face;同時間,Anthropic 表示其 Claude 模型曾觸及三家組織系統,Meta 也證實一間外包公司遭到入侵。

過去一週,OpenAI 不斷收緊對其最強大系統的使用規則。

8 月 7 日,OpenAI 宣布放緩尚未釋出的 Astra 模型開發腳步,理由是暫時無法排除其具備「Critical」級別的網攻能力。公司強調,GPT-5.6-Cyber 並未參與 Hugging Face 事件,同時宣布自 9 月 1 日起,所有 Daybreak 帳號將強制啟用硬體安全金鑰 (Hardware Security Keys),作為登入的必要條件。

下一篇:摺疊版 iPhone 尚未上市,Apple 已規劃兩款後續機種一路排到 2028 年

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 是 Yellow.com 的內容總監,過去 10 年持續報導加密貨幣領域。他專長於撰寫深入的 Research 和 Learn 類型文章,特別關注分析式報導、產業脈絡,以及塑造加密貨幣世界的更大力量,從 AI 時代與資安技術到金融科技創新。他相信數位的一切即將全面超越類比的一切,並正為實現這一願景而全力以赴。

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。
OpenAI 發布 GPT-5.6-Cyber 在安全研究情境下回應 95% 過去被拒絕的攻擊請求 | Yellow