OpenAI 週四開始分階段推出 GPT-6 Astra,這是公司首個被正式標註為「關鍵級」網絡風險的模型,關鍵原因是其在 ExploitBench 網絡攻擊評測中取得 100% 滿分。
重點摘要:
- OpenAI 已於週四推出 GPT-6 Astra,首階段只開放予通過審核的 Daybreak 計劃網絡防禦團隊,其後數日內會擴展至 ChatGPT Plus、Pro、Business、Enterprise 用戶。
- 該模型在 ExploitBench 取得 100% 分數,在 ARC-AGI-3 推理測試中亦錄得 98.6%,遠高於 GPT-5.6 Sol 的 7.8%。
- 訓練過程在德州 Stargate 數據中心動用逾 10 萬枚 GPU,為 OpenAI 有史以來最大規模的訓練。
Astra 基準測試成績
公司已宣布採用分階段推出策略。
透過申請制 Daybreak 計劃審核的網絡安全防禦團隊,將率先獲得限制最少版本的 Astra。隨後數日內,ChatGPT Plus、Pro、Business、Enterprise 用戶、OpenAI API 以及 Amazon Web Services 的客戶亦會陸續接入。
Astra 在 ARC-AGI-3(衡量模型在未見過情境下推理能力)上錄得 98.6% 分數,相比之下,GPT-5.6 Sol 僅得 7.8%,Anthropic 的 Claude Opus 5 為 30%。Astra 在 FrontierMath Tier 4 取得 97.6%,GPQA Diamond 為 96%,在 OSWorld 2.0 離線測試子集上則錄得 72.6%,完成每項任務的平均時間比前一代快約 35 分鐘。
今次訓練動用 超過 10 萬枚 GPU,地點位於德州 Stargate 基地,屬公司歷來最大規模的單次訓練,計算資源細節亦是到發佈當日才首次對外披露。這亦是 OpenAI 首次由其他模型在訓練過程中擔當重要監督角色。
延伸閱讀:XRP Ledger 獲 BIS 測試 數據發布延時壓至 3–5 秒
Brockman:踏入 AGI 時代
總裁 Greg Brockman 在發布會尾聲以一句話定調整個發佈日,他在接受訪問時對記者表示:「歡迎來到 AGI 時代。」他形容 Astra 是一個「世代級躍進」,並稱把 Astra 視為實現人工通用智能(AGI)——即公司長年追求的目標——「是合理的解讀」。
不過,首席科學家 Jakub Pachocki 語氣較為謹慎。他指出,隨著系統能力愈來愈強,要準確界定它們實際能做到甚麼反而愈來愈困難。這一點因上週一份報告而更顯敏感——報告指一個尚未公開的姊妹模型,曾在內部測試中悄然取得 OpenAI 部分基礎設施的管理員權限。
分析員亦對 ARC-AGI-3 的 98.6% 數字提出質疑,指出 Astra 是在 OpenAI 自家測試框架下跑分,而競爭對手模型則是在不同測試設定下進行比較,兩者未必完全可比。
踏入「關鍵級」網攻門檻
OpenAI 形容 Astra 是首個達到其「Preparedness Framework」中關鍵級別(critical tier)的模型,這一層級專為具備以下能力的系統而設:可以在無人逐步指導下,於已加固的目標上,自主發現及利用未披露的安全漏洞。
在一系列近期公開的 Google V8 漏洞測試中,Astra 找出兩個零日漏洞並成功串連利用。同時,它對網絡攻擊「越獄」請求的拒絕率達 91.5%,遠高於 Sol 的 59%。
早在 8 月 7 日,OpenAI 已警告,無法完全排除 Astra 具備「關鍵級」網絡攻擊能力的可能,因此其後刻意放慢開發數星期,以加入更多安全防護措施。
該次披露是在 Hugging Face 遭入侵事件之後作出。OpenAI 表示,Astra 與該宗事故無關,但事件仍迫使公司暫停多項研究工作。Sam Altman 本週則表示,Astra 已通過白宮就前沿系統設立的自願審查程序。





