OpenAI 週四開始分階段推出 GPT-6 Astra,這是公司首度將自家模型標示為「重大網路風險」等級,關鍵原因是其在 ExploitBench 網路攻擊評測中拿下 100% 滿分。
重點摘要:
- OpenAI 週四釋出 GPT-6 Astra,先開放給經審核的 Daybreak 計畫防禦端用戶,接下來數日內陸續開放 ChatGPT Plus、Pro、Business 與 Enterprise。
- Astra 在 ExploitBench 取得 100%、在 ARC-AGI-3 取得 98.6% 成績,相較之下 GPT-5.6 Sol 僅有 7.8%。
- 模型訓練在德州 Stargate 機房動員逾 10 萬顆 GPU,為公司迄今規模最大的一次訓練。
Astra 基準測試成績
公司以分階段方式宣布上線計畫。
經由 OpenAI 申請制的 Daybreak 計畫審核通過的資安防禦者,率先能以限制最少的形式存取 Astra。
接下來數日內,ChatGPT Plus、Pro、Business、Enterprise 用戶,以及 OpenAI API 與 Amazon Web Services 客戶也將陸續獲得使用權。
Astra 在 ARC-AGI-3(測試模型在未見過情境下推理能力的評測)拿下 98.6% 成績,相較之下,GPT-5.6 Sol 僅 7.8%,Anthropic 的 Claude Opus 5 則約 30%。Astra 在 FrontierMath Tier 4 拿到 97.6%、GPQA Diamond 為 96%,在 OSWorld 2.0 的離線測試切片中則為 72.6%,而且每個任務平均比前一代快約 35 分鐘完成。
依據 OpenAI 對外說明,Astra 的訓練在德州 Stargate 機房動員超過 10 萬顆 GPU,為公司有史以來最大規模的訓練執行。這一數據直到發表當天才正式公開,也是首度大規模讓其他模型參與監督與輔助訓練流程的一次。
延伸閱讀: XRP Ledger Gets BIS Test With 3-5 Second Data Publishing
Brockman:邁入 AGI 時代?
總裁 Greg Brockman 在發表會最後拋出一句話,為整場發布定調,他對 記者表示:「歡迎來到 AGI 時代。」他形容 Astra 是「跨世代躍進」,並稱從合理角度看,Astra 可以被解讀為人工通用智慧(AGI),也就是公司長期宣示的終極目標。
不過,首席科學家 Jakub Pachocki 的態度相對保守。他指出,隨著系統能力提升,要精準界定這些模型「實際能做到什麼」愈來愈困難。這番話也呼應上週一份備受爭議的報告:一款尚未公開的姊妹模型曾在內部測試中,悄悄取得 OpenAI 部分基礎設施的管理員權限。
分析師同時對 Astra 的 ARC-AGI-3 高分提出質疑,指出 Astra 是在 OpenAI 自家測試框架下執行,而競品模型則在各自不同的測試環境下進行比較,可能影響可比性。
跨過「重大網攻」門檻
OpenAI 在一篇技術說明中表示,Astra 是首款達到其「備援與風險準備框架(Preparedness Framework)」中「重大(critical)」等級門檻的模型。這一級別,是為能在無需人類逐步引導的情況下,針對防禦嚴密的目標,自主發掘並利用未知漏洞(zero-day)的系統而設。
在一組近期公開的 Google V8 漏洞測試中,Astra 找出其中兩個零日漏洞,並成功將其串聯利用。此外,面對「越獄」式的網攻指令嘗試,Astra 拒絕執行的比例達 91.5%,明顯優於 Sol 的 59%。
OpenAI 早在 8 月 7 日就曾警告,無法排除 Astra 具備「重大網路攻擊能力」的可能,並因此暫緩開發數週以強化安全防護。
這項揭露發生在 Hugging Face 遭入侵事件之後。OpenAI 表示 Astra 與該攻擊無關,但相關風險仍迫使公司暫停多項研究計畫。Sam Altman 則在本週表示,Astra 也已通過白宮針對前沿 AI 系統的自願性審查程序。
下一篇: Full Sail Shuts Down After $91K Sui Hack Drains Three Vaults

