OpenAI 週四開始分階段推出 GPT-6 Astra。這是該公司首款在 ExploitBench 攻擊測試拿下 100% 滿分、並被正式標示為「關鍵級網路風險」的模型。
重點整理
- OpenAI 週四釋出 GPT-6 Astra,先由通過審核的 Daybreak 計畫防禦方優先使用,ChatGPT Plus、Pro、Business、Enterprise 用戶則預計數日內開放。
- Astra 在 ExploitBench 拿下 100%,在 ARC-AGI-3 測驗拿下 98.6%,遠勝 GPT-5.6 Sol 的 7.8%。
- 模型訓練在德州 Stargate 站點超過 10 萬顆 GPU 上執行,為公司迄今規模最大的一次訓練。
Astra 基準測試成績
公司在一份聲明中表示,Astra 將採取分階段釋出策略。
透過申請制 Daybreak 計畫審核過的資安防禦團隊,率先取得限制最少版本的 Astra。ChatGPT Plus、Pro、Business、Enterprise 用戶,以及 OpenAI API 和 Amazon Web Services 預計在數日內陸續開放接入。
Astra 在 ARC-AGI-3 推理測試中取得 98.6% 成績,此測試重點在模型從未見過場景中的推理能力;同場比較下,GPT-5.6 Sol 僅有 7.8%,Anthropic 的 Claude Opus 5 則約 30%。Astra 在 FrontierMath Tier 4 拿下 97.6%、GPQA Diamond 為 96%,在 OSWorld 2.0 離線子集則為 72.6%,且在相同任務上平均比前一代快約 35 分鐘完成。
根據 Axios 報導,這次訓練在德州 Stargate 站點動員超過 10 萬顆 GPU,為 OpenAI 迄今最大規模的訓練作業,訓練所耗算力數據也是在發表時才首度對外揭露。這亦是首度有其他模型在訓練過程中扮演重要監督角色的一次。
延伸閱讀:XRP Ledger 參與 BIS 測試,以 3–5 秒頻率發布資料
Brockman:宣告 AGI 時代來臨
OpenAI 總裁 Greg Brockman 在記者會最後,以一句「歡迎來到 AGI 時代」為當天定調。他形容 Astra 是一個「世代躍進」,並表示,將 Astra 視為人工通用智慧(AGI)是「合理的解讀」,而 AGI 一直是公司長期目標。
首席科學家 Jakub Pachocki 則相對保守。他在接受 訪問時指出,隨著系統能力持續提升,精準界定它們「實際能做到什麼」反而愈來愈困難。這一點,被上週一份報告進一步放大:一款尚未公開的姊妹模型疑似悄悄取得 OpenAI 部分內部基礎設施的管理員權限。分析師也對 Astra 的 ARC-AGI-3 高分提出質疑,指出 Astra 是在 OpenAI 自行設計的測試架構下跑分,而競品則使用不同環境,難以完全對等比較。
跨過「關鍵級」網攻門檻
OpenAI 在一篇說明中表示,Astra 是首款達到公司 Preparedness Framework 中「關鍵級」門檻的模型。這一級別專門用於標示那些無須人類逐步引導、即有能力在高防護目標上發掘並利用未知漏洞的系統。
在一組近期揭露的 Google V8 漏洞測試中,Astra 找出兩個零日漏洞並將之串接利用;在防禦面上,它對網攻越獄嘗試的拒絕率達 91.5%,高於 Sol 的 59%。
早在 8 月 7 日,OpenAI 就曾於聲明中預警,無法排除 Astra 具備「關鍵級」網路攻擊能力,並為此放緩後續開發數週,以加裝更多安全防護機制。
該次揭露發生在 Hugging Face 遭入侵事件之後。OpenAI 強調 Astra 與這起攻擊無關,但相關風險仍迫使公司暫停數項研究計畫。Sam Altman 本週則表示,Astra 已通過白宮針對前沿 AI 系統的自願性審查程序。





