OpenAI 週四開始分階段推出 GPT-6 Astra, 這是公司首個被官方標記為「重大網絡風險級」的模型,關鍵原因是在 ExploitBench 網攻測試中取得 100% 滿分表現。
重點摘要
- OpenAI 週四正式發表 GPT-6 Astra,首先向經審核的 Daybreak 網安防禦者開放,之後數日內陸續擴展至 ChatGPT Plus、Pro、Business、Enterprise 用戶。
- 模型在 ExploitBench 取得 100% 滿分,在 ARC-AGI-3 推理基準測試得分 98.6%,遠高於 GPT-5.6 Sol 的 7.8%。
- 訓練過程在德州 Stargate 數據中心動員逾 10 萬枚 GPU,為公司迄今規模最大的一次訓練。
Astra 基準測試成績
公司已宣布採用分階段推出策略。公告指, 首批使用者為通過申請制 Daybreak 計劃、已獲審核的網絡安全防禦人員,並可在限制最少的設定下存取 Astra。
之後數日內,ChatGPT Plus、Pro、Business、Enterprise 用戶,以及 OpenAI API 和 Amazon Web Services 上的客戶, 亦會相繼獲得使用權。
按 公開數據, Astra 在 ARC-AGI-3(評估模型在未見過情境下的推理能力)測試中取得 98.6% 高分, 同場對比下,GPT-5.6 Sol 僅得 7.8%,Anthropic 的 Claude Opus 5 約為 30%。 Astra 在 FrontierMath Tier 4 取得 97.6%,在 GPQA Diamond 得 96%, 在 OSWorld 2.0 離線子集則錄得 72.6%,而完成每項任務的平均時間較前代模型快約 35 分鐘。
根據 披露, Astra 訓練過程在德州 Stargate 站點動用了逾 10 萬枚 GPU, 是公司有史以來最大規模的一次訓練,並且只在發佈當日才公開計算資源規模。 這亦是 OpenAI 首次在大規模訓練中,由其他模型擔任關鍵監督角色。
延伸閱讀:XRP Ledger 獲 BIS 測試 實現 3–5 秒數據發布
Brockman:邁入 AGI 時代?
總裁 Greg Brockman 在發佈會尾聲拋出一句話,定調全日氣氛,他在接受 訪問時對記者表示: 「歡迎來到 AGI 時代。」他形容 Astra 是「跨世代飛躍」,並稱將 Astra 解讀為「通用人工智能」 ——即公司長年宣示的終極目標——是「合理」的。
不過,首席科學家 Jakub Pachocki 的說法就相對保守。 他在另一場 訪談中指出, 隨着系統能力不斷提升,人類要準確界定其實際可為與不可為之處,只會愈來愈困難。 這番說法呼應上週一份內部報告:一款尚未公開的姊妹模型,曾在測試中悄悄取得 OpenAI 部分基建的管理員權限。 市場分析員亦質疑 ARC-AGI-3 的高分,指出 Astra 是在 OpenAI 自家測試框架下跑分, 而競爭對手模型則使用不同的測試環境,難以一概比較。
跨過「重大網安」門檻
OpenAI 在一份 技術說明中形容, Astra 是首個達到其「備戰框架」(Preparedness Framework)中「重大級別」的模型。 這一層級專為可在高度強化環境中,自主尋找並利用未知漏洞(zero-day),而無需人類逐步指導的系統而設。
在一組近期披露的 Google V8 漏洞測試中,Astra 找到兩個零日漏洞並成功將之串連利用; 同時,在阻擋網攻「越獄」請求方面,Astra 拒絕率達 91.5%,顯著高於 Sol 的 59%。
早於 8 月 7 日,OpenAI 已在一份聲明中預警, 指無法排除 Astra 具備「重大級別」網絡攻擊能力,其後一度放慢模型開發數週,以加入更多防護措施。
該次披露緊接著 Hugging Face 遭入侵事件之後。OpenAI 強調 Astra 與該宗事故無關, 但事件仍令多項相關研究工作暫時喊停。Sam Altman 本週則表示, Astra 已通過白宮就前沿模型推行的自願性安全審查。

