重點摘要
OpenAI 於 2026 年 9 月 3 日發表 GPT-6 Astra,自稱為目前全球最佳 AI 模型。
Astra 在 FrontierMath Tier 4、ARC-AGI-3 與 TerminalBench-4.0 等基準測試拿下頂尖成績。
現正陸續開放給 ChatGPT Plus、Pro、Business、Enterprise 用戶,以及 API 使用者。
OpenAI 執行長 Sam Altman 稱此次發表將「開啟新一代創業浪潮」。
模型採用「遞迴深度推理迴圈」架構,引來安全研究社群高度關注。
OpenAI 正式推出新一代旗艦模型 GPT-6 Astra,強調是公司迄今在能力與價值對齊表現上最成熟的產品。
此次發表明確鎖定五大應用場景:電腦操作自動化、軟體工程、科學研究、資安防護以及專業知識工作。
OpenAI 透過一系列 X 貼文宣布這項消息,執行長 Sam Altman 在一則 貼文 中表示,Astra「比預期多花了一些時間」,並引導讀者前往官方部落格了解技術細節。
首波將優先開放給部分機構客戶試用,接下來幾天內,所有 ChatGPT Plus、Pro、Business 與 Enterprise 訂閱用戶都可陸續使用該模型。
Astra 的基準測試成績
OpenAI 指出,Astra 在 FrontierMath Tier 4、ARC-AGI-3 與 TerminalBench-4.0 等前沿基準測試上,均達到最新「SOTA(state-of-the-art)」水準。ARC Prize 組織也在其聲明中證實,Astra 在 ARC-AGI-3 Semi-Private 測試中取得 62.7% 分數,每次完整測試成本約為 2.6 萬美元。
Astra 同時在 Agents' Last Exam、AutomationBench 與 ScreenSpot Pro 等評量上領先同業,這些測試主要模擬不同專業領域的電腦工作流程與自動化能力。
除了在 OpenAI 自家平台提供外,Astra 亦可透過 OpenAI API 以及 Amazon Web Services(AWS)使用。OpenAI 將 Astra 定調為「迄今最符合人類價值對齊的模型」,並強調其在理解用戶真實意圖方面有顯著提升。
延伸閱讀:狗狗幣漲逾 29% 後動能轉弱,從 $0.07 漲到 $0.09 遇壓
安全爭議與技術背景
Astra 的發表同時也引發對其底層架構的審視。新模型採用所謂「遞迴深度(recurrent depth)」推理機制,透過迴圈式推理強化長鏈條思考能力,但也讓外部觀察者更難監督其完整推理過程。
包括 Redwood Research 在內的安全研究團隊已對此提出警訊,認為此類架構恐讓 AI 監管與可解釋性更加複雜。
OpenAI 並證實,Astra 是公司首款達到其內部定義「Critical(關鍵級)」網路安全門檻的模型。基於此風險評級,Astra 在早期階段僅提供少數具資安背景的 alpha 測試者存取,以便評估潛在濫用情境。
與此同時,OpenAI 主要競爭對手 Google 在 Astra 推出前 106 天內,已連續發表四款 Gemini Flash 模型,但始終未端出新一代旗艦前沿模型。根據 Fortune 在 9 月 3 日的報導,Google 雖聲稱正在逼近「遞迴式自我改進(recursive self-improvement)」階段,卻在最高階模型能力層級上愈發落後。GPT-6 Astra 的問世,恐進一步拉大這項差距。
Altman 隨後在另一則 貼文 中表示,OpenAI 正全力讓 Astra「以我們所能做到的最快速度」進入更多人手中。OpenAI 總裁 Greg Brockman 也在 貼文 中呼應,預期 Astra 將深刻改變創業與科學研究的樣貌。





