重點摘要
OpenAI於2026年9月3日發佈GPT-6 Astra,稱之為現時全球最佳AI模型。
Astra在FrontierMath Tier 4、ARC-AGI-3及TerminalBench-4.0等基準測試中拔尖。
現正向ChatGPT Plus、Pro、Business及Enterprise用戶,以及API客戶分階段推出。
OpenAI行政總裁Sam Altman形容,是「創業新世代的起點」。
模型採用遞迴深度推理迴路,引起安全研究界對可監管性的疑慮。
OpenAI 9月3日正式發佈新一代大型模型 GPT-6 Astra,並將其定位為公司至今「能力最強、對齊度最高」的旗艦產品。
今次發佈明確針對多個高價值場景,包括電腦操控、自動化軟件開發、科學研究、網絡保安,以及各類專業辦公工作。
OpenAI透過社交平台X一連串貼文確認消息。行政總裁 Sam Altman 在一篇 貼文 中表示,Astra「比預期多花了一點時間」,並引導讀者查閱官方 blog 了解詳情。
Astra即日開始向部分機構客戶試點推出,預計數日內覆蓋所有ChatGPT Plus、Pro、Business及Enterprise訂戶。
Astra基準測試成績
OpenAI表示,Astra在FrontierMath Tier 4、ARC-AGI-3及TerminalBench-4.0等前沿基準測試中均錄得業界頂尖成績。
ARC Prize組織在一篇 文章 中披露,Astra在ARC-AGI-3 Semi-Private項目取得62.7%分數, 每次完整測試成本約為26,000美元。Astra同時在Agents' Last Exam、AutomationBench及ScreenSpot Pro等, 針對多行業電腦工作流程的評測中領先對手。
Astra亦已透過OpenAI API及 Amazon Web Services(AWS)提供使用。OpenAI稱這是其「對齊度最高」的模型, 指出在理解用戶意圖及行為約束方面有明顯改善。
安全爭議與技術背景
Astra問世之際,其底層架構同時成為安全社群關注焦點。模型採用所謂「遞迴深度」(recurrent depth)設計, 透過迴圈式推理讓模型在內部多輪思考,令外部研究人員更難清晰追蹤其完整思考鏈。
來自 Redwood Research 等安全團隊的研究人員已就此提出警示,憂慮此類設計削弱AI監督及審計能力。
OpenAI同時確認,Astra是公司首個觸及其所定義「關鍵級」(Critical)網絡安全門檻的模型。 由於風險評級較高,公司最初只向少數內部及受邀alpha測試者開放較高權限的功能。
另一方面,OpenAI主要競爭對手 Google 在Astra發佈前106日內,先後推出四款 Gemini Flash 模型, 但其最新一代前沿旗艦模型仍未見蹤影。《Fortune》在9月3日 報道 指出,Google聲稱正逼近「遞迴自我改進」階段,但在最高性能模型層級,與對手的差距有擴大之勢, 而GPT-6 Astra的推出似乎進一步拉開兩者距離。
Altman其後在另一篇 貼文 中表示,OpenAI正全力推進,希望「盡快將Astra帶到每一個人手中」。 OpenAI總裁 Greg Brockman 亦在 貼文 中呼應,強調創業及科學探索將是Astra最具變革力的兩大領域。





