要點摘要
OpenAI 於 2026 年 9 月 3 日推出 GPT-6 Astra,稱之為目前全球最佳模型。
Astra 聲稱於 FrontierMath Tier 4、ARC-AGI-3 及 TerminalBench-4.0 取得頂級成績。
現正向 ChatGPT Plus、Pro、Business、Enterprise 用戶及 API 用戶分階段開放。
OpenAI 行政總裁 Sam Altman 形容,是「新一代創業潮的開端」。
模型採用循環深度推理迴圈,引發安全研究界對監管及風險的疑慮。
OpenAI 9 月 3 日正式推出 GPT-6 Astra,定位為公司至今最強大、與用戶意圖最「對齊」的 AI 模型。
是次發佈明確鎖定五大應用場景:電腦操作與自動化流程、軟件工程、科學研究、網絡安全,以及各類專業辦公工作。
OpenAI 透過多則 X 帖文公布相關細節。行政總裁 Sam Altman 在一則 帖文中表示,Astra「比預期花了更長時間」才準備好, 並引導用戶查閱官方博客了解詳情。
Astra 已率先向部分機構客戶開放,並將於數日內陸續覆蓋所有 ChatGPT Plus、Pro、Business 及 Enterprise 訂閱用戶。
Astra 的基準測試表現
OpenAI 指出,Astra 在 FrontierMath Tier 4、ARC-AGI-3 和 TerminalBench-4.0 等前沿基準測試上, 均錄得業界領先成績。ARC Prize 組織亦在公告中確認, Astra 在 ARC-AGI-3 半公開測試中取得 62.7% 分數,每次運行成本約 26,000 美元。
此外,Astra 亦在 Agents' Last Exam、AutomationBench 和 ScreenSpot Pro 等評測中領先同業, 這些測試主要模擬跨行業的電腦操作和工作流程表現。
模型同時已經連接至 OpenAI API,並可在 Amazon Web Services(AWS)上使用。 OpenAI 形容 Astra 是其迄今「最對齊」的模型,強調在理解及執行用戶意圖方面有明顯改進。
延伸閱讀: 狗狗幣由 0.07 美元急彈 29% 至 0.09 美元後動能降溫
安全疑慮與技術背景
Astra 的推出,同時把焦點推向其底層架構設計。新模型採用所謂「循環深度」(recurrent depth)推理技術, 透過多輪迴圈思考提升推理能力,但亦令外部觀察者更難追蹤其完整思考鏈條, 令安全與監管研究人士憂慮可監督性下降。
來自 Redwood Research 等安全研究機構的專家,已就此發出風險提示,認為需要更嚴謹的審查與防護機制。
OpenAI 同時確認,Astra 是公司首個達到其內部定義「Critical」級別網絡安全門檻的模型。 基於該級別潛在攻防能力較高,OpenAI 起初只向少數 Alpha 測試者開放高級權限。
在競爭層面,OpenAI 主要對手 Google 於 Astra 發佈前 106 日內,已先後推出四款 Gemini Flash 模型,但其旗艦級 frontier 模型仍未面世。根據《Fortune》在 9 月 3 日的 報道, Google 表示正逼近「遞迴式自我改進」(recursive self-improvement), 然而在最頂級模型梯隊中,與競爭對手的差距卻有擴大跡象。GPT-6 Astra 的亮相,被視為進一步拉開這段距離。
Altman 其後在另一則 帖文中稱,OpenAI 正全力推動 Astra 「盡快走入每個人的手中」。 OpenAI 總裁 Greg Brockman 亦在 帖文中呼應,預期 Astra 將徹底改變創業模式及科學發現方式。





