要点概览
OpenAI 于 2026 年 9 月 3 日发布 GPT-6 Astra,称其为“目前全球最强大模型”。 Astra 在 FrontierMath Tier 4、ARC-AGI-3、TerminalBench-4.0 等基准上拿下领先成绩。 正在向 ChatGPT Plus、Pro、Business、Enterprise 以及 API 用户分批推送。 OpenAI CEO Sam Altman 称此次发布“开启了新一代创业浪潮”。 模型采用循环深度推理结构,引发安全研究者对可监督性与可控性的担忧。
OpenAI 于 9 月 3 日正式推出新旗舰模型 GPT-6 Astra,将其定位为公司迄今“最强大、与人类意图最高度对齐”的通用模型。
此次发布重点面向电脑使用场景、软件工程、科学研究、网络安全和各类专业办公工作。
OpenAI 通过社交平台 X 一系列帖文对外官宣。CEO Sam Altman 在一则帖文中表示,这款模型“让我们多花了一些时间”,并引导用户前往官方博客了解细节。
Astra 已开始小范围灰度放量,首批面向部分机构客户,预计数日内覆盖所有 ChatGPT Plus、Pro、Business 与 Enterprise 订阅用户。
基准测试成绩:冲在前沿
按 OpenAI 的说法,Astra 在 FrontierMath Tier 4、ARC-AGI-3 和 TerminalBench-4.0 等前沿基准上取得当前最优成绩。
ARC Prize 组织在其公告中确认,Astra 在 ARC-AGI-3 半私有赛道上取得 62.7% 的得分,单次测试成本约为 2.6 万美元。
Astra 同时在 Agents' Last Exam、AutomationBench 和 ScreenSpot Pro 等基准上位居榜首,这些指标主要评估模型在各类专业岗位上的电脑操作与自动化工作流能力。
新模型已通过 OpenAI API 对外提供,并登陆 Amazon Web Services(AWS)等云平台。
OpenAI 将 Astra 描述为迄今“对齐度最高”的模型,称其在理解用户真实意图和遵循使用边界方面有显著改进。
延伸阅读:狗狗币从 0.07 美元涨至 0.09 美元后动能降温
安全焦点与技术背景
Astra 的发布同时把聚光灯打在其底层架构之上。该模型采用“循环深度”(recurrent depth)推理技术,通过循环式的链式思考来提升复杂推理能力,但也使外部观察者更难清晰追踪其完整推理路径。
来自 Redwood Research 等机构的安全研究人员将这一特性视为 AI 可监督性和可解释性的新风险点,担心这会削弱第三方对高能力模型的独立审查能力。
OpenAI 方面确认,Astra 是其首个达到公司内部定义的网络安全“Critical(关键级)”门槛的模型。基于这一等级评估,OpenAI 起初仅向少数“Alpha”测试者提供高级访问权限,并在安全评估后逐步扩大可用范围。
在竞争维度上,OpenAI 的主要对手 Google 在 Astra 发布前 106 天内已经连续推出四款 Gemini Flash 模型,但其旗舰级前沿模型迟迟未见公开亮相。
《Fortune》在一篇报道中援引 Google 的说法称,公司正逼近“递归自我改进”能力,但在最顶级模型赛道上与对手的差距却在拉大。随着 GPT-6 Astra 上线,这一差距看起来进一步扩大。
Altman 随后在另一则帖文中表示,OpenAI 正努力让 Astra “尽快走进每个人的手中”。
OpenAI 总裁 Greg Brockman 也在贴文中传递类似信号,认为创业与科学发现将是 Astra 最先产生深远影响的两大板块。





