要点速览
OpenAI于2026年9月3日发布GPT-6 Astra,称其为当前全球最强大模型。 Astra在FrontierMath Tier 4、ARC-AGI-3和TerminalBench-4.0等基准上夺得领先成绩。 正向ChatGPT Plus、Pro、Business和Enterprise用户以及API客户分阶段开放。 OpenAI首席执行官Sam Altman称此次发布“开启了新一代创业浪潮”。 模型采用“循环深度”推理架构,引发安全研究界对可监督性的新担忧。
OpenAI正式发布新一代大模型 GPT-6 Astra,将其定位为公司迄今“最强大、同时也是与人类价值观最对齐”的模型。
此次发布重点面向几个高价值应用领域:复杂电脑操作与自动化、软件工程与代码生成、科学研究与发现、网络安全攻防、 以及各类专业办公与知识工作场景。
OpenAI通过在X平台上的多条帖子确认了发布消息。首席执行官 Sam Altman 在一则帖子中称, 这款模型“让我们多花了一些时间”,并引导用户查看配套博客以了解细节。
Astra已首先向部分合作机构小范围推送,预计数日内将覆盖全部ChatGPT Plus、Pro、Business和Enterprise订阅用户。
Astra的基准测试成绩
OpenAI表示,Astra在FrontierMath Tier 4、ARC-AGI-3和TerminalBench-4.0等前沿能力测评中取得了“业内领先”的结果。 其中,ARC Prize组织在其说明中确认,Astra在ARC-AGI-3 Semi-Private测试中拿到62.7%的成绩, 每次完整测评成本约为2.6万美元。
此外,Astra还在Agents' Last Exam、AutomationBench和ScreenSpot Pro等测试中位居榜首, 这些基准主要评估模型在不同行业专业软件和电脑工作流中的自动化处理能力。
在分发渠道上,Astra除了通过OpenAI自有API提供服务外,也已登陆 Amazon Web Services(AWS)。 OpenAI将Astra称为其“对齐程度最高的模型”,强调其在理解用户意图和遵循使用规范方面的进步。
安全争议与技术背景
Astra的架构设计也引发了安全社区的广泛关注。新模型引入了所谓“循环深度”(recurrent depth)推理机制, 通过循环式的内部推理回路提升复杂思考能力,但也让外部观察者更难直接追踪其“思维链路”。
包括 Redwood Research 在内的多位安全研究者指出,这种结构在提高能力的同时,可能削弱对模型内部推理过程的可审计性, 为AI安全和监管带来新的挑战。
OpenAI确认,Astra是其首个达到公司内部定义“关键级”(Critical)网络安全门槛的模型。 也正因为这一敏感级别,Astra在早期阶段仅向少数“Alpha测试者”开放高级能力,以控制潜在风险。
与此同时,OpenAI的主要竞争对手 Google 正在以较高频率推进 Gemini Flash 系列产品迭代。 在Astra发布前的106天内,Google相继推出了四个Gemini Flash模型,但其真正定位为“前沿旗舰”的顶级模型仍未面世。
《财富》在一篇报道中称, Google对外宣称正在逼近“递归自我改进”阶段,但在最高能力梯队的竞争中,正持续被对手拉开差距。 从当前公开信息看,GPT-6 Astra的推出似乎进一步扩大了OpenAI与竞争者之间的能力鸿沟。
Altman随后在另一则帖子中表示, OpenAI正努力“尽可能快地”让Astra走向大众。OpenAI总裁 Greg Brockman 也在帖子中呼应称, 创业创新和科学研究将是他最看好、也最有可能被Astra深度重塑的两大方向。





