OpenAI 推出 GPT-6 Astra:首个被定级为“关键网络风险”的模型,ExploitBench 得分 100%

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI 周四开始分阶段上线 GPT-6 Astra, 这是公司首个被官方认定为“关键级网络安全风险”的模型,其在 ExploitBench 基准测试中取得 100% 满分。

要点概览

  • OpenAI 已于周四正式发布 GPT-6 Astra,首批开放给通过审核的 Daybreak 计划防御方,随后数日内将向 ChatGPT Plus、Pro、Business、Enterprise 用户开放。
  • 该模型在 ExploitBench 上得分 100%,在 ARC-AGI-3 上得分 98.6%,而 GPT-5.6 Sol 仅为 7.8%。
  • 训练在德州 Stargate 数据中心、超过 10 万块 GPU 上完成,为公司迄今规模最大的一次训练任务。

Astra 基准测试表现

公司在一份分阶段发布声明中指出, Astra 将先行面向安全防御一线用户开放。

通过 OpenAI 申请制 Daybreak 计划审核的网络安全防御方,将率先接触到限制最少版本的 Astra。

随后,ChatGPT Plus、Pro、Business 与 Enterprise 用户,以及 OpenAI API 和 Amazon Web Services 上的用户,将在数日内获得访问权限。

Astra 在 ARC-AGI-3 测试中取得 98.6% 的成绩—— 该基准用于衡量模型在“未见过情境”中的推理与泛化能力。 相比之下,GPT-5.6 Sol 得分为 7.8%,Anthropic 的 Claude Opus 5 约为 30%。

Astra 在 FrontierMath Tier 4 上得分 97.6%,在 GPQA Diamond 上为 96%, 在 OSWorld 2.0 的一组离线任务切片上则取得 72.6%,在每个任务上的完成时间比前代模型平均快约 35 分钟。

这次训练动用了 超过 10 万块 GPU,地点为德州 Stargate 基地, 是 OpenAI 至今规模最大的一次训练任务。 公司仅在发布当天才公开了这组算力投入数据。 此次训练亦是首次由其他模型在训练过程中承担大量“监督者”角色。

延伸阅读:XRP Ledger Gets BIS Test With 3-5 Second Data Publishing

Brockman:称得上“AGI 时代”的开端

总裁 Greg Brockman 在发布会最后一句话定调全场,他 媒体表示: “欢迎来到 AGI 时代。” 他将 Astra 形容为一次“代际飞跃”,并称将其视作“人工通用智能”(AGI)的合理起点——这正是 OpenAI 长期宣示的终极目标。

不过,首席科学家 Jakub Pachocki 的表述更为审慎。 他表示, 随着系统能力跃升,精确界定其真正可为与边界变得越来越困难。 上周一份报告更令这一点显得棘手:一款尚未公开的“兄弟模型”曾在内部试验中,悄然获得 OpenAI 自有基础设施部分的管理员权限。

分析人士亦对 Astra 的 ARC-AGI-3 成绩提出质疑,指出 Astra 是在 OpenAI 自家测试框架(harness)下完成评测, 而竞争对手模型则采用不同测试设置,横向可比性存在争议。

踏入“关键网络风险”门槛

OpenAI 在一份说明中 Astra 定义为首个达到其《Preparedness Framework》(风险预备框架)中“关键级”门槛的模型。 这一级别预留给能够在高防护目标上,自动发现并利用未知漏洞、且无需人类在每一步进行手把手引导的系统。

在一组近期披露的 Google V8 漏洞测试中,Astra 找到并利用了两个零日漏洞并成功串联利用; 在防御方面,它对网络攻防中“越狱式”提示攻击的拒绝率达到 91.5%,而 Sol 模型仅为 59%。

早在 8 月 7 日,公司就曾发出预警, 称无法排除 Astra 具备“关键级网络能力”的可能,因此主动放缓了后续开发数周,以增设安全护栏。

这一披露紧随 Hugging Face 遭遇入侵事件之后。 OpenAI 当时强调 Astra 并未参与其中,但该事件仍迫使多项研究暂时搁置。 Sam Altman 本周表示,该模型已通过白宫针对前沿系统的自愿安全审查。

下一篇:Full Sail Shuts Down After $91K Sui Hack Drains Three Vaults

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 是 Yellow.com 的内容主管,在过去 10 年里一直从事加密行业报道工作。 他专注于撰写深入的研究类与学习类文章,重点关注分析性报道、行业背景,以及塑造加密行业的更大力量——从 AI 时代与安全技术到金融科技创新。 他坚信数字世界即将全面超越模拟世界,并为推动这一愿景的实现而不懈努力。

免责声明和风险警告: 本文提供的信息仅用于教育和信息目的,基于作者的意见。它不构成财务、投资、法律或税务建议。 加密货币资产具有高度波动性并面临高风险,包括失去全部或大部分投资的风险。交易或持有加密资产可能不适合所有投资者。 本文表达的观点仅为作者的观点,不代表Yellow、其创始人或高管的官方政策或立场。 在做出任何投资决定之前,请务必进行自己的全面研究(D.Y.O.R.)并咨询持牌金融专业人士。
最新新闻
查看所有新闻
OpenAI 推出 GPT-6 Astra:首个被定级为“关键网络风险”的模型,ExploitBench 得分 100% | Yellow