OpenAI 表示,其未发布模型 Astra 在自动化网络攻防和“代理式”编程方面的进展明显,叠加近期产出的 10 项重要数学成果,正逼近公司内部定义的 “Critical(关键级)”网络安全能力门槛。
要点速览
- OpenAI 8 月 7 日称,已无法排除 Astra 具备“关键级”网络安全能力的可能性。
- 公司暂停部分 Astra 内部项目,同时全面加固安全控制、沙箱和监测体系。
- Astra 还产出 10 项研究成果,解决或显著推进多项悬而未决的数学与理论计算机科学难题。
Astra 的网络安全风险
OpenAI 8 月 7 日披露,最新一轮内部评估 显示,Astra 在代理式编程与网络安全能力上跳跃式提升, 其攻防潜力已强到公司无法再“排除其达到 Critical 水平”的可能性。这并不意味着 Astra 已被正式认定为关键级模型, OpenAI 强调相关结论仍属初步评估。
按 OpenAI 的《Preparedness Framework(防范准备框架)》定义,Critical 级模型意味着其可在较高自主性下, 对大量高防护关键系统开发可用的零日漏洞利用工具,或从一个抽象指令出发,独立完成新型端到端网络攻击链路。
为此,OpenAI 正收紧 Astra 的网络与工具访问权限,强化模型权重保护、加密措施与沙箱隔离,并扩大对 Astra 作为“智能代理”时的 行为监控范围。
对于尚未满足更高安全标准的 Astra 活动,公司已主动按下暂停键;OpenAI 还计划与政府机构及特定的 AI 安全组织合作, 对 Astra 展开更系统的测试评估。OpenAI 在 8 月 1 日将 Astra 称为“我们的下一代旗舰模型”,而到了 8 月 7 日, 说法则变为“我们即将推出的模型之一”,措辞明显趋于审慎。
延伸阅读: 比特币或于本周末接近 BIP-110 分叉,但矿工支持率仅 2.59%
数学突破引发的新争议
安全预警背后,是 OpenAI 此前披露的一系列数学研究成果:一版内部 Astra 模型在量子复杂性、格密码、编码理论、 极值组合数学等多个方向上给出 10 项结果。OpenAI 称,这些成果要么解决,要么大幅推进了一批长期悬而未决的公开问题, 所耗算力成本按 Sol API 计价约为 2,000 美元。
哥伦比亚大学教授、First Proof 董事会成员 Andrew Blumberg 向 Mashable 表示,他对这些结果印象深刻, 但这并未改变他对当下 AI 实力的整体判断。他指出,许多成果是简洁反例或建立在既有工作基础上的“小而极其巧妙的构造”。 “它们并没有改变我的先验判断。”他说。
尽管如此,这些结果仍在展示一个趋于清晰的方向:前沿大模型正快速成为数学与理论研究的“协作者”, 但同一套代码推理与构造能力,也可以被直接迁移到软件漏洞挖掘和利用上,形成对称的安全风险。
这种张力正在重塑 OpenAI 对访问权限和产品落地策略的评估标准。
在 Astra 之前,OpenAI 对 GPT-5.6 Sol 的网络安全评级还是 High(高风险级),而非 Critical。 当时的评估认为,该模型可在一定程度上辅助漏洞发现和利用,但尚无法在高防护目标上稳定执行端到端的自主攻击。 与之相比,Astra 的最新评估被视为风险等级上的“台阶式升级”。





