OpenAI 指出,其未公開模型 Astra 近期在數學研究及自動化網絡攻防表現急速提升,並產出10 項具分量的數學成果,令該模型有機會逼近公司在「備戰框架」(Preparedness Framework)中訂立的「關鍵級」(Critical)網絡安全能力門檻。
要點速覽:
- OpenAI 於 8 月 7 日表示,現階段已無法排除 Astra 具備「關鍵級」網安能力的可能性。
- 公司已暫停部分 Astra 內部項目,同時強化安全控制、沙盒環境及監控機制。
- Astra 亦在數學及理論計算機科學多個範疇,產生 10 項解決或推進長年懸而未決問題的研究成果。
Astra 的網絡風險
OpenAI 稱,8 月 7 日完成的最新內部評估顯示,Astra 在代理式(agentic)編碼及網絡安全能力上有「重大進展」,進度之快,令公司已不能再斷言 Astra 不會觸及「關鍵級」門檻。不過,OpenAI 強調,現階段評估仍屬初步,亦未宣稱 Astra 已正式達標。
按 OpenAI 的備戰框架,「關鍵級」模型代表其可在多類經嚴格加固的關鍵系統上,自主開發可行的零日攻擊工具(zero-day exploits),或由高層次指令出發,自行設計並執行具創新的端對端攻擊行動。為此,OpenAI 表示正收緊 Astra 可接觸的內部網絡及工具權限,強化模型權重保護、加密及沙盒隔離機制,並擴大對 Astra 代理式使用場景的持續監控。
公司同時暫停未能符合新一輪嚴格安全要求的 Astra 活動,並計劃與政府機構及部分人工智能安全組織合作,進一步測試其風險。OpenAI 於 8 月 1 日曾形容 Astra 是「我們下一個主要模型」,到 8 月 7 日則改稱 Astra 為「其中一個即將推出的模型」,措辭上有所降溫。
延伸閱讀: 比特幣本周末或臨 BIP-110 分叉 礦工支持率僅 2.59%
數學突破與爭議
這次網安警示,是緊接 OpenAI 披露 Astra 內部版本在數學領域取得的一系列新成果而來。據稱,Astra 於量子複雜度、格基密碼(lattice cryptography)、編碼理論及極值組合學等多個範疇,一共產生 10 項結果,當中部分被指解決、或大幅推進長期懸而未決的開放問題;按 Sol API 的定價計算,相關運算成本約為 2,000 美元代幣。
哥倫比亞大學教授兼 First Proof 董事會成員 Andrew Blumberg 接受 Mashable 訪問時表示,這批結果「令人印象深刻」,但並未動搖他對現階段 AI 能力的整體看法。他指出,不少結果屬精簡的反例,或是建立在既有文獻之上的「小巧但極為巧妙結構」。他直言:「它們沒有改變我的先驗信念。」
儘管如此,這些成果仍然突顯前沿模型作為科研「合作者」的潛力——同一套強大編碼與推理能力,既可以用於解決高深數學問題,同時亦可能被挪用來尋找並利用軟件弱點,形成一種平行存在的安全風險。
這種兩面性,正逐步重塑 OpenAI 如何界定模型的開放程度及部署節奏。
在 Astra 之前,OpenAI 曾將 GPT-5.6 Sol 的網安能力評為「高」(High)級而非「關鍵級」。該模型雖然能輔助漏洞發掘及利用相關工作,但據稱尚未展現出對高度加固目標進行可靠、自主攻擊的能力。相比之下,Astra 最新評估結果被視為風險級別的一次明顯上調。





