OpenAI 表示,旗下未公開的新模型 Astra 在自主資安操作與程式代理能力上進展快速, 加上近期輸出十項重要數學成果, 讓公司首次無法排除其已接近「Critical」級別的資安風險門檻。
重點整理
- OpenAI 8 月 7 日指出,無法再排除 Astra 具備「Critical」等級的資安能力。
- 公司已暫停部分 Astra 內部專案,同步強化資安控管、沙盒與監控機制。
- Astra 產出 10 項研究成果,解決或大幅推進多項長年懸而未決的數學與理論電腦科學問題。
Astra 的資安風險評估
OpenAI 表示,8 月 7 日完成的內部測試顯示, Astra 在「代理式程式撰寫」以及資安相關能力上有顯著躍進,程度已高到公司無法再斬釘截鐵地說, Astra 不會達到其「備援與風險管理框架」(Preparedness Framework)中所定義的 Critical 等級。 不過,OpenAI 也強調,目前評估仍屬初步,尚未宣稱 Astra 已確定跨過該門檻。
依 OpenAI 框架,一個達到 Critical 等級的模型, 可能在缺乏人工監督下,自主開發出能攻破多種高強度防護關鍵系統的零日漏洞(zero-day exploits), 或從高階目標出發,設計並執行全新且完整的端到端攻擊流程。 因此,OpenAI 正收緊內外網路與工具權限、模型權重防護與加密措施, 同時加強沙盒環境與針對 Astra 代理式應用的全程監控。
公司也暫停所有尚未符合新一輪嚴格控管要求的 Astra 活動, 並表示將與政府機構及特定 AI 安全組織合作,進行更完整的測試。 OpenAI 在 8 月 1 日曾稱 Astra 為「下一個重量級模型」, 到 8 月 7 日則改口稱其是「即將推出的多個模型之一」。
延伸閱讀:比特幣本週末恐迎來 BIP-110 分叉,礦工支持度僅 2.59%
數學成果與學界反應
這波資安警訊,源自 OpenAI 近期公開的另一項訊息: 內部版本的 Astra 在多個領域產出 10 項研究成果,包括量子複雜度、 格基密碼學(lattice cryptography)、編碼理論與極值組合學等。 OpenAI 表示,這些成果解決或大幅推進了多個長期懸而未決的開放問題, 而整體推論成本約相當於使用 Sol API 時 2,000 美元的代幣費用。
哥倫比亞大學教授、First Proof 董事 Andrew Blumberg 向 Mashable 表示, 這些結果相當令人印象深刻,但並未改變他對當前 AI 能力的整體看法。 他指出,其中不少是精準反例,或是「小而極具巧思的構造」,建立在既有研究基礎之上。 「對我來說,它們沒有改變原本的先驗判斷。」他說。
儘管如此,這些成果仍突顯前沿模型在學術研究上的合作潛力: 一方面可能加速數學與理論電腦科學進展,另一方面卻也形成平行的資安風險—— 相同的高階程式與推理能力,亦可被挪用至軟體漏洞開發與利用。
這種「創新與風險並行」的張力,正逐步形塑 OpenAI 對 Astra 的使用權限與部署策略。
在 Astra 之前,OpenAI 曾將 GPT-5.6 Sol 的資安風險評級為「High」,而非「Critical」。 當時 GPT-5.6 Sol 已能協助進行漏洞搜尋與部分利用作業, 但 OpenAI 表示,它尚未展現可穩定且自主地攻擊「高防護目標」的能力。 相較之下,Astra 最新評估結果,被視為風險層級的明顯上修與警訊。





