OpenAI 指出,未正式推出的模型 Astra 在內部測試中,既交出10 項重要數學成果,亦在自主網絡攻防與程式編寫方面快速進步,令其網絡安全風險可能逼近公司所訂的「Critical」(關鍵)級別。
重點摘要:
- OpenAI 8 月 7 日表示,現階段已不能排除 Astra 具備「關鍵級」網絡攻擊能力的可能性。
- 公司已暫停部分 Astra 相關內部項目,同時加強安全控制、沙盒環境及監察機制。
- Astra 亦產出 10 項研究成果,解決或大幅推進數學及理論電腦科學中一些懸而未決的難題。
Astra 的網安風險
OpenAI 8 月 7 日披露,最新一輪內部評估顯示,Astra 在「代理式」(agentic)寫碼及網絡安全方面的能力大幅提升,程度之高,令公司再難斷言 Astra 不會觸及其《準備度框架》(Preparedness Framework)中的 Critical 風險級別。
OpenAI 強調,目前評估仍屬初步,並未宣稱 Astra 已確實達到該級別。
按 OpenAI 的框架定義,「Critical 級」模型可在缺乏人手監督下,自主開發針對多個高度防護關鍵系統的可行零日攻擊(zero-day exploits),或僅憑高層次指令便能設計並執行全新、端到端的複合攻擊。
OpenAI 表示,正收緊 Astra 的網絡及工具存取權限、模型權重保護、加密措施與沙盒隔離,並擴大對 Astra 作為代理使用時的行為監測。
任何暫時未完全符合新一輪強化控制要求的 Astra 相關工作,現已被暫停。公司又指,將與政府部門及部分人工智能安全機構合作,對 Astra 作更深入測試。
OpenAI 於 8 月 1 日曾形容 Astra 是「我們下一個主要模型」,到 8 月 7 日則改稱其為「我們其中一個即將推出的模型」,措辭上略見收斂。
延伸閱讀:比特幣本週末或迎來 BIP-110 分叉 礦工支持率僅 2.59%
數學突破引發爭論
這次網安警示,是緊接 OpenAI 公開 Astra 內部版本在數學領域的成績而來。該模型在量子複雜度、格基密碼學、編碼理論及極值組合學等多個範疇,產出 10 項研究結果。
OpenAI 指出,這些成果不是直接解決多年懸而未決的公開難題,就是在理論上明顯向前推進,而整體運算成本約為 2,000 美元代幣(按 Sol API 收費計算)。
哥倫比亞大學教授兼 First Proof 董事 Andrew Blumberg 接受 Mashable 訪問時表示,這批結果「相當亮眼」,但未足以改變他對現有 AI 能力的整體看法。
他形容,當中不少成果屬於簡潔的反例,或是在既有理論基礎上構建的「細小但極為巧妙」結構,「它們沒有改變我的先驗判斷」,他說。
儘管如此,這些結果仍然展示出前沿模型有潛力成為科研上的「合作研究員」——但同一套寫碼與推理能力,一旦轉向軟件漏洞利用與攻擊設計,便同步衍生嚴峻的安全隱憂。
這種兩面性,正逐步左右 OpenAI 如何評估模型的開放程度及部署策略。
在 Astra 之前,OpenAI 曾對 GPT-5.6 Sol 進行網安評級,當時只被定為「High」(高)而非「Critical」。
按公司說法,GPT-5.6 Sol 雖然能協助尋找並利用軟件漏洞,但未展現出對「高防護目標」持續而可靠的自主攻擊能力。
相比之下,Astra 近期的內部評估,標誌著風險級別出現明顯升級。





