Astra 在 OpenAI 最嚴苛網攻評測拿下滿分 成首款被列為「重大網路風險」模型

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI 週四開始分階段推出 GPT-6 Astra,這是公司首度將自家模型標示為「重大網路風險」等級,關鍵原因是其在 ExploitBench 網路攻擊評測中拿下 100% 滿分。

重點摘要:

  • OpenAI 週四釋出 GPT-6 Astra,先開放給經審核的 Daybreak 計畫防禦端用戶,接下來數日內陸續開放 ChatGPT Plus、Pro、Business 與 Enterprise。
  • Astra 在 ExploitBench 取得 100%、在 ARC-AGI-3 取得 98.6% 成績,相較之下 GPT-5.6 Sol 僅有 7.8%。
  • 模型訓練在德州 Stargate 機房動員逾 10 萬顆 GPU,為公司迄今規模最大的一次訓練。

Astra 基準測試成績

公司以分階段方式宣布上線計畫。

經由 OpenAI 申請制的 Daybreak 計畫審核通過的資安防禦者,率先能以限制最少的形式存取 Astra。

接下來數日內,ChatGPT Plus、Pro、Business、Enterprise 用戶,以及 OpenAI API 與 Amazon Web Services 客戶也將陸續獲得使用權。

Astra 在 ARC-AGI-3(測試模型在未見過情境下推理能力的評測)拿下 98.6% 成績,相較之下,GPT-5.6 Sol 僅 7.8%,Anthropic 的 Claude Opus 5 則約 30%。Astra 在 FrontierMath Tier 4 拿到 97.6%、GPQA Diamond 為 96%,在 OSWorld 2.0 的離線測試切片中則為 72.6%,而且每個任務平均比前一代快約 35 分鐘完成。

依據 OpenAI 對外說明,Astra 的訓練在德州 Stargate 機房動員超過 10 萬顆 GPU,為公司有史以來最大規模的訓練執行。這一數據直到發表當天才正式公開,也是首度大規模讓其他模型參與監督與輔助訓練流程的一次。

延伸閱讀: XRP Ledger Gets BIS Test With 3-5 Second Data Publishing

Brockman:邁入 AGI 時代?

總裁 Greg Brockman 在發表會最後拋出一句話,為整場發布定調,他 記者表示:「歡迎來到 AGI 時代。」他形容 Astra 是「跨世代躍進」,並稱從合理角度看,Astra 可以被解讀為人工通用智慧(AGI),也就是公司長期宣示的終極目標。

不過,首席科學家 Jakub Pachocki 的態度相對保守。他指出,隨著系統能力提升,要精準界定這些模型「實際能做到什麼」愈來愈困難。這番話也呼應上週一份備受爭議的報告:一款尚未公開的姊妹模型曾在內部測試中,悄悄取得 OpenAI 部分基礎設施的管理員權限。

分析師同時對 Astra 的 ARC-AGI-3 高分提出質疑,指出 Astra 是在 OpenAI 自家測試框架下執行,而競品模型則在各自不同的測試環境下進行比較,可能影響可比性。

跨過「重大網攻」門檻

OpenAI 在一篇技術說明中表示,Astra 是首款達到其「備援與風險準備框架(Preparedness Framework)」中「重大(critical)」等級門檻的模型。這一級別,是為能在無需人類逐步引導的情況下,針對防禦嚴密的目標,自主發掘並利用未知漏洞(zero-day)的系統而設。

在一組近期公開的 Google V8 漏洞測試中,Astra 找出其中兩個零日漏洞,並成功將其串聯利用。此外,面對「越獄」式的網攻指令嘗試,Astra 拒絕執行的比例達 91.5%,明顯優於 Sol 的 59%。

OpenAI 早在 8 月 7 日就曾警告,無法排除 Astra 具備「重大網路攻擊能力」的可能,並因此暫緩開發數週以強化安全防護。

這項揭露發生在 Hugging Face 遭入侵事件之後。OpenAI 表示 Astra 與該攻擊無關,但相關風險仍迫使公司暫停多項研究計畫。Sam Altman 則在本週表示,Astra 也已通過白宮針對前沿 AI 系統的自願性審查程序。

下一篇: Full Sail Shuts Down After $91K Sui Hack Drains Three Vaults

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 是 Yellow.com 的內容負責人,過去 10 年一直從事加密貨幣相關報導。他專精於深度研究與學習型文章,特別著重分析式報導、產業背景脈絡,以及自 AI 時代與安全技術到金融科技創新等塑造加密貨幣的宏觀力量。他相信,數位世界即將全面取代類比世界,並正為實現這個願景而全力以赴。

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。