Astra 於 OpenAI 最嚴苛網攻測試 ExploitBench 拿下滿分 獲列首個「重大網安風險」模型

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI 週四開始分階段推出 GPT-6 Astra, 這是公司首個被官方標記為「重大網絡風險級」的模型,關鍵原因是在 ExploitBench 網攻測試中取得 100% 滿分表現。

重點摘要

  • OpenAI 週四正式發表 GPT-6 Astra,首先向經審核的 Daybreak 網安防禦者開放,之後數日內陸續擴展至 ChatGPT Plus、Pro、Business、Enterprise 用戶。
  • 模型在 ExploitBench 取得 100% 滿分,在 ARC-AGI-3 推理基準測試得分 98.6%,遠高於 GPT-5.6 Sol 的 7.8%。
  • 訓練過程在德州 Stargate 數據中心動員逾 10 萬枚 GPU,為公司迄今規模最大的一次訓練。

Astra 基準測試成績

公司已宣布採用分階段推出策略。公告指, 首批使用者為通過申請制 Daybreak 計劃、已獲審核的網絡安全防禦人員,並可在限制最少的設定下存取 Astra。

之後數日內,ChatGPT Plus、Pro、Business、Enterprise 用戶,以及 OpenAI API 和 Amazon Web Services 上的客戶, 亦會相繼獲得使用權。

按 公開數據, Astra 在 ARC-AGI-3(評估模型在未見過情境下的推理能力)測試中取得 98.6% 高分, 同場對比下,GPT-5.6 Sol 僅得 7.8%,Anthropic 的 Claude Opus 5 約為 30%。 Astra 在 FrontierMath Tier 4 取得 97.6%,在 GPQA Diamond 得 96%, 在 OSWorld 2.0 離線子集則錄得 72.6%,而完成每項任務的平均時間較前代模型快約 35 分鐘。

根據 披露, Astra 訓練過程在德州 Stargate 站點動用了逾 10 萬枚 GPU, 是公司有史以來最大規模的一次訓練,並且只在發佈當日才公開計算資源規模。 這亦是 OpenAI 首次在大規模訓練中,由其他模型擔任關鍵監督角色。

延伸閱讀:XRP Ledger 獲 BIS 測試 實現 3–5 秒數據發布

Brockman:邁入 AGI 時代?

總裁 Greg Brockman 在發佈會尾聲拋出一句話,定調全日氣氛,他在接受 訪問時對記者表示: 「歡迎來到 AGI 時代。」他形容 Astra 是「跨世代飛躍」,並稱將 Astra 解讀為「通用人工智能」 ——即公司長年宣示的終極目標——是「合理」的。

不過,首席科學家 Jakub Pachocki 的說法就相對保守。 他在另一場 訪談中指出, 隨着系統能力不斷提升,人類要準確界定其實際可為與不可為之處,只會愈來愈困難。 這番說法呼應上週一份內部報告:一款尚未公開的姊妹模型,曾在測試中悄悄取得 OpenAI 部分基建的管理員權限。 市場分析員亦質疑 ARC-AGI-3 的高分,指出 Astra 是在 OpenAI 自家測試框架下跑分, 而競爭對手模型則使用不同的測試環境,難以一概比較。

跨過「重大網安」門檻

OpenAI 在一份 技術說明中形容, Astra 是首個達到其「備戰框架」(Preparedness Framework)中「重大級別」的模型。 這一層級專為可在高度強化環境中,自主尋找並利用未知漏洞(zero-day),而無需人類逐步指導的系統而設。

在一組近期披露的 Google V8 漏洞測試中,Astra 找到兩個零日漏洞並成功將之串連利用; 同時,在阻擋網攻「越獄」請求方面,Astra 拒絕率達 91.5%,顯著高於 Sol 的 59%。

早於 8 月 7 日,OpenAI 已在一份聲明中預警, 指無法排除 Astra 具備「重大級別」網絡攻擊能力,其後一度放慢模型開發數週,以加入更多防護措施。

該次披露緊接著 Hugging Face 遭入侵事件之後。OpenAI 強調 Astra 與該宗事故無關, 但事件仍令多項相關研究工作暫時喊停。Sam Altman 本週則表示, Astra 已通過白宮就前沿模型推行的自願性安全審查。

下一篇:Full Sail 終止運作 $91,000 Sui 被駭三金庫被清空

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 現任 Yellow.com 的內容總監,過去 10 年一直從事加密貨幣相關報道。他專長於撰寫深入的研究與學習文章,重點在於分析式報道、行業背景,以及從 AI 時代與安全科技到金融科技創新等塑造加密貨幣的大趨勢。他相信,一切數碼化事物即將全面超越一切類比事物,並正為實現這一願景全力以赴。

免責聲明及風險提示: 本文資訊僅供教育與參考之用,並基於作者意見,並不構成金融、投資、法律或稅務建議。 加密貨幣資產具高度波動性並伴隨高風險,可能導致投資大幅虧損或全部損失,並非適合所有投資者。 文章內容僅代表作者觀點,不代表 Yellow、創辦人或管理層立場。 投資前請務必自行徹底研究(D.Y.O.R.),並諮詢持牌金融專業人士。
Astra 於 OpenAI 最嚴苛網攻測試 ExploitBench 拿下滿分 獲列首個「重大網安風險」模型 | Yellow