OpenAI 已在 8 月 1 日證實,下一代主力模型家族將以 Astra 為名。這款尚未公開的系統曾一口氣解出 10 題數學難題,消息曝光時間僅落後 Anthropic 推出 Claude Opus 5 一週。
重點整理:
- OpenAI 於 8 月 1 日在研究文章中首度確認 Astra 名稱,並公布 10 題已解數學問題。
- Astra 採多代理長時間協作機制,單一題目可運算數小時到數天,目前尚未開放、亦無時程。
- Claude Opus 5 已於 7 月 24 日上線,定價為每百萬輸入 token 5 美元、輸出 25 美元,支援 100 萬 token 上下文。
OpenAI Astra 模型細節
OpenAI 在一篇研究貼文中正式公布 Astra 名稱,並將 10 項橫跨數學與理論電腦科學的重大成果,歸功於 Astra 的內部版本。這些命題多已開放逾十年,涵蓋高維幾何、編碼理論與量子複雜度理論,其中一項證明更建立了「非 sofic 群」存在性的結果。
Astra 的賣點不是「算得多快」,而是「撐得多久」:它會協調多個代理模型,在同一個問題上協作數小時甚至數天,以長時程推理取代短平快推論。
先前報導曾指出,Astra 將與 Sol、Terra、Luna 等系列並列,同樣尚未決定是否掛上 GPT-6 或 GPT-5.7 品牌,也沒有明確上市時間表。相關報導稱,Sam Altman 已在華府向政策制定者進行 Astra 示範,外界預期 Astra 家族將成為未來美國聯邦 AI 審核框架下,首批接受正式審查的模型之一。
延伸閱讀: AI 基礎設施:發薪日貸款商的百億美元豪賭,轉身搶進資料中心
Claude Opus 5:定價與測試成績
Anthropic 於 7 月 24 日正式發表 Claude Opus 5,定價維持與 Opus 4.8 相同,每百萬輸入 token 收費 5 美元、輸出 25 美元。根據外部測試,它在 Artificial Analysis Intelligence Index 上拿下 61 分,在多項任務的單次成本約為 Fable 5 的一半。
Opus 5 的上下文字串長度可達 100 萬 token,單次輸出上限為 128,000 token。在 ARC-AGI-3 測試中,它取得 30.2% 分數,約為次佳公開成績的三倍;在 Terminal-Bench 2.1「最大努力」設定下,也拿到 89.1% 的高分。Anthropic 發言人受訪時建議,企業在選型時,應至少比較一次「邊界清楚的短任務」與一次「長期、跨階段流程」的實際表現,再做採購決定。
市場與學界如何看 Astra?
Astra 目前沒有任何官方定價、公開測試數據或第三方評測,對潛在客戶而言,只能在「已上線的成熟產品」與「實驗室宣稱的突破」之間權衡。
曼徹斯特大學數學家 Thomas Bloom 在 X 上直言,這 10 項結果是「大新聞」,評價甚至高於 OpenAI 過去公布的數學證明。
不過,Bloom 也反駁了「Astra 會取代數學家」的說法,強調這個系統本身就是由人類研究者打造,並以歷來數學文獻為訓練基礎。OpenAI 研究員 Noam Brown 則指出,這次成果並未觸及任何一項「千禧年懸賞難題」,且團隊在每一題上實際投入的算力成本並不算高。
認知科學家 Gary Marcus 則在個人專欄中主張,Astra 的數學成果「確實存在」,但被嚴重「過度包裝」,距離「問題已被徹底解決」仍有明顯落差。
值得注意的是,這並非 Astra 相關技術的首度亮相。今年 5 月,同一長時程推理家族的系統,已成功推翻離散幾何領域懸宕 80 年的「Erdos 單位距離猜想」。當時,菲爾茲獎得主 Tim Gowers 表示,會毫不猶豫推薦該篇論文刊登於《Annals of Mathematics》。





