Anthropic:Claude Opus 5 成效幾乎追平 Fable、成本只要一半

Anthropic:Claude Opus 5 成效幾乎追平 Fable、成本只要一半

Anthropic 週五推出最新旗艦模型 Claude Opus 5,輸入端維持每百萬 token 5 美元的定價。公司表示,Opus 5 在整體表現上已逼近高價位的 Claude Fable 5,但成本僅為後者的一半。

重點整理:

  • Opus 5 沿用 Opus 4.8 的計價結構,輸入、輸出分別為每百萬 token 5 美元與 25 美元。
  • 在 GDPval-AA v2 知識工作基準測試中,Opus 5 拿下 1,861 分,領先 Fable 5 與 OpenAI 的 GPT-5.6 Sol。
  • 公司估算,相較 Fable 5,安全分類器觸發介入的頻率可降低約 85%。

Claude Opus 5:定價與存取方式

Anthropic 在部落格公告中說明,Opus 5 的定位是「為日常工作優化的模型」,而非單純追求排行榜上破表的分數。

Opus 5 將成為 Claude Max 訂閱用戶的預設模型,也是 Claude Pro 用戶目前能使用的最強版本;開發者則可透過 Claude API 直接調用。

Token 價格與 5 月 28 日推出的 Opus 4.8 相同。系統並提供「加速模式」,輸出速度約為預設的 2.5 倍,但收費為基礎費率兩倍;另有「效能調節」選項,讓企業可在推理能力與成本、延遲之間自行取捨,以換取更便宜、回應更快的結果。

延伸閱讀: BitMEX Is Shutting Down After 11 Years With No Buyer In Sight

與 GPT-5.6 Sol 比拚的基準測試成績

在 GDPval-AA v2 知識工作測試上,Opus 5 取得 1,861 分,優於 Fable 5 的 1,747 分,以及 OpenAIGPT-5.6 Sol 的 1,736 分。相關數據來自公司在發表時對外流傳的成績表。

在這組對照中,Sol 僅在一項測試領先,也就是名為 DeepSWE v1.1 的代理式程式設計基準。值得注意的是,Google 的 Gemini 系列並未出現在這份表格當中。

AI 開發平台 Cursor 共同創辦人 Sualeh Asif 表示,Opus 5「以 Opus 的價格與速度,提供接近 Fable 的智力水準」。法律軟體公司 Harvey 應用研究主管 Niko Grupen 則指出,即便在較低推理設定下,Opus 5 仍能維持品質,同時平均輸出 token 數比 Opus 4.8 減少 26%。

兩家公司都在正式發布前參與了模型測試。

Anthropic 近月來的模型發表節奏

Opus 5 是 Anthropic 在不到兩個月內推出的第四款 Claude 模型。Opus 4.8 於 5 月 28 日上線,接著是 6 月 9 日發表的神話級(Mythos-class)Fable 5,以及 6 月 30 日登場的 Sonnet 5。在此之前,Opus 系列亦快速迭代,自去年 11 月到今年 4 月,先後走過 4.5、4.6、4.7 等版本。

這波密集發表,發生在與華府關係緊繃的時點——今年 6 月,美國聯邦單位因網路安全疑慮,一度要求 Anthropic 下架其 Mythos 級模型;數週後相關限制解除,模型才得以重新上線。同月,Anthropic 已遞交秘密文件啟動首次公開發行(IPO)程序,外媒報導指,公司目前仍按原計畫朝今年掛牌目標推進。

下一篇: HubSpot Fell 12.7% And Analysts Point Straight At OpenAI's New Agent

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。
Anthropic:Claude Opus 5 成效幾乎追平 Fable、成本只要一半 | Yellow