Anthropic 週五正式推出新旗艦大模型 Claude Opus 5,輸入端收費維持每百萬 token 5 美元, 公司指其整體表現已相當接近定價更高的 Claude Fable 5, 但成本大約只係一半。
重點摘要
- Opus 5 沿用 Opus 4.8 收費結構,輸入每百萬 token 5 美元、輸出每百萬 token 25 美元。
- 喺 GDPval-AA v2 知識工作基準測試中,Opus 5 取得 1,861 分,領先 Fable 5 同 OpenAI GPT-5.6 Sol。
- 公司估計,其安全審查系統介入次數較 Fable 5 減少約 85%。
Claude Opus 5:定價與使用方式
Anthropic 喺官方 部落格 公布 Opus 5 詳情,定位為「為日常工作而設」的旗艦模型, 並非一味追逐排行榜最高分。
Opus 5 即日起成為 Claude Max 訂戶的預設模型,亦係 Claude Pro 用戶可以使用到的最高階型號; 開發者則可以透過 Claude API 直接接入。
Token 收費與 5 月 28 日推出的 Opus 4.8 一致。平台同時提供一個「加速模式」,輸出速度約為預設的 2.5 倍, 但按 token 收費亦加倍。另有「效能調校」選項,容許企業以犧牲部分推理能力,換取更低成本同更快回應時間。
延伸閱讀: BitMEX Is Shutting Down After 11 Years With No Buyer In Sight
與 GPT-5.6 Sol 正面較量:Opus 5 基準測試表現
喺 GDPval-AA v2 知識工作評測中,Opus 5 拿到 1,861 分,較 Fable 5 的 1,747 分同 OpenAI GPT-5.6 Sol 的 1,736 分為高, 相關數據見於公司隨發佈一併 流出 的比較表。
喺這組比較中,Sol 只喺一個指標上勝出——針對代理式寫程式的 DeepSWE v1.1 測試。 Google 的 Gemini 系列則完全未有出現在該表格之中。
開發工具公司 Cursor 聯合創辦人 Sualeh Asif 指出,Opus 5 以接近 Fable 的智能水準, 提供 Opus 系列一貫的速度與價格表現。法律科技公司 Harvey 應用研究主管 Niko Grupen 則表示, 即使喺較低推理設定下,Opus 5 仍能維持質素,同時平均輸出 token 數較 Opus 4.8 減少 26%。
兩間公司都喺正式發布前率先試用新模型。
五月以來 Anthropic 模型更新節奏
Opus 5 係 Anthropic 兩個月內推出的第四款 Claude 模型:Opus 4.8 於 5 月 28 日登場, 之後係 6 月 9 日面向高階長推理場景的 Mythos 級 Fable 5,以及 6 月 30 日推出的 Sonnet 5。 在此之前,Opus 系列亦由去年 11 月至今年 4 月之間快速迭代過 4.5、4.6、4.7 幾個版本。
呢輪密集發佈,正值 Anthropic 與華府監管部門關係緊張之際:今年 6 月, 美國聯邦官員曾基於網絡安全疑慮,要求公司暫時下架其 Mythos 級模型, 其後數星期先重新獲准恢復提供。
同一個月,Anthropic 已遞交機密文件,啟動首次公開募股(IPO)程序, 並被外電 報道 仍按計劃爭取今年內掛牌。
下一篇: HubSpot Fell 12.7% And Analysts Point Straight At OpenAI's New Agent





