評測者正引導一般使用者,將日常的文字、程式碼與規劃工作,轉向 5 個更便宜的對手模型,而非使用 Anthropic 的 Claude Fable 5。
重點摘要:
- 自 Fable 5 六月登場以來發布的比較指南,指出在程式開發、寫作與長文處理上,有五個經常被提到的替代方案。
- Google 的 Gemini 3.1 Pro 每百萬輸入 token 僅收費 2 美元,相較之下 Fable 5 為 10 美元。
- Fable 5 在 SWE-Bench Pro 測試中以 80.3% 領先群雄,但評測者認為日常任務根本用不到這種天花板表現。
依任務劃分的 Claude Fable 5 替代方案
自模型於 6 月 9 日上線後,一連串獨立科技部落格的比較指南,已依日常使用場景將前沿模型陣容重新整理。幾乎所有文章都得出同樣結論:Fable 5「Mythos 級」的強大運算,多半閒置在多數上班族每天實際執行的任務之外。
Claude Opus 4.8、OpenAI 的 GPT-5.5、Google 的 Gemini 3.1 Pro、xAI 的 Grok 和 Claude Sonnet 5,在這些比較中反覆出現。
Fable 5 的定價為每百萬輸入 token 10 美元、輸出 token 則為 50 美元,是目前領域中價格最高的一檔。它在 SWE-Bench Pro 程式測試中名列前茅,成績為 80.3%,領先 GPT-5.5 的 58.6% 以及 Gemini 3.1 Pro 的 54.2%。隨著任務越長、邏輯越糾結,Fable 5 的領先幅度越大——但這恰恰是一般使用者日常提問最會刻意避開的工作類型。
延伸閱讀:為何 Tether 轉身背離歐洲 MiCA 穩定幣規範
為何評測者鼓勵「任務導向分流」
Opus 4.8 被最多人點名為日常程式開發的近乎「即插即用」替代方案,因為它沿用了 Anthropic 的工具與授權機制,價格卻只有 Fable 5 的一半。GPT-5.5 則被多數評測者評為最容易選用的通用模型,在散文、草稿撰寫與日常研究等方面表現最為突出。
Gemini 3.1 Pro 在長文處理與規劃任務上勝出,每百萬輸入 token 僅 2 美元,是這幾款中最便宜的,同時在研究所層級的科學題目上略勝一籌。
Grok 則扮演代理人(agent)式任務的「預算型」選擇,不過評測者提醒,它在長時間推理中可能出現遺失脈絡的情況。Sonnet 5 則補上輕量、快速任務的空缺,以極低成本完成工作。
Fable 5 仍然訂下整個領域的天花板,Andrej Karpathy 甚至形容其領先幅度,是少見能在單一發表中達成的 SOTA 表現。不過評測者反駁,像是寫一篇部落格大綱、做一個快速摘要,根本用不上這種頭頂空間,因此為它支付最高牌價,只是在浪費錢。
Fable 5 動盪的首月表現
相關建議出現在模型動盪的首發階段。Anthropic 在 6 月 9 日推出 Fable 5,作為首個公開的 Mythos 級系統,卻在三天後,因傳出越獄報告而遭逢美國出口管制命令,被迫暫停服務。美國商務部在 6 月 30 日解除相關限制,Anthropic 隨即於 7 月 1 日恢復全球存取。





