Anthropic 在全球恢復 Fable 5,自 7 月 1 日起重新上線,能力維持完整,並新增一個濾器,可在超過 99% 的嘗試中封鎖被標記的駭客提示。
重點摘要:
- 美國商務部解除出口管制後,Fable 5 重新在 Anthropic 的主要產品中全球上線。
- 模型保留完整能力,但新增一個濾器,會將某個被標記的駭客提示改由較弱的模型回應。
- 測試顯示,較便宜的模型也能找出相同漏洞,削弱了將 Fable 5 視為「獨特高危」的理由。
Fable 5 全球回歸
美國商務部在 6 月 30 日解除緊急出口命令,隔天這款模型便重新在 Claude Platform、Claude.ai、Claude Code 和 Claude Cowork 等服務上向用戶開放。透過主要雲端平台的存取也將隨後恢復。
付費訂閱用戶可在 7 月 7 日前,於每週使用上限內使用該模型,其後則改為依使用量計費的點數制度。
該模型自 6 月 12 日起下線。監管機構禁止所有外國籍人士接觸該模型,並只給公司約 90 分鐘時間配合,Anthropic 因此選擇直接向所有用戶下架模型,而不是嘗試即時逐一過濾。
這項指令源於一份報告:Amazon 研究人員發現一個提示詞,能引導模型標記出多個常見系統中的軟體漏洞叢集。在其中一次互動中,模型更進一步產生可運作的程式碼,示範如何利用其中一個漏洞。真正引發警報的,正是這個實作示範,而不僅僅是漏洞清單。
延伸閱讀:CrowdStrike 警告 Claude Mythos 可能加速零日威脅判定
測試為 Fable 5 洗刷嫌疑
Anthropic 與政府及提交報告的公司共同進行的內部審查證實,許多更弱的模型同樣能找出這些漏洞,其中包括 Opus 4.8、GPT-5.5 和 Kimi K2.7。團隊檢測的其他模型也都能重現那個唯一的攻擊示範,這削弱了「只有 Fable 5 掌握獨一無二網路武器」的說法。公司先前就批評這項禁令是過度延伸。
修補措施十分狹窄。模型重新上線後,僅新增一個分類器,用來攔截那個被通報的提示詞,並將其改由較弱的 Opus 4.8 回應;Fable 5 的能力本身維持不變,但在一般程式碼情境中可能較常誤判並觸發警示,且每當介入時都會提醒用戶。
Mythos 5 仍受限制
Mythos 5,也就是同一底層模型但防護較少的版本,仍被圍籬限制於約 100 家經審核的美國組織之間,納入一項名為 Project Glasswing 的計畫中。
公司同時開放了公開管道以回報越獄(jailbreak)案例,並向監管機構承諾,未來在新一代前沿模型推出前,將提供更早的測試存取權。
Fable 5 最初於 6 月 9 日推出,作為 Anthropic 第一款廣泛開放的 Mythos 級模型,在多項產業評測中備受讚譽,但於發佈後數日即被迫下架。本次中斷僅持續了將近三週。如今的回歸,重新奪回了這段期間被一家快速崛起的中國實驗室默默拿走的評測領先地位。





