一個模型、兩種面孔:Anthropic 的 Claude Fable 5.1 與被鎖住的孿生兄弟 Mythos 5.1
Anthropic 的 Claude Fable 5.1 科學基準分數翻倍、快取讀取降價 75%,還帶來一個孿生兄弟——Mythos 5.1:同一個模型、較弱的防護,僅開放給通過審查的資安與生命科學機構。
當整個 AI 界花了整週爭論 OpenAI 的 GPT-6 Astra 之際,Anthropic 低調推出了本季結構上最有意思的模型:Claude Fable 5.1——一款用於高強度推理與長程代理任務、全面開放的前沿模型,以及 Claude Mythos 5.1——它的同卵孿生兄弟:相同的權重、相同的能力,卻只透過受限存取計畫,開放給通過審查的資訊安全與生命科學機構。
「兩個模型、同一顆大腦」的設計本身就是新聞重點。Anthropic 等於公開承認:自家最強的模型在危險領域太好用了,不能無限制公開;但同時也太危險了,不能對所有人完全解鎖。Fable 5.1 針對資安與生物學查詢內建了強固防護——許多查詢在分類器觸發時會被自動轉路由到能力較低的模型。Mythos 5.1 則為一小群受信任的防禦者與研究人員移除了大部分護欄。這是迄今最清楚的一次生產級「能力閘門」實驗:不是「安全模型 vs. 危險模型」,而是同一個智能、穿著兩套不同的鎖。
基準分數的躍進
頭條數字是 Terminal-Bench Science:Fable 5.1 拿下 52.6%,相較 Fable 5 的 24.7% 一代之間翻倍有餘,更遠超前 Claude Opus 5 的 29.0% 與 GPT-5.6 Sol 的 22.4%(Anthropic 表示標準誤差約 3.5–4 個百分點)。在獨立測試上,成績同樣亮眼:Artificial Analysis 的 Intelligence Index v4.1.1 給 Fable 5.1 66 分,對上 GPT-6 Astra 的 61 分,Claude 陣營領先五分;而在 Claude Code 環境中,Fable 5.1 更以 70 分登上指數榜首。
與 Astra 的比較並非一面倒,誠實報導必須加上但書。晚一天發布的 Astra 在多項代理基準上奪回了 state-of-the-art——有分析給它 Terminal-Bench Science 64.6%,超過 Fable 5.1 的 52.6%,在 Terminal-Bench 4.0 與 DeepSWE 上也領先。兩家公司如今是逐項基準輪流戴冠,而不是逐個模型分高下——這本身就說明前沿已經擠壓到什麼程度。
「防護稅」
這正是系統卡讀來迷人的地方。Fable 5.1 的評測是在正式防護全開的狀態下進行——安全分類器啟用、生物相關查詢自動回退到 Claude Opus 5。在防護介入的任務上,模型得分為零,連 OSWorld 這類通用代理基準也不例外。在整個 Artificial Analysis Intelligence Index 上,回退路由大約佔了 4% 的輸出 token。
想想這代表什麼:每一個公開的 Fable 5.1 基準分數,都是已經內含自身安全層成本的淨值。Anthropic 的模型不只是在跟 Astra 的原始能力競爭——它是一邊踩著自己的煞車一邊跑,卻還能在多項指標上獲勝。Karo Zieminski 精準地稱之為「safeguard tax(防護稅)」,而它首次讓安全 overhead 變得可量化。Anthropic 自己的支援文件也很直白:用 Fable 5.1 做例行、正當資安工作的使用者「應預期偏高的回退率」——坦白承認分類器的網撈鯊魚時也會撈到海豚。
定價:快取砍 75%
這次發布還帶著強烈的經濟訊號。快取讀取(cache-read)價格調降 75%,Anthropic 估計 Fable 5.1 對典型 token 計費工作負載的成本將比 Fable 5 低約 25%——對快取用量大的代理應用,「節省常常大得多」。對於 Fable 明鎖定的長程代理任務——單一任務可能重複讀取同一份情境數百次——快取經濟主宰了總成本。這波降價實質上是在補貼 Anthropic 想贏下的那類工作負載:跑好幾個小時的多步驟自主任務。
不該被遺忘的前情
Fable 5.1 的防護不是理論架構——是疤痕組織。原版 Fable 5 於 2026 年 6 月 9 日推出,是 Anthropic 首款被認定可公開使用的「Mythos 級」模型。上線幾天內就被多代理攻擊策略越獄,6 月 12 日——上市第三天——Anthropic 在美國國安審查與出口管制糾纏下全面暫停該模型。直到 7 月 1 日、美國解除與事件相關的管制後才重返線上,並配備了新的分類器;Anthropic 表示該分類器能擋下原越獄手法超過 99% 的嘗試。
那次事件重塑了業界談論越獄的方式——Anthropic 引入了三級嚴重度分類(輕微、窄域有害、廣域)——也解釋了 5.1 為何存在:重建的分類器堆疊、給真正需要原始能力的專業人士的受限孿生模型,以及一份以資安能力揭露為先的系統卡。系統卡直言,Fable 5.1 與 Mythos 5.1 展現了「我們發布過的所有模型中最強的整體資安能力」。同一週,OpenAI 自家的 Astra 文件也說它跨過了關鍵資安防護門檻——雙胞胎發放此刻讀來,不像產品策略,更像是整個業界第一次共同承認:資安能力已經長大到「單一模型、單一政策」範式裝不下了。
為什麼重要
在基準賽馬之外,有三個值得追蹤的觀察點:
能力閘門已自成產品類別。 Fable/Mythos 的分流把「認識你的客戶」(KYC)制度化到了前沿 AI。預期年內每一家擁有資安或生物能力模型的實驗室,都會推出類似的受限層級——不這麼做的替代方案,就是 Fable 5 的下場:所有人一起停機。
安全 overhead 首次成為公開指標。 4% 的回退 token 率、OSWorld 上的零分,給了外部審計者一組可跨世代追蹤的具體數字。如果防護 overhead 在能力成長的同時縮小,那才是真正的安全進步;如果它擴大,「安全部署太貴」的論點就有了實證彈藥。
快取經濟決定代理時代。 75% 的快取讀取降價,打的是長時代理的精確成本結構。2026 年的模型選型,越來越不是由五分的排行榜差距決定,而是由一次 12 小時自主跑程在邊際上花多少錢決定。
Fable 5.1 現已於 Claude 各平台與 API 上提供(凡按 token 計費處)。Mythos 5.1 不是你有錢就買得到的——而這,可以說正是它最重要的一項功能。
Sources
- [1] https://www.anthropic.com/claude-fable-and-mythos-5-1
- [2] https://www-cdn.anthropic.com/0339e6a7c5c7b87f5c07798616dc32c215d14235/Claude%20Fable%205.1%20&%20Claude%20Mythos%205.1%20System%20Card.pdf
- [3] https://thezvi.substack.com/p/claude-fable-51-and-mythos-51-the
- [4] https://www.latent.space/p/ainews-claude-fablemythos-51-new
- [5] https://www.rdworldonline.com/anthropic-doubles-a-science-benchmark-score-with-fable-5-1-while-openai-says-its-astra-models-crosses-critical-cyber-threshold/
- [6] https://artificialanalysis.ai/articles/benchmarking-gpt-6-astra
- [7] https://www.anthropic.com/news/redeploying-fable-5