Fable 級戰力、Opus 級價格:Anthropic 的 Claude Opus 5.5 重寫前線模型的成本曲線
Anthropic 的 Claude Opus 5.5 以每任務成本低 40% 的代價提供 Fable 5.1 等級的效能,API 價格調降 20%,安全評測創新高——這是該實驗室呼籲放緩前線發展後的第一個新模型。
就在 OpenAI 以半價的 GPT-6 Sol 與 Luna 重設前線價格曲線的兩天後,Anthropic 給出了回應。9 月 22 日,該實驗室發布了 Claude Opus 5.5——全新 Claude 5.5 家族的第一個模型,而這次的新聞重點不是跑分,而是一行成本數字:Anthropic 表示 Opus 5.5「在多數工作上達到 Claude Fable 5.1 的水準」,同時運行成本比 Opus 5 低 40%。
這個時間點不是巧合。前線實驗室如今陷入一場不熟悉的戰爭——比拚的不再是誰的模型最聰明,而是誰能把前線級智慧做到企業真正願意部署的價位。壓力來自下方:中國與西方的低價開放權重模型持續拉低每 token 成本地板,CNBC 報導指出,OpenAI 與 Anthropic 本週不約而同推出更便宜的模型,「因為兩家前線實驗室都持續面對來自更便宜的開放權重競爭者的激烈競爭」。
Anthropic 究竟發布了什麼
Opus 5.5 定位為 Claude 陣容的新主力旗艦,在多數工作負載上取代 Opus 5。在 Anthropic 自家的基準測試中,此模型在代理式編碼(agentic coding)、電腦操作(computer use)與知識工作上領先,在公司回報的幾乎每一項基準上都優於 Opus 5 與更大的 Fable 5.1。它瞄準的是長時間運行、高能力的代理——多小時的編碼 session、工具編排、以及大量文件的專業工作,這些正是 Claude 的招牌使用場景。
API 經濟學相當有攻擊性:
- 每百萬輸入 token 4 美元、每百萬輸出 token 20 美元——兩者都比 Opus 5 調降 20%
- 快取讀取調降 60% 至每百萬 token 0.20 美元
- 根據 llm-stats 的模型追蹤,具備 1M token 上下文視窗
- 依 Anthropic 自行估算,在典型的代理式工作負載中,每任務成本比 Opus 5 低 40%
可用性從第一天就相當廣:模型已透過 Claude API 以及 claude.ai 的 Pro、Max、Team 與企業版提供。Sonnet 5.5 與 Haiku 5.5 預計在未來幾週內推出,完成整個家族。
基準測試的全貌
第三方追蹤將 Opus 5.5 排在目前模型堆疊的頂端附近。BenchLM 給它 196 個模型中的第 2 名,分數 88.45/100。在衡量 44 種職業真實工作的 GDPval-AA v2.1 上,Anthropic 回報 Opus 5.5 拿到 1846 Elo,相較之下 Fable 5.1 為 1735、競爭對手為 1708——而且依 The Decoder 的報導,儘管價格明顯更低,它在多數任務上領先 OpenAI 的 GPT-6 Astra。
編碼代理的故事尤其乾淨俐落。Opus 5.5 以 66.4% 領先 Terminal-Bench 4.0,而 DataCamp 的正面對決發現,在兩款模型共有的基準上它都領先 GPT-6 Sol,其中 AutomationBench 的差距——Opus 5.5 的 40.0%——被稱為該比較中「最乾淨的數字」。Opus 5.5 也在 Terminal-Bench 4.0 上與 GPT-6 Astra 打平,但每任務成本僅約 40%,快取讀取便宜 5 倍。
「我們呼籲放緩前線之後的第一個發布」
Anthropic 聲明中最有意思的一句話,跟效能完全無關。用該公司的話說,Opus 5.5 是「我們呼籲放緩前線(pacing the frontier)之後的第一個發布」——指的是 Anthropic 近期公開呼籲協調放緩前線開發。它在發布前由外部評估者測試,包括 Frontier Design 與 METR,且聲明中詳述了發布前執行的自動化行為審查結果。
這樣的框架是個真正的新模式:一家前線實驗室在發布旗艦模型的同時,明確把它包裝成「能力放緩與持續出貨可以並存」的證據。Opus 5.5 也被描述為 Anthropic 迄今在安全評估上得分最高的模型——這個說法若經得起外部檢驗,將直接削弱每次前線模型發布時慣有的「安全 vs. 速度」對立框架。
「Claudish」問題
隨這次發布一起坦承的,還有一件事:Anthropic 證實正在修正使用者所說的 「Claudish」——那種一眼就能認出來的 Claude 家族寫作風格(諂媚的保留語氣、條列式口癖、破折號密集的節奏),它讓 Claude 的輸出容易被指紋識別。The Decoder 報導,該公司「承諾在 5.5 家族中修正 Claudish 寫作」。對於把 Claude 部署到面向消費者文案的企業來說,這不是小事;風格指紋識別是真實存在的偵測與品牌一致性問題。
分析:前線模型走向中階市場
2026 年 9 月的結構性故事是:「前線模型」與「昂貴模型」終於脫鉤了。OpenAI 的 Sol 與 Luna,以及現在的 Anthropic Opus 5.5,都在追逐同一個獎品:Fable-5.1 級(或 Astra 級)的能力,而且價格要低到一個代理可以跑一整天而不需要開採購會議。Anthropic 的這一步——以低 40% 的任務成本匹敵自家頂級型號的效能,同時以明顯更低的價格在多數基準上擊敗 GPT-6 Astra——是這個布局迄今最尖銳的一次出手。
對買家來說,實際的結論是:前線級代理工作的成本又一次全面下降。對開放權重生態系來說,擠壓更緊了:「夠好用而且免費」與「前線級而且便宜」之間,現在是唯一還有爭議的地帶。而對 Anthropic 來說,Opus 5.5 是一份聲明:這個實驗室可以一邊放緩前線、一邊贏得價格戰——至少在 Sonnet 5.5、Haiku 5.5,以及 OpenAI 的下一個動作之前是如此。
Sources
- [1] https://www.anthropic.com/claude-opus-5-5
- [2] https://www.anthropic.com/claude/opus
- [3] https://venturebeat.com/technology/anthropic-releases-claude-opus-5-5-beating-fable-5-1-on-key-agentic-benchmarks-at-60-cheaper-api-price
- [4] https://the-decoder.com/claude-opus-5-5-matches-fable-5-1-at-40-percent-lower-cost-as-anthropic-promises-to-fix-claudish-writing/
- [5] https://llm-stats.com/models/claude-opus-5-5