倒數計時:Claude Sonnet 5 API 九月一日漲價 50%——而新分詞器會讓實際漲幅更高
Anthropic 的 Claude Sonnet 5 促銷價將於 8 月 31 日到期。9 月 1 日起,輸入價從每百萬 token 2 美元漲到 3 美元、輸出從 10 美元漲到 15 美元——加上新版分詞器會讓 token 數量增加最多 35%,程式開發型工作負載的實際成本增幅可能接近一倍。
如果你的團隊在生產環境中使用 Claude Sonnet 5,現在就打開行事曆:促銷價將於 2026 年 8 月 31 日到期,標準費率自 9 月 1 日起生效。 距離期限只剩不到兩週,所有還在享受上市折扣的工作負載,成本都將顯著攀升——而對以程式開發為主的應用來說,帳面上的漲幅只是故事的一半。
9 月 1 日改了什麼
費率調整非常直接。8 月 31 日前,2026 年 6 月 30 日上市的 Claude Sonnet 5 定價為每百萬輸入 token 2 美元、每百萬輸出 token 10 美元。9 月 1 日起,標準價調漲為輸入 3 美元、輸出 15 美元,兩端各漲 50%。新費率適用於所有透過 Anthropic API 使用該模型的客戶,並不限於新註冊用戶。
漲幅同樣貫穿各種折扣方案:
- Batch API(非同步工作負載,原為標準價的一半):從每百萬 token 1 美元 / 5 美元,調漲為 1.50 美元 / 7.50 美元。
- 提示快取(prompt caching)倍率維持不變——五分鐘快取寫入仍是基礎輸入價的 1.25 倍、一小時寫入 2 倍、快取命中 0.1 倍。但這些倍率作用於一個剛上漲 50% 的基礎費率,因此依賴快取控制支出的團隊,會看到 9 月的漲幅穿透快取策略如實反映在帳單上,而不是被快取吸收掉。
Anthropic 並未公布企業大量授權或雲端市集方案——Sonnet 5 現已可在 Amazon Bedrock 與 Microsoft Foundry 上正式使用——將如何與這次調價互動。但無論如何,公開的 API 費率都會如期調整。
分詞器是第二重漲幅
接下來這部分,是太多團隊會在十月第一張帳單上才發現的事。Claude Sonnet 5 採用了新版分詞器(tokenizer),根據 Anthropic 自己的模型文件,同樣的文字現在產生的 token 數量比 Claude Sonnet 4.6 多出約 30%——視內容而定,程式碼比重高的內容增幅在 10% 到 35% 之間。
這帶來三個具體影響:
- Token 計數升高。 相同內容的使用量數據與 token 計數結果,都比 Sonnet 4.6 來得高。任何以舊分詞器校準的內部成本模型,都已經低估了支出。
- 上下文視窗實質縮水。 一百萬 token 的視窗仍然是一百萬 token,但每個 token 涵蓋的文字變少了——同樣的預算裝得下的實際內容跟著變少。
- max_tokens 預算可能截斷輸出。 為 Sonnet 4.6 調校的上限,可能砍掉 Sonnet 5 原本能完成的內容,無聲地降低輸出品質——看起來像模型退步,其實是配置債。
把兩項改變疊加起來:帳面上看似 50% 的成本增幅,一旦計入 token 數量本身的膨脹,實際可能接近原本估計的兩倍。
為什麼「硬期限」反而是透明的做法
旗艦模型上市時提供促銷價是業界常態——它降低了客戶在生產規模上測試的門檻,也讓廠商在定案長期價格前累積採用數據。這次不尋常之處在於期限的明確性:Anthropic 提前數月公布了確切日期,而不是讓轉換開放結束或埋在使用量門檻裡。
這給了財務與工程團隊一個固定的規劃基準,而不是滾動式估計:你可以精確模擬這次調價,而不是等帳單揭露一個未公告的變動。相較於默默調價的廠商,這是實實在在的對比。但另一面是,標準方案客戶完全沒有談判空間——期限就是期限。
未來兩週團隊該做什麼
Anthropic 自己的層級指引勾勒出稽核路徑:Haiku 用於快速問答與簡單抽取,Sonnet 作為編碼、寫作與多步驟工作流的「通用預設」,Opus 則保留給研究與複雜推理等 Sonnet 在測試中已證明不足的場景。在折扣期間把所有任務都預設丟給 Sonnet 5 的團隊,最好在新費率跑滿一個計費週期前,重新檢視這個預設。
9 月 1 日前的實用檢查清單:
- 重新計算 token。 用 Sonnet 5 的分詞器重跑代表性負載,以實際計數而非 Sonnet 4.6 的基準重建成本預估。
- 能降級就降級。 把抽取、分類與簡單問答搬到 Haiku;把 Sonnet 5 留給真正值得那個價格的代理與編碼工作負載。
- 善用批次與快取。 非同步工作負載與提示快取是僅存的兩個能結構性降低單位成本的槓桿——調價後兩者的相對價值都更高了。
- 現在就修正 max_tokens。 重新調校輸出預算,別讓分詞器膨脹偽裝成遷移後的品質退化。
- 確認市集條款。 如果你透過 Bedrock 或 Foundry 採購,先確認實際費率,別假設公開價目表直接適用。
更大的訊號
狹義來說,這只是一個模型的價格表變動。但一個固定、公開預告的到期日,透露了 API AI 成本走向的更大趨勢。在廠商還在為旗艦模型搶市佔的階段,促銷價有其道理;而一個統一適用、提前公告的到期日,暗示產業正轉向永續的單位經濟學壓過激進的獲客定價的階段——這個轉向,正好發生在 Anthropic 公布首批獲利季度、且試點成本與生產成本的落差開始在全產業顯現的時刻。
9 月 1 日不會是最後一個這類期限。隨著更多廠商以促銷價推出旗艦模型、再照公布時程讓折扣到期,教訓可以通用化:把促銷價視為上市補貼,而非成本基準。 圍繞 Sonnet 5 折扣價建立成本模型的企業,即將發現這些模型能否承受真實帳單的考驗——而提早稽核的團隊,會覺得它只是變貴了,而不是被嚇一跳。
Sources
- [1] https://datafloq.com/anthropic-confirms-claude-sonnet-5-prices-rise-50-on-september-1/
- [2] https://www.anthropic.com/news/claude-sonnet-5
- [3] https://platform.claude.com/docs/en/about-claude/pricing
- [4] https://aitoolsrecap.com/Blog/ai-news-august-18-2026
- [5] https://enterprisedna.co/resources/news/anthropic-claude-sonnet-5-pricing-deadline-cost-impact-2026