DeepSeek API 價格週日最多調漲 1,100%,尖峰時段計費正式登場
台灣時間 8 月 17 日凌晨 0 時起,DeepSeek V4-Flash 與 V4-Pro 改採尖峰/離峰雙軌費率,最高漲至現價 12 倍,廉價 frontier token 時代宣告終結。
過去兩年,DeepSeek 一直是整個 AI 產業最愛引用的反例:一家拿不到 NVIDIA 頂級晶片的中國實驗室,竟能以前所未有的低價提供 frontier 級模型,讓歐美同業的 API 帳單相形見絀。這份名聲奠基於 2025 年 1 月——當時 DeepSeek 的訓練成本敘事,讓 NVIDIA 單日市值蒸發數千億美元。而這個週末,平價 DeepSeek token 的時代正式畫下句點。
自 2026 年 8 月 16 日 16:00 UTC(台灣時間 8 月 17 日凌晨 0 時)起,DeepSeek 的 V4 模型家族改用新費率卡:依模型、token 類型、乃至於——這是頭一遭——你跑工作的時段不同,價格漲幅介於約 50% 到超過 1,100% 之間。
关鍵數字
現行計費方式非常單純:V4-Flash 的快取未命中輸入(cache miss input)為每百萬 token $0.14,輸出為 $0.28,全天統一價。甫於本週進入正式版的旗艦模型 V4-Pro 則是 $0.435 / $0.87。
週日之後,數字變成:
| 模型 | Token 類型 | 原價(單一價) | 新尖峰價 | 新離峰價 |
|---|---|---|---|---|
| V4-Flash | 輸入(快取未命中) | $0.14 | $0.44 | $0.22 |
| V4-Flash | 輸出 | $0.28 | $1.32 | $0.66 |
| V4-Flash | 輸入(快取命中) | $0.0028 | $0.014 | $0.007 |
| V4-Pro | 輸入(快取未命中) | $0.435 | $1.32 | $0.66 |
| V4-Pro | 輸出 | $0.87 | $3.96 | $1.98 |
| V4-Pro | 輸入(快取命中) | $0.003625 | $0.044 | $0.022 |
新聞標題裡那四位數的漲幅來自快取讀取(cache read)。V4-Pro 的快取命中輸入從每百萬 $0.003625 漲到尖峰時段的 $0.044——約 12 倍;V4-Flash 的快取命中輸入尖峰時段也調漲 5 倍。快取折扣正是讓 DeepSeek 對反覆重播相同長上下文的 agent 幾乎免費的關鍵機能,而它也是這次漲最凶的項目。
有尖峰時段的 API
比任何單一數字更重要的,是結構性的改變。DeepSeek 把一天切成分尖峰與離峰兩種時段:尖峰涵蓋 UTC 01:00–04:00 與 06:00–10:00,其餘時段一律以尖峰價的五折計費。官方說法是為了「更合理地分配資源」——講白一點,現在決定價格的是服務產能,而不是需求。
這個框架容易讓人誤解,所以必須講清楚:離峰不是相對於今天帳單的折扣。它是「調漲後尖峰價的一半」,而且就連最便宜的新檔位,都高於原本的單一 flat 價。週日之後,沒有人的成本會下降。
這也是主流 LLM 服務商第一次公開告訴客戶:你「什麼時候」跑工作,本身就是一個計價變數。雲端業者收 egress 費、賣保留容量由來已久;電信業的離峰時段折扣更可追溯到 1980 年代。但 frontier 模型的 API 一向把 token 當大宗商品定價——凌晨三點和下午三點一模一樣。DeepSeek 打破了這個慣例,而且是往更貴的方向打破。
為什麼是現在:算力、記憶體與 IPO
DeepSeek 的整個招牌,建立在以接近一個數量級的差距低價競爭之上。這個差距不會一夜消失——即使週日漲價之後,V4-Pro 尖峰輸出價 $3.96/百萬,仍遠低於美國一線 frontier API 對同等級模型的收費。但方向變了,而且這是新的。
兩股力量正在匯流。第一是硬體擠壓。讓 DDR5 記憶體價格漲到 2025 年四倍、迫使兩大遊戲主機在中期世代改款的同一波產能短缺,現在開始反映在 API 呼叫的成本上。HBM 與先進封裝產能未來數年已被預訂一空,其上的每一層——包括模型實驗室——都在悄悄重新定價。DeepSeek 自己也說了:AI 需求正在擠壓服務產能,新的分時費率就是它分配剩餘產能的方式。
第二是商業成熟度。據 Bloomberg 報導,這波調漲讓 DeepSeek 的費率更貼近對手,而該公司在完成一輪超過 70 億美元的首度外部融資後,正為 IPO 鋪路。兩件事可以同時為真:一家要接受公開市場檢視的公司需要利潤,而一家租用稀缺加速器的公司,不可能長期在每個快取 token 上虧錢。
這裡還有前史。DeepSeek 在 2024 年發起了中國的 LLM 價格戰,又在今年 7 月親手终结它——先在中國境內將 V4 尖峰時段費率加倍,TheNextWeb 當時即稱之為「降價競賽的終點」。週日的全球性調漲,是同一條路上的第二步,而且大得多。
開發者實際上該做什麼
如果你正在 DeepSeek 上開發,務實的因應方案樸素但有效:
- 週日前審查你的快取讀取支出。 對反覆重播長上下文的 agent 工作負載而言,快取命中很可能就是最大宗的費用項目,而它即將上漲 5–12 倍。現在搞清楚這個數字,勝過下個月收到帳單才發現。
- 把批次與評測工作移到離峰時段。 一天 24 小時中有 17 小時以半價計費,排程現在是真金白銀。微調掃描、eval 流程、資料回填,不在乎幾點跑。
- 重新為對外產品定價。 建立在 $0.28/M 輸出成本上的產品,應該改用 $0.66–$1.32 的模型來估算——因為很快就會是這個價。
- 重算多模型的比較數學。 與 GPT、Claude 各等級的價差縮小但沒有消失。對某些工作負載,轉換的損益計算會改變;對多數而言,DeepSeek 仍是省錢選項——只是不再壓倒性地便宜。
更大的圖像
全世界最便宜的 frontier API,已經圍繞稀缺算力重新定價。這才是真正的新聞。過去兩年,產業的預設假設是:推論價格只會下跌——每一代新模型都會帶來更高的性價比,永遠如此。DeepSeek 週日的調漲並沒有推翻這條長期曲線,但它下了個標點:2026 年,記憶體、封裝與加速器產能才是瓶頸,就連全世界最執著於效率的實驗室,也得付硬體帳單。
接下來值得觀察:如果 OpenAI、Anthropic 與 Google 跟進分時定價——在 agent 帶動的推論需求持續膨脹下,他們有完全相同的動機——週日這一天,未來可能會被記住是「token 變成公用事業」的起點:像電力一樣按小時計價,連尖峰附加費都一應俱全。
Sources
- [1] https://hwbusters.com/news/deepseek-api-prices-rise-up-to-1100-on-sunday-and-peak-hours-come-with-them/
- [2] https://www.infoworld.com/article/4209439/deepseek-raises-some-v4-prices-by-more-than-10x-as-ai-demand-strains-capacity.html
- [3] https://api-docs.deepseek.com/quick_start/pricing
- [4] https://finance.yahoo.com/technology/ai/articles/deepseek-raising-api-prices-1-174027670.html