DeepSeek-V4-Pro-0813 正式上線:1.6 兆參數 MoE 架構與突破性代理能力
DeepSeek 旗艦模型 V4-Pro 結束預覽階段正式發布,搭載 1.6 兆參數 MoE 架構、SWE-bench Verified 達 80.6%,並在調漲價格的同時保持強勢競爭力。
中國 AI 實驗室 DeepSeek 於 2026 年 8 月 13 日正式發布 DeepSeek-V4-Pro-0813,這是其旗艦混合專家(MoE)模型的正式版本。經過四個月的預覽測試階段,這個版本以大幅強化的代理能力、百萬級 token 上下文視窗,以及足以躋身全球頂尖編碼與推理模型之林的評測成績正式登場——而這一切的成本僅為西方競爭對手的零頭。
此次發布標誌著 DeepSeek 迄今為止最積極的一步,目標是確立自己作為 OpenAI、Anthropic 和 Google 前沿模型的主要開源替代方案。在開源與閉源模型差距持續縮小的當下,這個時間點的選擇格外引人注目。
技術規格:1.6 兆參數,490 億活躍參數
DeepSeek-V4-Pro-0813 採用混合專家架構,總參數量達 1.6 兆,其中每個 token 約激活 490 億參數。這種稀疏激活模式是 MoE 設計的核心特徵——它讓模型在擁有與最大密集模型相當的知識容量的同時,將單次前向傳播的計算成本降至可管理的範圍。架構會將每個 token 路由到專家子網路的子集中,而非激活整個模型。
主要規格包括:
- 上下文視窗: 100 萬 token(1M)
- 最大輸出: 384,000 token
- 推理模式: 可配置,包含用於複雜多步驟任務的「Max Effort」思考模式
- 輸入模態: 文字(合作夥伴 API 提供多模態擴展)
- 模型權重: 開源——可在 Hugging Face 的
deepseek-ai組織下取得
百萬級上下文視窗尤為值得關注。它讓開發者能夠在單一提示中處理整個程式碼庫、長篇文件或完整的對話歷史,無需分段處理——隨著代理工作流程對更廣泛上下文的需求日益增加,這項能力變得越來越重要。
評測成績:編碼冠軍
0813 版本最令人矚目的是其評測表現,尤其是在編碼和代理任務方面:
- SWE-bench Verified:80.6% ——開源模型有史以來的最高分,與 Gemini 3.1 Pro 並列。這項評測要求 AI 自主解決來自熱門 Python 倉庫的真實 GitHub 問題,需要多檔案推理、除錯和程式碼生成能力。
- Aider 基準測試:71.6% ——衡量複雜程式碼編輯任務的表現,V4-Pro 在此項評測中超過了 Claude Opus 4。
- 整體編碼能力: 多個社群評測報告顯示,V4-Pro 在編碼任務中優於 Claude 4 Opus,同時成本僅為其 1/68。
- 綜合品質: 在 vals.ai 排行榜上,DeepSeek V4 Pro 0813 在 82 個受評模型中排名第二,綜合得分 96.40%,距離閉源榜首僅差 0.60 分。
SWE-bench Verified 的結果尤為重要。80.6% 的成績意味著 DeepSeek-V4-Pro-0813 能夠自主解決大約五分之四的真實軟體工程問題——這項能力直到最近還是 OpenAI 和 Anthropic 最昂貴閉源模型的專利。對開源社群而言,這是一個里程碑:目前可用的最強開源編碼模型。
代理能力:核心亮點
據路透社報導,DeepSeek 明確強調 V4-Pro-0813 版本「大幅強化了代理能力」。模型可通過三個管道使用:API、DeepSeek 應用程式和網頁介面。公司特別指出,新版本專為多步驟推理、工具使用和自主任務完成而設計——這些正是 AI 代理框架的核心構建要素。
這種對代理效能的投入,與更廣泛的產業趨勢一致。2026 年全年,AI 開發的前沿已從單純追求評測分數轉向實際的代理部署。模型的評估標準不再只是回答問題的能力,而是它們能否導航複雜工作流程、調用外部工具、在長時間互動中維持狀態,以及完成需要數十個連續步驟的任務。DeepSeek 在這一領域的投入——結合超大上下文視窗——使 V4-Pro 成為構建代理應用的開發者的有力選擇。
Hacker News 上圍繞此次發布的討論反映了謹慎樂觀的態度。評論者指出,雖然評測數字令人印象深刻,但真實世界的代理表現往往與受控測試分數有所落差。一位開發者觀察到,給模型「一個混亂的程式碼庫、一些工具和一個需要 30 多個步驟的任務」才是代理能力是否名副其實的真正考驗。來自社群的早期報告顯示,模型在這些場景中表現良好,不過全面的獨立評估仍在進行中。
定價策略:便宜,但正在變貴
DeepSeek-V4-Pro-0813 標準定價為每百萬輸入 token 0.435 美元,每百萬輸出 token 0.87 美元。快取命中定價降至每百萬輸入 token 0.003625 美元,反映了 MoE 稀疏激活帶來的效率提升。作為對比,Claude Opus 4 根據等級不同,每百萬 token 收費約 15 至 75 美元,這使得 DeepSeek 在相同工作負載下便宜達 68 倍。
然而,在同一天,DeepSeek 同時宣布了大幅調漲 API 價格的決定,這一消息在開發者社群中引起了波瀾。新費率——根據模型、token 類型和使用時段不同,較現行價格上漲 50% 至 1,100%——將於 2026 年 8 月 16 日 16:00 UTC 生效。定價結構引入了尖峰和離峰時段,V4-Pro 輸出 token 在離峰時段將升至每百萬 2 美元,尖峰時段為 4 美元。
這種雙重策略——發布一個能力大幅提升的模型,同時調漲價格——表明 DeepSeek 正在從以獲取用戶為主的搶佔市場階段,轉向注重永續發展的模式。此前,DeepSeek 在 2026 年 4 月首次推出 V4-Pro 時提供了 75% 的折扣,大幅低於競爭對手。如今,憑藉已證實的市場需求和領先的評測成績,DeepSeek 顯然有信心開發者願意支付更高的費用。
Reddit 用戶的反應褒貶不一。一些人對漲價表示不滿,特別是對於高吞吐量的應用場景。另一些人則指出,即使在新費率下,DeepSeek 仍然比替代方案便宜得多——一個起始成本為 Claude 的 1/68 的模型上漲 4 倍,其價格仍約為 Claude 的 1/17。
取得管道與可用性
DeepSeek-V4-Pro-0813 可通過多種管道取得:
- DeepSeek API:
deepseek-v4-pro端點現在指向 0813 版本 - DeepSeek Chat: 網頁和行動應用介面已更新
- OpenRouter: 以標準費率提供第三方整合
- Hugging Face: 開源權重
deepseek-ai/DeepSeek-V4-Pro-0813 - 合作夥伴平台: 包括 Cursor、Aider 和各種代理框架
開源權重的可用性是一個關鍵的差異化因素。與 OpenAI 和 Anthropic 的閉源模型不同,開發者可以下載、微調和自行託管 DeepSeek-V4-Pro——前提是擁有運行 1.6 兆參數模型的硬體。490 億的活躍參數數意味著在高階多 GPU 配置上進行推理是可行的,但運行完整模型仍需要大量 VRAM。
產業背景與影響
DeepSeek-V4-Pro-0813 的發布發生在 2026 年 8 月 AI 領域活動密集的時期。Google 的 Gemini 應用剛剛突破 10 億月活躍用戶。Anthropic 開始在 Claude 的輸出中嵌入隱形浮水印。OpenAI 正準備淘汰 o3 模型。競爭格局前所未有地激烈。
DeepSeek 的策略很明確:以能力競爭,同時保持巨大的成本優勢。80.6% 的 SWE-bench 分數證明了該模型在最困難的編碼任務上能與前沿系統一較高下。開源方式在重視透明度和控制權的開發者中建立了忠誠度。而定價——即使在漲價之後——仍然具有顛覆性。
然而,漲價也引發了一個關於開源 AI 模型長期經濟學的重要問題。DeepSeek 一直受到其母公司和中國更廣泛的 AI 戰略推動的補貼支持。隨著公司走向財務永續,開源與閉源模型之間的成本差距可能會縮小。DeepSeek 能否在保持成本優勢的同時繼續推進前沿,仍有待觀察。
目前為止,DeepSeek-V4-Pro-0813 是可用的最強開源模型——也是 2026 年 8 月任何構建 AI 應用的開發者都值得認真考慮的選擇。
Sources
- [1] https://www.reuters.com/world/china/deepseek-releases-official-v4-pro-model-it-steps-up-expansion-2026-08-13/
- [2] https://openrouter.ai/deepseek/deepseek-v4-pro-0813
- [3] https://www.gmicloud.ai/en/blog/deepseek-v4-pro-steps-out-of-preview-the-0813-build-is-live
- [4] https://api-docs.deepseek.com/quick_start/pricing
- [5] https://vals.ai/benchmarks/swebench
- [6] https://www.reddit.com/r/DeepSeek/comments/1vmhvn4/deepseek_v4_pro_0813_benchmarks/
- [7] https://www.reuters.com/world/china/deepseek-raises-api-pricing-its-v4-models-2026-08-13/