在 DeepSeek V4 Flash 正式版推出 12 天後,DeepSeek V4 家族的滿血 Pro 版本終於就位。8 月 12 日晚間,DeepSeek 官方 API 文件的模型與價格頁面悄悄更新,DeepSeek V4 Pro 正式版本正式標示為「DeepSeek-V4-Pro-0813」,定價與規格也一併公布,OpenRouter 同步上架新模型頁面。這次更新非常低調,DeepSeek 官網首頁的橫幅仍維持先前 Flash 正式版公測;V4-Pro 暫未變動的提示,但 API 文件已明確列出新版本號與完整價格表,模型呼叫方式維持不變,使用 deepseek-v4-pro 即可自動指向最新 0813 版本。
版本確認:Flash 0731 與 Pro 0813 雙軌定案
根據 API 文件,DeepSeek V4 目前由兩個正式版本組成:DeepSeek-V4-Flash-0731 與 DeepSeek-V4-Pro-0813。兩者在基礎 URL 上完全一致,OpenAI 格式為 https://api.deepseek.com,Anthropic 格式為 https://api.deepseek.com/anthropic,差異在模型版本號。OpenRouter 的模型頁面也將 Pro 0813 標示為 GA 版本,發布日期為 2026 年 8 月 12 日。
關鍵規格:1M 上下文、384K 輸出、雙思考模式
Pro 0813 與 Flash 0731 在核心規格上保持一致,差異主要在效能定位與價格。兩者皆支援 1M 上下文長度,最大輸出為 384K,支援非思考與思考雙模式,且預設為思考模式。對於處理長程式碼庫、大規模文件與需要多步驟連續執行的 Agent 任務,1M 輸入搭配 384K 輸出代表單次呼叫可容納與生成的內容相當可觀。這也是 DeepSeek V4 系列從預覽版以來持續強調的賣點之一。
功能支援方面,兩款正式版皆涵蓋 JSON Output、Tool Calls、Responses API 與 Anthropic API,並支援對話前綴續寫 Beta,FIM 填空 Beta 則僅在非思考模式下提供。API 存取同時相容 OpenAI 與 Anthropic 格式,對於現有工作流程的遷移成本較低。
價格正式公布:Pro 為 Flash 三倍,官方同步預告將再調漲
這次更新最受關注的是價格。DeepSeek 先前已預告將整體調漲 API 服務價格,漲幅可能較大,這次 Pro 正式版的定價被視為確認該方向。根據 API 文件公布的人民幣與美元對照,兩款模型的價格如下:
- 快取命中輸入:Flash 每百萬 tokens 0.02 元、0.0028 美元;Pro 每百萬 tokens 0.025 元、0.003625 美元
- 快取未命中輸入:Flash 每百萬 tokens 1 元、0.14 美元;Pro 每百萬 tokens 3 元、0.435 美元
- 輸出:Flash 每百萬 tokens 2 元、0.28 美元;Pro 每百萬 tokens 6 元、0.87 美元
- 併發上限:Flash 2500,Pro 500
由此可見,兩個主要計費項快取未命中輸入與輸出,Pro 的價格皆為 Flash 的 3 倍,併發上限則為 Flash 的五分之一。OpenRouter 的價格頁面也顯示相同數字,Pro 0813 為 0.435 美元輸入、0.87 美元輸出,Flash 0731 為 0.14 美元與 0.28 美元,實際加權平均輸入價格因快取命中率而更低。文件同時備註,未來仍計畫整體上調服務定價,具體方案以官方通知為準。從產品定位來看,Flash 明顯面向高頻率、大規模呼叫場景,較低價格與較高併發更適合大量並行任務;Pro 則集中資源處理較高規格任務,雖然單價較高,但以同級模型相比仍屬較低的呼叫成本。
基準測試:對比預覽版大幅躍升,與頂級模型互有勝負
官方微信群組流出的 Agent 相關基準測試對比表顯示,Pro 0813 相較兩個預覽版本提升幅度相當顯著。該表涵蓋 10 項 Agent 基準,包含 HLE、Terminal Bench 2.1、NL2Repo、Cybergym、DeepSWE、Toolathlon-Verified、Agents’ Last Exam、AutomationBench、DSBench-FullStack 與 DSBench-Hard,對比對象包含 DeepSeek 自家 Flash 0731、兩個預覽版,以及 GLM-5.2、Kimi-K3、Opus-4.8 與 Fable 5。
以 DeepSeek 自家版本對比,Pro 0813 在全部 10 項基準皆為最佳,其中 DeepSWE 從預覽版 12.8 提升至 62.7,DSBench-Hard 從 31.1 提升至 67.2,Cybergym 從 52.7 提升至 83.3,AutomationBench 從 12.8 提升至 31.8,均屬數倍成長。Flash 0731 的表現亦優於兩個預覽版,但在多數項目仍落後 Pro 0813。
與外部模型對比,Pro 0813 在 Terminal Bench 2.1 取得 87.9 分,接近 Kimi-K3 的 88.3 分;Cybergym 83.3 分與 Fable 5 的 83.1 分相當;在 AutomationBench 取得 31.8 分為全表最高。Fable 5 在 HLE、DeepSWE、Toolathlon-Verified 與 DSBench-FullStack 等項目仍保持領先,Opus-4.8 則在 NL2Repo 與 DSBench-Hard 取得最高分,Kimi-K3 在 Agents’ Last Exam 取得 27.6 分領先。整體而言,Pro 0813 已進入與當前頂級 Agent 模型互有勝負的水準,而非單方面落後。
產品結構更清晰:Flash 主打規模化,Pro 主打高規格
隨著 Pro 0813 上線,DeepSeek V4 的產品分工變得更明確。官方文件將兩款模型並列呈現,規格與功能完全對齊,僅在價格與併發上做出區隔,Flash 面向成本與規模,Pro 面向更高規格的模型服務。
在整合生態上,兩款模型均已支援透過 Tool Calls、Responses API 與 Anthropic API 延伸至 Agent 與程式開發場景,對於需要長上下文與高併發的使用者,官方同時提供快取命中優惠,鼓勵透過上下文快取降低重複輸入的成本。OpenRouter 的數據亦顯示 Pro 0813 的快取命中率已達約 85.3%,加權平均輸入價格因此降至每百萬 Token 0.067 美元左右(還是便宜的像不要錢一樣)。
對於等待正式版的開發者,呼叫方式無需變更,沿用 deepseek-v4-pro 即可取得最新 0813 版本,Flash 則對應 deepseek-v4-flash。後續值得觀察的是官方是否補上正式公告與更新版技術報告,以及 Hugging Face 上的開源權重是否同步更新至 0813。
結語
DeepSeek-V4-Pro-0813 的上線並未伴隨盛大的發布會,而是以文件更新的形式悄悄到位,但定價與基準數據已足以說明其定位。這款 1.6T 總參數的旗艦模型在 Agent 基準上較預覽版大幅提升,並在多項測試中與當前頂級模型形成拉鋸,同時維持相對較低的 API 價格。至於能力到底如何可能要等這兩天更多開源社群的實測心得了。




