一直被稱為「價格屠夫」的中國深度求索 DeepSeek 在 2026 年 8 月 17 日凌晨(北京時間)正式實施新的 API 定價方案,正式結束了一直以來超低訂價時代。這次調整了峰谷分時定價機制,高峰時段費率為離峰時段的兩倍,部分項目漲幅最高達 1,214%。新費率已於 2026 年 8 月 16 日 16:00 UTC(台北時間 8 月 17 日 00:00)正式生效,適用於 DeepSeek-V4-Flash-0731 與 DeepSeek-V4-Pro-0813 兩個模型版本。模型本身並未更新,這次調整純粹是計費方式的變更。

不再白菜價!DeepSeek API 全球大漲價,最高漲 12 倍
峰谷定價:離峰半價、高峰翻倍
DeepSeek 這次最大的改變是將計費拆分為「高峰」與「離峰」兩個時段。高峰時段為 UTC 01:00–04:00 與 06:00–10:00(即台北時間 09:00–12:00 與 14:00–18:00),每天共計 7 小時;其餘 17 小時為離峰時段,費率恰好是高峰的一半。
以新台幣換算(匯率 1 美元兌 32.5 元新台幣),V4 Flash 與 V4 Pro 的新舊費率對比
V4 Flash(每百萬 Tokens)
- 輸入(快取命中):舊價 NT$0.09 → 離峰 NT$0.23、高峰 NT$0.46(漲幅 2.5× 至 5×)
- 輸入(快取未命中):舊價 NT$4.55 → 離峰 NT$7.15、高峰 NT$14.30(漲幅 1.57× 至 3.14×)
- 輸出:舊價 NT$9.10 → 離峰 NT$21.45、高峰 NT$42.90(漲幅 2.36× 至 4.71×)
V4 Pro(每百萬 Tokens)
- 輸入(快取命中):舊價 NT$0.12 → 離峰 NT$0.72、高峰 NT$1.43(漲幅 6.07× 至 12.14×)
- 輸入(快取未命中):舊價 NT$14.14 → 離峰 NT$21.45、高峰 NT$42.90(漲幅 1.52× 至 3.03×)
- 輸出:舊價 NT$28.28 → 離峰 NT$64.35、高峰 NT$128.70(漲幅 2.28× 至 4.55×)
漲最多的是哪一條?V4 Pro 快取命中高達 12 倍
Reddit 上流傳的「漲 1,100%」數字並非誇大。漲幅最驚人的是 V4 Pro 的快取命中輸入價格:從舊價每百萬 tokens 0.003625 美元(約 NT$0.12)飆升至高峰時段的 0.044 美元(約 NT$1.43),漲幅達 1,214%(老實說漲完依然很便宜…)。但這個數字需要放在脈絡中理解。快取命中價格原本就極低(舊價僅為快取未命中的 1/38 至 1/120),即使漲了 12 倍,高峰時段的快取命中價格(NT$1.43/百萬 tokens)仍然遠低於快取未命中價格(NT$42.90/百萬 tokens),差距約 30 倍。
一位 Reddit 用戶以實際 650 次 API 呼叫(16 個 session、1.56 億 prompt tokens、快取命中率 98.09%)進行了完整的費用重新計算,結果顯示其 Agent 工作負載在離峰時段的帳單約為過去的 2.7 倍,而完全無快取的工作負載則約為 1.5 倍。
換句話說,快取命中率越高的用戶,這次受到的衝擊越大。原本靠快取機制大幅壓低成本的工作負載,現在省下的錢變少了。
與競爭對手比較:DeepSeek 還是最便宜嗎?
漲價後的 DeepSeek V4 在市場上的定位出現了微妙變化,以離峰時段標準費率(不含快取)來看:
- V4 Flash 輸入(離峰 $0.22)vs GPT-5.6 Luna($0.20):Flash 在離峰時段的輸入成本略高於 Luna,但輸出成本($0.66 vs $1.20)仍低 45%。
- V4 Flash 輸入(高峰 $0.44)vs GPT-5.6 Luna($0.20):高峰時段 Flash 的輸入成本是 Luna 的 2.2 倍,但輸出仍便宜。
- V4 Pro(離峰 $0.66 輸入 / $1.98 輸出)vs GPT-5.6 Terra($2 輸入 / $12 輸出):V4 Pro 的輸入成本約為 Terra 的 1/3,輸出成本約為 1/6,仍有顯著價格優勢。
- Claude Sonnet 5($2 輸入 / $10 輸出):V4 Pro 離峰費率仍遠低於 Claude。
在快取命中這條路上,DeepSeek 即使漲了 12 倍,仍然保有極大優勢。V4 Flash 快取命中(高峰 $0.014/百萬 tokens)比 GPT-5.6 Luna 的快取讀取價格($0.02/百萬 tokens)更便宜。
在第三方託管平台方面,V4 Flash 的情況較為複雜。根據 OpenRouter 端點資料,28 個第三方託管商中有 26 個的 V4 Flash 輸入價格低於 DeepSeek 官方高峰費率($0.44),其中 DeepInfra 報價僅 $0.08 輸入 / $0.18 輸出。但 V4 Pro 則相反,DeepSeek 官方的離峰費率($0.66)低於所有第三方託管商。
對世界各地用戶的影響
這次峰谷定價對台灣用戶有一個隱藏的好處。DeepSeek 的高峰時段設定為台北時間 09:00–12:00 與 14:00–18:00,這恰好是中國大陸的工作時間。台灣雖然也在同一時區,但多數個人開發者和小型團隊的 API 呼叫時間較為分散,夜間批次任務、自動化排程等工作完全可以安排在離峰時段執行。
對於美國時區的開發者而言,這項調整幾乎沒有影響,美國的工作時間恰好對應到 DeepSeek 的離峰時段。歐洲用戶則需要將早晨的批次任務移至下午,以避開高峰時段的加倍費率。
DeepSeek 漲價背後:算力真空、融資壓力與行業退燒
DeepSeek 為何選在此時大幅調價?答案並非單一因素,而是多重壓力同時到位的結果。
算力供需失衡是直接導火線,2026 年 7 月 31 日 V4 Flash 正式版上線後,API 呼叫量呈爆發式增長,僅 8 月 1 日單日,單一平台的 Token 處理量就達到 8 兆,而全球頭部模型聚合平台 OpenRouter 上所有模型加起來,日均 Token 總量才 6.6 兆。伺服器叢集長期處於滿載狀態,8 月 4 日甚至出現 API 性能下降與服務中斷。
DeepSeek 原本寄望華為昇騰 950 超節點緩解算力壓力,華為在 7 月世界人工智慧大會上首次展示搭載 8,192 顆昇騰 950DT 晶片的 Atlas 950 SuperPod,訓練效率較上一代提升 17 倍,但要拖到 2026 年第四季才量產上市。這段「算力真空期」讓 DeepSeek 只能先以漲價抑制過量需求。
融資後的盈利壓力同樣不可忽視,2026 年 6 月,DeepSeek 完成首輪外部融資,總額超過 510 億元人民幣(約新台幣 2,270 億元),由梁文鋒領投,騰訊、寧德時代、網易、京東、IDG 資本等聯合參投,投後估值接近 4,000 億元。僅兩個月後,DeepSeek 啟動第二輪融資,目標 500 億元,估值提升至約 5,000 億元。融資規模急速膨脹,意味著投資人對商業閉環的獲利期待也隨之提高。
梁文鋒本人曾提出「十個月收回成本」的定價法則:買一批伺服器,十個月內收回設備成本,就是合理的利潤。當用量暴漲導致伺服器逼近極限時,調價以維持這個財務模型,是其內部邏輯的必然結果。
與此同時,梁文鋒旗下的量化投資業務也面臨壓力。資料顯示,截至 7 月 31 日,幻方量化對外展示的 9 只量化產品中,有 8 只年內收益由正轉負,多隻產品 7 月單月淨值跌幅超過 20%。另一家關聯私募九章資產的 2 只基金年內收益同樣為負。
行業整體退燒則提供了外部背景。2026 年以來,智譜 API 累計提價 83%,調用量反而逆势增長 400%;阿里雲、騰訊雲、百度智能雲等年初已集體上調 AI 算力相關價格;月之暗面在 7 月發布 Kimi K3 時也大幅調高 API 定價。[8]高盛研報指出,DeepSeek 的價格調整「反映國內 AI 模型需求持續旺盛、算力資源趨緊,行業競爭正從早期激進的價格戰,回歸更理性的定價框架」。
不過,分析師普遍認為此次漲價屬於過渡期措施。等到第四季華為昇騰 950 超節點量產上市、中國國產算力成本下降後,DeepSeek 的價格有望再次下調。
開發者因應建議
面對這波漲價,開發者可以採取以下幾個策略來控制成本:
- 將可排程的工作移至離峰時段:批次處理、模型評估、文件分析等非即時任務,安排在台北時間 18:00 之後或 09:00 之前執行,即可享受半價費率。對台灣用戶而言,這幾乎是零成本的調整。
- 評估 Flash 是否足以取代 Pro:V4 Flash(0731 版本後訓練更新)在多數 Agent 基準測試上的表現已接近甚至超越早期的 V4 Pro Preview。若工作負載不需要最高等級的推理能力,降級到 Flash 可節省約 3 倍成本。
- 比較第三方託管商:對於 V4 Flash 用量大的開發者,DeepInfra、Together AI 等第三方託管商的費率可能低於 DeepSeek 官方。但 V4 Pro 仍以官方離峰價格最具競爭力。
- 重新計算帳單:用過去一個月的 API 使用紀錄,套用新的峰谷費率計算實際漲幅。快取命中率越高的工作負載,漲幅越大,這一點與直覺相反,務必實際試算。
從低價攪局者到分級定價
DeepSeek 自 2024 年底 V3 發布以來,一直以「同等品質最低價」的定位打響名號。V3 的定價(每百萬 tokens 輸入 1 元人民幣、輸出 2 元人民幣)在當時遠低於 OpenAI 與 Anthropic,直接引發了中國 AI 市場的價格戰。
2025 年 1 月 R1 推理模型發布後,DeepSeek 進一步壓低了離峰時段的價格,甚至一度提供夜間半價優惠。那段時期是 DeepSeek API 的「最便宜」時期。如今隨著 V4 系列模型全面上線,DeepSeek 開始從「低價策略」轉向「分級定價」。峰谷機制的引入,加上整體基礎價格的上調,顯示 DeepSeek 正在尋求更可持續的商業模式。DeepSeek 在官方文件中也明確保留了再次調整價格的權利。
對於 AI Agent 開發者而言,這次漲價傳遞了一個明確的信號:過去那種「反正 DeepSeek 超便宜,不用省」的心態需要調整。成本最佳化,包括快取策略、排程管理、模型選擇,將成為 Agent 應用與開發中不可忽視的一環。





