沒想到,DeepSeek 的 API 價格戰才開始沒多久,官方就改變策略,改預告即將漲價,而且幅度可能不小。近日 DeepSeek 已開始通知 API 客戶,未來將大幅調整整體 API 服務價格,不過實際新的費率與生效日期還不知道。
這個動作也讓人懷疑,是不是 DeepSeek 自己的 GPU 資源都快撐不住了?
DeepSeek API 預告將大幅調漲:V4 Flash 降價後需求暴增,官方新費率尚未公布
根據 @gpuhell 用戶在 X 社群平台透露,DeepSeek 已開始通知 API 客戶,表示接下來會調高整體 API 服務價格,而且預期會是「大幅」調漲:
目前 DeepSeek 官方定價頁也有特別標注,計劃近期會調整整體 API 價格,預計漲幅較大,具體方案仍要等官方公告,並提醒開發者先依照實際使用量規劃用量:
DeepSeek 這次公告使用少見的「漲幅較大」,DeepSeek API 用戶真的要先有心理準備,甚至是想好之後漲價的替代方案。
現在的價格是,DeepSeek-V4-Flash-0731 的快取命中輸入 Token 每百萬為 0.02 元人民幣,快取未命中輸入 Token 為 1 元,輸出 Token 為 2 元;DeepSeek-V4-Pro 則分別是 0.025 元、3 元與 6 元。
| 模型 | 快取命中輸入 | 快取未命中輸入 | 輸出 |
|---|---|---|---|
| DeepSeek-V4-Flash | 0.02 元 | 1 元 | 2 元 |
| DeepSeek-V4-Pro | 0.025 元 | 3 元 | 6 元 |
那為何 DeepSeek 才剛降價,就突然預告要漲價?
目前來看最可能的原因,應該是 V4 Flash 的低價策略在短時間內帶來大量需求,服務端的推理容量開始面臨壓力。
有用戶就在 X 中提到,DeepSeek 模型在某些時段的推理速度非常慢,考慮到 DeepSeek 實驗室僅有約 2 萬個 NVIDIA H100 GPU 的有限算力規模,這非常有可能:
隨著先前大降價,許多用戶應該都將 DeepSeek 接進 AI 代理工具。價格越低,開發者越容易放大使用量,但對模型服務商來說,每一次輸出都會持續消耗 GPU 推理資源。
當 GPU 算力不夠時,就只能透過調高 API 價格來改善,增加收入的同時,也能降低非必要流量,保留給真正需要穩定服務的用戶。
對使用 DeepSeek API 的開發者來說,接下來最重要的不是先猜價格會漲多少,建議先弄清楚目前工作流中,哪些是快取命中、哪些是一般輸入,還有輸出 Token 每月佔多少比例。這樣之後才能更快速做出應對。


