DeepSeek V4 透過三種管道以不同價格銷售:訂閱制 coding agent、直接 API 金鑰,以及 gateway。每種管道對於由哪個模型 checkpoint 處理流量,也各有不同的保證。2026 年 8 月 16 日,這個 checkpoint 的差異變成了代價高昂的問題。DeepSeek 調整 V4 定價後,轉售商也隨之跟進。隨之而來的抱怨潮暴露出一個事實:大多數客戶根本不清楚自己買的是什麼。
2026 年 8 月 16 日 DeepSeek V4 的定價有什麼變化?
DeepSeek 於 8 月 16 日 16:00 UTC 將 V4 系列改為尖峰與離峰分層定價。尖峰時段為 01:00-04:00 和 06:00-10:00 UTC,這些時段的計費恰好是離峰費率的兩倍。離峰時段 V4 Flash 的價格為每百萬 tokens 快取命中輸入 $0.007、快取未命中輸入 $0.22、輸出 $0.66;尖峰時段則將這些數字翻倍。V4 Pro 離峰價格為 $0.022 / $0.66 / $1.98。
關注焦點集中在快取命中的跳漲。InfoWorld 報導某些費率的漲幅超過 10 倍。V4 Pro 的離峰快取命中價格上漲超過六倍,尖峰費率則上漲超過十二倍。DeepSeek 此前對快取命中給予了約 98% 的折扣,遠高於業界接近 90% 的慣例。因此,每個 agent 帳單中很大一部分是以接近零的價格計費的快取讀取。
正因為這個價差,調價對 coding agent 的衝擊才遠大於聊天介面。Agent 在每一輪都會重新提交冗長的系統提示加上不斷擴展的對話歷史,因此大部分輸入 tokens 都符合快取命中的條件。更高的快取命中價格特別打擊了 agent。
為什麼 OpenCode Go 削減了 DeepSeek 的限額?
OpenCode Go 每月收費 $10,最初宣傳為涵蓋高達 $60 的模型總用量。DeepSeek 公佈新費率後,同樣的 $10 能買到的 tokens 大幅減少。OpenCode 在數小時內削減了上限:V4 Flash 下降 50% 至每月 $30,V4 Pro 下降 75% 至 $15。
在 r/opencode 上,反應迅速湧現。一篇標題為「Bye bye OpenCode Go」的貼文獲得 315 個讚和 108 則留言,另一篇關於 Flash 預算的討論串則獲得 173 個讚。隔天,OpenCode 將 Flash 限額調回,而執行長公開說明的貼文獲得了 1,517 個讚,成為當週最多讚的貼文。
相同的機制適用於任何固定費用的轉售商。一個轉售按量計費上游容量的訂閱方案,等於將上游的價格風險計入轉售商自己的資產負債表。如果上游調價 10 倍,轉售商要嘛壓縮利潤、要嘛漲價、要嘛削減上限。OpenCode 在不到一天內公開削減了上限,比大多數業者更快也更坦率。買家仍然面臨一個明確的取捨:固定費用反映的是別人的成本結構,而那個結構是會變動的。
你拿到的是真正的 DeepSeek V4 Flash 嗎?
真正令人不安的是,沒有人能確定。
DeepSeek V4 Flash 採用量化感知訓練打造。路由專家約佔模型的 96%,原生以 MXFP4 儲存;其餘參數使用 FP8 或 BF16。正是這個架構讓已發佈的權重能展現其宣稱的行為。許多 serverless 供應商在此原生精度之上再對 activations 做 fp8 量化,以降低自身的服務成本。ZenMux 的基準測試報告描述了其後果:回應偏離參考權重,兩家提供相同模型名稱的供應商回傳了有可測量差異的結果。
相同的機制讓「相同提示、不同回答」的抱怨不再只是無從查證的個案,而是有了可驗證的解釋。它也提出了一個更尖銳的問題。OpenCode 儲存庫有一個未解決的 issue,#40409,記錄了一份報告,指出 Go 的 deepseek-v4-flash 自我辨識為 DeepSeek V3.2,知識截止日期為 2025 年 5 月,但用量卻以 V4 Flash 配額計費。請將此視為一位使用者對未解決 issue 的報告,而非已確認的發現。自我辨識是不可靠的證據:模型從訓練資料中學習自己的版本,而非從服務堆疊中得知。該 issue 仍然開放且具體,至今無人提出反駁。
無論該 issue 最終如何解決,這個實務教訓都成立。可重現性要求供應商揭露哪個 checkpoint 和哪種精度處理了每個請求。大多數訂閱方案省略了這項揭露,因為跨上游的共用路由正是讓固定費用得以持續的原因。
購買 DeepSeek V4 的三種方式如何比較?
| Coding agent 訂閱 | DeepSeek 直接 API | Gateway | |
|---|---|---|---|
| 計費方式 | 固定月費,有上限配額 | 按量計費,尖峰/離峰分層 | 按量計費,一把金鑰跨供應商 |
| Checkpoint 保證 | 通常未揭露 | 參考權重,官方直營 | 視情況而定;承諾前請先確認 |
| 價格變動風險 | 轉售商吸收,然後調整上限 | 你直接吸收 | 重新路由到其他上游 |
| 模型廣度 | 精選清單 | 僅 DeepSeek | 數百個模型 |
| 最適合 | 突發性探索式開發 | 可重現及離峰批次工作 | 多模型生產流量 |
買家不能再跳過過去忽略的「模型來源」這一項了。價格和廣度在著陸頁上很容易做基準測試,但模型來源預設不會被揭露——而這正是本月產生變化的關鍵維度。
你應該如何存取 DeepSeek V4?
根據對工作負載重要的保證來選擇,而不是根據宣傳的費率。
- haimaker.ai — 一個 OpenAI 相容端點,可存取 DeepSeek V4 及數百個其他模型,內建每請求成本記錄。供應商調價時會出現在你自己的遙測資料中,而不是社群論壇的貼文裡。當你想要 gateway 的廣度且路由仍需可檢視時,選擇它。AI API gateway 頁面完整涵蓋了路由模型。
- DeepSeek 自己的 API — 參考實作,也是唯一能讓你確定性地確認 checkpoint 的來源。它適合能將推論轉移到離峰時段的工作負載,此時 Flash 輸出成本為每百萬 tokens $0.66。
- OpenCode Go 及類似訂閱 — 它們適合以固定月費處理突發性工作負載。在八月的討論串中,多位使用者回報即使削減後的每週限額也很難用完。取捨在於:你無法驗證收到的是哪個 checkpoint。
- 其他 gateway — OpenRouter 路由來自 80 多家供應商的 400 多個模型,並公開明確的路由模式。不過,整合正在加速:Stripe 同意收購 OpenRouter,金額超過 $7B,較其三個月前的 B 輪估值溢價 5.4 倍。
當供應商已經選定且只需要設定細節時,DeepSeek in OpenCode 設定指南包含了供應商區塊以及常見的 /models 失敗模式。關於哪個低成本 API 值得申請金鑰的更廣泛問題,最便宜的 AI API 金鑰涵蓋了低於前沿定價的層級,而 OpenRouter 替代方案則對各 gateway 進行了逐一比較。
在下一次調價之前你應該做什麼?
DeepSeek 在一個月內調了兩次價格。尖峰與離峰分層表明,可用容量而非利潤率才是驅動這項限制的因素。當時一位 OpenCode 工程師的解讀是,漲價反映的是流量管理而非財務困境。如果這個解釋成立,未來的價格變動將更多由排程決定,而非回歸先前的費率。
最省力的準備工作是在你自己的基礎設施上記錄每個請求的成本。這樣下一次費率調整就會出現在你的指標中,而不是先出現在 Reddit 的討論串裡。將模型名稱和 base URL 放在設定檔中而非硬編碼,也能減少摩擦,讓切換上游變成部署問題而非程式碼庫重構。在此之後,關鍵的架構問題是工作負載是否真的需要經過驗證的 checkpoint。解決這單一問題後,其餘的決策就變成了標準的價格比較。
一個限制仍然存在:這些細節目前無法針對個別請求從外部驗證。沒有主要供應商在其 API 回應中包含服務精度或 checkpoint 雜湊。在此之前,確認模型來源意味著直接詢問供應商,而非依賴獨立查驗。
常見問題
OpenCode Go 比 DeepSeek API 便宜嗎?
對於突發性、探索性的工作,固定月費訂閱是合理的:固定成本能吸收按量計費下會被懲罰的用量尖峰。然而,在持續高負載的情況下,直接使用 API 通常更便宜,尤其是在離峰時段。它也是唯一能讓你確認哪個 checkpoint 實際處理了特定請求的管道。
為什麼不同供應商提供的 DeepSeek V4 Flash 回答會不同?
DeepSeek V4 Flash 採用量化感知訓練的權重,路由專家原生以 MXFP4 儲存,其餘參數則使用 FP8 或 BF16。許多 serverless 供應商為了降低服務成本,會對 activations 額外做一次 fp8 量化,這會使輸出偏離已發佈的參考權重。實際上,兩家列出相同模型名稱的供應商可能回傳有可測量差異的結果。
2026 年 8 月 DeepSeek V4 的定價有什麼變化?
尖峰與離峰定價於 2026 年 8 月 16 日 16:00 UTC 生效。尖峰時段為 01:00-04:00 和 06:00-10:00 UTC,費率恰好是離峰價格的兩倍。快取命中輸入的漲幅最大,在某些層級上高達約 1,100%,對依賴提示快取的 agent 工作負載造成最沉重的負擔。