---
title: DeepSeek V4 到底該去哪裡買：Go vs API vs Gateway
description: >-
  DeepSeek 於 8 月 16 日調整了 V4 的定價，所有轉售商也隨之跟進。這是一份買家指南，介紹購買 DeepSeek V4
  使用權的三種方式，以及為什麼你現在選擇的供應商，會決定由哪個 checkpoint 來回應你的請求。
date: 2026-08-27T00:00:00.000Z
location: 加州舊金山 – 2026 年 8 月 27 日
image: /images/deepseek-provider-comparison-hero.jpg
keywords: >-
  opencode deepseek, opencode go deepseek, deepseek v4 flash free, deepseek v4
  pro pricing, deepseek api price increase, buy deepseek v4 access, deepseek
  provider comparison
tags:
  - DeepSeek
  - AI gateways
  - Pricing
author:
  name: Wayne Pan
  url: 'https://www.linkedin.com/in/wapan/'
  title: CTO
faq:
  - question: OpenCode Go 比 DeepSeek API 便宜嗎？
    answer: >-
      對於突發性、探索性的工作，固定月費訂閱是合理的：固定成本能吸收按量計費下會被懲罰的用量尖峰。然而，在持續高負載的情況下，直接使用 API
      通常更便宜，尤其是在離峰時段。它也是唯一能讓你確認哪個 checkpoint 實際處理了特定請求的管道。
  - question: 為什麼不同供應商提供的 DeepSeek V4 Flash 回答會不同？
    answer: >-
      DeepSeek V4 Flash 採用量化感知訓練的權重，路由專家原生以 MXFP4 儲存，其餘參數則使用 FP8 或
      BF16。為了降低服務成本，許多 serverless 供應商會對 activations 額外做一次 fp8
      量化，這會使輸出偏離已發佈的參考權重。實際後果是：兩家列出相同模型名稱的供應商，可能回傳有可測量差異的結果。
  - question: 2026 年 8 月 DeepSeek V4 的定價有什麼變化？
    answer: >-
      尖峰與離峰定價於 2026 年 8 月 16 日 16:00 UTC 生效。尖峰時段為 01:00-04:00 和 06:00-10:00
      UTC，費率恰好是離峰價格的兩倍。快取命中輸入的漲幅最大，在某些層級上高達約 1,100%，對依賴提示快取的 agent 工作負載造成最沉重的負擔。
locale: zh-tw
translationKey: deepseek-provider-comparison
---
DeepSeek V4 透過三種管道以不同價格銷售：訂閱制 coding agent、直接 API 金鑰，以及 gateway。每種管道對於由哪個模型 checkpoint 處理流量，也各有不同的保證。2026 年 8 月 16 日，這個 checkpoint 的差異變成了代價高昂的問題。DeepSeek 調整 V4 定價後，轉售商也隨之跟進。隨之而來的抱怨潮暴露出一個事實：大多數客戶根本不清楚自己買的是什麼。

## 2026 年 8 月 16 日 DeepSeek V4 的定價有什麼變化？

DeepSeek 於 8 月 16 日 16:00 UTC 將 V4 系列改為尖峰與離峰分層定價。尖峰時段為 01:00-04:00 和 06:00-10:00 UTC，這些時段的計費恰好是離峰費率的兩倍。離峰時段 V4 Flash 的價格為每百萬 tokens 快取命中輸入 $0.007、快取未命中輸入 $0.22、輸出 $0.66；尖峰時段則將這些數字翻倍。V4 Pro 離峰價格為 $0.022 / $0.66 / $1.98。

關注焦點集中在快取命中的跳漲。[InfoWorld 報導](https://www.infoworld.com/article/4209439/deepseek-raises-some-v4-prices-by-more-than-10x-as-ai-demand-strains-capacity.html)某些費率的漲幅超過 10 倍。V4 Pro 的離峰快取命中價格上漲超過六倍，尖峰費率則上漲超過十二倍。DeepSeek 此前對快取命中給予了約 98% 的折扣，遠高於業界接近 90% 的慣例。因此，每個 agent 帳單中很大一部分是以接近零的價格計費的快取讀取。

正因為這個價差，調價對 coding agent 的衝擊才遠大於聊天介面。Agent 在每一輪都會重新提交冗長的系統提示加上不斷擴展的對話歷史，因此大部分輸入 tokens 都符合快取命中的條件。更高的快取命中價格特別打擊了 agent。

## 為什麼 OpenCode Go 削減了 DeepSeek 的限額？

OpenCode Go 每月收費 $10，最初宣傳為涵蓋高達 $60 的模型總用量。DeepSeek 公佈新費率後，同樣的 $10 能買到的 tokens 大幅減少。OpenCode 在數小時內削減了上限：V4 Flash 下降 50% 至每月 $30，V4 Pro 下降 75% 至 $15。

在 [r/opencode](https://www.reddit.com/r/opencode/comments/1vq46dj/bye_bye_opencode_go_deepseek_v4_flash_x16_pricier/) 上，反應迅速湧現。一篇標題為「Bye bye OpenCode Go」的貼文獲得 315 個讚和 108 則留言，另一篇關於 Flash 預算的討論串則獲得 173 個讚。隔天，OpenCode [將 Flash 限額調回](https://www.reddit.com/r/opencode/comments/1vr6kok/opencode_go_has_increased_the_deepseek_flash_limit/)，而執行長公開說明的貼文獲得了 1,517 個讚，成為當週最多讚的貼文。

相同的機制適用於任何固定費用的轉售商。一個轉售按量計費上游容量的訂閱方案，等於將上游的價格風險計入轉售商自己的資產負債表。如果上游調價 10 倍，轉售商要嘛壓縮利潤、要嘛漲價、要嘛削減上限。OpenCode 在不到一天內公開削減了上限，比大多數業者更快也更坦率。買家仍然面臨一個明確的取捨：固定費用反映的是別人的成本結構，而那個結構是會變動的。

## 你拿到的是真正的 DeepSeek V4 Flash 嗎？

真正令人不安的是，沒有人能確定。

DeepSeek V4 Flash 採用量化感知訓練打造。路由專家約佔模型的 96%，原生以 MXFP4 儲存；其餘參數使用 FP8 或 BF16。正是這個架構讓已發佈的權重能展現其宣稱的行為。許多 serverless 供應商在此原生精度之上再對 activations 做 fp8 量化，以降低自身的服務成本。[ZenMux 的基準測試報告](https://zenmux.ai/blog/deepseek-v4-flash-benchmarks)描述了其後果：回應偏離參考權重，兩家提供相同模型名稱的供應商回傳了有可測量差異的結果。

相同的機制讓「相同提示、不同回答」的抱怨不再只是無從查證的個案，而是有了可驗證的解釋。它也提出了一個更尖銳的問題。OpenCode 儲存庫有一個未解決的 issue，[#40409](https://github.com/anomalyco/opencode/issues/40409)，記錄了一份報告，指出 Go 的 `deepseek-v4-flash` 自我辨識為 DeepSeek V3.2，知識截止日期為 2025 年 5 月，但用量卻以 V4 Flash 配額計費。請將此視為一位使用者對未解決 issue 的報告，而非已確認的發現。自我辨識是不可靠的證據：模型從訓練資料中學習自己的版本，而非從服務堆疊中得知。該 issue 仍然開放且具體，至今無人提出反駁。

無論該 issue 最終如何解決，這個實務教訓都成立。可重現性要求供應商揭露哪個 checkpoint 和哪種精度處理了每個請求。大多數訂閱方案省略了這項揭露，因為跨上游的共用路由正是讓固定費用得以持續的原因。

<a href="https://app.haimaker.ai/sign-up?utm_source=blog&utm_medium=cta&utm_campaign=deepseek-provider-comparison_mid" class="cta-button">看清你實際跑的是什麼模型</a>

## 購買 DeepSeek V4 的三種方式如何比較？

| | Coding agent 訂閱 | DeepSeek 直接 API | Gateway |
|---|---|---|---|
| 計費方式 | 固定月費，有上限配額 | 按量計費，尖峰/離峰分層 | 按量計費，一把金鑰跨供應商 |
| Checkpoint 保證 | 通常未揭露 | 參考權重，官方直營 | 視情況而定；承諾前請先確認 |
| 價格變動風險 | 轉售商吸收，然後調整上限 | 你直接吸收 | 重新路由到其他上游 |
| 模型廣度 | 精選清單 | 僅 DeepSeek | 數百個模型 |
| 最適合 | 突發性探索式開發 | 可重現及離峰批次工作 | 多模型生產流量 |

買家不能再跳過過去忽略的「模型來源」這一項了。價格和廣度在著陸頁上很容易做基準測試，但模型來源預設不會被揭露——而這正是本月產生變化的關鍵維度。

## 你應該如何存取 DeepSeek V4？

根據對工作負載重要的保證來選擇，而不是根據宣傳的費率。

- **[haimaker.ai](https://haimaker.ai)** — 一個 OpenAI 相容端點，可存取 DeepSeek V4 及數百個其他模型，內建每請求成本記錄。供應商調價時會出現在你自己的遙測資料中，而不是社群論壇的貼文裡。當你想要 gateway 的廣度且路由仍需可檢視時，選擇它。[AI API gateway 頁面](/ai-api-gateway/)完整涵蓋了路由模型。
- **DeepSeek 自己的 API** — 參考實作，也是唯一能讓你確定性地確認 checkpoint 的來源。它適合能將推論轉移到離峰時段的工作負載，此時 Flash 輸出成本為每百萬 tokens $0.66。
- **OpenCode Go 及類似訂閱** — 它們適合以固定月費處理突發性工作負載。在八月的討論串中，多位使用者回報即使削減後的每週限額也很難用完。取捨在於：你無法驗證收到的是哪個 checkpoint。
- **其他 gateway** — OpenRouter 路由來自 80 多家供應商的 400 多個模型，並公開明確的路由模式。不過，整合正在加速：[Stripe 同意收購 OpenRouter](https://techcrunch.com/2026/08/16/stripe-will-reportedly-acquire-ai-gateway-startup-openrouter-for-7b/)，金額超過 $7B，較其三個月前的 B 輪估值溢價 5.4 倍。

當供應商已經選定且只需要設定細節時，[DeepSeek in OpenCode 設定指南](/blog/deepseek-opencode-setup/)包含了供應商區塊以及常見的 `/models` 失敗模式。關於哪個低成本 API 值得申請金鑰的更廣泛問題，[最便宜的 AI API 金鑰](/zh-tw/blog/最便宜的ai-api金鑰/)涵蓋了低於前沿定價的層級，而 [OpenRouter 替代方案](/blog/openrouter-alternatives/)則對各 gateway 進行了逐一比較。

## 在下一次調價之前你應該做什麼？

DeepSeek 在一個月內調了兩次價格。尖峰與離峰分層表明，可用容量而非利潤率才是驅動這項限制的因素。當時[一位 OpenCode 工程師的解讀](https://www.kucoin.com/news/flash/deepseek-s-price-hike-may-be-traffic-management-not-loss)是，漲價反映的是流量管理而非財務困境。如果這個解釋成立，未來的價格變動將更多由排程決定，而非回歸先前的費率。

最省力的準備工作是在你自己的基礎設施上記錄每個請求的成本。這樣下一次費率調整就會出現在你的指標中，而不是先出現在 Reddit 的討論串裡。將模型名稱和 base URL 放在設定檔中而非硬編碼，也能減少摩擦，讓切換上游變成部署問題而非程式碼庫重構。在此之後，關鍵的架構問題是工作負載是否真的需要經過驗證的 checkpoint。解決這單一問題後，其餘的決策就變成了標準的價格比較。

一個限制仍然存在：這些細節目前無法針對個別請求從外部驗證。沒有主要供應商在其 API 回應中包含服務精度或 checkpoint 雜湊。在此之前，確認模型來源意味著直接詢問供應商，而非依賴獨立查驗。

<a href="https://app.haimaker.ai/sign-up?utm_source=blog&utm_medium=cta&utm_campaign=deepseek-provider-comparison_end" class="cta-button">用一把金鑰存取 DeepSeek 和所有其他模型</a>

## 常見問題

#### OpenCode Go 比 DeepSeek API 便宜嗎？

對於突發性、探索性的工作，固定月費訂閱是合理的：固定成本能吸收按量計費下會被懲罰的用量尖峰。然而，在持續高負載的情況下，直接使用 API 通常更便宜，尤其是在離峰時段。它也是唯一能讓你確認哪個 checkpoint 實際處理了特定請求的管道。

#### 為什麼不同供應商提供的 DeepSeek V4 Flash 回答會不同？

DeepSeek V4 Flash 採用量化感知訓練的權重，路由專家原生以 MXFP4 儲存，其餘參數則使用 FP8 或 BF16。許多 serverless 供應商為了降低服務成本，會對 activations 額外做一次 fp8 量化，這會使輸出偏離已發佈的參考權重。實際上，兩家列出相同模型名稱的供應商可能回傳有可測量差異的結果。

#### 2026 年 8 月 DeepSeek V4 的定價有什麼變化？

尖峰與離峰定價於 2026 年 8 月 16 日 16:00 UTC 生效。尖峰時段為 01:00-04:00 和 06:00-10:00 UTC，費率恰好是離峰價格的兩倍。快取命中輸入的漲幅最大，在某些層級上高達約 1,100%，對依賴提示快取的 agent 工作負載造成最沉重的負擔。
