大家最常問的就是:該用哪個模型?老實說,這要看你想做什麼、願意花多少錢。

注意: Clawdbot 已更名為 OpenClaw——同樣強大的 AI Agent 平台,換了新名字。請前往 openclaw.ai 了解更多。

OpenClaw 支援十幾家供應商:Anthropic、OpenAI、Google,以及透過 haimaker.ai 使用的開源模型。每家供應商在成本、能力和資料去向方面各有取捨。

以下是我挑選模型時的考量。

OpenClaw 支援模型列表

OpenClaw 可以使用任何由支援的供應商或 OpenAI 相容端點提供的模型。實際可用清單比預設設定更廣。

供應商建議優先試用的模型最佳用途
HaimakerMiniMax M3、Qwen3 Coder、Kimi K2.7、DeepSeek V4一組 API 金鑰即可用於多個便宜模型
AnthropicClaude Opus 4.8、Claude Sonnet 4.6寫程式和高難度 Agent 任務
OpenAIGPT-5.6、GPT-5.5、GPT-5.4 Mini一般工作,API 行為穩定
GoogleGemini 3 Flash、Gemini 3.1 Pro長上下文和免費額度
xAIGrok 4.5、Grok 4.1 Fast、Grok Code Fast便宜的超大上下文/程式碼專用工作
DeepSeekDeepSeek V4 Pro、DeepSeek V4 Flash低成本寫程式與推理替代方案
OllamaQwen3.6、Gemma 4、gpt-oss本機/隱私推論

只要模型相容 OpenAI 格式,規則就很簡單:新增供應商、新增模型 ID,然後將完整模型名稱加入允許清單。這涵蓋了 Haimaker、Ollama、OpenRouter、Together、私有 vLLM 部署,以及大多數代管推論閘道。

價格、能力、隱私

這三者往往互相牽制。你或許能同時最佳化其中兩項,但很少能三者兼得。

價格

Token 價格差異極大。高階 Claude 模型每 token 的成本可能是 Grok 4.1 Fast 或 DeepSeek V4 Flash 等平價選項的數十倍——然而很多時候,產出品質其實差不多。一個值得注意的變化是:Claude Opus 4.8 的發布價格約為舊版 Opus 的三分之一,大幅縮小了「高階」和「中階」之間的差距。

對大多數助理任務來說,中階模型是合理的選擇。Claude Sonnet 4.6 以遠低於 Opus 的成本,提供接近 Opus 的能力。

能力

跑分歸跑分,別太當真。對 OpenClaw 來說,真正重要的是:

  • 工具呼叫 – 能否正確呼叫 shell 指令和 API,而不會弄錯語法?
  • 上下文追蹤 – 是否記得你 50 則訊息前說了什麼?
  • 程式碼品質 – 寫出來的程式碼能跑嗎?
  • 速度 – 送出請求後要多久才開始回應?

隱私

雲端 API 意味著你的提示詞會傳送到外部伺服器。對個人財務、健康資料或專有程式碼來說,這是個問題。你可以自行託管開源模型,但那需要硬體設備,也要能容忍較高的延遲。

依使用情境推薦

日常助理工作

Claude Sonnet 4.6(中階定價)

行事曆、電子郵件、研究、一般查詢。Sonnet 全部都能處理,而且不會讓荷包大失血。速度足以應付即時對話,能力也足以勝任多步驟任務。

更便宜的選項:GPT-5.4 Mini(不到 1 美元的價位)

簡單任務夠用。遇到複雜任務,品質會下降,但考量到成本只有幾分之一,有時這正是正確的選擇。

寫程式與自動化

Claude Opus 4.8(高階定價,但價格約僅為前幾代 Opus 的三分之一)

需要程式碼真正能跑的時候,Opus 值得額外投資。多檔案編輯和複雜除錯方面,它比我用過的任何模型都強;加上 4.8 降價,它已經可以當成日常寫程式預設模型,而不只是特殊情境才用。

替代方案: 啟用延伸思考的 Sonnet 4.6。只在需要額外算力時,才支付額外的推理 token 費用。

研究與文件分析

Gemini 3.1 Pro(中階定價)

超過 100 萬 token 的上下文視窗,讓你可以把整個程式碼庫丟給它。它擅長從大量長文件中彙整資訊。

OpenClaw 中的 Gemini 模型

如果你在做文件密集的工作,或者想要一個穩固的中階選項,Google 的 Gemini 系列值得仔細看看。

Gemini 3.1 Pro 是主力。百萬 token 的上下文視窗表示你可以把整個 repo 餵給它,然後請它找出 bug。長文件分析、合約審閱或程式碼庫問答,在上下文長度方面沒有其他模型能與之匹敵。

Gemini 3 Flash(遠低於 1 美元的定價)是速度選項。便宜、快速,對較簡單的任務表現出奇地好。如果你在處理大量查詢且不需要深度推理,Flash 表現得很好。

要透過 haimaker.ai 新增 Gemini 模型,請將它們加入你的供應商設定:

{
  models: {
    providers: {
      haimaker: {
        // ... existing config
        models: [
          // ... existing models
          { id: "google/gemini-3-pro", name: "Gemini 3 Pro" },
          { id: "google/gemini-3-flash", name: "Gemini 3 Flash" }
        ]
      }
    }
  }
}

或者你偏好直接使用 Google 的 API 也行。OpenClaw 原生支援 Google 作為供應商。

使用 Ollama 在本機運行 Gemma 4 搭配 OpenClaw

如果你想要零 API 成本,Gemma 4 + Ollama 是目前 OpenClaw 最佳的本機模型。Google 的 Gemma 4 8B 可以在任何配備 16GB 統一記憶體的 Mac 上運行,處理程式碼閱讀、簡單編輯和樣板程式碼,而且不會將任何資料傳送到外部伺服器。

安裝 Ollama、拉取模型,然後將 OpenClaw 指向它:

ollama pull gemma4
{
  models: {
    providers: {
      ollama: {
        baseUrl: "http://localhost:11434/v1",
        api: "openai-completions",
        models: [{ id: "gemma4:latest", name: "Gemma 4 8B", contextWindow: 131072, maxTokens: 8192 }]
      }
    }
  },
  agents: { defaults: { model: { primary: "ollama/gemma4:latest" } } }
}

完整教學:如何使用 Ollama 設定 Gemma 4 搭配 OpenClaw

隱私敏感工作

透過 haimaker.ai 使用 Qwen3 Coder 或 Llama 3.3 70B

開源模型,經由合規的基礎設施轉送。你的提示詞不會進入大型供應商的訓練資料管線。

若要做到滴水不漏,可以用 Ollama 或 vLLM 自行託管。你需要相當高規格的硬體(2 張 A100 或同等級),也要能忍受較高的延遲。

混合方案: 一般工作使用雲端 API,敏感任務切換到開源模型。Clawdbot 透過模型覆寫讓這變得很容易。

供應商比較

Anthropic(Claude)

高階定價(每百萬輸出 token $3–$75)。工具呼叫與指令遵循能力最佳。預設不會使用 API 資料進行訓練。

Claude 已成為寫程式 Agent 的預設選擇。工具呼叫的可靠性就是比其他方案好。

OpenAI(GPT)

中階定價($0.60–$15)。整體表現穩定、回應速度快。GPT-4o 是不錯的全方位選擇。Mini 版很適合大量、簡單的任務。

Google(Gemini)

具競爭力的定價($1.25–$10)。超大上下文視窗是主要賣點。非常適合文件密集的工作流程。

透過 haimaker.ai 使用開源模型

比市場低 5%(每百萬 token $0.10–$5)。跨 GPU 供應商轉送請求,以最佳化成本和延遲。避免將資料送到美國大型雲端服務商所帶來的合規麻煩。

API 相容 OpenAI 格式:

curl https://api.haimaker.ai/v1/chat/completions \
  -H "Authorization: Bearer $HAIMAKER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

將你的 base URL 換成 https://api.haimaker.ai/v1 就完成了。

在 HAIMAKER 取得 $10 免費額度

OpenClaw 設定

~/.openclaw/openclaw.json 中設定你的預設模型:

{
  agents: { defaults: { model: { primary: "anthropic/claude-sonnet-4-6" } } }
}

使用 /model opus/model haimaker/llama-3.3-70b 在工作階段中切換模型。

遷移說明: 如果你從 Clawdbot 遷移過來,設定檔會自動遷移。CLI 現在使用 openclaw 而非 clawdbot 指令。

在 OpenClaw 中新增 haimaker.ai 作為供應商

{
  env: { HAIMAKER_API_KEY: "sk-..." },
  agents: {
    defaults: { model: { primary: "haimaker/llama-3.3-70b" } }
  },
  models: {
    mode: "merge",
    providers: {
      haimaker: {
        baseUrl: "https://api.haimaker.ai/v1",
        apiKey: "${HAIMAKER_API_KEY}",
        api: "openai-completions",
        models: [
          { id: "llama-3.3-70b", name: "Llama 3.3 70B" },
          { id: "qwen3-coder", name: "Qwen3 Coder" },
          { id: "mistral-large", name: "Mistral Large" }
        ]
      }
    }
  }
}

不想手動編輯?npx -y @haimaker/connect --openclaw 會自動將該供應商區塊寫入 ~/.openclaw/openclaw.json連線指南 也涵蓋了它所處理的其他 Agent。

我該選擇哪個模型?

如果你還不確定,以下是快速決策樹:

「我只想要一個能用的」 — Claude Sonnet 4.6。它能妥善處理 80% 的任務,價格也合理。從這裡開始。

「我在寫正式環境的程式碼」 — Claude Opus 4.8。當你在凌晨兩點除錯一個棘手的非同步問題,而模型第一次就給出正確答案時,額外的成本就值得了。

「我需要處理長文件」 — Gemini 3.1 Pro。沒有其他模型能給你百萬 token 的上下文。把整個 repo、整份合約、整個對話串都餵給它。

「我需要免費的」Gemma 4 搭配 Ollama 是目前 OpenClaw 最佳的本機免費模型。任何配備 16GB 記憶體的 Mac 都能跑。Gemini Flash 也有免費額度。參閱我們的免費模型指南

「我需要便宜的」 — 簡單任務透過 haimaker.ai 使用 MiniMax M3 或 DeepSeek V4 Flash,需要更多推理能力時用 GLM-5.2。參閱我們的成本比較指南

「我要資料保持隱私」 — 透過 haimaker.ai 使用 Qwen3 Coder 或 Llama 3.3 70B。或者如果你有硬體,可以使用 Ollama 自行託管

「我想用 Gemini」 — 品質選 Gemini 3.1 Pro,速度和成本選 Gemini 3 Flash。兩者都可透過 haimaker.ai 或 Google 的 API 直接使用。

老實說,大多數人應該同時運行兩到三個模型,並在它們之間視任務切換。簡單任務用便宜模型,日常工作用中階模型,困難任務用高階模型。Haimaker 的路由引擎讓這很容易設定。

OpenClaw 模型列表

OpenClaw 支援的每個模型的完整定價、設定和使用情境分析:

Anthropic: Claude Opus 4.6 · Opus 4.5 · Opus 4.1 · Sonnet 4.6 · Sonnet 4.5 · Haiku 4.5

OpenAI: GPT-5.3 · GPT-5 Codex · GPT-5 Pro · GPT-5 · GPT-5 Mini · GPT-5 Nano · GPT-5.4 Pro · GPT-5.4 · GPT-5.2 · GPT-5.1 · GPT-4.1 · GPT-4.1 Mini · GPT-4.1 Nano · GPT-4o · GPT-4o Mini · GPT-4 Turbo · GPT-4 · o3 · o3 Mini · o4 Mini · o1 · o1 Mini

Google: Gemini 3.1 Pro · Gemini 3 Flash · Gemini 2.5 Pro · Gemini 2.5 Flash · Gemini 2.0 Flash

xAI: Grok 4.20 · Grok 4 · Grok 4 Fast · Grok 4.1 Fast · Grok Code Fast · Grok 3 · Grok 3 Mini · Grok 3 Mini Fast · Grok 2 · Grok 2 Vision

DeepSeek: DeepSeek R1 · DeepSeek V3.2 · DeepSeek V3.1 · DeepSeek V3

MiniMax: M2.5 · M2.5 Lightning · M2.1 · M2.1 Lightning · M2

智譜: GLM-5 · GLM-4.7 · GLM-4.7 Flash · GLM-4.6 · GLM-4.6 Exacto

Meta: Llama 4 Maverick · Llama 4 Scout

更多: Qwen3.5 397B · Qwen3 Max · Qwen3 Coder · Qwen3 Coder Plus · Qwen 2.5 Coder 32B · Kimi K2 · Kimi K2.5 · MiMo V2 Flash · UI-TARS 1.5

總結

沒有最佳模型,只有適合你當下需求的模型。

  • 便宜: MiniMax M3、DeepSeek V4 Flash,或透過 haimaker.ai 使用開源模型
  • 能力強: Opus 4.8 或 Gemini 3.1 Pro
  • 隱私: 透過 haimaker.ai 使用開源模型,或自行託管

大多數人應該從 Claude Sonnet 4.6 開始。它能妥善處理大多數任務,而且不會收到嚇人的帳單。再根據你的實際需求調整就好。

探索 HAIMAKER


準備好設定你自己的 OpenClaw Agent 了嗎?前往 openclaw.ai 開始使用,或查看 OpenClaw 文件 了解詳細的設定選項。