大家最常問的就是:該用哪個模型?老實說,這要看你想做什麼、願意花多少錢。
注意: Clawdbot 已更名為 OpenClaw——同樣強大的 AI Agent 平台,換了新名字。請前往 openclaw.ai 了解更多。
OpenClaw 支援十幾家供應商:Anthropic、OpenAI、Google,以及透過 haimaker.ai 使用的開源模型。每家供應商在成本、能力和資料去向方面各有取捨。
以下是我挑選模型時的考量。
OpenClaw 支援模型列表
OpenClaw 可以使用任何由支援的供應商或 OpenAI 相容端點提供的模型。實際可用清單比預設設定更廣。
| 供應商 | 建議優先試用的模型 | 最佳用途 |
|---|---|---|
| Haimaker | MiniMax M3、Qwen3 Coder、Kimi K2.7、DeepSeek V4 | 一組 API 金鑰即可用於多個便宜模型 |
| Anthropic | Claude Opus 4.8、Claude Sonnet 4.6 | 寫程式和高難度 Agent 任務 |
| OpenAI | GPT-5.6、GPT-5.5、GPT-5.4 Mini | 一般工作,API 行為穩定 |
| Gemini 3 Flash、Gemini 3.1 Pro | 長上下文和免費額度 | |
| xAI | Grok 4.5、Grok 4.1 Fast、Grok Code Fast | 便宜的超大上下文/程式碼專用工作 |
| DeepSeek | DeepSeek V4 Pro、DeepSeek V4 Flash | 低成本寫程式與推理替代方案 |
| Ollama | Qwen3.6、Gemma 4、gpt-oss | 本機/隱私推論 |
只要模型相容 OpenAI 格式,規則就很簡單:新增供應商、新增模型 ID,然後將完整模型名稱加入允許清單。這涵蓋了 Haimaker、Ollama、OpenRouter、Together、私有 vLLM 部署,以及大多數代管推論閘道。
價格、能力、隱私
這三者往往互相牽制。你或許能同時最佳化其中兩項,但很少能三者兼得。
價格
Token 價格差異極大。高階 Claude 模型每 token 的成本可能是 Grok 4.1 Fast 或 DeepSeek V4 Flash 等平價選項的數十倍——然而很多時候,產出品質其實差不多。一個值得注意的變化是:Claude Opus 4.8 的發布價格約為舊版 Opus 的三分之一,大幅縮小了「高階」和「中階」之間的差距。
對大多數助理任務來說,中階模型是合理的選擇。Claude Sonnet 4.6 以遠低於 Opus 的成本,提供接近 Opus 的能力。
能力
跑分歸跑分,別太當真。對 OpenClaw 來說,真正重要的是:
- 工具呼叫 – 能否正確呼叫 shell 指令和 API,而不會弄錯語法?
- 上下文追蹤 – 是否記得你 50 則訊息前說了什麼?
- 程式碼品質 – 寫出來的程式碼能跑嗎?
- 速度 – 送出請求後要多久才開始回應?
隱私
雲端 API 意味著你的提示詞會傳送到外部伺服器。對個人財務、健康資料或專有程式碼來說,這是個問題。你可以自行託管開源模型,但那需要硬體設備,也要能容忍較高的延遲。
依使用情境推薦
日常助理工作
Claude Sonnet 4.6(中階定價)
行事曆、電子郵件、研究、一般查詢。Sonnet 全部都能處理,而且不會讓荷包大失血。速度足以應付即時對話,能力也足以勝任多步驟任務。
更便宜的選項:GPT-5.4 Mini(不到 1 美元的價位)
簡單任務夠用。遇到複雜任務,品質會下降,但考量到成本只有幾分之一,有時這正是正確的選擇。
寫程式與自動化
Claude Opus 4.8(高階定價,但價格約僅為前幾代 Opus 的三分之一)
需要程式碼真正能跑的時候,Opus 值得額外投資。多檔案編輯和複雜除錯方面,它比我用過的任何模型都強;加上 4.8 降價,它已經可以當成日常寫程式預設模型,而不只是特殊情境才用。
替代方案: 啟用延伸思考的 Sonnet 4.6。只在需要額外算力時,才支付額外的推理 token 費用。
研究與文件分析
Gemini 3.1 Pro(中階定價)
超過 100 萬 token 的上下文視窗,讓你可以把整個程式碼庫丟給它。它擅長從大量長文件中彙整資訊。
OpenClaw 中的 Gemini 模型
如果你在做文件密集的工作,或者想要一個穩固的中階選項,Google 的 Gemini 系列值得仔細看看。
Gemini 3.1 Pro 是主力。百萬 token 的上下文視窗表示你可以把整個 repo 餵給它,然後請它找出 bug。長文件分析、合約審閱或程式碼庫問答,在上下文長度方面沒有其他模型能與之匹敵。
Gemini 3 Flash(遠低於 1 美元的定價)是速度選項。便宜、快速,對較簡單的任務表現出奇地好。如果你在處理大量查詢且不需要深度推理,Flash 表現得很好。
要透過 haimaker.ai 新增 Gemini 模型,請將它們加入你的供應商設定:
{
models: {
providers: {
haimaker: {
// ... existing config
models: [
// ... existing models
{ id: "google/gemini-3-pro", name: "Gemini 3 Pro" },
{ id: "google/gemini-3-flash", name: "Gemini 3 Flash" }
]
}
}
}
}
或者你偏好直接使用 Google 的 API 也行。OpenClaw 原生支援 Google 作為供應商。
使用 Ollama 在本機運行 Gemma 4 搭配 OpenClaw
如果你想要零 API 成本,Gemma 4 + Ollama 是目前 OpenClaw 最佳的本機模型。Google 的 Gemma 4 8B 可以在任何配備 16GB 統一記憶體的 Mac 上運行,處理程式碼閱讀、簡單編輯和樣板程式碼,而且不會將任何資料傳送到外部伺服器。
安裝 Ollama、拉取模型,然後將 OpenClaw 指向它:
ollama pull gemma4
{
models: {
providers: {
ollama: {
baseUrl: "http://localhost:11434/v1",
api: "openai-completions",
models: [{ id: "gemma4:latest", name: "Gemma 4 8B", contextWindow: 131072, maxTokens: 8192 }]
}
}
},
agents: { defaults: { model: { primary: "ollama/gemma4:latest" } } }
}
完整教學:如何使用 Ollama 設定 Gemma 4 搭配 OpenClaw。
隱私敏感工作
透過 haimaker.ai 使用 Qwen3 Coder 或 Llama 3.3 70B
開源模型,經由合規的基礎設施轉送。你的提示詞不會進入大型供應商的訓練資料管線。
若要做到滴水不漏,可以用 Ollama 或 vLLM 自行託管。你需要相當高規格的硬體(2 張 A100 或同等級),也要能忍受較高的延遲。
混合方案: 一般工作使用雲端 API,敏感任務切換到開源模型。Clawdbot 透過模型覆寫讓這變得很容易。
供應商比較
Anthropic(Claude)
高階定價(每百萬輸出 token $3–$75)。工具呼叫與指令遵循能力最佳。預設不會使用 API 資料進行訓練。
Claude 已成為寫程式 Agent 的預設選擇。工具呼叫的可靠性就是比其他方案好。
OpenAI(GPT)
中階定價($0.60–$15)。整體表現穩定、回應速度快。GPT-4o 是不錯的全方位選擇。Mini 版很適合大量、簡單的任務。
Google(Gemini)
具競爭力的定價($1.25–$10)。超大上下文視窗是主要賣點。非常適合文件密集的工作流程。
透過 haimaker.ai 使用開源模型
比市場低 5%(每百萬 token $0.10–$5)。跨 GPU 供應商轉送請求,以最佳化成本和延遲。避免將資料送到美國大型雲端服務商所帶來的合規麻煩。
API 相容 OpenAI 格式:
curl https://api.haimaker.ai/v1/chat/completions \
-H "Authorization: Bearer $HAIMAKER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-3.3-70b",
"messages": [{"role": "user", "content": "Hello!"}]
}'
將你的 base URL 換成 https://api.haimaker.ai/v1 就完成了。
OpenClaw 設定
在 ~/.openclaw/openclaw.json 中設定你的預設模型:
{
agents: { defaults: { model: { primary: "anthropic/claude-sonnet-4-6" } } }
}
使用 /model opus 或 /model haimaker/llama-3.3-70b 在工作階段中切換模型。
遷移說明: 如果你從 Clawdbot 遷移過來,設定檔會自動遷移。CLI 現在使用
openclaw而非clawdbot指令。
在 OpenClaw 中新增 haimaker.ai 作為供應商
{
env: { HAIMAKER_API_KEY: "sk-..." },
agents: {
defaults: { model: { primary: "haimaker/llama-3.3-70b" } }
},
models: {
mode: "merge",
providers: {
haimaker: {
baseUrl: "https://api.haimaker.ai/v1",
apiKey: "${HAIMAKER_API_KEY}",
api: "openai-completions",
models: [
{ id: "llama-3.3-70b", name: "Llama 3.3 70B" },
{ id: "qwen3-coder", name: "Qwen3 Coder" },
{ id: "mistral-large", name: "Mistral Large" }
]
}
}
}
}
不想手動編輯?npx -y @haimaker/connect --openclaw 會自動將該供應商區塊寫入 ~/.openclaw/openclaw.json;連線指南 也涵蓋了它所處理的其他 Agent。
我該選擇哪個模型?
如果你還不確定,以下是快速決策樹:
「我只想要一個能用的」 — Claude Sonnet 4.6。它能妥善處理 80% 的任務,價格也合理。從這裡開始。
「我在寫正式環境的程式碼」 — Claude Opus 4.8。當你在凌晨兩點除錯一個棘手的非同步問題,而模型第一次就給出正確答案時,額外的成本就值得了。
「我需要處理長文件」 — Gemini 3.1 Pro。沒有其他模型能給你百萬 token 的上下文。把整個 repo、整份合約、整個對話串都餵給它。
「我需要免費的」 — Gemma 4 搭配 Ollama 是目前 OpenClaw 最佳的本機免費模型。任何配備 16GB 記憶體的 Mac 都能跑。Gemini Flash 也有免費額度。參閱我們的免費模型指南。
「我需要便宜的」 — 簡單任務透過 haimaker.ai 使用 MiniMax M3 或 DeepSeek V4 Flash,需要更多推理能力時用 GLM-5.2。參閱我們的成本比較指南。
「我要資料保持隱私」 — 透過 haimaker.ai 使用 Qwen3 Coder 或 Llama 3.3 70B。或者如果你有硬體,可以使用 Ollama 自行託管。
「我想用 Gemini」 — 品質選 Gemini 3.1 Pro,速度和成本選 Gemini 3 Flash。兩者都可透過 haimaker.ai 或 Google 的 API 直接使用。
老實說,大多數人應該同時運行兩到三個模型,並在它們之間視任務切換。簡單任務用便宜模型,日常工作用中階模型,困難任務用高階模型。Haimaker 的路由引擎讓這很容易設定。
OpenClaw 模型列表
OpenClaw 支援的每個模型的完整定價、設定和使用情境分析:
Anthropic: Claude Opus 4.6 · Opus 4.5 · Opus 4.1 · Sonnet 4.6 · Sonnet 4.5 · Haiku 4.5
OpenAI: GPT-5.3 · GPT-5 Codex · GPT-5 Pro · GPT-5 · GPT-5 Mini · GPT-5 Nano · GPT-5.4 Pro · GPT-5.4 · GPT-5.2 · GPT-5.1 · GPT-4.1 · GPT-4.1 Mini · GPT-4.1 Nano · GPT-4o · GPT-4o Mini · GPT-4 Turbo · GPT-4 · o3 · o3 Mini · o4 Mini · o1 · o1 Mini
Google: Gemini 3.1 Pro · Gemini 3 Flash · Gemini 2.5 Pro · Gemini 2.5 Flash · Gemini 2.0 Flash
xAI: Grok 4.20 · Grok 4 · Grok 4 Fast · Grok 4.1 Fast · Grok Code Fast · Grok 3 · Grok 3 Mini · Grok 3 Mini Fast · Grok 2 · Grok 2 Vision
DeepSeek: DeepSeek R1 · DeepSeek V3.2 · DeepSeek V3.1 · DeepSeek V3
MiniMax: M2.5 · M2.5 Lightning · M2.1 · M2.1 Lightning · M2
智譜: GLM-5 · GLM-4.7 · GLM-4.7 Flash · GLM-4.6 · GLM-4.6 Exacto
Meta: Llama 4 Maverick · Llama 4 Scout
更多: Qwen3.5 397B · Qwen3 Max · Qwen3 Coder · Qwen3 Coder Plus · Qwen 2.5 Coder 32B · Kimi K2 · Kimi K2.5 · MiMo V2 Flash · UI-TARS 1.5
總結
沒有最佳模型,只有適合你當下需求的模型。
- 便宜: MiniMax M3、DeepSeek V4 Flash,或透過 haimaker.ai 使用開源模型
- 能力強: Opus 4.8 或 Gemini 3.1 Pro
- 隱私: 透過 haimaker.ai 使用開源模型,或自行託管
大多數人應該從 Claude Sonnet 4.6 開始。它能妥善處理大多數任務,而且不會收到嚇人的帳單。再根據你的實際需求調整就好。
準備好設定你自己的 OpenClaw Agent 了嗎?前往 openclaw.ai 開始使用,或查看 OpenClaw 文件 了解詳細的設定選項。