「免費」這個詞在 AI 模型圈已經被講到濫了。我直接說清楚,對 OpenClaw 使用者來說,「免費」到底代表什麼。
大致分三種:完全零成本的模型(本機)、有免費額度但遲早會用完的模型,以及便宜到在帳單上幾乎可以忽略的模型。以下逐一說明。
真正免費:本機模型
唯一不收 token 費用的,就是跑在你自己硬體上的模型。Ollama 讓這件事變得很簡單。
安裝 Ollama、拉取一個模型、把 OpenClaw 指向本機:
# Install Ollama
curl -fsSL https://ollama.com/install.sh | sh
# Pull a coding model
ollama pull qwen3.6:27b
然後在 ~/.openclaw/openclaw.json 中把 Ollama 加為供應商:
{
models: {
providers: {
ollama: {
baseUrl: "http://localhost:11434/v1",
api: "openai-completions",
models: [
{ id: "qwen3.6:27b", name: "Qwen3.6 27B" }
]
}
}
},
agents: {
defaults: {
model: { primary: "ollama/qwen3.6:27b" }
}
}
}
哪些本機模型好用
Qwen3.6 27B 是目前的最佳平衡點——社群至今仍稱它是本機程式開發的天花板。它在 SWE-bench Verified 得分 77.2%,日常的程式碼生成、除錯、多檔案編輯都能勝任,而且只需要約 18GB VRAM(一張 RTX 5090,或 32GB 以上統一記憶體的 M 系列 Mac)。
Qwen3 Coder 30B 是針對 agent 調校的替代選擇——256K 上下文、可靠的工具呼叫,這對 OpenClaw 的 tool loop 很重要。
gpt-oss 20B 和 Gemma 4 能在 16GB 的機器上跑。gpt-oss 20B 自發布以來已經成為小型模型的預設首選——每個 token 只啟用約 3.6B 參數,還能調整推理強度。不過遇到複雜任務時品質還是會下降;多檔案重構這種事我不會放心交給它們。
實際的取捨
本機模型免費,但速度不快。回應時間比雲端 API 慢 3 到 10 倍,取決於你的硬體。而且就算是消費級硬體能跑得動的最佳開源模型,在處理最棘手的除錯與多檔案工作時,還是比不上頂尖的 Claude 模型。
如果你的工作主要是讀檔案、產生樣板程式碼、做簡單編輯,本機模型很夠用。但如果你在做複雜除錯或架構設計,那些任務還是得靠雲端模型。
雲端供應商的免費方案
有幾家供應商提供真正免費的使用額度。
Gemini Flash 是雲端推論的最佳免費選項。Google 的免費方案提供每分鐘 15 次請求,上下文視窗最高可達 100 萬 token。日常寫寫程式已經夠用了。
// Add to ~/.openclaw/openclaw.json
{
models: {
providers: {
google: {
models: [
{ id: "gemini-3-flash", name: "Gemini 3 Flash" }
]
}
}
}
}
要注意的是:免費方案的速率限制比較嚴格,而且你的資料可能會被拿去訓練。如果是 side project 或學習用途,這大概無所謂。但如果是公司專有程式碼,請用付費 API 或改跑本機。
幾乎免費:不到一美元的模型
有些模型的 token 單價低到即使整天重度使用 OpenClaw,費用也不到 1 美元。
| 模型 | 輸入成本 | 輸出成本 | 每日成本估算 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.10/M | ~$0.28/M | ~$0.15 |
| GLM-4.7 Flash | $0.07/M | $0.28/M | ~$0.15 |
| GPT-4o-mini | $0.15/M | $0.60/M | ~$0.50 |
| MiniMax M3 | $0.30/M | — | ~$0.50 |
每日估算以約 500K 輸入 + 200K 輸出 token 為基準,大約是一個忙碌的程式開發日的用量。
MiniMax M3 值得特別說一下:$0.30/M 的輸入成本加上 100 萬 token 的上下文視窗,讓它成為目前平價區間中 CP 值最高的選擇——全天候讓 agent 跑一個月大約 $7–15。DeepSeek V4 Flash 則是把價格壓到最低的選擇:便宜到 24/7 跑 agent 一個月不到 $5。
這些模型很適合處理程式開發中比較單調的部分:讀檔案、簡單編輯、寫文件、跑測試。把 20% 的困難問題導向更好的模型,總帳單就能壓在每天 $5 以內。
你可以透過 Haimaker 用一組 API 金鑰存取以上所有模型,也可以分別到各家供應商設定。
將 Haimaker 金鑰放進 HAIMAKER_API_KEY 之後,connect CLI(npx -y @haimaker/connect --openclaw)會自動把供應商設定寫進 OpenClaw,讓你不用手動改 JSON 就能使用這些不到一美元的模型。
實用設定:免費 + 便宜的混合方案
多數在意成本的人,最後都會走到這一步:
- 本機模型處理簡單任務(透過 Ollama 跑 Qwen3.6 27B,免費)
- 便宜雲端模型處理中等任務(DeepSeek V4 Flash 或 MiniMax M3,銅板價)
- 高階模型處理困難問題(Claude Sonnet 或 Opus,按量計費)
{
agents: {
defaults: {
model: {
primary: "ollama/qwen3.6:27b",
thinking: "anthropic/claude-sonnet-4-6"
}
}
}
}
本機模型處理 60–70% 的請求(讀檔案、簡單的程式碼),剩下的交給 Sonnet。每日 API 費用從 $30–50 降到 $2–5。
關於模型路由的更多細節,請參考我們的多 Agent 工作流程指南。
完整的模型比較,請參閱 OpenClaw 最佳模型。成本最佳化策略,請參閱削減 96% token 成本。