어떤 모델을 써야 하는지 묻는 분이 정말 많습니다. 솔직히 말하면 무엇을 하느냐, 예산이 얼마인지에 따라 다릅니다.

참고: Clawdbot은 OpenClaw로 리브랜딩했습니다. 강력한 AI 에이전트 플랫폼은 그대로이고 이름만 바뀌었습니다. 자세한 내용은 openclaw.ai에서 확인하세요.

OpenClaw는 10여 개의 프로바이더를 지원합니다. Anthropic, OpenAI, Google, 그리고 haimaker.ai를 통한 오픈소스 모델까지. 각각 비용, 성능, 데이터가 저장되는 위치에 따라 장단점이 있습니다.

제가 모델을 고르는 기준을 정리해 봤습니다.

OpenClaw 지원 모델 목록

OpenClaw는 지원되는 프로바이더나 OpenAI 호환 엔드포인트로 제공되는 모든 모델을 사용할 수 있습니다. 실제 지원 범위는 기본 설정보다 훨씬 넓습니다.

프로바이더시작하기 좋은 모델추천 용도
HaimakerMiniMax M3, Qwen3 Coder, Kimi K2.7, DeepSeek V4API 키 하나로 여러 저가 모델 사용
AnthropicClaude Opus 4.8, Claude Sonnet 4.6코딩과 어려운 에이전트 작업
OpenAIGPT-5.6, GPT-5.5, GPT-5.4 Mini일반 업무, 안정적인 API 동작
GoogleGemini 3 Flash, Gemini 3.1 Pro긴 컨텍스트와 무료 등급 활용
xAIGrok 4.5, Grok 4.1 Fast, Grok Code Fast저렴한 대용량 컨텍스트 또는 코드 특화
DeepSeekDeepSeek V4 Pro, DeepSeek V4 Flash저비용 코딩·추론 대체재
OllamaQwen3.6, Gemma 4, gpt-oss로컬/프라이빗 추론

모델이 OpenAI 호환이라면 규칙은 간단합니다. 프로바이더를 추가하고, 모델 ID를 추가한 다음, 전체 한정 모델 이름(fully qualified model name)을 허용 목록에 추가하면 됩니다. Haimaker, Ollama, OpenRouter, Together, 사설 vLLM 배포, 대부분의 호스팅 추론 게이트웨이에 모두 적용됩니다.

가격, 성능, 프라이버시

이 세 가지는 서로 트레이드오프 관계입니다. 두 가지를 최적화할 수는 있어도 셋 모두를 한 번에 잡기는 어렵습니다.

가격

토큰 가격은 천차만별입니다. 프리미엄 Claude 모델은 Grok 4.1 Fast나 DeepSeek V4 Flash 같은 보급형 옵션보다 토큰당 수십 배 비쌉니다. 그런데 출력 품질은 많은 경우 비슷합니다. 눈에 띄는 변화가 하나 있습니다. Claude Opus 4.8이 이전 Opus 가격의 약 3분의 1로 출시되면서 ‘프리미엄’과 ‘중간 가격대’의 경계가 크게 좁혀졌습니다.

대부분의 어시스턴트 작업에는 중간 가격대 모델이 합리적입니다. Claude Sonnet 4.6은 Opus 성능의 대부분을 훨씬 낮은 비용으로 제공합니다.

성능

벤치마크는 믿을 게 못 됩니다. OpenClaw에서 실제로 중요한 기준은 다음과 같습니다.

  • 도구 호출 – 셸 명령과 API를 문법 오류 없이 호출할 수 있는가?
  • 컨텍스트 추적 – 50개 메시지 전에 했던 말을 기억하는가?
  • 코드 품질 – 작성한 코드가 실제로 실행되는가?
  • 속도 – 응답이 시작될 때까지 얼마나 걸리는가?

프라이버시

클라우드 API를 쓰면 프롬프트가 외부 서버로 전송됩니다. 개인 금융, 건강 데이터, 독점 코드라면 문제가 됩니다. 오픈소스 모델을 셀프호스팅할 수 있지만, 하드웨어가 필요하고 응답 지연을 감수해야 합니다.

용도별 추천

일상 어시스턴트 작업

Claude Sonnet 4.6 (중간 가격대)

캘린더, 이메일, 리서치, 일반 질문까지 Sonnet이 비용 부담 없이 모두 처리합니다. 실시간 채팅에 충분히 빠르고 여러 단계 작업도 잘 해냅니다.

더 저렴한 선택: GPT-5.4 Mini (1달러 미만 가격대)

단순 작업에는 충분합니다. 복잡한 작업에서는 품질이 떨어지지만 비용이 훨씬 낮으니 그게 맞을 때도 있습니다.

코딩 및 자동화

Claude Opus 4.8 (프리미엄 가격대, 대신 이전 Opus 세대보다 약 3배 저렴)

코드가 실제로 돌아가야 한다면 Opus가 프리미엄 값을 톡톡히 합니다. 여러 파일 수정과 복잡한 디버깅을 제가 써 본 어떤 모델보다 잘 처리합니다. 4.8 가격 인하 덕분에 특별한 순간에만 쓰는 모델이 아니라 일상 코딩 기본 모델로 쓸 수 있게 됐습니다.

대안: 확장 사고(extended thinking)를 켠 Sonnet 4.6. 추론 토큰에 대해서만 필요할 때 추가 비용을 지불하면 됩니다.

리서치 및 문서 분석

Gemini 3.1 Pro (중간 가격대)

100만 토큰 이상의 컨텍스트 윈도우에 코드베이스 전체를 넣을 수 있습니다. 긴 문서에서 정보를 종합하는 데 뛰어납니다.

OpenClaw에서 Gemini 모델 활용

문서 작업이 많거나 탄탄한 중간 가격대 옵션을 찾고 있다면 Google Gemini 제품군을 자세히 살펴볼 만합니다.

Gemini 3.1 Pro는 주력 모델입니다. 백만 토큰 컨텍스트 윈도우를 활용해 저장소 전체를 넣고 버그를 찾아 달라고 할 수 있습니다. 긴 문서 분석, 계약 검토, 코드베이스 Q&A에서 컨텍스트 길이만큼은 다른 모델이 따라오기 어렵습니다.

Gemini 3 Flash (1달러 미만 초저가)는 속도 우선 선택입니다. 저렴하고 빠르며 단순 작업은 놀라울 만큼 잘 해냅니다. 대량 쿼리를 처리하면서 깊은 추론이 필요 없다면 Flash로 충분합니다.

haimaker.ai를 통해 Gemini 모델을 추가하려면 프로바이더 설정에 아래처럼 추가하세요:

{
  models: {
    providers: {
      haimaker: {
        // ... existing config
        models: [
          // ... existing models
          { id: "google/gemini-3-pro", name: "Gemini 3 Pro" },
          { id: "google/gemini-3-flash", name: "Gemini 3 Flash" }
        ]
      }
    }
  }
}

원한다면 Google API를 직접 사용해도 됩니다. OpenClaw는 Google을 공식 프로바이더로 지원합니다.

OpenClaw에서 Gemma 4 로컬로 실행하기

API 비용을 아예 없애고 싶다면 지금 OpenClaw용 로컬 모델로는 Gemma 4 + Ollama가 최고입니다. Google Gemma 4 8B는 16GB 통합 메모리를 갖춘 Mac이라면 어디서든 실행되며, 코드 읽기, 간단한 편집, 보일러플레이트 작성을 외부 서버에 아무것도 보내지 않고 처리합니다.

Ollama를 설치하고 모델을 pull한 다음 OpenClaw에 연결하세요:

ollama pull gemma4
{
  models: {
    providers: {
      ollama: {
        baseUrl: "http://localhost:11434/v1",
        api: "openai-completions",
        models: [{ id: "gemma4:latest", name: "Gemma 4 8B", contextWindow: 131072, maxTokens: 8192 }]
      }
    }
  },
  agents: { defaults: { model: { primary: "ollama/gemma4:latest" } } }
}

전체 가이드: Ollama로 OpenClaw에 Gemma 4 설정하기.

프라이버시가 중요한 작업

haimaker.ai를 통한 Qwen3 Coder 또는 Llama 3.3 70B

오픈소스 모델을 컴플라이언스를 갖춘 인프라를 통해 라우팅합니다. 프롬프트가 대형 프로바이더의 학습 파이프라인에 들어가지 않습니다.

보안에 극도로 민감하다면 Ollama나 vLLM으로 셀프호스팅하세요. 상당한 하드웨어(A100 2개 또는 동급)와 지연 시간을 감수할 인내가 필요합니다.

하이브리드 접근: 일반 작업에는 클라우드 API를 쓰고, 민감한 작업에는 오픈소스로 전환하세요. OpenClaw는 모델 오버라이드 기능으로 이 전환을 쉽게 만들어 줍니다.

프로바이더 비교

Anthropic (Claude)

프리미엄 가격(출력 토큰 100만 개당 $3~$75). 도구 호출과 지시 이행이 최고 수준입니다. 기본적으로 API 데이터를 학습에 사용하지 않습니다.

Claude는 이제 코딩 에이전트의 기본 선택이 됐습니다. 도구 사용 안정성이 대안보다 확실히 낫습니다.

OpenAI (GPT)

중간 가격대($0.60~$15). 준수한 일반 성능, 빠른 응답. GPT-4o는 무난한 만능 모델입니다. Mini 버전은 대량의 단순 작업에 잘 맞습니다.

Google (Gemini)

경쟁력 있는 가격($1.25~$10). 거대한 컨텍스트 윈도우가 핵심 강점입니다. 문서 중심 워크플로우에 적합합니다.

haimaker.ai를 통한 오픈소스

시장가보다 5% 저렴(토큰 100만 개당 $0.10~$5). 비용과 지연 시간을 최적화하기 위해 GPU 공급자 사이에서 요청을 라우팅합니다. 미국 하이퍼스케일러에 데이터를 보낼 때 따르는 컴플라이언스 부담도 피할 수 있습니다.

API는 OpenAI 호환입니다:

curl https://api.haimaker.ai/v1/chat/completions \
  -H "Authorization: Bearer $HAIMAKER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

기본 URL을 https://api.haimaker.ai/v1로 바꾸면 끝입니다.

HAIMAKER에서 $10 무료 크레딧 받기

OpenClaw 설정

~/.openclaw/openclaw.json에서 기본 모델을 설정하는 방법:

{
  agents: { defaults: { model: { primary: "anthropic/claude-sonnet-4-6" } } }
}

세션 중에 /model opus 또는 /model haimaker/llama-3.3-70b로 모델을 전환할 수 있습니다.

마이그레이션 참고: Clawdbot에서 넘어온 경우 설정 파일이 자동으로 마이그레이션됩니다. CLI는 이제 openclaw 대신 clawdbot 명령을 사용합니다.

OpenClaw에서 haimaker.ai를 프로바이더로 추가하기

{
  env: { HAIMAKER_API_KEY: "sk-..." },
  agents: {
    defaults: { model: { primary: "haimaker/llama-3.3-70b" } }
  },
  models: {
    mode: "merge",
    providers: {
      haimaker: {
        baseUrl: "https://api.haimaker.ai/v1",
        apiKey: "${HAIMAKER_API_KEY}",
        api: "openai-completions",
        models: [
          { id: "llama-3.3-70b", name: "Llama 3.3 70B" },
          { id: "qwen3-coder", name: "Qwen3 Coder" },
          { id: "mistral-large", name: "Mistral Large" }
        ]
      }
    }
  }
}

수동 편집을 건너뛰고 싶다면 npx -y @haimaker/connect --openclaw 명령이 해당 프로바이더 블록을 ~/.openclaw/openclaw.json에 자동으로 작성해 줍니다. 연결 가이드에서 지원하는 다른 에이전트도 확인할 수 있습니다.

어떤 모델을 선택해야 하나요?

아직 고민 중이라면 이렇게 빠르게 결정해 보세요.

“그냥 잘 되는 게 필요해요” — Claude Sonnet 4.6. 작업 80%를 잘 처리하고 가격도 합리적입니다. 여기서 시작하세요.

“프로덕션 코드를 작성하고 있어요” — Claude Opus 4.8. 새벽 2시에 까다로운 비동기 이슈를 디버깅하다가 모델이 첫 시도에 정확히 해결해 주면 추가 비용은 충분히 값어치를 합니다.

“긴 문서를 처리해야 해요” — Gemini 3.1 Pro. 백만 토큰 컨텍스트를 제공하는 유일한 모델입니다. 저장소 전체든, 계약서 전체든, 스레드 전체든 넣어 보세요.

“무료로 써야 해요”Ollama로 Gemma 4가 지금 OpenClaw용 최고의 무료 로컬 모델입니다. 16GB Mac이면 실행됩니다. Gemini Flash도 무료 등급이 있습니다. 무료 모델 가이드도 참고하세요.

“저렴하게 쓰고 싶어요” — 단순 작업에는 haimaker.ai의 MiniMax M3 또는 DeepSeek V4 Flash, 더 많은 추론이 필요하면 GLM-5.2를 쓰세요. 비용 비교 가이드를 참고하세요.

“데이터를 비공개로 유지하고 싶어요” — haimaker.ai의 Qwen3 Coder나 Llama 3.3 70B를 쓰세요. 하드웨어가 있다면 Ollama로 셀프호스팅할 수도 있습니다.

“Gemini를 쓰고 싶어요” — 품질은 Gemini 3.1 Pro, 속도와 비용은 Gemini 3 Flash. 둘 다 haimaker.ai 또는 Google API로 직접 사용할 수 있습니다.

솔직히 말하면 대부분 2~3개 모델을 두고 라우팅하는 게 정답입니다. 단순 작업에는 저렴한 모델, 일상 작업에는 중간 가격대 모델, 어려운 작업에는 프리미엄 모델을 쓰세요. Haimaker 라우팅 엔진을 쓰면 설정이 쉽습니다.

OpenClaw 모델 목록

OpenClaw에서 지원하는 모든 모델의 전체 가격, 설정, 용도별 정리는 아래와 같습니다.

Anthropic: Claude Opus 4.6 · Opus 4.5 · Opus 4.1 · Sonnet 4.6 · Sonnet 4.5 · Haiku 4.5

OpenAI: GPT-5.3 · GPT-5 Codex · GPT-5 Pro · GPT-5 · GPT-5 Mini · GPT-5 Nano · GPT-5.4 Pro · GPT-5.4 · GPT-5.2 · GPT-5.1 · GPT-4.1 · GPT-4.1 Mini · GPT-4.1 Nano · GPT-4o · GPT-4o Mini · GPT-4 Turbo · GPT-4 · o3 · o3 Mini · o4 Mini · o1 · o1 Mini

Google: Gemini 3.1 Pro · Gemini 3 Flash · Gemini 2.5 Pro · Gemini 2.5 Flash · Gemini 2.0 Flash

xAI: Grok 4.20 · Grok 4 · Grok 4 Fast · Grok 4.1 Fast · Grok Code Fast · Grok 3 · Grok 3 Mini · Grok 3 Mini Fast · Grok 2 · Grok 2 Vision

DeepSeek: DeepSeek R1 · DeepSeek V3.2 · DeepSeek V3.1 · DeepSeek V3

MiniMax: M2.5 · M2.5 Lightning · M2.1 · M2.1 Lightning · M2

Zhipu: GLM-5 · GLM-4.7 · GLM-4.7 Flash · GLM-4.6 · GLM-4.6 Exacto

Meta: Llama 4 Maverick · Llama 4 Scout

기타: Qwen3.5 397B · Qwen3 Max · Qwen3 Coder · Qwen3 Coder Plus · Qwen 2.5 Coder 32B · Kimi K2 · Kimi K2.5 · MiMo V2 Flash · UI-TARS 1.5

결론

완벽한 모델은 없습니다. 지금 하는 일에 맞는 모델만 있을 뿐입니다.

  • 저렴하게: MiniMax M3, DeepSeek V4 Flash 또는 haimaker.ai의 오픈소스 모델
  • 성능: Opus 4.8 또는 Gemini 3.1 Pro
  • 프라이버시: haimaker.ai의 오픈소스 모델 또는 셀프호스팅

대부분의 사람은 Claude Sonnet 4.6부터 시작하는 것이 좋습니다. 대부분의 작업을 잘 처리하면서 비용 폭탄을 맞을 걱정이 없습니다. 실제 필요한 것에 맞춰 조정해 보세요.

HAIMAKER 둘러보기


나만의 OpenClaw 에이전트를 설정할 준비가 됐나요? openclaw.ai에서 시작하거나 OpenClaw 문서에서 자세한 설정 옵션을 확인하세요.