Alle fragen, welches Modell sie verwenden sollen. Die ehrliche Antwort: Es kommt darauf an, was du vorhast und wie viel du ausgeben willst.

Hinweis: Clawdbot wurde in OpenClaw umbenannt — dieselbe leistungsfähige KI-Agentenplattform, neuer Name. Mehr dazu auf openclaw.ai.

OpenClaw unterstützt ein Dutzend Provider: Anthropic, OpenAI, Google, Open-Source-Modelle über haimaker.ai. Jeder Provider hat seine Kompromisse bei Kosten, Leistung und der Frage, wo deine Daten landen.

So gehe ich bei der Auswahl vor.

Unterstützte Modelle in OpenClaw

OpenClaw kann jedes Modell verwenden, das über einen unterstützten Provider oder einen OpenAI-kompatiblen Endpoint bereitgestellt wird. Die tatsächlich unterstützte Liste ist größer als die Standardkonfiguration.

ProviderModelle zum EinstiegBester Einsatzzweck
HaimakerMiniMax M3, Qwen3 Coder, Kimi K2.7, DeepSeek V4Ein API-Key für viele günstige Modelle
AnthropicClaude Opus 4.8, Claude Sonnet 4.6Coding und anspruchsvolle Agentenaufgaben
OpenAIGPT-5.6, GPT-5.5, GPT-5.4 MiniAllgemeine Arbeit, zuverlässiges API-Verhalten
GoogleGemini 3 Flash, Gemini 3.1 ProLanger Kontext und Nutzung des kostenlosen Kontingents
xAIGrok 4.5, Grok 4.1 Fast, Grok Code FastGünstig mit großem Kontext oder codespezifische Arbeit
DeepSeekDeepSeek V4 Pro, DeepSeek V4 FlashGünstiges Coding und Reasoning-Fallback
OllamaQwen3.6, Gemma 4, gpt-ossLokale/private Inferenz

Wenn das Modell OpenAI-kompatibel ist, gilt eine einfache Regel: Provider hinzufügen, Modell-ID hinzufügen, den vollständig qualifizierten Modellnamen in die Allowlist aufnehmen. Das funktioniert mit Haimaker, Ollama, OpenRouter, Together, privaten vLLM-Deployments und den meisten gehosteten Inferenz-Gateways.

Preis, Leistung, Datenschutz

Diese drei Faktoren konkurrieren miteinander. Zwei kannst du optimieren, aber selten alle drei gleichzeitig.

Preis

Die Token-Preise variieren extrem. Premium-Claude-Modelle kosten pro Token ein Vielfaches von Budget-Optionen wie Grok 4.1 Fast oder DeepSeek V4 Flash — und liefern in vielen Fällen ähnliche Ergebnisse. Eine bemerkenswerte Entwicklung: Claude Opus 4.8 ist zu etwa einem Drittel des alten Opus-Preises gestartet und hat die Lücke zwischen „Premium” und „Mittelklasse” damit fast geschlossen.

Für die meisten Assistentenaufgaben ist ein Mittelklasse-Modell sinnvoll. Claude Sonnet 4.6 liefert einen Großteil der Opus-Leistung zu einem Bruchteil der Kosten.

Leistung

Benchmarks lügen. Für OpenClaw zählt in der Praxis:

  • Tool Calling – Kann das Modell Shell-Befehle und APIs aufrufen, ohne bei der Syntax zu patzen?
  • Kontextverfolgung – Erinnert es sich noch an das, was du vor 50 Nachrichten gesagt hast?
  • Codequalität – Läuft der Code, den es schreibt, tatsächlich?
  • Geschwindigkeit – Wie schnell kommt die erste Antwort?

Datenschutz

Cloud-APIs bedeuten, dass deine Prompts auf externen Servern landen. Bei persönlichen Finanzdaten, Gesundheitsdaten oder proprietärem Code ist das ein Problem. Du kannst Open-Source-Modelle selbst hosten, brauchst dafür aber Hardware und musst mit höherer Latenz leben.

Empfehlungen nach Anwendungsfall

Tägliche Assistentenarbeit

Claude Sonnet 4.6 (Mittelklasse-Preis)

Kalender, E-Mail, Recherche, allgemeine Anfragen. Sonnet bewältigt das alles, ohne dein Budget zu sprengen. Schnell genug für Echtzeit-Chat, smart genug für mehrstufige Aufgaben.

Günstigere Option: GPT-5.4 Mini (deutlich unter einem Dollar)

Für einfache Aufgaben völlig in Ordnung. Bei komplexeren Dingen sinkt die Qualität, aber zum Bruchteil der Kosten ist das manchmal der richtige Kompromiss.

Coding und Automatisierung

Claude Opus 4.8 (Premium-Klasse, aber ca. 3× günstiger als frühere Opus-Generationen)

Wenn der Code tatsächlich funktionieren muss, ist Opus den Aufpreis wert. Multi-File-Edits und komplexes Debugging beherrscht es besser als alles andere, was ich getestet habe — und durch die Preissenkung bei 4.8 eignet es sich jetzt als tägliches Coding-Standardmodell statt nur für besondere Fälle.

Alternative: Sonnet 4.6 mit aktiviertem Extended Thinking. Du zahlst nur dann mehr pro Reasoning-Token, wenn du die zusätzliche Leistung wirklich brauchst.

Recherche und Dokumentenanalyse

Gemini 3.1 Pro (Mittelklasse-Preis)

Das Kontextfenster von über 1 Million Tokens ermöglicht es dir, ganze Codebasen auf einmal zu verarbeiten. Es ist gut darin, Informationen aus langen Dokumenten zusammenzuführen.

Gemini-Modelle in OpenClaw

Googles Gemini-Familie ist einen genaueren Blick wert, wenn du viel mit Dokumenten arbeitest oder eine solide Mittelklasse-Option suchst.

Gemini 3.1 Pro ist das Arbeitspferd. Das Kontextfenster von einer Million Tokens bedeutet: Du kannst ein komplettes Repo hineinwerfen und es bitten, den Bug zu finden. Für die Analyse langer Dokumente, Vertragsprüfungen oder Fragen zur Codebasis reicht kein anderes Modell an diese Kontextlänge heran.

Gemini 3 Flash (deutlich unter einem Dollar) ist die Speed-Option. Günstig, schnell und überraschend leistungsfähig für einfachere Aufgaben. Wenn du ein hohes Anfragevolumen routest und kein tiefes Reasoning brauchst, ist Flash die richtige Wahl.

Um Gemini-Modelle über haimaker.ai hinzuzufügen, trage sie in deine Provider-Konfiguration ein:

{
  models: {
    providers: {
      haimaker: {
        // ... existing config
        models: [
          // ... existing models
          { id: "google/gemini-3-pro", name: "Gemini 3 Pro" },
          { id: "google/gemini-3-flash", name: "Gemini 3 Flash" }
        ]
      }
    }
  }
}

Oder nutze sie direkt über Googles API, wenn dir das lieber ist. Google ist bei OpenClaw als First-Party-Provider direkt integriert.

Gemma 4 lokal mit OpenClaw betreiben

Wenn du keine API-Kosten willst, ist Gemma 4 + Ollama derzeit das beste lokale Modell für OpenClaw. Googles Gemma 4 8B läuft auf jedem Mac mit 16 GB Unified Memory und übernimmt das Lesen von Code, einfache Änderungen und Boilerplate — ohne dass etwas an externe Server geht.

Installiere Ollama, lade das Modell und richte OpenClaw darauf aus:

ollama pull gemma4
{
  models: {
    providers: {
      ollama: {
        baseUrl: "http://localhost:11434/v1",
        api: "openai-completions",
        models: [{ id: "gemma4:latest", name: "Gemma 4 8B", contextWindow: 131072, maxTokens: 8192 }]
      }
    }
  },
  agents: { defaults: { model: { primary: "ollama/gemma4:latest" } } }
}

Vollständige Anleitung: Gemma 4 mit OpenClaw über Ollama einrichten.

Datenschutzsensible Arbeit

Qwen3 Coder oder Llama 3.3 70B über haimaker.ai

Open-Source-Modelle, geroutet über konforme Infrastruktur. Deine Prompts landen nicht in den Trainings-Pipelines der großen Anbieter.

Wer auf Nummer sicher gehen will: Self-Hosting mit Ollama oder vLLM. Dafür brauchst du ernsthafte Hardware (2× A100 oder vergleichbar) und musst höhere Latenz in Kauf nehmen.

Hybrid-Ansatz: Cloud-APIs für allgemeine Arbeit, Open Source für sensible Aufgaben. OpenClaw macht den Wechsel mit Modell-Overrides einfach.

Provider-Vergleich

Anthropic (Claude)

Premium-Preise (3–75 $ pro Million Output-Tokens). Bestes Tool Calling und beste Befolgung von Anweisungen. Standardmäßig kein Training mit API-Daten.

Claude ist zum De-facto-Standard für Coding-Agenten geworden. Die Tool-Nutzung ist schlicht zuverlässiger als bei den Alternativen.

OpenAI (GPT)

Mittelklasse-Preise (0,60–15 $). Solide allgemeine Leistung, schnelle Antworten. GPT-4o ist ein guter Allrounder. Die Mini-Variante eignet sich gut für einfache Aufgaben mit hohem Volumen.

Google (Gemini)

Wettbewerbsfähige Preise (1,25–10 $). Das riesige Kontextfenster ist das Hauptargument. Ideal für dokumentenlastige Workflows.

Open Source über haimaker.ai

5 % unter Marktpreis (0,10–5 $ pro Million Tokens). Anfragen werden zur Kosten- und Latenzoptimierung über verschiedene GPU-Provider geleitet. So vermeidest du Compliance-Probleme, die beim Senden von Daten an US-Hyperscaler entstehen.

Die API ist OpenAI-kompatibel:

curl https://api.haimaker.ai/v1/chat/completions \
  -H "Authorization: Bearer $HAIMAKER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Base-URL auf https://api.haimaker.ai/v1 setzen — fertig.

$10 GRATIS-GUTHABEN AUF HAIMAKER SICHERN

OpenClaw-Konfiguration

Dein Standardmodell legst du in ~/.openclaw/openclaw.json fest:

{
  agents: { defaults: { model: { primary: "anthropic/claude-sonnet-4-6" } } }
}

Das Modell wechselst du während der Sitzung mit /model opus oder /model haimaker/llama-3.3-70b.

Migrationshinweis: Wenn du von Clawdbot kommst, werden deine Konfigurationsdateien automatisch migriert. Die CLI verwendet jetzt openclaw statt clawdbot-Befehlen.

haimaker.ai als Provider in OpenClaw hinzufügen

{
  env: { HAIMAKER_API_KEY: "sk-..." },
  agents: {
    defaults: { model: { primary: "haimaker/llama-3.3-70b" } }
  },
  models: {
    mode: "merge",
    providers: {
      haimaker: {
        baseUrl: "https://api.haimaker.ai/v1",
        apiKey: "${HAIMAKER_API_KEY}",
        api: "openai-completions",
        models: [
          { id: "llama-3.3-70b", name: "Llama 3.3 70B" },
          { id: "qwen3-coder", name: "Qwen3 Coder" },
          { id: "mistral-large", name: "Mistral Large" }
        ]
      }
    }
  }
}

Keine Lust auf manuelles Bearbeiten? npx -y @haimaker/connect --openclaw schreibt genau diesen Provider-Block für dich in ~/.openclaw/openclaw.json. Der Connect-Guide behandelt auch die anderen unterstützten Agenten.

Welches Modell sollte ich wählen?

Falls du noch unsicher bist, hier der schnelle Entscheidungsbaum:

„Ich will einfach etwas, das funktioniert.” — Claude Sonnet 4.6. Es erledigt 80 % der Aufgaben gut, und die Preise sind angemessen. Starte hier.

„Ich schreibe Produktionscode.” — Claude Opus 4.8. Die Mehrkosten lohnen sich, wenn du um 2 Uhr nachts ein fieses Async-Problem debuggst und das Modell es beim ersten Mal richtig löst.

„Ich muss lange Dokumente verarbeiten.” — Gemini 3.1 Pro. Nichts anderes bietet eine Million Tokens Kontext. Gib ihm das komplette Repo, den ganzen Vertrag, den gesamten Thread.

„Ich brauche es kostenlos.”Gemma 4 mit Ollama ist derzeit das beste kostenlose lokale Modell für OpenClaw. Läuft auf jedem 16-GB-Mac. Gemini Flash hat ebenfalls ein kostenloses Kontingent. Siehe unseren Guide zu kostenlosen Modellen.

„Ich brauche es günstig.” — MiniMax M3 oder DeepSeek V4 Flash über haimaker.ai für einfache Aufgaben, GLM-5.2, wenn du mehr Reasoning brauchst. Siehe unseren Kostenvergleichs-Guide.

„Ich will, dass meine Daten privat bleiben.” — Qwen3 Coder oder Llama 3.3 70B über haimaker.ai. Oder selbst hosten mit Ollama, wenn du die Hardware hast.

„Ich will Gemini verwenden.” — Gemini 3.1 Pro für Qualität, Gemini 3 Flash für Geschwindigkeit und Kosten. Beide verfügbar über haimaker.ai oder direkt über Googles API.

Die ehrliche Antwort: Die meisten sollten zwei oder drei Modelle betreiben und je nach Aufgabe zwischen ihnen wechseln. Ein günstiges Modell für einfache Aufgaben, ein Mittelklasse-Modell für den Alltag und ein Premium-Modell für die harten Fälle. Haimakers Routing-Engine macht die Einrichtung einfach.

OpenClaw-Modellliste

Vollständige Preise, Einrichtung und Übersicht der Einsatzbereiche für jedes in OpenClaw unterstützte Modell:

Anthropic: Claude Opus 4.6 · Opus 4.5 · Opus 4.1 · Sonnet 4.6 · Sonnet 4.5 · Haiku 4.5

OpenAI: GPT-5.3 · GPT-5 Codex · GPT-5 Pro · GPT-5 · GPT-5 Mini · GPT-5 Nano · GPT-5.4 Pro · GPT-5.4 · GPT-5.2 · GPT-5.1 · GPT-4.1 · GPT-4.1 Mini · GPT-4.1 Nano · GPT-4o · GPT-4o Mini · GPT-4 Turbo · GPT-4 · o3 · o3 Mini · o4 Mini · o1 · o1 Mini

Google: Gemini 3.1 Pro · Gemini 3 Flash · Gemini 2.5 Pro · Gemini 2.5 Flash · Gemini 2.0 Flash

xAI: Grok 4.20 · Grok 4 · Grok 4 Fast · Grok 4.1 Fast · Grok Code Fast · Grok 3 · Grok 3 Mini · Grok 3 Mini Fast · Grok 2 · Grok 2 Vision

DeepSeek: DeepSeek R1 · DeepSeek V3.2 · DeepSeek V3.1 · DeepSeek V3

MiniMax: M2.5 · M2.5 Lightning · M2.1 · M2.1 Lightning · M2

Zhipu: GLM-5 · GLM-4.7 · GLM-4.7 Flash · GLM-4.6 · GLM-4.6 Exacto

Meta: Llama 4 Maverick · Llama 4 Scout

Weitere: Qwen3.5 397B · Qwen3 Max · Qwen3 Coder · Qwen3 Coder Plus · Qwen 2.5 Coder 32B · Kimi K2 · Kimi K2.5 · MiMo V2 Flash · UI-TARS 1.5

Fazit

Es gibt kein bestes Modell. Es gibt nur das richtige Modell für das, was du gerade tust.

  • Günstig: MiniMax M3, DeepSeek V4 Flash oder Open Source über haimaker.ai
  • Leistungsfähig: Opus 4.8 oder Gemini 3.1 Pro
  • Privat: Open Source über haimaker.ai oder selbst gehostet

Die meisten sollten mit Claude Sonnet 4.6 anfangen. Es erledigt die meisten Aufgaben gut und sprengt nicht dein Budget. Von dort aus kannst du je nach tatsächlichem Bedarf anpassen.

HAIMAKER ENTDECKEN


Bereit, deinen eigenen OpenClaw-Agenten einzurichten? Besuche openclaw.ai, um loszulegen, oder wirf einen Blick in die OpenClaw-Dokumentation für detaillierte Konfigurationsoptionen.