Tout le monde demande quel modèle utiliser. La réponse honnête : tout dépend de ce que vous faites et de votre budget.
Note : Clawdbot a été renommé OpenClaw — même plateforme d’agent IA puissante, nouveau nom. Pour en savoir plus, consultez openclaw.ai.
OpenClaw prend en charge une douzaine de fournisseurs : Anthropic, OpenAI, Google et des modèles open source via haimaker.ai. Chacun présente des compromis entre coût, capacités et destination de vos données.
Voici comment je m’y prends pour choisir.
Liste des modèles compatibles avec OpenClaw
OpenClaw peut utiliser n’importe quel modèle exposé par un fournisseur pris en charge ou via un endpoint compatible OpenAI. En pratique, la liste des modèles utilisables est plus large que la configuration par défaut.
| Fournisseur | Modèles de départ | Meilleur usage |
|---|---|---|
| Haimaker | MiniMax M3, Qwen3 Coder, Kimi K2.7, DeepSeek V4 | Une seule clé API pour accéder à de nombreux modèles bon marché |
| Anthropic | Claude Opus 4.8, Claude Sonnet 4.6 | Code et tâches d’agent complexes |
| OpenAI | GPT-5.6, GPT-5.5, GPT-5.4 Mini | Travail général, comportement API fiable |
| Gemini 3 Flash, Gemini 3.1 Pro | Contexte long et offre gratuite | |
| xAI | Grok 4.5, Grok 4.1 Fast, Grok Code Fast | Contexte énorme à bas coût ou travail lié au code |
| DeepSeek | DeepSeek V4 Pro, DeepSeek V4 Flash | Code et raisonnement à faible coût en secours |
| Ollama | Qwen3.6, Gemma 4, gpt-oss | Inférence locale/privée |
Si le modèle est compatible OpenAI, la règle est simple : ajoutez le fournisseur, ajoutez l’ID du modèle, puis ajoutez le nom complet du modèle à la liste autorisée. Cela couvre Haimaker, Ollama, OpenRouter, Together, les déploiements vLLM privés et la plupart des passerelles d’inférence hébergées.
Prix, capacités, confidentialité
Ces trois critères sont difficiles à concilier. On peut en optimiser deux, peut-être, mais rarement les trois à la fois.
Prix
Le prix au token varie énormément. Les modèles premium de Claude coûtent des dizaines de fois plus par token que les options économiques comme Grok 4.1 Fast ou DeepSeek V4 Flash — pour des résultats souvent similaires. Un changement notable : Claude Opus 4.8 est sorti à environ un tiers de l’ancien prix d’Opus, ce qui a comblé une bonne partie de l’écart entre le haut de gamme et le milieu de gamme.
Pour la plupart des tâches d’assistant, un modèle intermédiaire est un bon choix. Claude Sonnet 4.6 offre l’essentiel des capacités d’Opus pour une fraction du prix.
Capacités
Les benchmarks sont trompeurs. Pour OpenClaw, ce qui compte vraiment :
- Appels d’outils – Peut-il exécuter des commandes shell et appeler des API sans se tromper dans la syntaxe ?
- Suivi du contexte – Se souvient-il de ce que vous avez dit il y a 50 messages ?
- Qualité du code – Quand il écrit du code, ce code fonctionne-t-il ?
- Vitesse – Combien de temps avant qu’il ne commence à répondre ?
Confidentialité
Avec les API cloud, vos prompts passent par des serveurs externes. Pour les finances personnelles, les données de santé ou le code propriétaire, c’est un problème. Vous pouvez auto-héberger des modèles open source, mais il faut du matériel adapté et accepter une latence élevée.
Recommandations par cas d’usage
Travail d’assistant au quotidien
Claude Sonnet 4.6 (tarification intermédiaire)
Calendrier, e-mails, recherche, requêtes générales. Sonnet gère tout cela sans faire exploser le budget. Assez rapide pour le chat en temps réel, assez intelligent pour les tâches à plusieurs étapes.
Option moins chère : GPT-5.4 Mini (tarif à moins d’un dollar)
Suffisant pour les tâches simples. La qualité baisse sur tout ce qui est complexe, mais pour une fraction du coût, c’est parfois le bon choix.
Code et automatisation
Claude Opus 4.8 (haut de gamme, mais environ 3 fois moins cher que les générations Opus précédentes)
Quand le code doit vraiment fonctionner, Opus vaut le surcoût. Il gère les modifications multi-fichiers et le débogage complexe mieux que tout ce que j’ai utilisé, et la baisse de prix de la 4.8 en fait un choix viable comme modèle de code quotidien, plutôt qu’un modèle réservé aux grandes occasions.
Alternative : Sonnet 4.6 avec la réflexion étendue activée. Vous payez plus pour les tokens de raisonnement uniquement quand vous avez besoin de puissance.
Recherche et analyse de documents
Gemini 3.1 Pro (tarification intermédiaire)
La fenêtre de contexte de plus d’un million de tokens permet de lui soumettre des bases de code entières. Il est bon pour synthétiser des informations issues de longs documents.
Les modèles Gemini dans OpenClaw
La famille Gemini de Google mérite qu’on s’y attarde si vous travaillez beaucoup sur des documents ou si vous cherchez une option intermédiaire solide.
Gemini 3.1 Pro est la valeur sûre. Cette fenêtre de contexte d’un million de tokens signifie que vous pouvez lui fournir un dépôt entier et lui demander de trouver le bug. Pour l’analyse de longs documents, la révision de contrats ou les questions-réponses sur une base de code, rien n’arrive à sa hauteur en matière de longueur de contexte.
Gemini 3 Flash (tarification bien en dessous du dollar) est l’option rapide. Il est bon marché, véloce et étonnamment performant pour les tâches simples. Si vous traitez un grand volume de requêtes sans avoir besoin d’un raisonnement approfondi, Flash s’en sort très bien.
Pour ajouter des modèles Gemini via haimaker.ai, ajoutez-les à votre configuration de fournisseur :
{
models: {
providers: {
haimaker: {
// ... existing config
models: [
// ... existing models
{ id: "google/gemini-3-pro", name: "Gemini 3 Pro" },
{ id: "google/gemini-3-flash", name: "Gemini 3 Flash" }
]
}
}
}
}
Ou utilisez-les directement via l’API Google si vous préférez. OpenClaw prend en charge Google comme fournisseur intégré.
Faire tourner Gemma 4 en local avec OpenClaw
Si vous voulez éviter tout coût d’API, Gemma 4 + Ollama est actuellement le meilleur modèle local pour OpenClaw. Gemma 4 8B de Google fonctionne sur n’importe quel Mac doté de 16 Go de mémoire unifiée et prend en charge la lecture de code, les éditions simples et le code boilerplate sans rien envoyer à des serveurs externes.
Installez Ollama, téléchargez le modèle, puis pointez OpenClaw vers lui :
ollama pull gemma4
{
models: {
providers: {
ollama: {
baseUrl: "http://localhost:11434/v1",
api: "openai-completions",
models: [{ id: "gemma4:latest", name: "Gemma 4 8B", contextWindow: 131072, maxTokens: 8192 }]
}
}
},
agents: { defaults: { model: { primary: "ollama/gemma4:latest" } } }
}
Guide complet : Comment configurer Gemma 4 avec OpenClaw en utilisant Ollama.
Travail nécessitant une confidentialité renforcée
Qwen3 Coder ou Llama 3.3 70B via haimaker.ai
Modèles open source, acheminés via une infrastructure conforme. Vos prompts ne se retrouvent pas dans les pipelines d’entraînement des grands fournisseurs.
Pour une paranoïa maximale, hébergez vous-même avec Ollama ou vLLM. Il vous faudra du matériel sérieux (2 GPU A100 ou équivalent) et de la patience face à une latence plus élevée.
Approche hybride : utilisez les API cloud pour le travail général et basculez vers l’open source pour les tâches sensibles. Clawdbot facilite cela grâce aux remplacements de modèle.
Comparaison des fournisseurs
Anthropic (Claude)
Tarification premium (3 $ à 75 $ par million de tokens en sortie). Meilleurs appels d’outils et meilleur respect des instructions. Pas d’entraînement sur les données API par défaut.
Claude est devenu le choix par défaut des agents de code. L’utilisation des outils y est tout simplement plus fiable que chez les alternatives.
OpenAI (GPT)
Tarification intermédiaire (0,60 $ à 15 $). Bonnes performances générales, réponses rapides. GPT-4o est un bon modèle polyvalent. La variante mini convient bien aux tâches simples à fort volume.
Google (Gemini)
Tarification compétitive (1,25 $ à 10 $). Son immense fenêtre de contexte est son principal atout. Idéal pour les workflows centrés sur les documents.
Open source via haimaker.ai
5 % en dessous des prix du marché (0,10 $ à 5 $ par million de tokens). Les requêtes sont réparties entre plusieurs fournisseurs GPU afin d’optimiser coût et latence. Cela évite les problèmes de conformité liés à l’envoi de données vers les hyperscalers américains.
L’API est compatible OpenAI :
curl https://api.haimaker.ai/v1/chat/completions \
-H "Authorization: Bearer $HAIMAKER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-3.3-70b",
"messages": [{"role": "user", "content": "Hello!"}]
}'
Remplacez votre URL de base par https://api.haimaker.ai/v1 et c’est terminé.
OBTENEZ 10 $ DE CRÉDITS GRATUITS SUR HAIMAKER
Configuration d’OpenClaw
Pour définir votre modèle par défaut dans ~/.openclaw/openclaw.json :
{
agents: { defaults: { model: { primary: "anthropic/claude-sonnet-4-6" } } }
}
Changez de modèle en cours de session avec /model opus ou /model haimaker/llama-3.3-70b.
Note de migration : Si vous venez de Clawdbot, vos fichiers de configuration sont migrés automatiquement. La CLI utilise désormais
openclawà la place des commandesclawdbot.
Ajouter haimaker.ai comme fournisseur dans OpenClaw
{
env: { HAIMAKER_API_KEY: "sk-..." },
agents: {
defaults: { model: { primary: "haimaker/llama-3.3-70b" } }
},
models: {
mode: "merge",
providers: {
haimaker: {
baseUrl: "https://api.haimaker.ai/v1",
apiKey: "${HAIMAKER_API_KEY}",
api: "openai-completions",
models: [
{ id: "llama-3.3-70b", name: "Llama 3.3 70B" },
{ id: "qwen3-coder", name: "Qwen3 Coder" },
{ id: "mistral-large", name: "Mistral Large" }
]
}
}
}
}
Vous préférez éviter l’édition manuelle ? npx -y @haimaker/connect --openclaw écrit pour vous exactement ce bloc de fournisseur dans ~/.openclaw/openclaw.json ; le guide de connexion décrit également les autres agents pris en charge.
Quel modèle dois-je choisir ?
Si vous hésitez encore, voici l’arbre de décision rapide :
« Je veux juste un modèle qui marche » — Claude Sonnet 4.6. Il gère correctement 80 % des tâches et son tarif est raisonnable. Commencez par lui.
« J’écris du code de production » — Claude Opus 4.8. Le surcoût s’amortit quand vous déboguez un problème asynchrone retors à 2 h du matin et que le modèle trouve la bonne réponse du premier coup.
« Je dois traiter de longs documents » — Gemini 3.1 Pro. Aucun autre modèle ne vous offre un million de tokens de contexte. Donnez-lui le dépôt complet, le contrat complet, toute la conversation.
« Je veux une solution gratuite » — Gemma 4 avec Ollama est actuellement le meilleur modèle local gratuit pour OpenClaw. Il fonctionne sur n’importe quel Mac doté de 16 Go. Gemini Flash dispose aussi d’une offre gratuite. Consultez notre guide des modèles gratuits.
« Je veux une solution économique » — MiniMax M3 ou DeepSeek V4 Flash via haimaker.ai pour les tâches simples, GLM-5.2 quand vous avez besoin de plus de raisonnement. Consultez notre guide de comparaison des coûts.
« Je veux que mes données restent privées » — Qwen3 Coder ou Llama 3.3 70B via haimaker.ai. Ou auto-hébergez avec Ollama si vous avez le matériel nécessaire.
« Je veux utiliser Gemini » — Gemini 3.1 Pro pour la qualité, Gemini 3 Flash pour la vitesse et le coût. Les deux sont disponibles via haimaker.ai ou directement par l’API Google.
En toute honnêteté, la plupart des gens devraient utiliser deux ou trois modèles et basculer entre eux. Utilisez un modèle bon marché pour les tâches simples, un modèle intermédiaire pour le travail quotidien et un modèle premium pour les tâches difficiles. Le moteur de routage de Haimaker facilite cette mise en place.
Liste des modèles OpenClaw
Tarifs complets, configuration et répartition par cas d’usage pour chaque modèle pris en charge dans OpenClaw :
Anthropic : Claude Opus 4.6 · Opus 4.5 · Opus 4.1 · Sonnet 4.6 · Sonnet 4.5 · Haiku 4.5
OpenAI : GPT-5.3 · GPT-5 Codex · GPT-5 Pro · GPT-5 · GPT-5 Mini · GPT-5 Nano · GPT-5.4 Pro · GPT-5.4 · GPT-5.2 · GPT-5.1 · GPT-4.1 · GPT-4.1 Mini · GPT-4.1 Nano · GPT-4o · GPT-4o Mini · GPT-4 Turbo · GPT-4 · o3 · o3 Mini · o4 Mini · o1 · o1 Mini
Google : Gemini 3.1 Pro · Gemini 3 Flash · Gemini 2.5 Pro · Gemini 2.5 Flash · Gemini 2.0 Flash
xAI : Grok 4.20 · Grok 4 · Grok 4 Fast · Grok 4.1 Fast · Grok Code Fast · Grok 3 · Grok 3 Mini · Grok 3 Mini Fast · Grok 2 · Grok 2 Vision
DeepSeek : DeepSeek R1 · DeepSeek V3.2 · DeepSeek V3.1 · DeepSeek V3
MiniMax : M2.5 · M2.5 Lightning · M2.1 · M2.1 Lightning · M2
Zhipu : GLM-5 · GLM-4.7 · GLM-4.7 Flash · GLM-4.6 · GLM-4.6 Exacto
Meta : Llama 4 Maverick · Llama 4 Scout
Autres : Qwen3.5 397B · Qwen3 Max · Qwen3 Coder · Qwen3 Coder Plus · Qwen 2.5 Coder 32B · Kimi K2 · Kimi K2.5 · MiMo V2 Flash · UI-TARS 1.5
En résumé
Il n’y a pas de modèle parfait, seulement le bon modèle pour ce que vous faites.
- Bon marché : MiniMax M3, DeepSeek V4 Flash ou l’open source via haimaker.ai
- Performant : Opus 4.8 ou Gemini 3.1 Pro
- Privé : Open source via haimaker.ai ou auto-hébergé
La plupart des gens devraient commencer avec Claude Sonnet 4.6. Il gère bien la plupart des tâches sans vous ruiner. Ajustez ensuite en fonction de vos besoins réels.
Prêt à configurer votre propre agent OpenClaw ? Consultez openclaw.ai pour commencer ou parcourez la documentation OpenClaw pour connaître toutes les options de configuration détaillées.