Todo el mundo pregunta qué modelo usar. Sinceramente: depende de lo que estés haciendo y de cuánto quieras gastar.

Nota: Clawdbot ha cambiado de nombre a OpenClaw — la misma plataforma potente de agentes de IA, ahora con nuevo nombre. Más información en openclaw.ai.

OpenClaw es compatible con una docena de proveedores: Anthropic, OpenAI, Google y modelos open source a través de haimaker.ai. Cada uno tiene sus pros y sus contras en cuanto a coste, capacidad y dónde acaban tus datos.

Yo lo veo así.

Lista de modelos compatibles con OpenClaw

OpenClaw puede usar cualquier modelo expuesto a través de un proveedor compatible o un endpoint compatible con OpenAI. La lista práctica de modelos compatibles es más amplia que la configuración por defecto.

ProveedorModelos con los que merece la pena empezarMejor uso
HaimakerMiniMax M3, Qwen3 Coder, Kimi K2.7, DeepSeek V4Una sola clave de API para muchos modelos baratos
AnthropicClaude Opus 4.8, Claude Sonnet 4.6Programación y tareas complejas de agente
OpenAIGPT-5.6, GPT-5.5, GPT-5.4 MiniTrabajo general, comportamiento fiable de la API
GoogleGemini 3 Flash, Gemini 3.1 ProContexto largo y uso del nivel gratuito
xAIGrok 4.5, Grok 4.1 Fast, Grok Code FastContexto enorme a bajo coste o trabajo específico de código
DeepSeekDeepSeek V4 Pro, DeepSeek V4 FlashProgramación y razonamiento de bajo coste como alternativa
OllamaQwen3.6, Gemma 4, gpt-ossInferencia local/privada

Si el modelo es compatible con OpenAI, la regla es simple: añade el proveedor, añade el ID del modelo y luego incluye en la lista de permitidos el nombre completo del modelo. Eso cubre Haimaker, Ollama, OpenRouter, Together, despliegues privados de vLLM y la mayoría de gateways de inferencia hosted.

Precio, capacidad, privacidad

Estas tres cosas compiten entre sí. Puedes optimizar dos de ellas, quizá, pero rara vez las tres a la vez.

Precio

El precio por token varía enormemente. Los modelos premium de Claude cuestan decenas de veces más por token que opciones económicas como Grok 4.1 Fast o DeepSeek V4 Flash, y en muchos casos los resultados son similares. Un cambio notable: Claude Opus 4.8 se lanzó a un precio de aproximadamente un tercio del antiguo Opus, lo que redujo la brecha entre «premium» y «gama media».

Para la mayoría de tareas de asistente, un modelo de gama media tiene sentido. Claude Sonnet 4.6 te da gran parte de la capacidad de Opus a una fracción del coste.

Capacidad

Los benchmarks mienten. Para OpenClaw, lo que de verdad importa:

  • Llamadas a herramientas – ¿Puede invocar comandos de shell y APIs sin equivocarse con la sintaxis?
  • Gestión del contexto – ¿Recuerda lo que dijiste hace 50 mensajes?
  • Calidad del código – Cuando escribe código, ¿funciona?
  • Velocidad – ¿Cuánto tarda en empezar a responder?

Privacidad

Con las API en la nube, tus prompts se envían a servidores externos. Para finanzas personales, datos de salud o código propietario, eso es un problema. Puedes alojar modelos open source localmente, pero necesitas hardware y tolerancia a la latencia.

Recomendaciones por caso de uso

Trabajo diario de asistente

Claude Sonnet 4.6 (precio de gama media)

Calendario, correo electrónico, investigación, consultas generales. Sonnet lo gestiona todo sin arruinarte. Lo bastante rápido para chatear en tiempo real y lo bastante inteligente para tareas en varios pasos.

Opción más barata: GPT-5.4 Mini (por menos de un dólar)

Suficiente para tareas simples. La calidad baja en cuanto la tarea se complica, pero a una fracción del coste, a veces es la decisión correcta.

Programación y automatización

Claude Opus 4.8 (nivel premium, pero ~3× más barato que las generaciones anteriores de Opus)

Cuando el código tiene que funcionar de verdad, Opus merece la pena pagar la diferencia. Gestiona ediciones en varios archivos y depuración compleja mejor que cualquier otra cosa que haya probado, y la rebaja de precio de la versión 4.8 lo convierte en una opción viable para el día a día, no solo para ocasiones especiales.

Alternativa: Sonnet 4.6 con razonamiento extendido activado. Pagas más por token de razonamiento solo cuando necesitas esa potencia.

Investigación y análisis de documentos

Gemini 3.1 Pro (precio de gama media)

La ventana de contexto de más de 1M de tokens te permite pasarle bases de código enteras. Se le da muy bien sintetizar información de documentos largos.

Modelos de Gemini en OpenClaw

La familia Gemini de Google merece un vistazo más de cerca si trabajas mucho con documentos o quieres una opción sólida de gama media.

Gemini 3.1 Pro es el caballo de batalla. Esa ventana de contexto de un millón de tokens te permite pasarle un repositorio entero y pedirle que encuentre el bug. Para análisis de documentos largos, revisión de contratos o preguntas sobre una base de código, nada se le acerca en longitud de contexto.

Gemini 3 Flash (muy por debajo de un dólar) es la opción rápida. Es barato, rápido y sorprendentemente capaz para tareas más simples. Si gestionas consultas de alto volumen y no necesitas razonamiento profundo, Flash lo resuelve bien.

Para añadir modelos de Gemini a través de haimaker.ai, añádelos a la configuración de tu proveedor:

{
  models: {
    providers: {
      haimaker: {
        // ... existing config
        models: [
          // ... existing models
          { id: "google/gemini-3-pro", name: "Gemini 3 Pro" },
          { id: "google/gemini-3-flash", name: "Gemini 3 Flash" }
        ]
      }
    }
  }
}

O úsalos directamente a través de la API de Google si lo prefieres. OpenClaw es compatible con Google como proveedor oficial.

Ejecutar Gemma 4 localmente con OpenClaw

Si quieres cero costes de API, Gemma 4 + Ollama es el mejor modelo local para OpenClaw ahora mismo. El modelo Gemma 4 8B de Google funciona en cualquier Mac con 16 GB de memoria unificada y se encarga de leer código, hacer ediciones simples y generar código boilerplate sin enviar nada a servidores externos.

Instala Ollama, descarga el modelo y luego apunta OpenClaw hacia él:

ollama pull gemma4
{
  models: {
    providers: {
      ollama: {
        baseUrl: "http://localhost:11434/v1",
        api: "openai-completions",
        models: [{ id: "gemma4:latest", name: "Gemma 4 8B", contextWindow: 131072, maxTokens: 8192 }]
      }
    }
  },
  agents: { defaults: { model: { primary: "ollama/gemma4:latest" } } }
}

Guía completa: Cómo configurar Gemma 4 con OpenClaw usando Ollama.

Trabajo sensible a la privacidad

Qwen3 Coder o Llama 3.3 70B a través de haimaker.ai

Modelos open source, enrutados a través de infraestructura que cumple la normativa. Tus prompts se mantienen fuera de los pipelines de entrenamiento de los grandes proveedores.

Para máxima paranoia, alójalo localmente con Ollama o vLLM. Necesitarás hardware serio (2 × A100 o equivalente) y tolerancia a la latencia.

Enfoque híbrido: Usa API en la nube para el trabajo general y cambia a open source para las tareas sensibles. Clawdbot lo hace fácil con la sobrescritura de modelos.

Comparativa de proveedores

Anthropic (Claude)

Precio premium ($3–$75 por millón de tokens de salida). La mejor llamada a herramientas y seguimiento de instrucciones. Sin entrenamiento con datos de la API por defecto.

Claude se ha convertido en el estándar para agentes de programación. El uso de herramientas es sencillamente más fiable que el de las alternativas.

OpenAI (GPT)

Precio de gama media ($0,60–$15). Rendimiento general sólido, respuestas rápidas. GPT-4o es un buen todoterreno. La variante mini funciona bien para tareas simples de alto volumen.

Google (Gemini)

Precio competitivo ($1,25–$10). Esa enorme ventana de contexto es el punto fuerte. Genial para flujos de trabajo intensivos en documentos.

Open source a través de haimaker.ai

5 % por debajo del precio de mercado ($0,10–$5 por millón de tokens). Distribuye peticiones entre proveedores de GPU para optimizar coste y latencia. Evita las complicaciones de cumplimiento normativo que supone enviar datos a los hiperescaladores estadounidenses.

La API es compatible con OpenAI:

curl https://api.haimaker.ai/v1/chat/completions \
  -H "Authorization: Bearer $HAIMAKER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Cambia tu URL base a https://api.haimaker.ai/v1 y listo.

CONSIGUE $10 EN CRÉDITOS GRATIS EN HAIMAKER

Configuración de OpenClaw

Para definir tu modelo por defecto en ~/.openclaw/openclaw.json:

{
  agents: { defaults: { model: { primary: "anthropic/claude-sonnet-4-6" } } }
}

Cambia de modelo a mitad de sesión con /model opus o /model haimaker/llama-3.3-70b.

Nota de migración: Si vienes de Clawdbot, tus archivos de configuración se migran automáticamente. La CLI ahora usa openclaw en lugar de los comandos clawdbot.

Añadir haimaker.ai como proveedor en OpenClaw

{
  env: { HAIMAKER_API_KEY: "sk-..." },
  agents: {
    defaults: { model: { primary: "haimaker/llama-3.3-70b" } }
  },
  models: {
    mode: "merge",
    providers: {
      haimaker: {
        baseUrl: "https://api.haimaker.ai/v1",
        apiKey: "${HAIMAKER_API_KEY}",
        api: "openai-completions",
        models: [
          { id: "llama-3.3-70b", name: "Llama 3.3 70B" },
          { id: "qwen3-coder", name: "Qwen3 Coder" },
          { id: "mistral-large", name: "Mistral Large" }
        ]
      }
    }
  }
}

¿Prefieres evitar la edición manual? npx -y @haimaker/connect --openclaw escribe ese bloque de proveedor exacto en ~/.openclaw/openclaw.json por ti; la guía de conexión cubre también los demás agentes que gestiona.

¿Qué modelo debería elegir?

Si aún no lo tienes claro, aquí va el árbol de decisión rápido:

«Solo quiero algo que funcione» — Claude Sonnet 4.6. Gestiona bien el 80 % de las tareas y su precio es razonable. Empieza aquí.

«Estoy escribiendo código de producción» — Claude Opus 4.8. El coste extra se amortiza cuando estás depurando un problema asíncrono complicado a las 2 de la madrugada y el modelo lo resuelve bien a la primera.

«Necesito procesar documentos largos» — Gemini 3.1 Pro. Nada más te ofrece un millón de tokens de contexto. Pásale el repositorio entero, el contrato entero, el hilo entero.

«Lo necesito gratis»Gemma 4 con Ollama es el mejor modelo local gratuito para OpenClaw ahora mismo. Funciona en cualquier Mac con 16 GB. Gemini Flash también tiene un nivel gratuito. Consulta nuestra guía de modelos gratuitos.

«Lo necesito barato» — MiniMax M3 o DeepSeek V4 Flash a través de haimaker.ai para tareas simples, GLM-5.2 cuando necesites más razonamiento. Consulta nuestra guía de comparación de costes.

«Quiero que mis datos se mantengan privados» — Qwen3 Coder o Llama 3.3 70B a través de haimaker.ai. O alójalo localmente con Ollama si tienes el hardware.

«Quiero usar Gemini» — Gemini 3.1 Pro para calidad, Gemini 3 Flash para velocidad y coste. Ambos disponibles a través de haimaker.ai o directamente con la API de Google.

La verdad es que la mayoría debería usar dos o tres modelos y enrutar entre ellos. Usa un modelo barato para tareas simples, uno de gama media para el trabajo diario y uno premium para lo difícil. El motor de enrutamiento de Haimaker facilita mucho esta configuración.

Lista de modelos de OpenClaw

Precios detallados, configuración y desglose de casos de uso para cada modelo compatible con OpenClaw:

Anthropic: Claude Opus 4.6 · Opus 4.5 · Opus 4.1 · Sonnet 4.6 · Sonnet 4.5 · Haiku 4.5

OpenAI: GPT-5.3 · GPT-5 Codex · GPT-5 Pro · GPT-5 · GPT-5 Mini · GPT-5 Nano · GPT-5.4 Pro · GPT-5.4 · GPT-5.2 · GPT-5.1 · GPT-4.1 · GPT-4.1 Mini · GPT-4.1 Nano · GPT-4o · GPT-4o Mini · GPT-4 Turbo · GPT-4 · o3 · o3 Mini · o4 Mini · o1 · o1 Mini

Google: Gemini 3.1 Pro · Gemini 3 Flash · Gemini 2.5 Pro · Gemini 2.5 Flash · Gemini 2.0 Flash

xAI: Grok 4.20 · Grok 4 · Grok 4 Fast · Grok 4.1 Fast · Grok Code Fast · Grok 3 · Grok 3 Mini · Grok 3 Mini Fast · Grok 2 · Grok 2 Vision

DeepSeek: DeepSeek R1 · DeepSeek V3.2 · DeepSeek V3.1 · DeepSeek V3

MiniMax: M2.5 · M2.5 Lightning · M2.1 · M2.1 Lightning · M2

Zhipu: GLM-5 · GLM-4.7 · GLM-4.7 Flash · GLM-4.6 · GLM-4.6 Exacto

Meta: Llama 4 Maverick · Llama 4 Scout

Más: Qwen3.5 397B · Qwen3 Max · Qwen3 Coder · Qwen3 Coder Plus · Qwen 2.5 Coder 32B · Kimi K2 · Kimi K2.5 · MiMo V2 Flash · UI-TARS 1.5

En resumen

No existe el mejor modelo. Existe el modelo adecuado para lo que estás haciendo.

  • Barato: MiniMax M3, DeepSeek V4 Flash u open source a través de haimaker.ai
  • Capaz: Opus 4.8 o Gemini 3.1 Pro
  • Privado: Open source a través de haimaker.ai o alojado localmente

La mayoría debería empezar con Claude Sonnet 4.6. Gestiona bien la mayoría de las tareas y no te generará una factura alarmante. Ajusta a partir de ahí según lo que de verdad necesites.

EXPLORA HAIMAKER


¿Listo para configurar tu propio agente de OpenClaw? Visita openclaw.ai para empezar o consulta la documentación de OpenClaw para ver las opciones de configuración detalladas.