---
title: Cómo añadir un proveedor personalizado a Hermes Agent (2026)
description: >-
  Conecta Hermes Agent a cualquier proveedor compatible con OpenAI — MiniMax,
  DeepSeek, Gemini, Grok, OpenAI o haimaker.ai. URL base, claves API y
  soluciones para los timeouts.
date: 2026-05-11T00:00:00.000Z
updatedDate: 2026-06-26T00:00:00.000Z
location: 'San Francisco, CA – 11 de mayo de 2026'
image: /images/hermes-custom-provider-setup-hero.jpg
keywords: >-
  hermes agent proveedor personalizado, hermes agent configuración proveedor,
  hermes agent clave api, hermes agent minimax configuración proveedor, hermes
  agent gemini api, hermes agent deepseek configuración, hermes agent grok api,
  hermes endpoint personalizado, hermes agent api compatible openai
faq:
  - question: ¿Cómo añado un proveedor personalizado a Hermes Agent?
    answer: >-
      Ejecuta `hermes model` en tu terminal, elige 'Custom endpoint' e introduce
      tres datos: la URL base del proveedor (terminada en /v1), tu clave API y
      el identificador del modelo. Hermes guarda la selección y la usa en cada
      ejecución. Cualquier proveedor que exponga un endpoint
      /v1/chat/completions compatible con OpenAI funciona — MiniMax, DeepSeek,
      Google, xAI, OpenAI, OpenRouter, una instancia local de Ollama o
      haimaker.ai. Para haimaker.ai en concreto, 'npx -y @haimaker/connect
      --hermes' configura Hermes con un solo comando.
  - question: ¿Qué URL base necesita Hermes Agent?
    answer: >-
      Hermes necesita la raíz compatible con OpenAI, no la ruta completa de
      chat-completions. Usa https://api.haimaker.ai/v1 para haimaker,
      https://api.minimax.io/v1 para MiniMax, https://api.deepseek.com/v1 para
      DeepSeek, https://generativelanguage.googleapis.com/v1beta/openai para la
      capa compatible con OpenAI de Gemini, https://api.x.ai/v1 para xAI Grok,
      https://api.openai.com/v1 para OpenAI o http://localhost:11434/v1 para
      Ollama. Hermes añade /chat/completions automáticamente.
  - question: ¿Por qué mi proveedor personalizado de Hermes da timeout?
    answer: >-
      Las tareas largas del agente en un proveedor más lento pueden superar el
      timeout de lectura por defecto de Hermes. Establece la variable de entorno
      HERMES_STREAM_READ_TIMEOUT (en segundos) a un valor más alto antes de
      lanzar Hermes, y comprueba que tu URL base termina en /v1 sin barra
      diagonal al final. Un error 401 en lugar de un timeout significa que la
      clave API no se registró; vuelve a ejecutar `hermes model` e introdúcela
      de nuevo.
locale: es-es
translationKey: hermes-custom-provider-setup
---
Hermes Agent incluye una lista reducida de proveedores integrados, pero su verdadera flexibilidad reside en la opción **Custom endpoint**: cualquier servicio que utilice el formato de chat-completions de OpenAI se conecta con una URL base, una clave y un nombre de modelo. Esto cubre MiniMax, DeepSeek, Google Gemini, xAI Grok, OpenAI, OpenRouter, un servidor privado de vLLM, una instancia local de Ollama y [haimaker.ai](https://haimaker.ai) para acceder a todos a la vez.

Aquí tienes la configuración general y, a continuación, los valores exactos para los proveedores más solicitados.

## El método general

Todos los proveedores personalizados de Hermes se configuran siguiendo el mismo flujo de tres preguntas:

```bash
hermes model
```

1. Elige **Custom endpoint** en el menú.
2. Introduce la **URL base** — la raíz compatible con OpenAI, terminada en `/v1` (Hermes añade `/chat/completions` automáticamente).
3. Introduce tu **clave API** para ese proveedor.
4. Introduce el **identificador del modelo** que espera el proveedor.

Hermes guarda la selección y la usa en cada ejecución posterior. Para cambiar de proveedor más adelante, ejecuta `hermes model` de nuevo. Ese es todo el mecanismo; el resto del artículo consiste simplemente en rellenar los valores correctos.

Un modelo solo funciona bien en Hermes si sigue los esquemas de herramientas y tiene suficiente contexto para los bucles del agente; apunta a al menos ~64K de contexto utilizable. Consulta [Mejores modelos para Hermes Agent](/blog/best-models-for-hermes/) para elegir el modelo adecuado.

## haimaker.ai — una sola clave para todos los modelos

En lugar de gestionar una cuenta, una clave y una URL base distintas para cada proveedor, apunta Hermes a haimaker.ai una vez y cambia de modelo editando una sola cadena. La forma más rápida de configurarlo es un único comando:

```bash
export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes
```

[`@haimaker/connect`](/connect) escribe la configuración del endpoint personalizado de Hermes, verifica la clave y se cierra. Añade `--model` para fijar un modelo concreto o `--pick-model` para elegir uno interactivamente, y ejecuta `npx @haimaker/connect --uninstall --hermes` para deshacerlo. Obtén una clave primero en [app.haimaker.ai](https://app.haimaker.ai/sign-up); las cuentas nuevas incluyen créditos gratuitos.

¿Prefieres el flujo integrado de `hermes model`? Introduce estos valores cuando te los pida:

- **URL base:** `https://api.haimaker.ai/v1`
- **Clave API:** tu clave de haimaker.ai
- **Modelo:** cualquier modelo compatible, p. ej. `anthropic/claude-sonnet-4-6`, `openai/gpt-5-4-codex`, `google/gemini-3-1-pro`, `minimax/minimax-m2-5`, `deepseek/deepseek-v3-2`, `xai/grok-4-1-fast`, `zai/glm-4-7`, `moonshot/kimi-k2-5`

Los modelos cuestan aproximadamente un 5 % menos que la tarifa de mercado, y solo gestionas una cuenta de facturación.

## MiniMax en Hermes

MiniMax M2.5 es la opción económica más popular para Hermes: lo suficientemente barato para dejarlo funcionando y lo bastante capaz para manejar bucles de herramientas.

- **URL base:** `https://api.minimax.io/v1`
- **Clave API:** desde tu consola de la plataforma MiniMax
- **Modelo:** `MiniMax-M2.5` (usa el ID exacto que se muestra en la consola de MiniMax; las mayúsculas y minúsculas importan)

O consigue MiniMax a través de haimaker.ai con el modelo `minimax/minimax-m2-5` y evita tener que crear una cuenta aparte.

## Google Gemini en Hermes

Gemini expone una capa compatible con OpenAI, así que funciona como endpoint personalizado de Hermes.

- **URL base:** `https://generativelanguage.googleapis.com/v1beta/openai`
- **Clave API:** tu clave de Google AI Studio
- **Modelo:** `gemini-3-flash` para tareas rápidas y económicas; `gemini-3.1-pro` para investigación con contexto largo

Sí, Hermes Agent admite Google Gemini de esta forma; no hay ninguna integración de Gemini aparte que activar, es simplemente un endpoint personalizado. O usa `google/gemini-3-1-pro` a través de haimaker.ai.

## DeepSeek en Hermes

- **URL base:** `https://api.deepseek.com/v1`
- **Clave API:** desde la plataforma DeepSeek
- **Modelo:** `deepseek-chat` (apunta a la línea V3.2 actual) o `deepseek-reasoner`

A través de haimaker.ai: `deepseek/deepseek-v3-2`.

## xAI Grok en Hermes

- **URL base:** `https://api.x.ai/v1`
- **Clave API:** desde la consola de xAI
- **Modelo:** `grok-4.1-fast` para tareas económicas que requieren mucho contexto, `grok-code-fast` para tareas específicas de código

A través de haimaker.ai: `xai/grok-4-1-fast`.

## Modelos de OpenAI / Codex en Hermes

Si quieres usar los modelos propios de OpenAI (incluida la línea Codex) con Hermes:

- **URL base:** `https://api.openai.com/v1`
- **Clave API:** una clave **API** de OpenAI (una suscripción a ChatGPT Plus no incluye acceso a la API; necesitas una clave API aparte con la facturación habilitada)
- **Modelo:** `gpt-5.4-codex` para programación, `gpt-5.4` para trabajo general

A través de haimaker.ai: `openai/gpt-5-4-codex`.

## Modelos locales vía Ollama

- **URL base:** `http://localhost:11434/v1`
- **Clave API:** cualquier cadena no vacía (Ollama la ignora, pero Hermes requiere un valor)
- **Modelo:** `gemma4:latest`, `qwen3.5:latest` o cualquiera que hayas descargado

```bash
ollama pull gemma4
hermes model   # Custom endpoint → base URL above → model gemma4:latest
```

## Problemas comunes

- **Timeouts en tareas largas.** Los proveedores más lentos pueden superar el *stream read timeout* por defecto de Hermes durante iteraciones largas del agente. Establece `HERMES_STREAM_READ_TIMEOUT` (segundos) a un valor mayor antes de lanzar Hermes.
- **Errores 401 / autenticación.** La clave no se registró, o pegaste un token de consola o sesión en lugar de una clave API. Vuelve a ejecutar `hermes model` e introdúcela de nuevo.
- **404 en las peticiones.** Tu URL base probablemente ya incluye `/chat/completions` o tiene una barra diagonal al final. Hermes añade la ruta automáticamente: termina la URL en `/v1`.
- **Llamadas a herramientas que fallan repetidamente.** Normalmente es el modelo, no la configuración. Los modelos pequeños se desvían de los esquemas de herramientas; sube a un modelo de nivel superior.

## Obtén tu clave de haimaker.ai

Las cuentas nuevas obtienen créditos gratuitos para probar. Explora todos los modelos compatibles con precios en tiempo real y benchmarks en [haimaker.ai](https://haimaker.ai) y, a continuación, ejecuta `npx -y @haimaker/connect --hermes` para apuntar Hermes hacia él.

<a href="https://app.haimaker.ai/sign-up?utm_source=hermes_blog&utm_medium=cta&utm_campaign=hermes_custom_provider" class="cta-button">OBTÉN 10 $ EN CRÉDITOS GRATIS EN HAIMAKER</a>

---

*Relacionado: [Mejores modelos para Hermes Agent](/blog/best-models-for-hermes/) · [Precios de Hermes Agent](/blog/hermes-api-costs-pricing/) · [Hermes Agent vs Codex CLI](/blog/hermes-vs-codex/)*
