Hermes Agent est livré avec une courte liste de fournisseurs intégrés, mais sa véritable flexibilité réside dans l’option Custom endpoint : tout service qui implémente le format chat-completions d’OpenAI se connecte avec une URL de base, une clé et un nom de modèle. Cela couvre MiniMax, DeepSeek, Google Gemini, xAI Grok, OpenAI, OpenRouter, un serveur vLLM privé, une instance Ollama locale et haimaker.ai, qui regroupe tous ces fournisseurs en un seul.

Voici la configuration générale, puis les valeurs exactes pour les fournisseurs qui suscitent le plus de questions.

La méthode générale

Chaque fournisseur personnalisé dans Hermes se configure avec la même procédure :

hermes model
  1. Choisissez Custom endpoint dans le menu.
  2. Saisissez l’URL de base — la racine compatible OpenAI, se terminant par /v1 (Hermes ajoute /chat/completions lui-même).
  3. Saisissez votre clé API pour ce fournisseur.
  4. Saisissez l’identifiant du modèle attendu par le fournisseur.

Hermes enregistre la sélection et l’utilise pour chaque exécution ultérieure. Pour changer de fournisseur, relancez simplement hermes model. Le mécanisme se résume à cela — la suite de cet article détaille les valeurs à utiliser.

Un modèle ne fonctionne bien dans Hermes que s’il respecte les schémas d’outils et dispose d’assez de contexte pour les boucles de l’agent — visez au moins ~64K de contexte utilisable. Consultez Meilleurs modèles pour Hermes Agent pour savoir quel modèle choisir.

haimaker.ai — une seule clé pour tous les modèles

Au lieu de gérer un compte, une clé et une URL de base distincts par fournisseur, pointez Hermes vers haimaker.ai une seule fois et changez de modèle en modifiant une seule chaîne. La méthode la plus rapide se résume à une seule commande :

export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes

@haimaker/connect écrit la configuration de l’endpoint personnalisé dans Hermes, vérifie la clé, puis se termine. Ajoutez --model pour fixer un modèle ou --pick-model pour en choisir un de manière interactive, et exécutez npx @haimaker/connect --uninstall --hermes pour annuler la configuration. Commencez par créer une clé sur app.haimaker.ai ; les nouveaux comptes bénéficient de crédits gratuits.

Vous préférez utiliser la commande intégrée hermes model ? Saisissez ces valeurs lorsqu’elle vous le demande :

  • URL de base : https://api.haimaker.ai/v1
  • Clé API : votre clé haimaker.ai
  • Modèle : n’importe quel modèle pris en charge, par ex. anthropic/claude-sonnet-4-6, openai/gpt-5-4-codex, google/gemini-3-1-pro, minimax/minimax-m2-5, deepseek/deepseek-v3-2, xai/grok-4-1-fast, zai/glm-4-7, moonshot/kimi-k2-5

Les modèles coûtent environ 5 % de moins que le tarif du marché, et vous ne gérez qu’un seul compte de facturation.

MiniMax dans Hermes

MiniMax M2.5 est le choix économique le plus populaire pour Hermes — suffisamment abordable pour tourner en continu, suffisamment robuste pour gérer les boucles d’outils.

  • URL de base : https://api.minimax.io/v1
  • Clé API : depuis la console de votre plateforme MiniMax
  • Modèle : MiniMax-M2.5 (utilisez l’ID exact affiché dans la console MiniMax — la casse compte)

Ou passez par haimaker.ai avec le modèle minimax/minimax-m2-5 pour éviter de créer un compte séparé.

Google Gemini dans Hermes

Gemini expose une couche compatible OpenAI, ce qui permet de l’utiliser comme endpoint personnalisé dans Hermes.

  • URL de base : https://generativelanguage.googleapis.com/v1beta/openai
  • Clé API : votre clé Google AI Studio
  • Modèle : gemini-3-flash pour un travail rapide et économique ; gemini-3.1-pro pour la recherche sur de longs contextes

Oui, Hermes Agent prend en charge Google Gemini de cette façon — il n’y a pas d’intégration Gemini séparée à activer, c’est simplement un endpoint personnalisé. Vous pouvez aussi utiliser google/gemini-3-1-pro via haimaker.ai.

DeepSeek dans Hermes

  • URL de base : https://api.deepseek.com/v1
  • Clé API : depuis la plateforme DeepSeek
  • Modèle : deepseek-chat (correspond à la gamme V3.2 actuelle) ou deepseek-reasoner

Via haimaker.ai : deepseek/deepseek-v3-2.

xAI Grok dans Hermes

  • URL de base : https://api.x.ai/v1
  • Clé API : depuis la console xAI
  • Modèle : grok-4.1-fast pour des tâches à grand contexte à moindre coût, grok-code-fast pour les tâches spécifiques au code

Via haimaker.ai : xai/grok-4-1-fast.

Modèles OpenAI / Codex dans Hermes

Si vous souhaitez utiliser les modèles d’OpenAI (y compris la gamme Codex) avec Hermes :

  • URL de base : https://api.openai.com/v1
  • Clé API : une clé API OpenAI (un abonnement ChatGPT Plus ne donne pas accès à l’API — il vous faut une clé API distincte avec la facturation activée)
  • Modèle : gpt-5.4-codex pour le code, gpt-5.4 pour un usage général

Via haimaker.ai : openai/gpt-5-4-codex.

Modèles locaux via Ollama

  • URL de base : http://localhost:11434/v1
  • Clé API : n’importe quelle chaîne non vide (Ollama l’ignore, mais Hermes exige une valeur)
  • Modèle : gemma4:latest, qwen3.5:latest, ou tout modèle que vous avez téléchargé
ollama pull gemma4
hermes model   # Custom endpoint → base URL above → model gemma4:latest

Problèmes courants

  • Timeouts sur les étapes longues. Les fournisseurs plus lents peuvent dépasser le timeout de lecture par défaut de Hermes lors des étapes lourdes de l’agent. Définissez HERMES_STREAM_READ_TIMEOUT (en secondes) à une valeur plus élevée avant de lancer Hermes.
  • Erreurs 401 / authentification. La clé n’a pas été enregistrée, ou vous avez collé un token de console ou de session au lieu d’une clé API. Relancez hermes model et ressaisissez-la.
  • 404 sur les requêtes. Votre URL de base inclut probablement déjà /chat/completions, ou comporte une barre oblique finale. Hermes ajoute le chemin lui-même — l’URL doit se terminer par /v1.
  • Appels d’outils qui échouent de manière répétée. C’est généralement le modèle en cause, pas la configuration. Les petits modèles ne respectent pas toujours les schémas d’outils ; passez à un modèle plus performant.

Obtenez votre clé haimaker.ai

Les nouveaux comptes reçoivent des crédits gratuits pour tester. Parcourez tous les modèles pris en charge avec les tarifs en temps réel et les benchmarks sur haimaker.ai, puis exécutez npx -y @haimaker/connect --hermes pour y connecter Hermes.

OBTENEZ 10 $ DE CRÉDITS GRATUITS SUR HAIMAKER


Articles connexes : Meilleurs modèles pour Hermes Agent · Tarifs de Hermes Agent · Hermes Agent vs Codex CLI