Hermes Agent bringt ab Werk eine kurze Liste eingebauter Anbieter mit, aber die eigentliche Stärke liegt in der Option Custom endpoint: Jeder Dienst, der das OpenAI-Chat-Completions-Format unterstützt, lässt sich mit einer Basis-URL, einem API-Schlüssel und einem Modellnamen einbinden. Das umfasst MiniMax, DeepSeek, Google Gemini, xAI Grok, OpenAI, OpenRouter, eine private vLLM-Box, eine lokale Ollama-Instanz — und haimaker.ai für alle auf einmal.

Im Folgenden zuerst die allgemeine Einrichtung, danach die konkreten Werte für die am häufigsten nachgefragten Anbieter.

Die allgemeine Methode

Jeder benutzerdefinierte Anbieter wird in Hermes über denselben Ablauf mit drei Schritten eingerichtet:

hermes model
  1. Wähle Custom endpoint aus dem Menü.
  2. Gib die Basis-URL ein — die OpenAI-kompatible Wurzel, die auf /v1 endet (Hermes hängt /chat/completions selbst an).
  3. Gib deinen API-Schlüssel für diesen Anbieter ein.
  4. Gib die Modellbezeichnung ein, die der Anbieter erwartet.

Hermes speichert die Auswahl und verwendet sie bei jedem weiteren Durchlauf. Um den Anbieter später zu wechseln, führe erneut hermes model aus. Das ist der gesamte Mechanismus — im Rest dieses Beitrags geht es nur noch darum, die richtigen Werte einzutragen.

Ein Modell funktioniert in Hermes nur dann gut, wenn es Tool-Schemata korrekt befolgt und genügend Kontext für die Agenten-Schritte mitbringt — ziele auf mindestens ~64K nutzbaren Kontext ab. Siehe Beste Modelle für Hermes Agent für die konkrete Modellwahl.

haimaker.ai — ein Schlüssel für jedes Modell

Statt für jeden Anbieter ein separates Konto, einen separaten Schlüssel und eine separate Basis-URL zu verwalten, richtest du Hermes einmal auf haimaker.ai aus und wechselst Modelle, indem du nur eine Zeichenkette änderst. Am schnellsten geht die Einrichtung mit einem einzigen Befehl:

export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes

@haimaker/connect schreibt die Konfiguration für den benutzerdefinierten Endpunkt von Hermes, prüft den Schlüssel und beendet sich danach. Füge --model hinzu, um ein Modell festzulegen, oder --pick-model für eine interaktive Auswahl. Mit npx @haimaker/connect --uninstall --hermes machst du die Konfiguration rückgängig. Hole dir zuerst einen Schlüssel unter app.haimaker.ai; neue Konten erhalten kostenloses Guthaben.

Wer lieber den eingebauten hermes model-Ablauf nutzen möchte, gibt diese Werte ein:

  • Basis-URL: https://api.haimaker.ai/v1
  • API-Schlüssel: dein haimaker.ai-Schlüssel
  • Modell: jedes unterstützte Modell, z. B. anthropic/claude-sonnet-4-6, openai/gpt-5-4-codex, google/gemini-3-1-pro, minimax/minimax-m2-5, deepseek/deepseek-v3-2, xai/grok-4-1-fast, zai/glm-4-7, moonshot/kimi-k2-5

Die Modelle laufen etwa 5 % unter Marktpreis, und du verwaltest nur ein einziges Abrechnungskonto.

MiniMax in Hermes

MiniMax M2.5 ist die beliebte Budget-Wahl für Hermes — günstig genug für den Dauerbetrieb und leistungsfähig genug für Tool-Schleifen.

  • Basis-URL: https://api.minimax.io/v1
  • API-Schlüssel: aus der MiniMax-Konsole
  • Modell: MiniMax-M2.5 (verwende die exakte ID aus der MiniMax-Konsole — Groß-/Kleinschreibung muss genau stimmen)

Oder nutze MiniMax über haimaker.ai mit dem Modell minimax/minimax-m2-5 und spar dir das separate Konto.

Google Gemini in Hermes

Gemini bietet eine OpenAI-kompatible Schicht und funktioniert daher als benutzerdefinierter Endpunkt in Hermes.

  • Basis-URL: https://generativelanguage.googleapis.com/v1beta/openai
  • API-Schlüssel: dein Schlüssel aus Google AI Studio
  • Modell: gemini-3-flash für günstige, schnelle Aufgaben; gemini-3.1-pro für Recherchen mit langem Kontext

Tatsächlich unterstützt Hermes Agent Google Gemini auf diese Weise — es gibt keine separate Gemini-Integration, die aktiviert werden müsste; es ist einfach ein benutzerdefinierter Endpunkt. Oder verwende google/gemini-3-1-pro über haimaker.ai.

DeepSeek in Hermes

  • Basis-URL: https://api.deepseek.com/v1
  • API-Schlüssel: von der DeepSeek-Plattform
  • Modell: deepseek-chat (verweist auf die aktuelle V3.2-Linie) oder deepseek-reasoner

Über haimaker.ai: deepseek/deepseek-v3-2.

xAI Grok in Hermes

  • Basis-URL: https://api.x.ai/v1
  • API-Schlüssel: aus der xAI-Konsole
  • Modell: grok-4.1-fast für günstige Aufgaben mit großem Kontext, grok-code-fast für codebezogene Aufgaben

Über haimaker.ai: xai/grok-4-1-fast.

OpenAI / Codex-Modelle in Hermes

Wenn du OpenAIs eigene Modelle (einschließlich der Codex-Linie) hinter Hermes nutzen möchtest:

  • Basis-URL: https://api.openai.com/v1
  • API-Schlüssel: ein OpenAI-API-Schlüssel (ein ChatGPT-Plus-Abonnement enthält keinen API-Zugang — du benötigst einen separaten API-Schlüssel mit aktivierter Abrechnung)
  • Modell: gpt-5.4-codex für Coding, gpt-5.4 für allgemeine Aufgaben

Über haimaker.ai: openai/gpt-5-4-codex.

Lokale Modelle über Ollama

  • Basis-URL: http://localhost:11434/v1
  • API-Schlüssel: eine beliebige nicht-leere Zeichenkette (Ollama ignoriert sie, aber Hermes verlangt einen Wert)
  • Modell: gemma4:latest, qwen3.5:latest oder was auch immer du heruntergeladen hast
ollama pull gemma4
hermes model   # Custom endpoint → base URL above → model gemma4:latest

Häufige Probleme

  • Timeouts bei langen Schritten. Langsamere Anbieter können den Standard-Lese-Timeout von Hermes bei längeren Agenten-Schritten überschreiten. Setze HERMES_STREAM_READ_TIMEOUT (Sekunden) auf einen höheren Wert, bevor du Hermes startest.
  • 401 / Authentifizierungsfehler. Der Schlüssel wurde nicht übernommen, oder du hast einen Konsolen-/Session-Token statt eines API-Schlüssels eingefügt. Führe hermes model erneut aus und gib ihn nochmal ein.
  • 404 bei Anfragen. Deine Basis-URL enthält vermutlich bereits /chat/completions oder hat einen abschließenden Schrägstrich. Hermes hängt den Pfad selbst an — die URL sollte auf /v1 enden.
  • Tool-Aufrufe schlagen wiederholt fehl. Das liegt in der Regel am Modell, nicht an der Konfiguration. Kleinere Modelle weichen bei Tool-Schemata oft ab — wechsle zu einem leistungsstärkeren Modell.

Hol dir deinen haimaker.ai-Schlüssel

Neue Konten erhalten kostenloses Guthaben zum Testen. Entdecke alle unterstützten Modelle mit Live-Preisen und Benchmarks auf haimaker.ai und führe dann npx -y @haimaker/connect --hermes aus, um Hermes damit zu verbinden.

$10 KOSTENLOSES GUTHABEN AUF HAIMAKER SICHERN


Verwandte Beiträge: Beste Modelle für Hermes Agent · Hermes Agent Preise · Hermes Agent vs Codex CLI