---
title: Cách thêm provider tùy chỉnh vào Hermes Agent (2026)
description: >-
  Kết nối Hermes Agent với bất kỳ provider tương thích với OpenAI nào — MiniMax,
  DeepSeek, Gemini, Grok, OpenAI hoặc haimaker.ai. Base URL, API key và cách
  khắc phục lỗi timeout.
date: 2026-05-11T00:00:00.000Z
updatedDate: 2026-06-26T00:00:00.000Z
location: 'San Francisco, CA – ngày 11 tháng 5 năm 2026'
image: /images/hermes-custom-provider-setup-hero.jpg
keywords: >-
  hermes agent custom provider, hermes agent provider setup, hermes agent api
  key, hermes agent minimax provider setup, hermes agent gemini api, hermes
  agent deepseek setup, hermes agent grok api, hermes custom endpoint, hermes
  agent openai compatible api
faq:
  - question: Làm thế nào để thêm provider tùy chỉnh vào Hermes Agent?
    answer: >-
      Chạy `hermes model` trong terminal, chọn “Custom endpoint” và nhập ba
      thông tin: base URL của provider (kết thúc bằng /v1), API key và định danh
      model. Hermes lưu lựa chọn này và dùng lại cho mọi lần chạy. Bất kỳ
      provider nào có endpoint /v1/chat/completions tương thích với OpenAI đều
      hoạt động — MiniMax, DeepSeek, Google, xAI, OpenAI, OpenRouter, một bản
      Ollama cục bộ hoặc haimaker.ai. Riêng với haimaker.ai, “npx -y
      @haimaker/connect --hermes” cấu hình Hermes chỉ bằng một lệnh duy nhất.
  - question: Hermes Agent cần base URL nào?
    answer: >-
      Hermes cần URL gốc tương thích với OpenAI, không phải đường dẫn
      chat-completions đầy đủ. Sử dụng https://api.haimaker.ai/v1 cho haimaker,
      https://api.minimax.io/v1 cho MiniMax, https://api.deepseek.com/v1 cho
      DeepSeek, https://generativelanguage.googleapis.com/v1beta/openai cho lớp
      tương thích OpenAI của Gemini, https://api.x.ai/v1 cho xAI Grok,
      https://api.openai.com/v1 cho OpenAI hoặc http://localhost:11434/v1 cho
      Ollama. Hermes tự thêm /chat/completions.
  - question: Tại sao provider tùy chỉnh trong Hermes của tôi bị timeout?
    answer: >-
      Các bước agent kéo dài trên provider chậm có thể vượt quá thời gian chờ
      đọc mặc định của Hermes. Đặt biến môi trường HERMES_STREAM_READ_TIMEOUT
      (tính bằng giây) ở giá trị cao hơn trước khi khởi chạy Hermes, và kiểm tra
      rằng base URL kết thúc bằng /v1, không có dấu gạch chéo ở cuối. Nếu nhận
      lỗi 401 thay vì timeout, nghĩa là API key chưa được ghi nhận — hãy chạy
      lại `hermes model` và nhập lại.
locale: vi-vn
translationKey: hermes-custom-provider-setup
---
Hermes Agent có sẵn một danh sách ngắn các provider tích hợp, nhưng tùy chọn **Custom endpoint** mới là thứ mang lại sự linh hoạt thực sự: bất kỳ dịch vụ nào hỗ trợ định dạng chat completions của OpenAI đều có thể dùng được — bạn chỉ cần base URL, API key và tên model. Điều đó bao gồm MiniMax, DeepSeek, Google Gemini, xAI Grok, OpenAI, OpenRouter, một máy chủ vLLM riêng, một bản Ollama cục bộ và [haimaker.ai](https://haimaker.ai) để dùng tất cả cùng một lúc.

Dưới đây là hướng dẫn thiết lập chung, tiếp theo là thông số chính xác cho các provider được hỏi nhiều nhất.

## Phương pháp chung

Mọi provider tùy chỉnh trong Hermes đều đi qua cùng một quy trình ba bước hỏi:

```bash
hermes model
```

1. Chọn **Custom endpoint** từ menu.
2. Nhập **base URL** — URL gốc tương thích với OpenAI, kết thúc bằng `/v1` (Hermes tự thêm `/chat/completions`).
3. Nhập **API key** cho provider đó.
4. Nhập **định danh model** mà provider yêu cầu.

Hermes lưu lựa chọn này và dùng lại cho mọi lần chạy sau. Để đổi provider sau này, hãy chạy lại `hermes model`. Toàn bộ cơ chế chỉ có vậy thôi — phần còn lại của bài viết chỉ là điền đúng các giá trị.

Một model chỉ hoạt động tốt trong Hermes nếu tuân thủ đúng tool schema và có đủ context cho các vòng lặp của agent — hãy chọn model có ít nhất khoảng 64K context khả dụng. Xem [Các model tốt nhất cho Hermes Agent](/blog/best-models-for-hermes/) để biết nên chọn model nào.

## haimaker.ai — một key dùng cho mọi model

Thay vì phải quản lý riêng tài khoản, key và base URL cho từng provider, bạn hãy trỏ Hermes đến haimaker.ai một lần rồi chuyển model bằng cách sửa một chuỗi duy nhất. Cách nhanh nhất để thiết lập là chạy một lệnh duy nhất:

```bash
export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes
```

[`@haimaker/connect`](/connect) ghi cấu hình custom-endpoint của Hermes, xác minh key, sau đó thoát. Thêm `--model` để cố định một model hoặc `--pick-model` để chọn model tương tác, và chạy `npx @haimaker/connect --uninstall --hermes` để hoàn tác. Trước tiên hãy lấy key tại [app.haimaker.ai](https://app.haimaker.ai/sign-up); tài khoản mới có kèm credit miễn phí.

Muốn dùng quy trình `hermes model` có sẵn? Hãy nhập các giá trị sau khi được hỏi:

- **Base URL:** `https://api.haimaker.ai/v1`
- **API key:** key haimaker.ai của bạn
- **Model:** bất kỳ model nào được hỗ trợ, ví dụ `anthropic/claude-sonnet-4-6`, `openai/gpt-5-4-codex`, `google/gemini-3-1-pro`, `minimax/minimax-m2-5`, `deepseek/deepseek-v3-2`, `xai/grok-4-1-fast`, `zai/glm-4-7`, `moonshot/kimi-k2-5`

Chi phí chạy model thấp hơn khoảng 5% so với giá thị trường, và bạn chỉ phải quản lý một tài khoản thanh toán duy nhất.

## MiniMax trong Hermes

MiniMax M2.5 là lựa chọn phổ biến với mức giá tiết kiệm cho Hermes — đủ rẻ để chạy liên tục, đủ mạnh để xử lý các vòng lặp tool.

- **Base URL:** `https://api.minimax.io/v1`
- **API key:** lấy từ console nền tảng MiniMax của bạn
- **Model:** `MiniMax-M2.5` (hãy dùng chính xác ID hiển thị trong console MiniMax — phân biệt chữ hoa chữ thường)

Hoặc dùng MiniMax qua haimaker.ai với model `minimax/minimax-m2-5` và bỏ qua việc tạo tài khoản riêng.

## Google Gemini trong Hermes

Gemini cung cấp một lớp tương thích OpenAI, nên nó hoạt động như một custom endpoint của Hermes.

- **Base URL:** `https://generativelanguage.googleapis.com/v1beta/openai`
- **API key:** key Google AI Studio của bạn
- **Model:** `gemini-3-flash` cho tác vụ nhanh, chi phí thấp; `gemini-3.1-pro` cho nghiên cứu cần context dài

Đúng vậy — Hermes Agent hỗ trợ Google Gemini theo cách này. Bạn không cần bật tích hợp Gemini riêng; nó chỉ là một custom endpoint. Hoặc dùng `google/gemini-3-1-pro` qua haimaker.ai.

## DeepSeek trong Hermes

- **Base URL:** `https://api.deepseek.com/v1`
- **API key:** lấy từ nền tảng DeepSeek
- **Model:** `deepseek-chat` (trỏ đến dòng V3.2 hiện tại) hoặc `deepseek-reasoner`

Qua haimaker.ai: `deepseek/deepseek-v3-2`.

## xAI Grok trong Hermes

- **Base URL:** `https://api.x.ai/v1`
- **API key:** lấy từ console xAI
- **Model:** `grok-4.1-fast` cho tác vụ context lớn, chi phí thấp, `grok-code-fast` cho các tác vụ chuyên về code

Qua haimaker.ai: `xai/grok-4-1-fast`.

## OpenAI / Codex models trong Hermes

Nếu bạn muốn dùng model của chính OpenAI (bao gồm dòng Codex) với Hermes:

- **Base URL:** `https://api.openai.com/v1`
- **API key:** **API key** của OpenAI (gói đăng ký ChatGPT Plus không bao gồm quyền truy cập API — bạn cần tạo API key riêng và bật thanh toán)
- **Model:** `gpt-5.4-codex` cho lập trình, `gpt-5.4` cho tác vụ chung

Qua haimaker.ai: `openai/gpt-5-4-codex`.

## Model cục bộ qua Ollama

- **Base URL:** `http://localhost:11434/v1`
- **API key:** bất kỳ chuỗi không rỗng nào (Ollama bỏ qua, nhưng Hermes yêu cầu phải có giá trị)
- **Model:** `gemma4:latest`, `qwen3.5:latest` hoặc bất kỳ model nào bạn đã pull

```bash
ollama pull gemma4
hermes model   # Custom endpoint → base URL above → model gemma4:latest
```

## Các vấn đề thường gặp

- **Timeout ở các bước dài.** Khi dùng provider chậm, các bước agent kéo dài có thể vượt quá thời gian chờ đọc luồng mặc định của Hermes trong các lượt chạy lớn. Hãy đặt `HERMES_STREAM_READ_TIMEOUT` (giây) ở giá trị lớn hơn trước khi khởi chạy Hermes.
- **Lỗi 401 / xác thực.** Key chưa được ghi nhận, hoặc bạn đã dán token console/session thay vì API key. Hãy chạy lại `hermes model` và nhập lại.
- **404 khi gửi request.** Base URL của bạn có thể đã bao gồm `/chat/completions` hoặc có dấu gạch chéo ở cuối. Hermes tự thêm đường dẫn — hãy để URL kết thúc tại `/v1`.
- **Tool call thất bại liên tục.** Thường là do model, không phải do cấu hình. Các model nhỏ thường xử lý tool schema không ổn định; hãy chọn model ở phân khúc cao hơn.

## Lấy key haimaker.ai của bạn

Tài khoản mới được tặng credit miễn phí để dùng thử. Bạn có thể xem mọi model được hỗ trợ kèm giá và benchmark theo thời gian thực tại [haimaker.ai](https://haimaker.ai), sau đó chạy `npx -y @haimaker/connect --hermes` để trỏ Hermes đến đó.

<a href="https://app.haimaker.ai/sign-up?utm_source=hermes_blog&utm_medium=cta&utm_campaign=hermes_custom_provider" class="cta-button">Nhận $10 credit miễn phí trên haimaker.ai</a>

---

*Bài liên quan: [Các model tốt nhất cho Hermes Agent](/blog/best-models-for-hermes/) · [Bảng giá Hermes Agent](/blog/hermes-api-costs-pricing/) · [Hermes Agent vs Codex CLI](/blog/hermes-vs-codex/)*
