Hermes Agent có sẵn một danh sách ngắn các provider tích hợp, nhưng tùy chọn Custom endpoint mới là thứ mang lại sự linh hoạt thực sự: bất kỳ dịch vụ nào hỗ trợ định dạng chat completions của OpenAI đều có thể dùng được — bạn chỉ cần base URL, API key và tên model. Điều đó bao gồm MiniMax, DeepSeek, Google Gemini, xAI Grok, OpenAI, OpenRouter, một máy chủ vLLM riêng, một bản Ollama cục bộ và haimaker.ai để dùng tất cả cùng một lúc.
Dưới đây là hướng dẫn thiết lập chung, tiếp theo là thông số chính xác cho các provider được hỏi nhiều nhất.
Phương pháp chung
Mọi provider tùy chỉnh trong Hermes đều đi qua cùng một quy trình ba bước hỏi:
hermes model
- Chọn Custom endpoint từ menu.
- Nhập base URL — URL gốc tương thích với OpenAI, kết thúc bằng
/v1(Hermes tự thêm/chat/completions). - Nhập API key cho provider đó.
- Nhập định danh model mà provider yêu cầu.
Hermes lưu lựa chọn này và dùng lại cho mọi lần chạy sau. Để đổi provider sau này, hãy chạy lại hermes model. Toàn bộ cơ chế chỉ có vậy thôi — phần còn lại của bài viết chỉ là điền đúng các giá trị.
Một model chỉ hoạt động tốt trong Hermes nếu tuân thủ đúng tool schema và có đủ context cho các vòng lặp của agent — hãy chọn model có ít nhất khoảng 64K context khả dụng. Xem Các model tốt nhất cho Hermes Agent để biết nên chọn model nào.
haimaker.ai — một key dùng cho mọi model
Thay vì phải quản lý riêng tài khoản, key và base URL cho từng provider, bạn hãy trỏ Hermes đến haimaker.ai một lần rồi chuyển model bằng cách sửa một chuỗi duy nhất. Cách nhanh nhất để thiết lập là chạy một lệnh duy nhất:
export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes
@haimaker/connect ghi cấu hình custom-endpoint của Hermes, xác minh key, sau đó thoát. Thêm --model để cố định một model hoặc --pick-model để chọn model tương tác, và chạy npx @haimaker/connect --uninstall --hermes để hoàn tác. Trước tiên hãy lấy key tại app.haimaker.ai; tài khoản mới có kèm credit miễn phí.
Muốn dùng quy trình hermes model có sẵn? Hãy nhập các giá trị sau khi được hỏi:
- Base URL:
https://api.haimaker.ai/v1 - API key: key haimaker.ai của bạn
- Model: bất kỳ model nào được hỗ trợ, ví dụ
anthropic/claude-sonnet-4-6,openai/gpt-5-4-codex,google/gemini-3-1-pro,minimax/minimax-m2-5,deepseek/deepseek-v3-2,xai/grok-4-1-fast,zai/glm-4-7,moonshot/kimi-k2-5
Chi phí chạy model thấp hơn khoảng 5% so với giá thị trường, và bạn chỉ phải quản lý một tài khoản thanh toán duy nhất.
MiniMax trong Hermes
MiniMax M2.5 là lựa chọn phổ biến với mức giá tiết kiệm cho Hermes — đủ rẻ để chạy liên tục, đủ mạnh để xử lý các vòng lặp tool.
- Base URL:
https://api.minimax.io/v1 - API key: lấy từ console nền tảng MiniMax của bạn
- Model:
MiniMax-M2.5(hãy dùng chính xác ID hiển thị trong console MiniMax — phân biệt chữ hoa chữ thường)
Hoặc dùng MiniMax qua haimaker.ai với model minimax/minimax-m2-5 và bỏ qua việc tạo tài khoản riêng.
Google Gemini trong Hermes
Gemini cung cấp một lớp tương thích OpenAI, nên nó hoạt động như một custom endpoint của Hermes.
- Base URL:
https://generativelanguage.googleapis.com/v1beta/openai - API key: key Google AI Studio của bạn
- Model:
gemini-3-flashcho tác vụ nhanh, chi phí thấp;gemini-3.1-procho nghiên cứu cần context dài
Đúng vậy — Hermes Agent hỗ trợ Google Gemini theo cách này. Bạn không cần bật tích hợp Gemini riêng; nó chỉ là một custom endpoint. Hoặc dùng google/gemini-3-1-pro qua haimaker.ai.
DeepSeek trong Hermes
- Base URL:
https://api.deepseek.com/v1 - API key: lấy từ nền tảng DeepSeek
- Model:
deepseek-chat(trỏ đến dòng V3.2 hiện tại) hoặcdeepseek-reasoner
Qua haimaker.ai: deepseek/deepseek-v3-2.
xAI Grok trong Hermes
- Base URL:
https://api.x.ai/v1 - API key: lấy từ console xAI
- Model:
grok-4.1-fastcho tác vụ context lớn, chi phí thấp,grok-code-fastcho các tác vụ chuyên về code
Qua haimaker.ai: xai/grok-4-1-fast.
OpenAI / Codex models trong Hermes
Nếu bạn muốn dùng model của chính OpenAI (bao gồm dòng Codex) với Hermes:
- Base URL:
https://api.openai.com/v1 - API key: API key của OpenAI (gói đăng ký ChatGPT Plus không bao gồm quyền truy cập API — bạn cần tạo API key riêng và bật thanh toán)
- Model:
gpt-5.4-codexcho lập trình,gpt-5.4cho tác vụ chung
Qua haimaker.ai: openai/gpt-5-4-codex.
Model cục bộ qua Ollama
- Base URL:
http://localhost:11434/v1 - API key: bất kỳ chuỗi không rỗng nào (Ollama bỏ qua, nhưng Hermes yêu cầu phải có giá trị)
- Model:
gemma4:latest,qwen3.5:latesthoặc bất kỳ model nào bạn đã pull
ollama pull gemma4
hermes model # Custom endpoint → base URL above → model gemma4:latest
Các vấn đề thường gặp
- Timeout ở các bước dài. Khi dùng provider chậm, các bước agent kéo dài có thể vượt quá thời gian chờ đọc luồng mặc định của Hermes trong các lượt chạy lớn. Hãy đặt
HERMES_STREAM_READ_TIMEOUT(giây) ở giá trị lớn hơn trước khi khởi chạy Hermes. - Lỗi 401 / xác thực. Key chưa được ghi nhận, hoặc bạn đã dán token console/session thay vì API key. Hãy chạy lại
hermes modelvà nhập lại. - 404 khi gửi request. Base URL của bạn có thể đã bao gồm
/chat/completionshoặc có dấu gạch chéo ở cuối. Hermes tự thêm đường dẫn — hãy để URL kết thúc tại/v1. - Tool call thất bại liên tục. Thường là do model, không phải do cấu hình. Các model nhỏ thường xử lý tool schema không ổn định; hãy chọn model ở phân khúc cao hơn.
Lấy key haimaker.ai của bạn
Tài khoản mới được tặng credit miễn phí để dùng thử. Bạn có thể xem mọi model được hỗ trợ kèm giá và benchmark theo thời gian thực tại haimaker.ai, sau đó chạy npx -y @haimaker/connect --hermes để trỏ Hermes đến đó.
Nhận $10 credit miễn phí trên haimaker.ai
Bài liên quan: Các model tốt nhất cho Hermes Agent · Bảng giá Hermes Agent · Hermes Agent vs Codex CLI