2026년 7월 기준 Hermes Agent에 가장 좋은 모델은 대부분의 사용자에게 Claude Sonnet 4.6, 코드를 정확하게 짜야 할 때는 Claude Opus 4.8, 에이전트가 24시간 돌아가고 비용이 성능보다 중요할 때는 MiniMax M3입니다. Hermes 자체는 모델에 구애받지 않습니다. 모든 단계를 하나의 OpenAI 호환 엔드포인트로 전송하므로, 그 안에서 실제로 일하는 모델은 1분 안에 바꿀 수 있는 설정값에 불과합니다.

그 유연성이 바로 핵심입니다. 지난 분기에 모델 라인업이 거의 완전히 교체됐기 때문에, 봄에 모델을 설정해 둔 Hermes 사용자라면 지금은 더 이상 최선의 선택이 아닌 모델을 쓰고 있을 가능성이 큽니다. 현재 순위와 그대로 입력하면 되는 값을 정리했습니다.

지금 Hermes Agent에 가장 좋은 모델은 무엇인가요?

기본 모델로는 Claude Sonnet 4.6을 선택하세요. 도구 호출이 안정적이고, 가격도 중간 수준이며, 긴 에이전트 루프에서도 예상 밖의 문제가 적습니다. Anthropic은 현재 코딩 에이전트 분야를 압도적으로 이끌고 있어서, Polymarket의 ‘최고의 코딩 AI’ 예측 시장에서 Anthropic이 98%를 차지하고 있습니다. Claude Opus 4.8은 SWE-bench Verified에서 88.6%, 프론티어 모델인 Claude Fable 5는 95.0%를 기록했습니다.

순위모델티어Hermes에서 가장 적합한 용도
1Claude Sonnet 4.6미드기본 주력 모델, 비용과 성능의 균형
2Claude Opus 4.8프리미엄프로덕션 코딩, 어려운 다단계 디버깅
3Gemini 3.1 Pro미드리서치 및 리포지토리 규모 컨텍스트(100만+ 토큰)
4Kimi K2.7 / K3미드오픈 웨이트 프론티어 코딩, 에이전트 스웜
5MiniMax M3버짓상시 운영 에이전트, 입력 100만 토큰당 0.30달러에 100만 컨텍스트
6DeepSeek V4 Flash버짓가장 저렴한 24/7 운영, 월 5달러 미만
7GLM-5.2버짓SWE-bench Pro에서 가장 강력한 오픈 모델(62.1%)

프리미엄 티어에 대한 참고: Claude Opus 4.8은 이전 Opus 세대의 약 3분의 1 가격으로 출시됐습니다. Opus를 특별한 경우에만 아껴 쓰라는 예전 조언은 이제 옛말입니다. 코딩이 중심인 Hermes 작업이라면 이제 일상적으로 쓰기에도 합리적인 선택입니다.

Hermes Agent에서 모델을 어떻게 전환하나요?

Hermes Agent는 hermes model 명령으로 모델을 선택합니다. Custom endpoint를 선택한 다음, /v1로 끝나는 베이스 URL, API 키, 모델 ID를 입력하세요. OpenAI 호환 프로바이더라면 모두 사용할 수 있습니다. 이 글에서 소개한 모든 모델에 가장 빠르게 접근하려면 하나의 엔드포인트를 사용하세요:

export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes

@haimaker/connect가 Hermes 커스텀 엔드포인트 설정을 대신 작성해 주고 키를 검증합니다. 그다음부터 Sonnet에서 MiniMax로, 또 Kimi로 전환할 때 프로바이더 계정을 새로 만들 필요 없이 모델 문자열 하나만 수정하면 됩니다:

  • 베이스 URL: https://api.haimaker.ai/v1
  • 모델 예시: anthropic/claude-sonnet-4-6, google/gemini-3-1-pro, minimax/minimax-m3, deepseek/deepseek-v4-flash, moonshot/kimi-k2-7

프로바이더별 베이스 URL과 타임아웃 해결 방법을 포함한 전체 가이드는 Hermes 커스텀 프로바이더 설정 가이드에서 확인하세요.

용도별로 어떤 모델을 선택해야 하나요?

리더보드 순위가 아니라 에이전트가 가장 자주 수행하는 작업에 모델을 맞추세요. Hermes는 긴 도구 호출 루프를 실행하므로, 도구 호출 신뢰성과 컨텍스트 크기가 단순 벤치마크 점수보다 중요합니다. 다음 네 가지 프로필이 대부분의 Hermes 설정을 포괄합니다.

일상 지원 및 자동화 작업

Claude Sonnet 4.6. 캘린더 작업, 리서치 실행, 파일 정리, 중간 규모 코딩이 모두 여기에 해당합니다. Hermes 도구 스키마를 일관되게 준수하기 때문에, 40단계 실행이 23단계에서 중단되는 일을 막아 줍니다.

프로덕션 코딩

Claude Opus 4.8, SWE-bench Verified 88.6%. Hermes 실행 결과를 실제로 병합할 풀 리퀘스트로 만들고 싶다면, 재작업 루프가 줄어들기 때문에 프리미엄 티어 비용이 아깝지 않습니다. 7월 9일에 정식 출시된 GPT-5.6은 이 용도에서 Anthropic 외 대안 중 가장 강력합니다.

리서치 및 긴 문서

Gemini 3.1 Pro. 100만+ 토큰 컨텍스트 윈도우 덕분에 Hermes가 세션 내내 리포지토리 전체나 여러 PDF를 지나치게 잘라내지 않고 유지할 수 있습니다.

상시 운영 저비용 에이전트

MiniMax M3 또는 DeepSeek V4 Flash. 하루 종일 폴링하고, 요약하고, 파일로 정리하는 Hermes 에이전트를 프리미엄 토큰으로 돌리면 안 됩니다. M3는 입력 100만 토큰당 0.30달러에 100만 컨텍스트 윈도우를 제공하며, 24/7 운영 기준 월 7~15달러 수준입니다. V4 Flash는 가격 하한선으로, 같은 운영 조건에서 월 5달러 미만입니다.

이 순위의 모든 모델은 하나의 haimaker.ai 키로 이용할 수 있고, 시장 가격보다 약 5% 저렴합니다. Hermes를 하나의 엔드포인트에 연결한 뒤 문자열 하나만 수정하면 티어를 전환할 수 있습니다.

모든 HERMES 모델을 위한 키 하나 받기

오픈 웨이트 티어는 어떻게 됐나요?

오픈 웨이트 티어는 올여름부터 더 이상 타협점이 아닙니다. Moonshot의 Kimi K3는 7월 16일에 공개되어 아레나 리더보드에서 Claude Fable과 GPT-5.6 Sol을 모두 이겼고, 코딩에 특화된 형제 모델인 Kimi K2.7은 지금 바로 Hermes에서 사용할 수 있습니다. GLM-5.2는 SWE-bench Pro 62.1%로 오픈 모델 선두이며, MiniMax M3(59.0%)와 Kimi K2.6(58.6%)을 앞섭니다.

Hermes 사용자에게는 두 가지 실질적인 의미가 있습니다.

  • Kimi K2.6 이상은 에이전트 스웜 조정을 지원합니다. 서로 협업하는 특화된 하위 에이전트를 생성한다는 뜻입니다. Hermes를 멀티 에이전트 패턴으로 확장할 생각이라면, Kimi 라인이 정확히 그런 형태의 작업에 맞춰져 있습니다.
  • 오픈 웨이트 모델의 가격 압박은 실재합니다. 에이전트 벤치마크에서 ‘오픈 저비용 모델’과 ‘클로즈드 미드 모델’의 격차는 이제 몇 포인트에 불과하지만, 가격 격차는 여전히 큽니다. 핵심이 아닌 대부분의 Hermes 워크로드에는 오픈 티어가 합리적인 기본값입니다.

Hermes Agent가 로컬 모델을 실행할 수 있나요?

네. Hermes는 로컬 Ollama 서버를 또 하나의 커스텀 엔드포인트로 취급합니다. 베이스 URL http://localhost:11434/v1, 아무 플레이스홀더 API 키, 그리고 내려받은 모델만 지정하면 됩니다. 커뮤니티에서 가장 많이 추천하는 로컬 모델은 Qwen3.6 27B입니다. 24GB GPU 하나로 SWE-bench Verified 77.2%를 달성했고, 16GB 환경에서는 gpt-oss 20B를 쓸 수 있습니다.

솔직한 주의점: 로컬 모델은 가장 어려운 다중 파일 작업에서는 여전히 클라우드 모델에 뒤처집니다. 그래서 실제로 안정적으로 작동하는 구성은 저렴하고 프라이버시가 중요한 단계는 로컬로 처리하고, 더 어려운 작업은 클라우드 모델로 올리는 하이브리드입니다. Ollama 코딩 모델 가이드에서 하드웨어 티어를, 코딩 에이전트용 가장 저렴한 API에서 하이브리드의 클라우드 측을 다룹니다.

결론

Hermes Agent에 단 하나의 최고 모델은 없지만, 2026년 7월에는 분명한 기본 스택이 있습니다.

  • 시작: Claude Sonnet 4.6을 일상 주력 모델로
  • 확장: 프로덕션 코드에는 Claude Opus 4.8
  • 절약: 상시 백그라운드 에이전트에는 MiniMax M3 또는 DeepSeek V4 Flash
  • 실험: 오픈 웨이트 가격으로 프론티어급 성능을 원한다면 Kimi K2.7과 GLM-5.2

Hermes는 엔드포인트에 구애받지 않으므로, 이 중 어느 것을 선택해도 특정 모델에 묶이지 않습니다. 키 하나를 설정해 두고, 다음 릴리스가 나오면 스택을 다시 평가하세요. 지금 출시 속도라면 새 릴리스가 몇 주마다 한 번씩 나옵니다.

HAIMAKER에서 HERMES 실행하기


모델이 아니라 에이전트를 비교하고 싶으신가요? Hermes vs Codex를 참고하세요. 엔드포인트 자체를 설정하고 싶으신가요? Hermes 커스텀 프로바이더 가이드를 참고하세요.