Hermes Agent 설치 비용은 $0입니다. 소프트웨어는 MIT 라이선스의 오픈 소스이며 피할 수 없는 유일한 청구 항목은 모델 토큰입니다. 그 외의 모든 항목은 선택 사항이며 별도로 가격이 책정됩니다. Nous Portal 구독은 월 $0, $20, $100 또는 $200이고, Hermes Cloud 호스팅은 하루 $0.56부터 시작하며, Tool Gateway 사용은 사용량별 요금이 공개되지 않은 유료 구독 기능입니다.
이 페이지는 Nous Research의 오픈 소스 에이전트인 Hermes Agent에 관한 것입니다. 2026년 9월 21일 저장소를 실시간으로 확인한 결과 archived: false, MIT 라이선스, 그리고 같은 날의 푸시가 확인되었습니다. 가장 최근에 공개된 릴리스는 Hermes Agent v0.21.3이며, 2026년 9월 14일 v2026.9.14 태그가 지정되었습니다. 이는 Nous의 오픈 웨이트 모델 제품군인 Hermes 3 또는 Hermes 4가 아니며, 같은 이름의 명품 브랜드도 아닙니다.
서로 별개인 네 가지 청구 항목 중 의무적인 것은 하나뿐
| 구매하는 것 | 공개 가격 | 명시된 위치 |
|---|---|---|
| Hermes Agent 소프트웨어: CLI, 터미널 UI, Desktop, 메시징 게이트웨이 | $0, MIT 라이선스 | Hermes FAQ: 선택한 공급자의 LLM API 사용량에 대해서만 비용을 지불합니다 |
| 모델 토큰 | 선택한 공급자가 청구하는 금액 | 공급자 자체의 요금표 |
| Nous Portal 구독(선택 사항) | 월 $0 / $20 / $100 / $200 | Portal 요금제 |
| Nous Tool Gateway: 웹 검색, 이미지 생성, TTS, 클라우드 브라우저 | 유료 구독 기능입니다. 구독에 포함된 사용량을 기준으로 사용한 만큼 지불합니다. 사용량별 요금은 공개되지 않았습니다. 동일한 문서에는 일부 계정에 대신 소량의 무료 도구 풀이 제공된다고도 나와 있습니다 | Tool Gateway 문서 |
| Hermes Cloud 호스팅(선택 사항) | Medium은 실행 중 하루 $0.56, 중지 상태 하루 $0.03입니다. Large는 실행 중 하루 $1.09, 중지 상태 하루 $0.03입니다. 배포하려면 크레딧 $2 이상 또는 활성 구독이 필요합니다 | Hermes Cloud |
| Hermes Business / Enterprise | 공개된 가격은 없습니다. 둘 다 Portal 자체 푸터에서 연결되어 있지만, 2026년 9월 21일 일반 HTTP 클라이언트에서는 어느 페이지도 반환되지 않았으므로 여기서는 약관을 확인하지 못했습니다 | Business 페이지 |
Hermes Cloud는 인스턴스 요금을 매일 후불로 청구하며, 자체 페이지에 따르면 추론 및 도구 사용량은 인스턴스 가격에 더해 별도로 청구됩니다. 따라서 호스팅 견적만으로는 전체 청구액을 알 수 없습니다. 동일한 FAQ에 따르면 로컬 모델은 하드웨어를 소유한 후에는 실행 비용이 완전히 무료입니다. 모든 수치는 2026년 9월 21일에 확인했습니다. 다른 에이전트에 적용한 동일한 네 가지 청구 항목 분석은 OpenClaw 가격에 있습니다.
Nous Portal 요금제: 토큰 할인이 아니라 크레딧을 구매하는 방식
| 등급 | 월 요금 | 월간 크레딧 | 이월 한도 |
|---|---|---|---|
| 무료 | $0 | $0 — 무료 모델만 사용, 표준 요청 한도 | — |
| Plus | $20 | $22(10% 보너스), 호스팅된 도구 사용량, 높은 요청 한도 | $10 |
| Super | $100 | $110 | $50 |
| Ultra | $200 | $220 | $100 |
| 일회성 충전 | +$10 / +$20 / +$50 / +$100 / +$200 또는 임의 금액 | Stripe로 결제 | — |
크레딧이 곧 상품입니다. $20 구독은 모델 사용액 $22를 구매하므로, 토큰별 결제 대비 장점은 모든 모델의 요금이 더 저렴해지는 것이 아니라 보너스와 번들로 제공되는 도구 및 한도입니다. 2026년 9월 21일 공개 카탈로그를 확인했을 때 Claude 항목은 Anthropic이 공개한 요금을 그대로 적용했습니다. Opus 5는 입력 $5.00 / 출력 $25.00, Fable 5.1은 $10.00 / $50.00이며 할인은 표시되지 않았습니다. 다른 항목이 할인되는지는 해당 페이지에서 확인할 수 없습니다. 항목별로 단일 요금만 표시되고 옆에 기준 가격이 없기 때문입니다. 또한 지역별 및 배치 변형이 별도 항목으로 등록되므로 하나의 모델이 서로 다른 요금으로 여러 번 나타날 수 있습니다. Kimi K3는 $1.70 / $8.50, :US 항목은 $3.63 / $18.15, 배치 항목은 $3.00 / $15.00입니다. 실제로 호출할 정확한 항목 ID를 기준으로 예산을 책정하고, 인용하는 모든 요금에는 확인 날짜를 표시하세요.
예산을 책정하기 전에 알아둘 세 가지 주의점이 있습니다. 무료 등급은 실제로 존재하지만 모델 ID에 :free 접미사가 붙은 항목으로 제한됩니다. 2026년 9월 21일 확인 당시에는 7개였으며, 이 목록은 현재 카탈로그에서 다시 생성되므로 “무료 모델을 사용하라”는 조언은 빠르게 낡습니다. Portal 자체 화면은 카탈로그 규모에 대해 서로 다른 두 개의 어림수를 제시합니다. 모든 유료 요금제 카드에 표시된 더 작은 수치와 카탈로그 자체 위 섹션에 표시된 더 큰 수치입니다. 반면 해당 시점에 공개 목록에는 360개 항목이 있었으므로, 어느 수치든 예산 입력값이 아니라 마케팅 수치로 취급하세요. 요금제 카드에는 요청률 수치도 없습니다. “standard”와 “high” 요청 한도만 표시되므로, 자신의 계정에서 확인하기 전까지 동시성은 검증되지 않은 것으로 간주하세요. 요금제 표는 Portal 홈페이지와 manage-subscription에 있으며, 일반 HTTP 클라이언트로는 페이지 대신 Vercel 보안 확인 화면이 표시됩니다. 브라우저에서 확인하세요.
토큰이 실제로 사용되는 곳
요금표는 한 번의 호출에 가격을 매깁니다. Hermes는 작업량을 청구하며, 문서화된 세 가지 증폭 요인이 둘 사이에 존재합니다.
보조 슬롯. 대시보드에는 제목 생성, 비전, 압축, 승인, 웹 추출, 스킬 허브, MCP 라우팅 등을 포함한 11개의 보조 작업 슬롯이 노출되며, 모든 슬롯의 기본값은 auto입니다. 즉 Hermes는 해당 작업에도 주 모델을 사용하려고 합니다. 문서에서 제시하는 낭비 사례는 압축입니다. 빠른 채팅 모델은 추론 모델 비용의 50분의 1로 해당 작업을 수행합니다. 따라서 한 번의 사용자 입력이 여러 번의 청구 호출로 이어질 수 있습니다.
위임. 위임 문서에 따르면 병렬 서브에이전트 배치는 일반적으로 한 실행의 전체 토큰 중 대부분을 소모합니다. 그래서 작업자 모델은 delegation.model로 별도로 구성할 수 있습니다. 자체 비용 경고에 따르면 max_spawn_depth: 3와 max_concurrent_children: 3를 함께 사용하면 동시 리프 에이전트가 27개에 이를 수 있으며, 기본 깊이는 1입니다.
캐시 연속성. 동일한 모델 구성 페이지에서는 프롬프트 캐시가 요청을 처리하는 모델을 기준으로 지정된다고 경고합니다. 따라서 대화 중간에 모델을 변경하면, 명시적인 /model 전환이든 자동 폴백이든 다른 계정으로의 자격 증명 풀 순환이든 관계없이 다음 메시지는 캐시 요금이 아니라 전체 입력 요금으로 대화 전체를 다시 읽습니다. 캐시 요금은 약 75~90% 할인된 것으로 설명되어 있습니다. 기본 보호 설정인 model.switch_context_confirm_tokens: 100000는 바로 이 일회성 재읽기 비용이 두 모델 간 토큰별 요금 차이를 크게 웃돌 수 있기 때문에 존재합니다.
예약 작업에서 이 문제가 가장 크게 발생하며, 기대하는 방향과는 반대입니다. cron 문서에 따르면 자체 모델이 없는 작업은 hermes model 또는 /model 중 실행되는 순간 설정된 값을 사용하므로, 채팅 모델을 변경하면 다음 실행부터 전체 cron 작업군도 함께 변경됩니다. 무인 작업이 모델 전환을 따라가면 안 될 때는 작업을 고정하거나(hermes cron create/edit --pin 또는 명시적인 --model / --provider) cron.model을 사용해 작업군의 기본값을 설정하세요. 스크립트 전용 작업인 문서의 no_agent 모드는 추론 계층에 전혀 접근하지 않습니다. 이 모든 항목을 추정하지 말고 측정하세요. FAQ에는 /usage, /compress, hermes prompt-size가 문서화되어 있고, 웹 대시보드에는 전체 토큰, 캐시 적중률, 모델별 내역을 보여주는 분석 화면이 문서화되어 있습니다.
각 작업에 사용할 모델 선택
여기서는 품질 순위를 뒷받침하는 벤치마크가 없으므로, 리더보드가 아니라 각 선택을 결정하는 요소를 정리한 표입니다.
| 기능 | 실제로 결정하는 요소 |
|---|---|
| 주요 턴(도구 호출 루프) | 신뢰할 수 있는 도구 호출과 충분한 컨텍스트. 대화는 잘하지만 도구 호출을 제대로 하지 못하는 모델은 요금표가 시사하는 것보다 재시도 비용이 더 많이 듭니다 |
| 압축, 제목, 승인 점수 산정, 웹 추출 | 성능이 충분한 가장 저렴한 채팅 모델. 문서에서는 여기서 추론 모델을 낭비라고 설명합니다 |
| 위임 작업자 | 사용량이 집중되는 곳입니다. 주 모델을 상속하지 말고 delegation.model을 명시적으로 설정하세요 |
| 비전 | 모델이 models.dev에 없거나 이미지가 네이티브 방식으로 라우팅되지 않고 사전 처리되는 경우 model.supports_vision: true을 선언하세요 |
| 무인 cron 작업 | 고정되지 않은 작업은 실행 시점의 주 모델로 실행되므로 고정하거나 cron.model을 설정하세요. 도구 세트는 작게 유지하세요. 큰 도구 스키마는 모든 호출에서 프롬프트를 부풀립니다 |
알아둘 만한 공식 입장은 두 가지입니다. Nous는 저비용 기본값을 제공합니다. 2026년 9월 20일자로 표시되어 다음 날 확인한 원격 모델 매니페스트에서는 z-ai/glm-5.2를 기본값으로 지정하고 있으며, 카탈로그 문서에서는 기본값이 가장 비싼 플래그십 모델이 아니라 의도적으로 성능이 충분한 저비용 모델이라고 설명합니다. 또한 Nous는 자체 가중치를 에이전트 안에서 사용하지 말 것을 권고합니다. Portal 통합 페이지에서는 Hermes 4가 빠른 도구 호출 루프보다는 채팅과 추론에 맞게 조정되었으므로 Hermes Agent 안에서 사용하는 것을 권장하지 않는다고 설명합니다. 해당 페이지의 추천 목록인 범용 에이전트용 Claude Sonnet 4.6, GPT-5.5 Pro, 긴 컨텍스트를 지원하는 Gemini 3 Pro 프리뷰, 비용 효율적인 코더 DeepSeek V4 Pro는 매니페스트와 현재 카탈로그 모두에 비해 뒤처져 있으므로 출발점으로 삼고 해당 모델 ID로 실제 모델을 호출할 수 있는지 확인하세요.
관찰된 사용량 역시 순위가 아닙니다. 2026년 9월 21일 확인한 OpenRouter의 Hermes Agent 공개 앱 페이지에서는 MiniMax M3, Ox Alpha라는 라벨 없는 항목, Ling 3.0 Flash Fin, GPT-4o-mini, 두 개의 DeepSeek V4 Flash 빌드가 30일 토큰 사용량에서 선두권을 차지했습니다. 이는 플래그십 모델이 아니라 저렴하고 빠른 모델이었습니다. 이 데이터는 사람들이 하나의 게이트웨이를 통해 무엇을 실행했는지를 기록할 뿐, 사용자의 작업에서 무엇이 가장 잘 작동했는지를 보여주지는 않습니다.
“Hermes 모델”은 서로 다른 두 가지 질문입니다
하나는 위에서 설명한 것처럼 에이전트가 사용할 모델을 선택하는 문제입니다. 다른 하나는 Hermes 4 오픈 웨이트 제품군으로, Hugging Face에 공개된 Hermes-4-405B, -70B, -14B를 말하며, Hermes 3는 Ollama를 통해 배포됩니다. 이들은 같은 회사의 모델 가중치이지 에이전트가 아니며, Nous는 Hermes 4를 에이전트 안에서 실행하지 말라고 합니다. 여기에는 검증되지 않은 주장이 하나 있습니다. Portal 통합 문서에서는 Hermes 4 모델을 Portal에서 큰 폭으로 할인된 요금으로 사용할 수 있다고 설명하지만, 2026년 9월 21일 현재 공개 카탈로그에서 “hermes”와 “nous”를 검색한 결과 일치하는 행이 없었습니다. 로그인한 사용자에게만 표시되거나 문서가 오래되었을 가능성이 있습니다. 자신의 계정에서 확인할 수 없는 Hermes 4 Portal 요금을 기준으로 예산을 책정하지 마세요.
Hermes Agent에 가장 좋고 저렴한 API
이는 서로 다른 주장으로 분리해야 합니다. 표시된 최저 가격은 요금표에 관한 사실이고, 작업을 완료하는 최저 비용은 재시도, 컨텍스트 길이, 캐시 적중에 따라 달라집니다.
| 경로 | 유리한 경우 | 먼저 확인할 것 |
|---|---|---|
| Nous Portal 구독 | 도구, 모델, 호스팅을 하나의 잔액으로 관리하려는 경우입니다. Quick Setup에서는 이를 권장되는 빠른 경로라고 부릅니다 | 토큰별 할인이 아니라 크레딧입니다. Tool Gateway는 유료 등급 기능입니다 |
| 공급자 직접 API 키 | 하나의 모델 제품군, 중간 계층 없음, 공급자 기능 우선 | 소비자용 채팅 요금제는 대부분 작동하지 않습니다. Claude Pro는 Hermes를 전혀 구동할 수 없고, Claude Max는 구매한 추가 사용량 크레딧이 필요하며, Google 소비자 요금제에는 문서화된 경로가 없습니다 |
| 서드파티 OpenAI 호환 게이트웨이 | 하나의 키로 표시된 요금의 특정 모델 집합을 사용하려는 경우 | transport을 명시적으로 설정하고 각 모델에서 프롬프트 캐싱을 선택적으로 활성화하세요. 둘 다 자동으로 추론되지 않습니다 |
| 무료 Portal 모델 | 중단을 감수할 수 있는 탐색 및 작업 | 무료로 표시된 모델로 제한되며, 해당 목록은 현재 카탈로그에서 다시 생성됩니다 |
| 로컬 추론 | 이미 적합한 하드웨어를 실행하고 있는 경우 | FAQ에 따르면 실행 비용은 무료이지만 도구 호출 품질은 Hermes가 아니라 서빙 스택의 문제입니다 |
Hermes 문서에 따르면 OpenAI 호환 API를 제공하는 서비스라면 무엇이든 작동하며, 공급자 참조 문서에는 경쟁 게이트웨이에 대한 설정 예시도 포함되어 있습니다. 따라서 사용자 지정 엔드포인트 경로는 임시 우회책이 아니라 정식 경로입니다. Kunavo가 적합한 범위는 “가장 저렴한 경로”보다 좁습니다. Kunavo의 카탈로그에는 Claude 및 GPT급 모델과 미디어 모델이 포함되어 있지만, 관찰된 Hermes 사용량을 지배하는 오픈 웨이트 모델은 포함되어 있지 않습니다. 이미 그러한 모델을 기반으로 설정을 운영 중이라면 Kunavo가 더 저렴한 경로는 아닙니다. Kunavo는 Claude 또는 GPT의 주요 턴을 하나의 키로 표시된 요금에 유지하기 위한 경로입니다.
같은 모델, 같은 토큰, 두 개의 요금표
표준 비캐시 입력 및 출력 토큰 백만 개당 USD입니다. Anthropic 직접 요금은 2026년 9월 21일 확인한 Anthropic의 요금 페이지에서 가져왔고, Kunavo 열은 현재 카탈로그를 기준으로 합니다.
| 모델 | Anthropic 직접: 입력 / 출력 | Kunavo: 입력 / 출력 | Hermes에서 맡길 수 있는 역할 |
|---|---|---|---|
| Claude Haiku 4.5 | $1.00 / $5.00 | $0.70 / $3.50 | 보조 슬롯 및 위임 작업자 |
| Claude Sonnet 5 | $2.00 / $10.00 | $1.40 / $7.00 | 주요 도구 호출 턴 |
| Claude Opus 5 | $5.00 / $25.00 | $3.50 / $17.50 | 어려운 작업 및 상위 모델로의 에스컬레이션 |
이제 계산해 보겠습니다. 한 달 동안 비캐시 입력 토큰 2천만 개와 출력 토큰 2백만 개를 사용한다고 가정합니다. 이는 주 턴, 보조 슬롯, 위임 작업자를 모두 합산한 수치이며, 이 합산이 중요한 이유는 턴별 추정으로는 세 요소 중 두 가지를 놓치기 때문입니다.
| 라우팅 가정 | 카탈로그 추정치 |
|---|---|
| 모두 Claude Sonnet 5에서 실행 | $42.00 |
| 주요 턴은 Claude Sonnet 5에서 실행(입력 4M / 출력 0.6M), 보조 슬롯과 위임 작업자는 Claude Haiku 4.5에서 실행(입력 16M / 출력 1.4M) | $25.90 |
| 모두 Claude Sonnet 5에서 실행하되, 입력 중 16M은 백만 개당 $0.14의 요금으로 캐시 읽기 처리 | $21.84 |
이는 카탈로그 요금에 따른 토큰 산술일 뿐, 측정된 Hermes 작업 비용이 아니며 청구액의 상한도 아닙니다. 여기에는 캐시 쓰기 비용이 포함되지 않습니다. 이 경우 Claude 캐시 쓰기는 입력 요금의 1.25배로 청구되며 캐싱 문서에 설명되어 있습니다. 또한 유료 도구, 호스팅, 세금도 제외합니다. 더 저렴한 모델이 추가 시도 없이 할당된 작업을 완료한다고 가정합니다. 더 저렴한 행이 실제로 더 저렴한지를 결정하는 것은 요금이 아니라 이 가정이며, 이를 테스트하는 방법은 비용 최적화에서 설명합니다.
Kunavo의 카탈로그 금액은 상한이 아니라 청구 하한입니다. 업스트림에서 요금을 보고하면 청구액은 카탈로그 비용과 업스트림 비용에 해당 마크업을 곱한 금액 중 더 큰 값이 됩니다. 최소 금액은 구독 없이 $10 선불 충전이며, 이는 자금이 충전된 계정을 개설하는 데 필요한 현금이지 작업 비용이 아닙니다. 결제를 참조하세요.
서드파티 엔드포인트를 Hermes에 연결하기
이 구성은 2026년 9월 21일에 원문 문서로 검토한 Hermes의 자체 제공업체 참조 문서를 바탕으로 합니다. Kunavo를 대상으로 Hermes를 실행한 적은 없습니다. Hermes용 Kunavo 설정 가이드도 없으며, 아래 내용은 어느 것도 테스트를 거친 통합으로 해석해서는 안 됩니다. 이를 시도하는 동안 현재 정상 작동하는 경로를 계속 사용할 수 있도록 유지하세요.
# ~/.hermes/config.yaml
providers:
kunavo:
api: https://api.kunavo.com/v1
key_env: KUNAVO_API_KEY
transport: chat_completions # set it; do not rely on URL auto-detection
models:
claude-sonnet-5:
prompt_caching: true
model:
default: claude-sonnet-5
provider: custom:kunavoKUNAVO_API_KEY=your-key사용자 지정 엔드포인트가 자동으로 제공하지 않는 다섯 가지 항목이 있으며, 각각 문서화된 비용이 있습니다.
transport을 명시적으로 설정하세요. 비워 두면 URL 기반 자동 감지로 대체됩니다. 공급자 참조 문서에서는 이를 빈 필드에 대한 폴백으로 설명하고, 정확히 하나의 규칙만 예시로 제시합니다. 즉/anthropic경로는anthropic_messages로 확인됩니다. 여기서 확인한 어떤 페이지에도 나머지 휴리스틱은 열거되어 있지 않으므로, 아무 동작도 일어나지 않을 것이라고 가정하지 말고 전송 방식을 명시해야 합니다. Hermes의 해당 경로에 대한 자체 회귀 테스트에는 이를 방지하기 위한 실패 모드가 기록되어 있습니다.openai-api항목이 지역 OpenAI 호스트를 가리키면 공급자가 직접 선언한 전송 방식이 아니라chat_completions로 조용히 확인되며, 모든 도구 호출 턴이 400을 반환합니다. Kunavo는/v1/chat/completions,/v1/messages,/v1/responses를 제공하므로 문서상으로는 세 가지 문서화된 전송 방식 모두에 대응하는 엔드포인트가 있습니다. 이는 문서 수준의 일치일 뿐 테스트된 일치가 아닙니다. 감지에 맡기지 말고 사용하려는 전송 방식을 직접 지정하세요.- 각 모델을 프롬프트 캐싱에 옵트인하세요. 베어 모델 별칭을 해석하는 게이트웨이에서는 모델별로 캐시 마커를 선언해야 합니다. Hermes는 프로바이더 이름, 호스트 또는 모델 제품군만으로 캐시 지원 여부를 추론하지 않겠다고 명시합니다. 이를 누락하면 캐시된 입력 요금이 조용히 적용되지 않으며, 긴 세션에서 가장 큰 비용 절감 수단을 잃게 됩니다. 프롬프트 캐싱을 참조하세요.
- 기본값이 잘못된 경우
context_length을 설정하세요. 사용자 지정 OpenAI 호환 엔드포인트에는 카탈로그 기준의 자동 출력 상한이 적용되지 않습니다. 서버 자체의 기본값이 적용되며, 이 값은 모델 최대치보다 낮을 수 있습니다. 컨텍스트 창은 models.dev로 이어지는 체인을 통해 확인되며, 이후 128K 폴백이 적용됩니다. extra_headers이 적용되는 범위를 파악하세요. 모델 구성 페이지는 OpenAI 호환 경로와anthropic_messages경로에 이를 적용합니다. 주 클라이언트,/model스위치, 재빌드 및 보조 클라이언트 모두에 해당합니다. 또한 이를 사용하지 않는 유일한 모드로bedrock_converse를 명시합니다.codex_responses에 대해서는 어느 쪽도 언급하지 않으므로 해당 조합은 테스트되지 않은 것으로 취급하세요. Anthropic 프로토콜에서는 프로바이더 문서의 예시가 Hermes가 덧붙이는 접미사를 명시하지 않은 채api을 특정 경로로 지정합니다. 따라서 첫 호출에서 기록된 요청 경로를 확인하세요. 기본 URL 문서에서는 그곳에서 발생하는 대부분의 404를 유발하는 origin과/v1의 혼동을 다룹니다.- 프로바이더를 추가하려면
hermes model을 사용하세요. 세션 중/model는 이미 구성한 엔드포인트 사이를 전환할 뿐 새 엔드포인트를 추가할 수 없으며, 이 전환으로 캐시가 삭제됩니다.
첫 번째 시험에서는 실제 도구 호출이 포함된 범위가 제한된 작업 하나를 실행한 다음 /usage과 대시보드의 상세 내역을 확인하고 예약된 작업을 이전하세요. 해당 경로를 자금이 충전된 키로 테스트할 준비가 되면 Kunavo 계정을 생성하세요. 프로바이더가 아니라 에이전트를 선택하는 중인가요? Hermes와 OpenClaw 비교에서 두 워크플로를 비교합니다.
자주 묻는 질문
Hermes Agent의 비용은 얼마인가요?
Hermes Agent 소프트웨어는 무료입니다. MIT 라이선스의 오픈 소스이며, 자체 FAQ에 따르면 선택한 공급자의 LLM API 사용량에 대해서만 비용을 지불합니다. 선택적으로 유료인 항목은 월 $0, $20, $100 또는 $200의 Nous Portal 구독, 실행 중인 Medium 인스턴스 기준 하루 $0.56부터 시작하는 Hermes Cloud 호스팅, 그리고 Nous Tool Gateway 사용입니다. Nous Tool Gateway는 문서에서 유료 구독 기능으로 설명되어 있으며 일부 계정에는 대신 소량의 무료 도구 풀이 제공됩니다. 사용량별 요금표는 공개되어 있지 않습니다. 가격은 2026년 9월 21일 Nous 페이지에서 확인했습니다.
Hermes Agent에서는 어떤 모델을 사용해야 하나요?
Nous는 의도적으로 저비용 기본값을 제공합니다. 2026년 9월 20일자로 표시되어 다음 날 확인한 원격 모델 매니페스트에서는 z-ai/glm-5.2를 기본 모델로 지정하고 있으며, 카탈로그 문서에서는 가장 비싼 플래그십 모델이 아니라 성능이 충분한 저비용 모델을 기본값으로 선택한다고 설명합니다. Nous Portal 통합 페이지에서는 별도로 범용 에이전트용 모델로 Claude Sonnet 4.6을 추천하고, GPT-5.5 Pro, 긴 컨텍스트를 지원하는 Gemini 3 Pro preview, 비용 효율적인 코더로 DeepSeek V4 Pro를 함께 제시합니다. 이러한 서술형 권장 사항은 매니페스트와 현재 카탈로그의 내용을 따라가지 못하므로, 자신의 계정에서 모델 ID가 정상적으로 인식되는지 확인하세요. 여기서는 품질 순위를 뒷받침하는 작업 벤치마크가 없습니다.
Hermes Agent에 가장 저렴한 API는 무엇인가요?
표시된 최저 가격과 작업을 완료하는 최저 비용은 서로 다른 문제입니다. 무료 Nous Portal 모델은 토큰 가격이 0이지만 무료로 표시된 모델로 제한되며, 그 목록은 고정되어 있지 않고 현재 카탈로그에서 다시 생성됩니다. 로컬 모델은 하드웨어를 이미 보유하고 있다면 실행 비용이 무료입니다. 2026년 9월 21일 Portal 자체 카탈로그의 유료 항목 중 최저 요금은 연구소의 플래그십 모델이 아니라 오픈 웨이트 모델에 있었습니다. 하지만 도구 호출 루프에 실패해 재시도하는 모델은 더 비싸더라도 작업을 완료하는 모델보다 비용이 더 많이 들 수 있습니다. 요금표만 보고 선택하지 말고 에이전트 자체의 /usage와 대시보드 분석 기능으로 측정하세요.
Claude Pro 또는 Claude Max 구독을 Hermes Agent와 함께 사용할 수 있나요?
Claude Pro로는 Hermes Agent를 전혀 구동할 수 없습니다. Hermes 공급자 문서에 따르면 Pro 구독자는 OAuth 경로를 사용할 수 없으며 대신 ANTHROPIC_API_KEY를 사용해야 합니다. Claude Max는 구매한 추가 사용량 크레딧이 있을 때만 작동하며, 포함된 Max 할당량은 그대로 유지되고 Hermes 사용량은 모두 추가 사용량으로 청구됩니다. Google 소비자 요금제에는 문서화된 경로가 없고, xAI OAuth는 구독 등급에 따라 HTTP 403을 반환할 수 있습니다. 일반적인 경로는 토큰별 과금 API 액세스입니다.
Hermes 4 모델은 Hermes Agent와 같은 것인가요?
아니요. Hermes 3과 Hermes 4는 Nous Research의 오픈 웨이트 LLM 제품군으로, Hugging Face에 Hermes-4-405B, Hermes-4-70B, Hermes-4-14B로 공개되어 있습니다. Hermes Agent는 MIT 라이선스의 에이전트 소프트웨어입니다. Nous는 Hermes 4를 Hermes Agent 안에서 실행하지 말 것을 명시적으로 권고하며, Hermes 4는 에이전트가 의존하는 빠른 도구 호출 루프가 아니라 채팅과 추론에 맞게 조정되었다고 설명합니다.
Nous Portal 구독은 Claude 모델을 할인하나요?
토큰 요금은 할인하지 않습니다. 2026년 9월 21일 Portal 카탈로그를 확인했을 때 Claude 항목에는 Anthropic이 공개한 요금 대비 할인이 없었습니다. Sonnet은 입력 $2.00, 출력 $10.00, Opus 5는 $5.00와 $25.00, Haiku는 $1.00와 $5.00, Fable 5.1은 $10.00와 $50.00로 백만 토큰당 과금됩니다. 유료 등급에서 추가되는 것은 10% 크레딧 보너스, Tool Gateway 사용량 번들, 더 높은 요청 한도입니다. Portal 자체 문구는 무료 옵션과 Portal 전용 할인을 약속하지만, 카탈로그에는 항목별 단일 요금만 표시되고 옆에 기준 가격이 없으므로 어떤 항목이 할인되는지는 공개 페이지에서 확인할 수 없습니다.
Nous Research 및 Anthropic 페이지는 2026년 9월 21일에 확인했으며, 같은 날 GitHub API를 통해 저장소 상태와 최신 릴리스를 검증했습니다. Kunavo 요금과 위의 모든 합계는 실시간 모델 카탈로그를 기준으로 계산한 예시적 추정치입니다. Hermes 구성은 런타임 테스트가 아니라 소스 문서에 근거해 보고한 것입니다.