Hermes Agentのインストール費用は$0です。ソフトウェアはMITライセンスのオープンソースで、避けられない請求はモデルのトークン料金だけです。 その他はすべて任意で、個別に料金が設定されています。月額$0、$20、$100または$200のNous Portalサブスクリプション、1日$0.56からのHermes Cloudホスティング、そして従量料金を公開していない有料サブスクリプション機能のTool Gateway利用です。
このページで扱うのは、Nous ResearchのオープンソースエージェントであるHermes Agentです。2026年9月21日にリポジトリをライブ確認したところ、archived: false、MITライセンス、同日付のプッシュが確認されました。最新の公開リリースはHermes Agent v0.21.3で、2026年9月14日にv2026.9.14としてタグ付けされています。これはNousのオープンウェイトモデルファミリーであるHermes 3やHermes 4ではなく、同名の高級品ブランドでもありません。
4つの別々の請求、そのうち必須なのは1つだけ
| 購入するもの | 掲載価格 | 記載箇所 |
|---|---|---|
| Hermes Agentソフトウェア:CLI、ターミナルUI、Desktop、メッセージングゲートウェイ | $0、MITライセンス | Hermes FAQ:選択したプロバイダーのLLM API利用料だけを支払います |
| モデルのトークン | 選択したプロバイダーが請求する料金 | プロバイダー独自の料金表 |
| Nous Portalサブスクリプション(任意) | 月額$0 / $20 / $100 / $200 | Portalプラン |
| Nous Tool Gateway:ウェブ検索、画像生成、TTS、クラウドブラウザー | 有料サブスクリプション機能。サブスクリプションに対して従量利用分を支払います。従量料金は公開されていません。同じ文書には、一部のアカウントには代わりに少量の無料ツールプールが付与されるとも記載されています | Tool Gateway文書 |
| Hermes Cloudホスティング(任意) | Mediumは稼働中$0.56/日、停止中$0.03/日。Largeは稼働中$1.09/日、停止中$0.03/日。デプロイにはクレジット最低$2、または有効なサブスクリプションが必要 | Hermes Cloud |
| Hermes Business / Enterprise | 価格は公開されていません。どちらもPortal独自のフッターからリンクされていますが、2026年9月21日にいずれのページも単純なHTTPクライアントには返答しなかったため、ここでは利用条件を検証できません | Businessページ |
Hermes Cloudはインスタンス料金を日次の後払いで請求し、独自のページには、推論とツール利用がインスタンス料金に加えて別途請求されると記載されています。したがって、ホスティング料金だけでは請求総額になりません。同じFAQによれば、ローカルモデルはハードウェアを所有していれば実行自体は完全に無料です。すべての数値は2026年9月21日に確認しました。別のエージェントに同じ4つの請求区分を適用した内容はOpenClawの料金にあります。
Nous Portalプラン:購入するのはトークン割引ではなくクレジット
| 階層 | 月額料金 | 月間クレジット | 繰越上限 |
|---|---|---|---|
| 無料 | $0 | $0 — 無料モデルのみ、標準のレート制限 | — |
| Plus | $20 | $22(10パーセントのボーナス)、ホスト型ツール利用、高いレート制限 | $10 |
| Super | $100 | $110 | $50 |
| Ultra | $200 | $220 | $100 |
| 一回限りのチャージ | + $10 / +$20 / +$50 / +$100 / +$200、または任意の金額 | Stripeによる支払い | — |
クレジットが商品です。$20のサブスクリプションではモデル利用に$22分が使えるため、従量課金に対する利点は、ボーナスとバンドルされたツールおよび上限であり、すべてのモデルの料金が安くなることではありません。2026年9月21日に確認した公開カタログでは、ClaudeのエントリにAnthropicが公開している料金が適用されていました。Opus 5は入力$5.00 / 出力$25.00、Fable 5.1は$10.00 / $50.00で、割引は示されていません。その他が割引されているかどうかは、そのページでは確認できません。各エントリに1つの料金だけが表示され、横に基準価格がないためです。表示から分かるのは、地域別やバッチ別のバリアントが別エントリとして掲載されるため、1つのモデルが異なる料金で複数回登場する場合があることです。Kimi K3は$1.70 / $8.50、その:USエントリは$3.63 / $18.15、バッチエントリは$3.00 / $15.00です。呼び出す正確なエントリIDを基準に予算を立て、引用する内容には日付を付けてください。
予算を立てる前に3つの注意点があります。無料ティアは実在しますが、モデルIDに:freeサフィックスが付いたエントリに限定されます。2026年9月21日の確認時は7件でした。この一覧は最新のカタログから再構築されるため、「無料のものを使う」という助言はすぐに古くなります。Portal自身の画面では、カタログ規模について異なる2つの概数が示されています。すべての有料プランカードには小さい方の概数が、カタログ自体の上にあるセクションには大きい方の概数が表示されています。一方、確認時点の公開一覧には360件のエントリがあったため、これらの数字はいずれも予算の算定に使う数値ではなく、マーケティング上の数字として扱ってください。プランカードにはリクエストレートの数値もなく、「標準」と「高い」レート制限としか書かれていません。自分のアカウントで確認するまで、同時実行数は未検証として扱ってください。プラン表はPortalホームページとmanage-subscriptionにありますが、単純なHTTPクライアントではページの代わりにVercelのセキュリティチェックポイントが返されます。ブラウザーで確認してください。
トークンは実際にどこへ行くのか
料金表は1回の呼び出しに価格を付けます。Hermesはワークロードに対して請求し、その2つの間には文書化された3つの増加要因があります。
補助スロット。ダッシュボードには11個の補助タスクスロットがあります。タイトル生成、ビジョン、圧縮、承認、ウェブ抽出、スキルハブ、MCPルーティングなどで、すべてのデフォルトはautoです。つまりHermesはその処理にもメインモデルを試します。文書にある無駄の例は圧縮です。高速なチャットモデルなら推論モデルの50分の1のコストで処理できます。そのため、1回のユーザーターンが複数の請求対象呼び出しになることがあります。
委譲。委譲に関する文書では、サブエージェントの並列バッチが通常、1回の実行における総トークンの大半を消費すると説明されています。そのため、ワーカーモデルはdelegation.modelとして個別に設定できます。独自のコスト警告では、max_spawn_depth: 3とmax_concurrent_children: 3を使用すると、同時実行されるリーフエージェントが27個に達する可能性があるとされています。デフォルトの深さは1です。
キャッシュの継続性。同じモデル設定ページでは、プロンプトキャッシュがリクエストを処理するモデルに紐付くと警告しています。そのため、会話途中でモデルを変更すると、明示的な/model切り替え、自動フォールバック、または認証情報プールによる別アカウントへのローテーションのいずれであっても、次のメッセージではキャッシュ料金ではなく、会話全体を通常の入力料金で再読込します。キャッシュ料金は約75〜90パーセント割引とされています。デフォルトのガードであるmodel.switch_context_confirm_tokens: 100000は、まさにこの一度限りの再読込が、2つのモデル間のトークン単価の差を大きく上回る可能性があるため存在します。
この影響が最も大きく現れるのはスケジュール実行であり、しかも期待とは逆の方向に作用します。cronのドキュメントによると、独自のモデルが指定されていないジョブは、実行が開始される時点でhermes modelまたは/modelに設定されているモデルで実行されるため、チャットのモデルを変更すると、cronジョブ全体も次回の実行時にそのモデルへ切り替わります。無人で実行されるジョブがモデルの切り替えに追随してはならない場合は、ジョブを固定する(hermes cron create/edit --pin、または--model / --providerを明示的に指定する)か、cron.modelでジョブ全体のデフォルトモデルを設定してください。スクリプトのみを実行するジョブ、つまりドキュメントでいうno_agentモードは、推論レイヤーを一切使用しません。これらを推測で済ませるのではなく、測定してください。FAQでは/usage、/compress、hermes prompt-sizeが説明されており、Webダッシュボードのドキュメントでは、総トークン数、キャッシュヒット率、モデル別の内訳を確認できる分析画面が説明されています。
各ジョブのモデルを選ぶ
ここで品質の順位を裏付けるベンチマークはないため、これはリーダーボードではなく、各選択を決める要因の表です。
| 役割 | 実際に決める要因 |
|---|---|
| メインターン(ツール呼び出しループ) | 信頼できるツール呼び出しと十分なコンテキスト。会話はうまくてもツール呼び出しが不得手なモデルは、料金表から想定するより再試行の分だけ高くつきます |
| 圧縮、タイトル、承認スコアリング、ウェブ抽出 | 能力を備えた最も安価なチャットモデル。文書では、ここで推論モデルを使うのは無駄だとしています |
| 委譲ワーカー | ボリュームが集中する場所。メインモデルを継承せず、delegation.modelを明示的に設定します |
| ビジョン | モデルがmodels.devにない場合、または画像がネイティブにルーティングされず事前処理される場合は、model.supports_vision: trueを宣言します |
| 無人のcronジョブ | 固定されていないジョブは、ジョブの実行時点で設定されているメインモデルで動作するため、固定するかcron.modelを設定してください。ツールセットは小さく保ってください。大きなツールスキーマは、呼び出しのたびにプロンプトを膨らませます |
知っておく価値のある公式見解が2つあります。Nousは低コストのデフォルトを提供しています。2026年9月20日付で翌日に読み取ったリモートモデルマニフェストでは、z-ai/glm-5.2がデフォルトとされ、カタログ文書では、デフォルトは意図的に十分な能力を持つ低コストモデルであり、最も高価なフラッグシップではないと説明されています。また、Nousは自社のウェイトをエージェント内で使わないよう勧告しています。Portal統合ページでは、Hermes 4はチャットと推論向けに調整されており、高速なツール呼び出しループ向けではないため、Hermes Agent内での使用を推奨していません。そのページの候補、つまり汎用エージェント用途のClaude Sonnet 4.6、GPT-5.5 Pro、長いコンテキストに対応するGemini 3 Pro preview、費用対効果の高いコーダーとしてのDeepSeek V4 Proは、マニフェストと最新カタログの両方に遅れています。したがって出発点として扱い、モデルIDが解決されることを確認してください。
観測された利用状況も順位ではありません。2026年9月21日に確認したOpenRouterのHermes Agent公開アプリページでは、30日間のトークン量はMiniMax M3、Ox Alphaというラベルのないエントリ、Ling 3.0 Flash Fin、GPT-4o-mini、2つのDeepSeek V4 Flashビルドが上位でした。フラッグシップではなく、安価で高速なモデルです。これは1つのゲートウェイ経由で人々が実行した内容を記録したものであり、あなたのタスクで何が最も良い性能を発揮したかを示すものではありません。
「Hermesモデル」には2つの異なる問いがある
1つはエージェントに指定するモデルで、上で説明したものです。もう1つはHermes 4オープンウェイトファミリーで、Hugging Face上のHermes-4-405B、-70B、-14Bを指します。また、Hermes 3はOllamaで配布されています。これらは同じ会社のモデルウェイトであり、エージェントではありません。NousはHermes 4をエージェント内で実行しないよう述べています。ここには未検証の主張が1つあります。Portal統合文書ではHermes 4モデルがPortalで大幅な割引料金で利用できるとしていますが、2026年9月21日に最新の公開カタログ全体で「hermes」と「nous」を検索したところ、一致する行はありませんでした。サインイン時のみ表示されるか、文書が古い可能性があります。自分のアカウントで確認できないHermes 4 Portal料金を基準に予算を立てないでください。
Hermes Agentに最適で最も安いAPI
これらは異なる主張であり、分けて考えるべきです。掲載価格の安さは料金表の事実ですが、タスク完了までの最低コストは再試行、コンテキスト長、キャッシュヒットに左右されます。
| ルート | 有利な場合 | 最初に確認すること |
|---|---|---|
| Nous Portalサブスクリプション | ツール、モデル、ホスティングを1つの残高にまとめたい場合。Quick Setupでは、推奨される手早い方法とされています | トークン単位の割引ではなくクレジットです。Tool Gatewayは有料ティアの機能です |
| ベンダーの直接APIキー | 1つのモデルファミリー、中間レイヤーなし、ベンダー機能を優先 | コンシューマー向けチャットプランはほとんど機能しません。Claude ProではHermesをまったく動かせず、Claude Maxでは購入した追加利用クレジットが必要で、Googleのコンシューマープランには文書化された経路がありません |
| サードパーティのOpenAI互換ゲートウェイ | 1つのキーで、掲載料金の特定モデル群を使いたい場合 | transportを明示的に設定し、各モデルでプロンプトキャッシュを有効にしてください。どちらも自動推測されません |
| 無料のPortalモデル | 中断を許容できる探索や作業 | 無料とフラグ付けされたモデルに限定され、その一覧は最新のカタログから再構築されます |
| ローカル推論 | 適切なハードウェアをすでに実行している場合 | FAQによれば実行は無料ですが、ツール呼び出しの品質はHermesではなくサービングスタック側の問題です |
Hermesの文書では、OpenAI互換APIを持つサービスなら動作すると説明されており、プロバイダーリファレンスには競合ゲートウェイ向けのレシピも掲載されています。したがってカスタムエンドポイント経路は回避策ではなく、正式な経路です。Kunavoが当てはまる範囲は「最安」より狭いものです。KunavoのカタログにはClaudeやGPTクラスのモデルに加えてメディアモデルがありますが、Hermesの観測された利用を支配するオープンウェイトモデルは含まれていません。すでにそれらで構成しているなら、Kunavoはより安い経路ではありません。ClaudeまたはGPTのメインターンを、1つのキーで掲載料金に基づいて運用するための経路です。
同じモデル、同じトークン、2つの料金表
標準のキャッシュ未使用入力・出力トークン100万個あたりのUSD。Anthropicの直接料金は2026年9月21日に確認した同社の料金ページから、Kunavo列は最新のカタログから取得しています。
| モデル | Anthropic直接:入力 / 出力 | Kunavo:入力 / 出力 | 候補となるHermesの役割 |
|---|---|---|---|
| Claude Haiku 4.5 | $1.00 / $5.00 | $0.70 / $3.50 | 補助スロットと委譲ワーカー |
| Claude Sonnet 5 | $2.00 / $10.00 | $1.40 / $7.00 | メインのツール呼び出しターン |
| Claude Opus 5 | $5.00 / $25.00 | $3.50 / $17.50 | 難しいタスクとエスカレーション |
では計算します。1か月あたりキャッシュ未使用の入力トークン2,000万個と出力トークン200万個を、メインターン、補助スロット、委譲ワーカー全体で合算すると仮定します。この合計が重要です。ターン単位の見積もりでは、3つのうち2つを見落とすためです。
| ルーティングの前提 | カタログ見積もり |
|---|---|
| すべてClaude Sonnet 5で実行 | $42.00 |
| メインターンはClaude Sonnet 5(入力400万 / 出力60万)、補助スロットと委譲ワーカーはClaude Haiku 4.5(入力1,600万 / 出力140万) | $25.90 |
| すべてClaude Sonnet 5で実行。ただし入力のうち1,600万は、100万あたり$0.14でキャッシュ読み取りとして到着 | $21.84 |
これはカタログ料金に基づくトークン計算であり、実測したHermesタスクでも請求額の上限でもありません。キャッシュ書き込みは含みません。ここではClaudeのキャッシュ書き込みは入力料金の1.25倍で請求され、キャッシュ文書で説明されています。また、有料ツール、ホスティング、税も含みません。さらに、安価なモデルが追加試行なしで割り当てられた作業を完了すると仮定しています。安価な行が実際に安いかどうかを決めるのは料金ではなくこの仮定です。コスト最適化では、その検証方法を説明しています。
Kunavoのカタログ金額は上限ではなく請求額の下限です。上流サービスが料金を報告した場合、請求額はカタログ料金と、適用されるマークアップを乗じた上流コストの大きい方になります。最低額はサブスクリプションなしの$10前払いチャージで、これは資金を入れたアカウントを開設するために必要な現金であり、タスクのコストではありません。請求を参照してください。
サードパーティのエンドポイントをHermesに接続する
この設定は、2026年9月21日にソース文書として確認したHermes独自のプロバイダーリファレンスに基づいています。Kunavoに対するHermesの実行は行っていません。Hermes向けのKunavoセットアップガイドもなく、以下をテスト済みの統合と解釈しないでください。試す間も、現在動作している経路を利用できる状態にしておいてください。
# ~/.hermes/config.yaml
providers:
kunavo:
api: https://api.kunavo.com/v1
key_env: KUNAVO_API_KEY
transport: chat_completions # set it; do not rely on URL auto-detection
models:
claude-sonnet-5:
prompt_caching: true
model:
default: claude-sonnet-5
provider: custom:kunavoKUNAVO_API_KEY=your-keyカスタムエンドポイントで無料では得られない5つのこと。それぞれに文書化されたコストがあります。
transportを明示的に設定します。空欄のままにするとURLベースの自動検出にフォールバックします。プロバイダーリファレンスでは、空欄フィールドに対するフォールバックとして説明され、/anthropicパスがanthropic_messagesに解決されるという1つのルールだけが例示されています。ここで確認したどのページにも、そのヒューリスティックの残りは列挙されていません。そのため、何も起きないと仮定せず、トランスポートを指定する必要があります。Hermesのその経路に対する独自の回帰テストには、これが防ぐ失敗モードが記録されています。openai-apiエントリをリージョナルなOpenAIホストに向けると、プロバイダー自身が宣言したトランスポートではなく、暗黙にchat_completionsへ解決され、すべてのツール呼び出しターンが400を返しました。Kunavoは/v1/chat/completions、/v1/messages、/v1/responsesを提供しているため、文書化された3つのトランスポートすべてに、理論上は対応するエンドポイントがあります。ただしこれは文書レベルの一致にすぎず、テスト済みではありません。検出に選択させず、使用するトランスポートを指定してください。- 各モデルでプロンプトキャッシュを有効にします。 裸のモデルエイリアスを解決するゲートウェイでは、キャッシュマーカーをモデルごとに宣言する必要があります。Hermesは、プロバイダー名、ホスト、モデルファミリーからキャッシュ対応を推測しないと明記しています。これを忘れると、長いセッションで最大の効果を持つキャッシュ入力料金が、何も通知されないまま適用されません。プロンプトキャッシュを参照してください。
- デフォルトが正しくない場合は
context_lengthを設定します。 カスタムのOpenAI互換エンドポイントには、カタログ相当の出力上限が自動的には適用されません。サーバー独自のデフォルト値が適用され、モデルの最大値より低い場合もあります。コンテキストウィンドウは、models.devを経由し、最終的に128Kへフォールバックするチェーンで解決されます。 extra_headersが対象とする範囲を把握します。 モデル設定ページでは、この設定はOpenAI互換ルートとanthropic_messagesルートに適用され、メインクライアント、/modelによる切り替え、再ビルド、補助クライアントのすべてが対象になると説明されています。また、bedrock_converseはこの設定を使用しない唯一のモードとして記載されています。codex_responsesについてはどちらとも記載されていないため、この組み合わせは未テストとして扱ってください。Anthropicとの通信では、プロバイダーのドキュメント例がapiをパスに指定していますが、Hermesが付加するサフィックスは示されていません。そのため、初回呼び出し時に記録されたリクエストパスを確認してください。ベースURLのドキュメントでは、そこで発生する404の大半の原因となるオリジンと/v1の取り違えについて説明しています。- プロバイダーを追加するには
hermes modelを使用します。 セッション途中の/modelは、すでに設定済みのエンドポイント間を切り替えるだけで、新しいエンドポイントを追加することはできません。また、その切り替えによってキャッシュは破棄されます。
最初の試行では、実際のツール呼び出しを含む範囲を限定したタスクを1つ実行し、その後で/usageとダッシュボードの内訳を確認してから、スケジュール済みの作業を移行してください。その経路を、入金済みキーで試す準備ができたらKunavoアカウントを作成します。プロバイダーではなくエージェントを選ぶ段階ですか?HermesとOpenClawの比較で2つのワークフローを比較できます。
よくある質問
Hermes Agentの料金はいくらですか?
Hermes Agentのソフトウェアは無料です。MITライセンスのオープンソースであり、独自のFAQにも、支払うのは選択したプロバイダーのLLM API利用料だけだと記載されています。任意で有料となるものには、月額$0、$20、$100または$200のNous Portalサブスクリプション、稼働中のMediumインスタンスで1日$0.56からのHermes Cloudホスティング、そしてNous Tool Gatewayの利用があります。Tool Gatewayは有料サブスクリプション機能と説明されていますが、一部のアカウントには代わりに少量の無料ツールプールが提供されます。従量課金の料金表は公開されていません。料金は2026年9月21日にNousのページで確認しました。
Hermes Agentではどのモデルを使うべきですか?
Nousは意図的に低コストのデフォルトを用意しています。2026年9月20日付で翌日に読み取ったリモートモデルマニフェストでは、z-ai/glm-5.2がデフォルトモデルとされています。また、カタログ文書では、最も高価なフラッグシップではなく、十分な能力を持つ低コストモデルをデフォルトとして選んでいると説明されています。Nous Portalの統合ページでは、汎用的なエージェント用途の候補としてClaude Sonnet 4.6を別途挙げ、さらにGPT-5.5 Pro、長いコンテキストに対応するGemini 3 Pro preview、費用対効果の高いコーダーとしてDeepSeek V4 Proを紹介しています。これらの文章による推奨はマニフェストや最新のカタログより遅れているため、自分のアカウントでモデルIDが解決されることを確認してください。ここで品質の順位を裏付けるタスクベンチマークはありません。
Hermes Agentに最も安いAPIはどれですか?
掲載価格の安さと、タスク完了までの総コストの低さは別の問題です。無料のNous Portalモデルはトークン価格がゼロですが、無料とフラグ付けされたモデルに限定され、その一覧は固定ではなく最新のカタログから再構築されます。ローカルモデルは、ハードウェアを所有していれば実行自体は無料です。2026年9月21日時点のPortal独自カタログにある有料エントリでは、最も低い料金は研究所のフラッグシップではなくオープンウェイトモデルに設定されていました。ただし、ツール呼び出しのループに失敗して再試行するモデルは、より高価でも完了できるモデルより高くつく可能性があります。料金表だけで選ばず、エージェント独自の/usageとダッシュボード分析で測定してください。
Claude ProまたはClaude MaxのサブスクリプションをHermes Agentで使えますか?
Claude ProではHermes Agentをまったく動かせません。Hermesのプロバイダー文書には、Pro加入者はOAuth経路を利用できず、代わりにANTHROPIC_API_KEYを使うよう記載されています。Claude Maxは購入した追加利用クレジットがある場合に限り機能し、Hermesの利用はすべて追加利用として請求され、Maxに含まれる利用枠は消費されません。Googleのコンシューマープランには文書化された経路がなく、xAI OAuthはサブスクリプションのティアによってHTTP 403を返す場合があります。通常の経路は、トークン単位で支払うAPIアクセスです。
Hermes 4モデルはHermes Agentと同じものですか?
いいえ。Hermes 3とHermes 4はNous ResearchのオープンウェイトLLMファミリーで、Hugging FaceではHermes-4-405B、Hermes-4-70B、Hermes-4-14Bとして公開されています。Hermes AgentはMITライセンスのエージェントソフトウェアです。Nousは、Hermes 4をHermes Agent内で実行しないよう明示的に勧告しています。Hermes 4はチャットと推論向けに調整されており、エージェントが依存する高速なツール呼び出しループ向けではないためです。
Nous PortalのサブスクリプションでClaudeモデルは割引されますか?
トークン単価については割引されません。2026年9月21日に確認したPortalカタログでは、ClaudeのエントリにAnthropicが公開している料金からの割引はありませんでした。100万トークンあたりの入力料金と出力料金は、それぞれSonnetが$2.00と$10.00、Opus 5が$5.00と$25.00、Haikuが$1.00と$5.00、Fable 5.1が$10.00と$50.00です。有料ティアで追加されるのは、10パーセントのクレジットボーナス、Tool Gatewayのバンドル利用、より高いリクエスト上限です。Portal自身の説明では無料オプションとPortal限定割引が約束されていますが、カタログには各エントリにつき単一の料金しか表示されず、その横に比較基準となる価格もないため、どのエントリが割引されているかを公開ページで確認することはできません。
Nous ResearchおよびAnthropicのページは2026年9月21日に確認しました。リポジトリの状態と最新リリースも、同日にGitHub APIで検証しています。Kunavoの料金と上記のすべての合計は、稼働中のモデルカタログに基づいて計算した参考見積もりです。Hermesの設定は、実行時テストではなく、ソースドキュメントに基づいて記載しています。