返回指南
定價·2026年9月18日·更新於 2026年9月30日·閱讀約 9 分鐘

Hermes Agent 定價:實際執行成本

軟體費用為 $0。你的帳單是 token,加上費率表未列出的三個倍增因素。

最後審核於 。

Hermes Agent 的安裝費用為 $0:軟體採 MIT 授權的開放原始碼,而唯一無法避免的費用是模型權杖。 其他一切都是選用項目,且分別計價:每月 $0、$20、$100 或 $200 的 Nous Portal 訂閱、每天 $0.56 起的 Hermes Cloud 託管,以及 Tool Gateway 使用量;這是付費訂閱功能,且未發布按次計費費率。

本頁介紹的是 Hermes Agent,即 Nous Research 的開放原始碼代理程式。2026 年 9 月 21 日對該儲存庫進行即時查核,回傳 archived: false、MIT 授權,以及同日的一次推送;最新發布版本是 Hermes Agent v0.21.3,於 2026 年 9 月 14 日標記為 v2026.9.14。它不是 Hermes 3 或 Hermes 4(Nous 的開放權重模型系列),也不是同名的奢侈品品牌。

四筆獨立費用,其中只有一筆是必要費用

你購買的是什麼公布價格所述位置
Hermes Agent 軟體:CLI、終端機 UI、Desktop、訊息閘道$0,MIT 授權Hermes 常見問題集:你只需支付所選供應商的 LLM API 使用量
模型權杖由你所選的供應商收取的任何費用供應商自身的價目表
Nous Portal 訂閱(選用)每月 $0 / $20 / $100 / $200Portal 方案
Nous Tool Gateway:網路搜尋、圖片生成、TTS、雲端瀏覽器付費訂閱功能;使用量按訂閱方案計費。未發布按次計費費率。同一份文件也指出,部分帳戶可改為享有少量免費工具配額Tool Gateway 文件
Hermes Cloud 託管(選用)Medium 執行中每天 $0.56、停止每天 $0.03;Large 執行中每天 $1.09、停止每天 $0.03;部署需要至少 $2 的額度,或有效訂閱Hermes Cloud
Hermes Business / Enterprise未發布價格。兩者都由 Portal 自身頁尾連結;2026 年 9 月 21 日,兩個頁面都未回應純 HTTP 用戶端,因此此處未驗證其條款Business 頁面

Hermes Cloud 按日計算執行個體費用,並於事後收費;其自身頁面指出,推理與工具使用量會在執行個體價格之外另行計費。因此,託管報價永遠不是完整帳單。根據同一份常見問題集,擁有硬體後,本地模型的執行費用完全為零。所有數字均於 2026 年 9 月 21 日查核。另一個代理程式的相同四筆費用拆解請參閱 OpenClaw 定價。

Nous Portal 方案:你購買的是額度,而不是權杖折扣

方案層級每月價格每月額度結轉上限
免費$0$0——僅限免費模型,標準速率限制—
Plus$20$22(10% 紅利)、託管工具使用量、較高的請求速率上限$10
Super$100$110$50
Ultra$200$220$100
一次性儲值+ $10 / + $20 / + $50 / + $100 / + $200,或任意金額由 Stripe 收款—

額度就是產品本身。$20 訂閱會購買 $22 的模型支出,因此其相較於按權杖付費的優勢是紅利加上內含工具與限制,而不是每個模型都有更低費率。在 2026 年 9 月 21 日讀取的公開目錄中,Claude 項目採用Anthropic 發布的費率——Opus 5 輸入 $5.00 / 輸出 $25.00,Fable 5.1 $10.00 / $50.00——未顯示任何折減。該頁面無法讓你確認其他項目是否享有折扣:每個項目只列出一個費率,旁邊沒有參考價格。它確實顯示,同一模型可能以不同費率出現,因為區域與批次變體會列為不同項目——Kimi K3 為 $1.70 / $8.50,其 :US 項目為 $3.63 / $18.15,其批次項目為 $3.00 / $15.00。請依據你將呼叫的確切項目 ID 編列預算,並為任何引用標註日期。

編列預算前有三項注意事項。免費層確實存在,但僅限模型 ID 帶有 :free 後綴的項目——在 2026 年 9 月 21 日的讀取中有七個——而且該清單會根據即時目錄重新建立,因此「使用免費模型」的建議很快就會過時。Portal 自身頁面對目錄大小引用了兩個不同的取整概略數字——每張付費方案卡片上的較小數字,以及目錄本身上方區段中的較大數字——而發布的清單在該次讀取中包含 360 個項目,因此請將這些數字視為行銷資訊,而不是預算輸入。方案卡片也沒有顯示請求速率數字;它們只寫著「標準」與「高」速率限制,因此在你自己的帳戶中確認前,請將並行數視為未驗證。方案表位於 Portal 首頁與 manage-subscription 上;純 HTTP 用戶端取得的是 Vercel 安全性檢查頁,而非該頁面——請在瀏覽器中讀取。

權杖實際流向何處

價目表會為一次呼叫定價。Hermes 則會針對工作負載計費,而兩者之間有三項文件記載的乘數。

輔助槽位。 儀表板提供 11 個輔助任務槽位——標題生成、視覺、壓縮、核准、網路擷取、技能中心、MCP 路由及其他功能——每個槽位的預設值都是 auto,表示 Hermes 也會嘗試使用你的主要模型完成該工作。文件自身以壓縮為浪費範例:快速聊天模型執行該工作的成本是推理模型的五十分之一。一次使用者回合因此可能產生數次計費呼叫。

委派。 委派文件指出,平行子代理程式批次通常會消耗執行總權杖數的絕大多數,因此工作模型可以獨立設定為 delegation.model。其成本警告指出,max_spawn_depth: 3 搭配 max_concurrent_children: 3 時,最多可達 27 個並行葉節點代理程式;預設深度為 1。

快取連續性。同一份模型設定頁面警告,提示快取會以服務該請求的模型為索引,因此任何對話中途的模型變更——明確的 /model 切換、自動備援,或憑證池輪替至不同帳戶——都會使下一則訊息以完整輸入價格重新讀取整段對話,而不是使用快取費率;文件將後者描述為約 75% 至 90% 的折扣。之所以設有預設防護設定 model.switch_context_confirm_tokens: 100000,正是因為這次一次性的重新讀取成本可能遠高於兩個模型之間的每權杖差額。

排程工作最容易受到這項影響,而且結果不是你所希望的方向:cron 文件指出,沒有自有模型的工作會在執行當下使用 hermes model 或 /model 的設定,因此變更聊天模型後,整個 cron 工作群組會在下一次執行時一併跟著變更。當無人值守的工作不得跟隨切換時,請固定工作(hermes cron create/edit --pin,或明確指定 --model / --provider),或使用 cron.model 設定工作群組預設值。僅腳本工作——文件中的 no_agent 模式——完全不會接觸推理層。不要估算這些數值,請直接測量:常見問題集記載了 /usage、/compress 與 hermes prompt-size,而網頁儀表板記載了一個分析檢視,其中包含總權杖數、快取命中百分比及每個模型的明細。

為每項工作選擇模型

此處沒有任何基準測試支援品質排名,因此這是一張說明每項選擇決定因素的表格,而不是排行榜。

工作實際決定因素
主要回合(工具呼叫迴圈)可靠的工具呼叫與足夠的上下文。能良好對話但工具呼叫不佳的模型,其重試成本會高於費率所顯示的成本
壓縮、標題、核准評分、網路擷取最便宜且能力足夠的聊天模型。文件指出,在此使用推理模型是浪費
委派工作者這是大量使用量所在之處。請明確設定 delegation.model,不要繼承主要模型
視覺功能當模型不在 models.dev 中時,請宣告 model.supports_vision: true,否則圖片會先經過預處理,而不是原生路由
無人值守的 cron 工作未固定的工作會在工作執行時使用當下的主要模型,因此請固定它,或設定 cron.model。保持工具集精簡——大型工具結構描述會在每次呼叫時增加提示內容

有兩項官方立場值得了解。Nous 提供低成本預設值:遠端模型清單標註的日期為 2026 年 9 月 20 日,於隔日讀取,將 z-ai/glm-5.2 標示為預設值;目錄文件表示,預設值刻意選擇能力足夠的低成本模型,絕不是最昂貴的旗艦模型。此外,Nous 不建議在代理程式內使用自有權重:Portal 整合頁面指出,不建議在 Hermes Agent 內使用 Hermes 4,因為它針對聊天與推理調校,而非快速連續的工具呼叫迴圈。該頁面的候選清單——Claude Sonnet 4.6 作為通用代理程式首選、GPT-5.5 Pro、具長上下文的 Gemini 3 Pro 預覽版,以及作為具成本效益程式設計模型的 DeepSeek V4 Pro——落後於模型清單與即時目錄,因此請將其視為起點,並確認模型 ID 能解析。

觀察到的使用量也不是排名。2026 年 9 月 21 日讀取的OpenRouter Hermes Agent 公開應用程式頁面顯示,30 天權杖量由 MiniMax M3、名為 Ox Alpha 但未標示的項目、Ling 3.0 Flash Fin、GPT-4o-mini 及兩個 DeepSeek V4 Flash 建置版本領先——都是便宜、快速的模型,而非旗艦模型。這記錄的是人們透過單一閘道執行的內容,不是哪些模型在你的任務上表現最佳。

「Hermes 模型」其實是兩個不同問題

一個問題是要將代理程式指向哪個模型,上文已回答。另一個問題是Hermes 4 開放權重系列——Hugging Face 上的 Hermes-4-405B、-70B 與 -14B,以及透過 Ollama 發布的 Hermes 3。這些是同一家公司提供的模型權重,不是代理程式,而 Nous 表示不要在其中執行 Hermes 4。有一項聲明未經驗證:Portal 整合文件表示,Portal 以大幅折扣的費率提供 Hermes 4 模型,但在 2026 年 9 月 21 日對即時公開目錄搜尋「hermes」與「nous」時,沒有找到相符項目。它們可能只有登入後才可見,也可能是文件已過時。不要根據你在自己帳戶中看不到的 Hermes 4 Portal 價格編列預算。

Hermes Agent 的最佳與最便宜 API

這是不同的主張,應分開看待。列出的最低價格是價目表事實;完成任務的最低成本則取決於重試、上下文長度與快取命中。

方式適用情況首先要檢查的事項
Nous Portal 訂閱你希望工具、模型與託管共用一筆餘額。Quick Setup將其稱為建議的快速途徑額度,而不是每權杖折扣。Tool Gateway 是付費層級功能
直接供應商 API 金鑰單一模型系列、沒有中間層、優先使用供應商功能消費者聊天方案大多無法使用:Claude Pro 完全無法驅動 Hermes,Claude Max 需要購買額外使用額度,而 Google 消費者方案沒有文件記載的路徑
第三方 OpenAI 相容閘道您希望在單一金鑰下,以列出的費率使用特定模型組合明確設定 transport,並為每個模型啟用提示快取;兩者都不會自動推斷
免費 Portal 模型探索與可容忍中斷的工作僅限標記為免費的模型,而且該清單會根據即時目錄重新建立
本機推論您已在執行合適的硬體根據 FAQ,執行本身免費,但工具呼叫品質是服務堆疊的問題,而不是 Hermes 的問題

Hermes 文件說明,任何具備 OpenAI 相容 API 的服務都能運作,其供應商參考文件甚至包含競爭閘道的操作配方,因此自訂端點路徑是正式支援的路線,而不是權宜方案。Kunavo 的定位比「最便宜」更窄:其目錄涵蓋 Claude 和 GPT 類模型以及媒體模型,而主導目前觀察到的 Hermes 使用情況的開放權重模型並不在其中。如果您的設定已經在執行那些模型,Kunavo 並不是更便宜的路線;它適合在單一金鑰下,以列出的費率維持 Claude 或 GPT 的主要回合。

相同模型、相同權杖、兩份價格表

每百萬個標準未快取輸入與輸出權杖的美元價格。Anthropic 的直接費率取自其價格頁面,該頁面已於 2026 年 9 月 21 日查核;Kunavo 欄位則讀取即時目錄。

模型Anthropic 直接價格:輸入/輸出Kunavo:輸入 / 輸出候選 Hermes 角色
Claude Haiku 4.5$1.00 / $5.00$0.70 / $3.50輔助插槽與委派工作者
Claude Sonnet 5$2.00 / $10.00$1.40 / $7.00主要工具呼叫回合
Claude Opus 5$5.00 / $25.00$3.50 / $17.50困難任務與升級處理

現在進行算術計算。假設一個月包含2,000 萬個未快取輸入權杖與 200 萬個輸出權杖,並將主要回合、輔助插槽與委派工作者合併計算——這個合計數很重要,因為按回合估算會漏掉三者中的兩者。

路由假設目錄估算
全部使用 Claude Sonnet 5$42.00
主要回合使用 Claude Sonnet 5(輸入 4M/輸出 0.6M);輔助插槽與委派工作者使用 Claude Haiku 4.5(輸入 16M/輸出 1.4M)$25.90
全部使用 Claude Sonnet 5,但其中 16M 的輸入會以每百萬 $0.14 的價格作為快取讀取$21.84

這是按照目錄費率計算的權杖算術,不是經測量的 Hermes 任務,也不是帳單上限。其中不包括快取寫入——Claude 快取寫入在此按輸入費率的 1.25 倍計費,詳見快取文件——也不包括付費工具、代管服務與稅金。此外,這假設較便宜的模型能在不增加嘗試次數的情況下完成分配給它的工作。決定較便宜那一列是否實際更便宜的,是這項假設,而不是費率;成本最佳化說明如何測試這一點。

Kunavo 的目錄金額是計費下限,而不是上限:當上游回報其費用時,帳單金額取目錄成本與上游成本乘以適用加成兩者中較高者。最低金額是 $10 預付儲值,不含訂閱;這是開設已儲值帳戶所需的現金,不是任務成本。請參閱計費。

將第三方端點串接到 Hermes

此設定來自Hermes 自己的供應商參考文件,並於 2026 年 9 月 21 日以來源文件形式查閱。尚未執行任何針對 Kunavo 的 Hermes 測試,也沒有 Kunavo 的 Hermes 設定指南,以下內容不應解讀為經測試的整合。嘗試時請保留目前可用的工作路徑。

取自 Hermes 供應商文件的起點
# ~/.hermes/config.yaml
providers:
  kunavo:
    api: https://api.kunavo.com/v1
    key_env: KUNAVO_API_KEY
    transport: chat_completions   # set it; do not rely on URL auto-detection
    models:
      claude-sonnet-5:
        prompt_caching: true

model:
  default: claude-sonnet-5
  provider: custom:kunavo
~/.hermes/.env
KUNAVO_API_KEY=your-key

自訂端點不會免費取得的五件事;每一項都有已記錄的成本:

  1. 明確設定 transport。留白會退回以 URL 為依據的自動偵測;供應商參考文件將其描述為空白欄位的備援方式,並只示範一條規則——將 /anthropic 路徑解析為 anthropic_messages。此處查閱的任何頁面都沒有列出該啟發式方法的其他部分,因此應指定傳輸方式,而不是假設不會觸發任何內容。Hermes 針對該路徑的自有回歸測試記錄了它要防止的失敗模式:指向區域 OpenAI 主機的 openai-api 項目,會靜默解析為 chat_completions,而不是供應商本身宣告的傳輸方式,導致每個工具呼叫回合都回傳 400。Kunavo 提供 /v1/chat/completions、/v1/messages 與 /v1/responses,因此三種已記錄的傳輸方式在文件上都有相符端點——這只是文件層級的符合,並非經過測試。請指定您要的傳輸方式,不要讓偵測機制替您選擇。
  2. 為每個模型啟用提示快取。對於會解析裸模型別名的閘道,快取標記必須逐模型宣告;Hermes 表示不會根據供應商名稱、主機或模型系列推斷快取支援。漏掉這項設定會靜默失去快取輸入費率,而這是長工作階段中最大的槓桿。請參閱提示快取。
  3. 在預設值不正確時設定 context_length。自訂 OpenAI 相容端點不會自動取得目錄規模的輸出上限——套用的是伺服器自己的預設值,而且可能低於模型上限。上下文視窗會透過一串設定解析,最後以 models.dev 為準,並以 128K 作為備援。
  4. 了解 extra_headers 涵蓋的範圍。模型設定頁面將其套用於 OpenAI 相容路由以及 anthropic_messages 路由——包括主要用戶端、/model 切換、重建與輔助用戶端——並指出 bedrock_converse 是唯一不使用它的模式。該頁面沒有說明 codex_responses 的情況,因此請將這種組合視為未經測試。在 Anthropic 線路上,供應商文件的範例將 api 指向某個路徑,但沒有說明 Hermes 會附加的後綴,因此請在第一次呼叫時檢查記錄的請求路徑——基礎 URL 文件說明了應使用網站根網址(origin)還是帶有 /v1 的網址這個陷阱,該處大多數 404 都源於此。
  5. 使用 hermes model 來新增供應商。工作階段中途的 /model 只能在您已設定的端點之間切換,無法新增端點——而且該切換會捨棄快取。

首次試用時,先執行一項有明確範圍且包含實際工具呼叫的任務,然後讀取 /usage 和儀表板明細,再將排程工作移轉過去。準備好以已儲值金鑰測試這條路徑時,建立 Kunavo 帳戶。仍在選擇代理程式而不是其供應商?Hermes 與 OpenClaw會比較兩種工作流程。

常見問題

Hermes Agent 的費用是多少?

Hermes Agent 軟體完全免費:它採用 MIT 授權的開放原始碼,而其常見問題集表示,你只需支付所選供應商的 LLM API 使用費。選用的付費項目包括每月 $0、$20、$100 或 $200 的 Nous Portal 訂閱、執行中 Medium 執行個體每天 $0.56 起的 Hermes Cloud 託管,以及 Nous Tool Gateway 使用量;文件將後者描述為付費訂閱功能——部分帳戶則會取得少量免費工具配額——且未發布按次計費價目表。價格已於 2026 年 9 月 21 日在 Nous 頁面查核。

我應在 Hermes Agent 中使用哪個模型?

Nous 刻意提供低成本預設值:標註日期為 2026 年 9 月 20 日、隔日讀取的遠端模型清單,將 z-ai/glm-5.2 標示為預設模型;目錄文件表示,選擇預設值是為了提供能力足夠的低成本模型,而非最昂貴的旗艦模型。Nous Portal 整合頁面則另外將 Claude Sonnet 4.6 列為通用代理程式首選,並列出 GPT-5.5 Pro、具長上下文的 Gemini 3 Pro 預覽版,以及具成本效益的程式設計模型 DeepSeek V4 Pro。這些文字建議落後於模型清單與即時目錄,因此請確認模型 ID 能在你的帳戶中解析。此處沒有任何任務基準測試支援品質排名。

Hermes Agent 最便宜的 API 是哪個?

列出的最低價格與完成任務的最低成本是不同問題。免費的 Nous Portal 模型權杖價格為零,但僅限標記為免費的模型,而該清單會根據即時目錄重新建立,不是固定不變的。擁有硬體後,執行本地模型的費用為零。在 2026 年 9 月 21 日 Portal 自有目錄的付費項目中,最低費率出現在開放權重模型,而非實驗室旗艦模型——但無法完成工具呼叫迴圈並需要重試的模型,成本可能高於能完成任務的較昂貴模型。請使用代理程式自身的 /usage 與儀表板分析資料衡量,而不要只依據價目表選擇。

我可以在 Hermes Agent 中使用 Claude Pro 或 Claude Max 訂閱嗎?

Claude Pro 完全無法驅動 Hermes Agent:Hermes 供應商文件指出,Pro 訂閱者不能使用 OAuth 路徑,並要求改用 ANTHROPIC_API_KEY。Claude Max 只有在購買額外使用額度後才能運作,而且所有 Hermes 使用量都會計入額外使用量,而 Max 內含額度保持不變。Google 消費者方案沒有文件記載的路徑,而 xAI OAuth 可能依訂閱層級回傳 HTTP 403。按權杖付費的 API 存取是正常途徑。

Hermes 4 模型與 Hermes Agent 是同一回事嗎?

不是。Hermes 3 與 Hermes 4 是 Nous Research 的開放權重 LLM 系列,在 Hugging Face 上發布為 Hermes-4-405B、Hermes-4-70B 與 Hermes-4-14B。Hermes Agent 則是採 MIT 授權的代理程式軟體。Nous 明確建議不要在 Hermes Agent 內執行 Hermes 4,因為 Hermes 4 的調校目標是聊天與推理,而不是代理程式所依賴的快速連續工具呼叫迴圈。

Nous Portal 訂閱會折扣 Claude 模型嗎?

不會折扣權杖費率。在 2026 年 9 月 21 日讀取的 Portal 目錄中,Claude 項目的費率沒有低於 Anthropic 發布的費率:Sonnet 每百萬權杖輸入 $2.00、輸出 $10.00;Opus 5 為 $5.00 與 $25.00;Haiku 為 $1.00 與 $5.00;Fable 5.1 為 $10.00 與 $50.00。付費層級增加的是 10% 額度紅利、內含 Tool Gateway 使用量及較高的請求限制。Portal 自身的文案承諾免費選項與 Portal 專屬折扣,但目錄對每個項目只列出單一費率,旁邊沒有參考價格,因此公開頁面無法讓你確認哪些項目享有折扣。

Nous Research 與 Anthropic 頁面於 2026 年 9 月 21 日查閱;同日也透過 GitHub API 核實儲存庫狀態與最新版本。Kunavo 費率及以上所有總額均根據即時模型目錄計算,僅為示意性估算。Hermes 設定取自來源文件,而非執行階段測試。