Zurück zu den Leitfäden
Preise·18. September 2026·Aktualisiert am 30. September 2026·9 Min. Lesezeit

Hermes-Agent-Preise: Was die Ausführung tatsächlich kostet

Die Software kostet 0 $. Deine Rechnung besteht aus Tokens – plus drei Multiplikatoren, für die keine Preisliste einen Tarif nennt.

Zuletzt überprüft am .

Die Installation von Hermes Agent kostet $0: Die Software ist Open Source unter der MIT-Lizenz, und die einzige unvermeidbare Rechnung betrifft Modell-Token. Alles andere ist optional und wird separat berechnet: ein Nous-Portal-Abonnement für $0, $20, $100 oder $200 pro Monat, Hermes-Cloud-Hosting ab $0.56 pro Tag sowie die Tool-Gateway-Nutzung, eine Funktion kostenpflichtiger Abonnements, für die kein Preis pro Nutzung veröffentlicht ist.

Auf dieser Seite geht es um Hermes Agent, den Open-Source-Agenten von Nous Research. Eine Live-Prüfung des Repositorys am 21. September 2026 ergab archived: false, eine MIT-Lizenz und einen Push am selben Tag; die neueste veröffentlichte Version ist Hermes Agent v0.21.3, gekennzeichnet durch v2026.9.14 am 14. September 2026. Es handelt sich nicht um Hermes 3 oder Hermes 4, die Open-Weight-Modellfamilie von Nous, und auch nicht um die gleichnamige Luxusgütermarke.

Vier getrennte Rechnungen, von denen nur eine verpflichtend ist

Was Sie kaufenVeröffentlichter PreisWo dies angegeben ist
Hermes-Agent-Software: CLI, Terminal-UI, Desktop, Messaging-Gateway$0, MIT-lizenziertHermes-FAQ: Sie zahlen nur für die LLM-API-Nutzung Ihres gewählten Providers
Modell-TokensWas auch immer Ihr gewählter Provider berechnetDie eigene Preisliste Ihres Providers
Nous-Portal-Abonnement (optional)$0 / $20 / $100 / $200 pro MonatPortal-Tarife
Nous Tool Gateway: Websuche, Bildgenerierung, TTS, Cloud-BrowserEine Funktion kostenpflichtiger Abonnements; Abrechnung nach Nutzung innerhalb des Abonnements. Kein Preis pro Nutzung veröffentlicht. In derselben Dokumentation wird darauf hingewiesen, dass einige Konten stattdessen Anspruch auf ein kleines kostenloses Tool-Kontingent habenTool-Gateway-Dokumentation
Hermes-Cloud-Hosting (optional)Medium $0.56/Tag im Betrieb, $0.03/Tag gestoppt; Large $1.09/Tag im Betrieb, $0.03/Tag gestoppt; zum Bereitstellen sind mindestens $2 Guthaben oder ein aktives Abonnement erforderlichHermes Cloud
Hermes Business / EnterpriseKein Preis veröffentlicht. Beide sind in der Fußzeile des Portals verlinkt; keine der beiden Seiten antwortete am 21. September 2026 auf einen einfachen HTTP-Client, daher sind ihre Bedingungen hier nicht verifiziertBusiness-Seite

Hermes Cloud berechnet die Instanz täglich nachträglich, und auf der eigenen Seite steht, dass Inferenz- und Tool-Nutzung zusätzlich zum Instanzpreis separat abgerechnet werden. Ein Hosting-Angebot ist daher niemals die gesamte Rechnung. Lokale Modelle können laut derselben FAQ vollständig kostenlos ausgeführt werden, sobald Sie die Hardware besitzen. Alle Angaben wurden am 21. September 2026 geprüft. Dieselbe Aufschlüsselung in vier Rechnungen für einen anderen Agenten finden Sie unter OpenClaw-Preise.

Nous-Portal-Tarife: Sie kaufen Guthaben, keinen Tokenrabatt

StufeMonatlicher PreisMonatliches GuthabenÜbertragungslimit
Kostenlos$0$0 — nur kostenlose Modelle, standardmäßige Ratenlimits—
Plus$20$22 (ein Bonus von 10 Prozent), gehostete Tool-Nutzung, hohe Ratenlimits$10
Super$100$110$50
Ultra$200$220$100
Einmalige Aufladung+$10 / +$20 / +$50 / +$100 / +$200 oder ein beliebiger BetragÜber Stripe bezahlt—

Das Guthaben ist das Produkt. Ein Abonnement für $20 kauft $22 an Modellausgaben; sein Vorteil gegenüber der Abrechnung pro Token ist daher der Bonus zusammen mit den gebündelten Tools und Limits — nicht ein günstigerer Preis für jedes Modell. Im öffentlichen Katalog vom 21. September 2026 wiesen die Claude-Einträge die von Anthropic veröffentlichten Preise auf — Opus 5 mit $5.00 Input / $25.00 Output, Fable 5.1 mit $10.00 / $50.00 — ohne erkennbare Reduzierung. Ob etwas anderes rabattiert ist, lässt sich auf dieser Seite nicht prüfen: Sie zeigt pro Eintrag einen Preis und keinen Referenzpreis daneben. Sie zeigt jedoch, dass ein Modell mehrfach zu unterschiedlichen Preisen erscheinen kann, weil regionale und Batch-Varianten als separate Einträge aufgeführt werden — Kimi K3 mit $1.70 / $8.50, sein :US-Eintrag mit $3.63 / $18.15, sein Batch-Eintrag mit $3.00 / $15.00. Kalkulieren Sie anhand der exakten Eintrags-ID, die Sie aufrufen werden, und versehen Sie zitierte Angaben mit einem Datum.

Drei Vorbehalte, bevor Sie budgetieren. Der kostenlose Tarif ist real, aber auf die Einträge beschränkt, deren Modell-ID das Suffix :free trägt — bei der Abfrage vom 21. September 2026 waren es sieben —, und diese Liste wird aus dem Live-Katalog neu erstellt; Empfehlungen wie „verwende das kostenlose Modell“ veralten daher schnell. Die eigenen Portaloberflächen nennen zwei unterschiedliche runde Zahlen für die Kataloggröße — eine kleinere auf jeder Karte eines kostenpflichtigen Tarifs, eine größere im Abschnitt über dem Katalog selbst —, während die veröffentlichte Liste bei dieser Abfrage 360 Einträge enthielt; behandeln Sie daher jede dieser Zahlen als Marketing und nicht als Budgetgrundlage. Auf den Tarifkarten erscheinen ebenfalls keine Zahlen für die Anfragerate; dort stehen nur „standardmäßige“ und „hohe“ Ratenlimits. Betrachten Sie die Nebenläufigkeit daher als unbestätigt, bis Sie sie in Ihrem eigenen Konto sehen. Die Tariftabelle befindet sich auf der Portal-Startseite und unter manage-subscription, wo ein einfacher HTTP-Client statt der Seite einen Vercel-Sicherheitscheck erhält — lesen Sie sie in einem Browser.

Wohin die Token tatsächlich fließen

Eine Preisliste bepreist einen Aufruf. Hermes berechnet eine Arbeitslast, und dazwischen liegen drei dokumentierte Multiplikatoren.

Zusätzliche Slots. Das Dashboard stellt 11 zusätzliche Aufgaben-Slots bereit — Titelerstellung, Vision, Komprimierung, Genehmigung, Web-Extraktion, Skills-Hub, MCP-Routing und weitere —, und jeder verwendet standardmäßig auto, was bedeutet, dass Hermes auch für diese Aufgabe Ihr Hauptmodell verwendet. Das eigene Dokumentationsbeispiel für Verschwendung ist die Komprimierung: Ein schnelles Chatmodell erledigt diese Aufgabe zu einem Fünfzigstel der Kosten eines Schlussfolgerungsmodells. Eine einzelne Benutzerrunde kann daher aus mehreren abgerechneten Aufrufen bestehen.

Delegation. Die Delegationsdokumentation besagt, dass ein paralleler Batch von Subagenten typischerweise den Großteil der Gesamttoken eines Laufs verbraucht; deshalb ist das Arbeitsmodell separat als delegation.model konfigurierbar. Der eigene Kostenhinweis besagt, dass max_spawn_depth: 3 zusammen mit max_concurrent_children: 3 bis zu 27 gleichzeitig laufende Blattagenten ergeben kann; die Standardtiefe beträgt 1.

Cache-Kontinuität. Dieselbe Modellkonfigurationsseite weist darauf hin, dass Prompt-Caches an das Modell gebunden sind, das die Anfrage verarbeitet. Jeder Modellwechsel mitten im Gespräch — ein expliziter Wechsel mit /model, ein automatischer Fallback oder eine Rotation des Anmeldedatenpools auf ein anderes Konto — führt dazu, dass die nächste Nachricht das gesamte Gespräch zum vollständigen Inputpreis erneut liest, statt zum Cachepreis, der dort mit ungefähr 75 bis 90 Prozent Rabatt angegeben wird. Eine standardmäßige Schutzmaßnahme, model.switch_context_confirm_tokens: 100000, existiert genau deshalb, weil dieses einmalige erneute Lesen den Tokenpreisunterschied zwischen den beiden Modellen übersteigen kann.

Bei geplanten Aufgaben wirkt sich dies am stärksten aus, und zwar nicht in der erhofften Richtung: Die Cron-Dokumentation besagt, dass ein Job ohne eigenes Modell mit dem Modell läuft, auf das hermes model oder /model zum Zeitpunkt seiner Ausführung gesetzt ist. Wenn Sie Ihr Chatmodell ändern, verschiebt sich beim nächsten Lauf daher die gesamte Cron-Flotte mit. Fixieren Sie den Job (hermes cron create/edit --pin, oder ausdrücklich --model / --provider) oder legen Sie mit cron.model einen Flottenstandard fest, wenn ein unbeaufsichtigter Job einem Wechsel nicht folgen darf. Nur-Skript-Jobs — der Modus no_agent aus der Dokumentation — greifen niemals auf die Inferenzebene zu. Statt dies zu schätzen, messen Sie es: Die FAQ dokumentiert /usage, /compress und hermes prompt-size, und das Web-Dashboard dokumentiert eine Analyseansicht mit Gesamttoken, Cache-Trefferquote und Aufschlüsselung nach Modell.

Das Modell für jede Aufgabe auswählen

Kein Benchmark auf dieser Seite stützt eine Qualitätsrangfolge; dies ist daher eine Tabelle dessen, was die jeweilige Auswahl bestimmt, keine Bestenliste.

AufgabeWas tatsächlich entscheidet
Hauptrunde (die Tool-Calling-Schleife)Zuverlässige Tool-Aufrufe und ausreichend Kontext. Ein Modell, das gut konversiert, aber Tools schlecht aufruft, verursacht durch Wiederholungen höhere Kosten, als sein Preis vermuten lässt
Komprimierung, Titel, Bewertung von Genehmigungen, Web-ExtraktionDas günstigste leistungsfähige Chatmodell. Die Dokumentation bezeichnet Schlussfolgerungsmodelle hier als Verschwendung
Delegations-ArbeitsmodelleWo das Volumen anfällt. Setzen Sie delegation.model ausdrücklich, statt das Hauptmodell zu übernehmen
BildverständnisGeben Sie model.supports_vision: true an, wenn sich das Modell nicht in models.dev befindet oder Bilder vorverarbeitet statt nativ weitergeleitet werden
Unbeaufsichtigte Cron-JobsEin nicht fixierter Job läuft mit dem Hauptmodell, wie es bei seiner Ausführung eingestellt ist; fixieren Sie ihn daher oder setzen Sie cron.model. Halten Sie das Toolset klein — ein großes Tool-Schema vergrößert den Prompt bei jedem Aufruf

Zwei offizielle Positionen sind wissenswert. Nous liefert einen kostengünstigen Standard: Das auf den 20. September 2026 datierte und am folgenden Tag gelesene Remote-Model-Manifest markiert z-ai/glm-5.2 als Standard, und die Katalogdokumentation besagt, dass der Standard bewusst ein leistungsfähiges, kostengünstiges Modell und niemals das teuerste Spitzenmodell ist. Nous rät außerdem davon ab, die eigenen Gewichte im Agenten zu verwenden: Die Portal-Integrationsseite sagt, Hermes 4 werde für die Verwendung innerhalb von Hermes Agent nicht empfohlen, da es auf Chat und Schlussfolgerungen statt auf die schnelle Tool-Calling-Schleife abgestimmt ist. Die Auswahlliste dieser Seite — Claude Sonnet 4.6 als agentisches Allzweckmodell, GPT-5.5 Pro, eine Vorschauversion von Gemini 3 Pro mit langem Kontext und DeepSeek V4 Pro als kostengünstiges Modell für Programmieraufgaben — hinkt sowohl dem Manifest als auch dem Live-Katalog hinterher. Betrachten Sie sie daher als Ausgangspunkt und bestätigen Sie, dass die Modell-ID aufgelöst wird.

Die beobachtete Nutzung ist ebenfalls keine Rangliste. Die am 21. September 2026 gelesene öffentliche App-Seite von OpenRouter für Hermes Agent zeigte beim 30-Tage-Tokenvolumen MiniMax M3 an der Spitze, einen unbeschrifteten Eintrag namens Ox Alpha, Ling 3.0 Flash Fin, GPT-4o-mini und zwei DeepSeek-V4-Flash-Versionen — günstige, schnelle Modelle statt Spitzenmodelle. Dies zeigt, was Menschen über einen Gateway ausgeführt haben, nicht, was bei Ihrer Aufgabe am besten funktioniert hat.

„Hermes-Modelle“ sind zwei verschiedene Fragen

Die eine Frage ist, auf welches Modell der Agent zeigen soll; sie wurde oben beantwortet. Die andere betrifft die Hermes-4-Open-Weight-Familie — Hermes-4-405B, -70B und -14B auf Hugging Face, mit Hermes 3, verteilt über Ollama. Dies sind Modellgewichte desselben Unternehmens, nicht der Agent, und Nous sagt, Hermes 4 nicht darin auszuführen. Eine Aussage hier ist unverifiziert: Die Portal-Integrationsdokumentation besagt, Hermes-4-Modelle seien im Portal zu stark rabattierten Preisen verfügbar, doch eine Suche nach „hermes“ und „nous“ im öffentlichen Live-Katalog lieferte am 21. September 2026 keine passenden Zeilen. Entweder sind sie nur nach der Anmeldung sichtbar oder die Dokumentation ist veraltet. Kalkulieren Sie nicht mit einem Hermes-4-Portalpreis, den Sie in Ihrem eigenen Konto nicht sehen können.

Beste und günstigste API für Hermes Agent

Dies sind unterschiedliche Aussagen und sollten getrennt bleiben. Der günstigste aufgeführte Preis ist eine Tatsache der Preisliste; die niedrigsten Kosten zum Abschließen der Aufgabe hängen von Wiederholungen, Kontextlänge und Cache-Treffern ab.

WegWann sie gewinntZuerst prüfen
Nous-Portal-AbonnementSie möchten Tools, Modelle und Hosting über ein gemeinsames Guthaben. Quick Setup bezeichnet dies als empfohlenen schnellen WegGuthaben, kein Rabatt pro Token. Das Tool Gateway ist eine Funktion kostenpflichtiger Tarife
Direkter Vendor-API-KeyEine Modellfamilie, keine Zwischenebene, zuerst die Funktionen des VendorsVerbraucher-Chat-Tarife funktionieren größtenteils nicht: Claude Pro kann Hermes überhaupt nicht steuern, Claude Max benötigt gekaufte Guthaben für zusätzliche Nutzung, und für Google-Verbraucherpläne gibt es keinen dokumentierten Weg
Ein OpenAI-kompatibler Gateway eines DrittanbietersSie möchten einen bestimmten Modellsatz zu einem aufgeführten Preis unter einem SchlüsselSetzen Sie transport ausdrücklich und aktivieren Sie Prompt-Caching für jedes Modell; beides wird nicht automatisch abgeleitet
Kostenlose Portal-ModelleErkundung und Arbeit, die Unterbrechungen toleriertAuf die als kostenlos markierten Modelle beschränkt; diese Liste wird aus dem Live-Katalog neu erstellt
Lokale InferenzSie betreiben bereits geeignete HardwareLaut FAQ kostenlos ausführbar, doch die Qualität des Tool-Callings ist ein Problem des Serving-Stacks, nicht von Hermes

Hermes dokumentiert, dass jeder Dienst mit einer OpenAI-kompatiblen API funktioniert, und seine Provider-Referenz enthält sogar Anleitungen für konkurrierende Gateways. Der Weg über einen benutzerdefinierten Endpunkt ist daher ein gleichwertiger Weg und kein Behelf. Kunavo ist enger gefasst als „am günstigsten“: Sein Katalog umfasst Claude- und GPT-Klassenmodelle sowie Medienmodelle, aber nicht die Open-Weight-Modelle, die die beobachtete Hermes-Nutzung dominieren. Wenn Ihr Setup bereits auf diesen läuft, ist Kunavo nicht der günstigere Weg. Es ist der Weg, um Claude- oder GPT-Hauptrunden zu einem aufgeführten Preis unter einem Schlüssel zu halten.

Dasselbe Modell, dieselben Token, zwei Preislisten

USD pro Million standardmäßiger, nicht gecachter Input- und Output-Tokens. Anthropics direkte Preise stammen von der eigenen Preisseite, geprüft am 21. September 2026; die Kunavo-Spalte liest den Live-Katalog.

ModellAnthropic direkt: Input / OutputKunavo: Eingabe / AusgabeVorgesehene Hermes-Rolle
Claude Haiku 4.5$1.00 / $5.00$0.70 / $3.50Zusätzliche Slots und Delegations-Arbeitsmodelle
Claude Sonnet 5$2.00 / $10.00$1.40 / $7.00Hauptrunde mit Tool-Calling
Claude Opus 5$5.00 / $25.00$3.50 / $17.50Schwierige Aufgaben und Eskalation

Nun zur Berechnung. Nehmen wir einen Monat mit 20 Millionen nicht gecachten Input-Tokens und 2 Millionen Output-Tokens, gezählt über Hauptrunden, zusätzliche Slots und Delegations-Arbeitsmodelle zusammen — genau diese kombinierte Anzahl ist entscheidend, weil eine Schätzung pro Runde zwei der drei Bereiche verfehlt.

Routing-AnnahmeKatalogschätzung
Alles auf Claude Sonnet 5$42.00
Hauptrunden auf Claude Sonnet 5 (4M Input / 0.6M Output); zusätzliche Slots und Delegations-Arbeitsmodelle auf Claude Haiku 4.5 (16M Input / 1.4M Output)$25.90
Alles auf Claude Sonnet 5, aber 16M des Inputs kommen als Cache-Lesevorgänge zu $0.14 pro Million$21.84

Dies ist Tokenberechnung zu Katalogpreisen, keine gemessene Hermes-Aufgabe und keine Abrechnungshöchstgrenze. Cache-Schreibvorgänge sind ausgeschlossen — Claude-Cache-Schreibvorgänge werden hier mit dem 1,25-Fachen des Inputpreises berechnet, wie in der Caching-Dokumentation erläutert — ebenso kostenpflichtige Tools, Hosting und Steuern. Außerdem wird angenommen, dass das günstigere Modell seine zugewiesene Arbeit ohne zusätzliche Versuche abschließt. Diese Annahme und nicht der Preis entscheidet, ob die günstigere Zeile tatsächlich günstiger ist; Kostenoptimierung beschreibt, wie Sie dies testen.

Der Katalogbetrag von Kunavo ist ein Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Kosten meldet, wird der höhere Betrag aus Katalogkosten und Upstream-Kosten multipliziert mit dem geltenden Aufschlag berechnet. Das Minimum ist eine vorausbezahlte Aufladung von $10 ohne Abonnement — das für die Eröffnung eines finanzierten Kontos erforderliche Geld, nicht die Kosten einer Aufgabe. Siehe Abrechnung.

Einen Drittanbieter-Endpunkt in Hermes einbinden

Diese Konfiguration stammt aus der eigenen Provider-Referenz von Hermes, die am 21. September 2026 anhand der Quelldokumente geprüft wurde. Es wurde kein Hermes-Lauf gegen Kunavo durchgeführt, es gibt keine Kunavo-Einrichtungsanleitung für Hermes, und nichts Folgendes sollte als getestete Integration verstanden werden. Halten Sie Ihren bisherigen Arbeitsweg verfügbar, während Sie es ausprobieren.

Ein Ausgangspunkt aus der Provider-Dokumentation von Hermes
# ~/.hermes/config.yaml
providers:
  kunavo:
    api: https://api.kunavo.com/v1
    key_env: KUNAVO_API_KEY
    transport: chat_completions   # set it; do not rely on URL auto-detection
    models:
      claude-sonnet-5:
        prompt_caching: true

model:
  default: claude-sonnet-5
  provider: custom:kunavo
~/.hermes/.env
KUNAVO_API_KEY=your-key

Fünf Dinge, die ein benutzerdefinierter Endpunkt nicht automatisch erledigt und die jeweils dokumentierte Kosten verursachen:

  1. Setze transport ausdrücklich. Wenn das Feld leer bleibt, greift die URL-basierte automatische Erkennung, die in der Provider-Referenz als Fallback für ein leeres Feld beschrieben und anhand genau einer Regel veranschaulicht wird — ein /anthropic-Pfad wird zu anthropic_messages aufgelöst. Der übrige Teil dieser Heuristik wird auf keiner der hier gelesenen Seiten aufgelistet. Deshalb sollte der Transport benannt werden, statt anzunehmen, dass nichts ausgelöst wird. Hermes' eigener Regressionstest für diesen Pfad dokumentiert den Fehlerfall, den er absichert: Ein openai-api-Eintrag, der auf einen regionalen OpenAI-Host verwies, wurde stillschweigend zu chat_completions statt zu dem vom Provider selbst angegebenen Transport aufgelöst, und jeder Tool-Aufruf-Zyklus gab 400 zurück. Kunavo stellt /v1/chat/completions, /v1/messages und /v1/responses bereit, sodass alle drei dokumentierten Transporte auf dem Papier einen passenden Endpunkt haben — eine Übereinstimmung auf Dokumentationsebene, nicht eine getestete. Benenne den gewünschten Transport, statt die Erkennung wählen zu lassen.
  2. Aktiviere Prompt-Caching für jedes Modell. Bei einem Gateway, das einen einfachen Modellalias auflöst, müssen Cache-Markierungen pro Modell angegeben werden; Hermes erklärt, dass die Cache-Unterstützung nicht anhand des Providernamens, Hosts oder der Modellfamilie abgeleitet wird. Wenn dies fehlt, wird der Tarif für zwischengespeicherte Eingaben stillschweigend nicht genutzt — der größte Hebel in einer langen Sitzung. Siehe Prompt-Caching.
  3. Setze context_length, wenn der Standardwert falsch ist. Benutzerdefinierte OpenAI-kompatible Endpunkte erhalten keine automatische, katalogbasierte Ausgabebegrenzung — es gelten die Standardwerte des Servers, die niedriger als das Modellmaximum sein können. Das Kontextfenster wird über eine Kette aufgelöst, die bei models.dev endet, gefolgt von einem Fallback auf 128K.
  4. Verstehe, was extra_headers abdeckt. Die Modellkonfigurationsseite wendet es auf OpenAI-kompatible Routen und auf anthropic_messages-Routen an — gleichermaßen auf den Hauptclient, Modellwechsel über /model, Neuaufbauten und zusätzliche Clients — und nennt bedrock_converse als den einzigen Modus, der es nicht verwendet. Zu codex_responses macht sie keine Aussage, daher sollte diese Kombination als ungetestet betrachtet werden. Beim Anthropic-Protokoll verweist das Beispiel in der Provider-Dokumentation bei api auf einen Pfad, ohne das von Hermes angehängte Suffix anzugeben. Prüfe daher beim ersten Aufruf den aufgezeichneten Request-Pfad — die Dokumentation zur Basis-URL behandelt dort die Verwechslung zwischen dem URL-Ursprung und /v1, die hinter den meisten 404-Fehlern steckt.
  5. Verwende hermes model, um einen Provider hinzuzufügen. /model während einer Sitzung wechselt zwischen bereits konfigurierten Endpunkten und kann keinen neuen hinzufügen — außerdem verwirft dieser Wechsel den Cache.

Führe für einen ersten Test eine begrenzte Aufgabe mit einem echten Tool-Aufruf aus und lies anschließend /usage sowie die Aufschlüsselung im Dashboard, bevor du geplante Arbeit verlegst. Kunavo-Konto erstellen, sobald du bereit bist, diese Route mit einem aufgeladenen Schlüssel zu testen. Du wählst noch zwischen den Agents statt zwischen ihren Providern? Hermes vs. OpenClaw vergleicht die beiden Workflows.

Häufig gestellte Fragen

Wie viel kostet Hermes Agent?

Die Hermes-Agent-Software kostet nichts: Sie ist Open Source unter der MIT-Lizenz, und die eigene FAQ besagt, dass Sie nur für die LLM-API-Nutzung Ihres gewählten Providers zahlen. Optionale kostenpflichtige Bestandteile sind ein Nous-Portal-Abonnement für $0, $20, $100 oder $200 pro Monat, Hermes-Cloud-Hosting ab $0.56 pro Tag für eine laufende Medium-Instanz sowie die Nutzung des Nous Tool Gateway, die in der Dokumentation als Funktion eines kostenpflichtigen Abonnements beschrieben wird — einige Konten erhalten stattdessen ein kleines kostenloses Tool-Kontingent —, wobei keine Preisliste pro Nutzung veröffentlicht ist. Die Preise wurden am 21. September 2026 auf den Nous-Seiten geprüft.

Welches Modell sollte ich in Hermes Agent verwenden?

Nous liefert bewusst einen kostengünstigen Standard: Das auf den 20. September 2026 datierte und am folgenden Tag gelesene Remote-Model-Manifest weist z-ai/glm-5.2 als Standardmodell aus, und die Katalogdokumentation besagt, dass der Standard als leistungsfähiges, kostengünstiges Modell und nicht als teuerstes Spitzenmodell ausgewählt wird. Die Integrationsseite des Nous-Portals führt Claude Sonnet 4.6 separat als agentisches Allzweckmodell auf, außerdem GPT-5.5 Pro, eine Vorschauversion von Gemini 3 Pro mit langem Kontext und DeepSeek V4 Pro als kostengünstiges Modell für Programmieraufgaben. Diese Textempfehlungen hinken dem Manifest und dem Live-Katalog hinterher; bestätigen Sie daher, dass die Modell-ID in Ihrem eigenen Konto aufgelöst wird. Kein Aufgaben-Benchmark stützt hier eine Qualitätsrangfolge.

Welche API ist für Hermes Agent am günstigsten?

Der günstigste aufgeführte Preis und die niedrigsten Kosten zum Abschließen einer Aufgabe sind unterschiedliche Fragen. Ein kostenloses Nous-Portal-Modell hat einen Tokenpreis von null, ist aber auf die als kostenlos markierten Modelle beschränkt; diese Liste wird aus dem Live-Katalog neu erstellt und ist nicht fest. Ein lokales Modell kann kostenlos ausgeführt werden, sobald Sie die Hardware besitzen. Unter den kostenpflichtigen Einträgen im eigenen Portal-Katalog am 21. September 2026 lagen die niedrigsten Preise bei Open-Weight-Modellen und nicht bei den Spitzenmodellen der Labore — ein Modell, das in einer Tool-Calling-Schleife scheitert und Wiederholungen benötigt, kann jedoch mehr kosten als ein teureres Modell, das die Aufgabe abschließt. Messen Sie mit dem eigenen /usage und den Dashboard-Analysen des Agents, statt nur anhand einer Preisliste zu entscheiden.

Kann ich mein Claude-Pro- oder Claude-Max-Abonnement mit Hermes Agent verwenden?

Claude Pro kann Hermes Agent überhaupt nicht steuern: Die Hermes-Provider-Dokumentation besagt, dass Pro-Abonnenten den OAuth-Pfad nicht verwenden können, und verweist stattdessen auf einen ANTHROPIC_API_KEY. Claude Max funktioniert nur mit gekauften Guthaben für zusätzliche Nutzung; sämtliche Hermes-Nutzung wird als zusätzliche Nutzung abgerechnet, während das enthaltene Max-Kontingent unberührt bleibt. Für Google-Verbraucherpläne gibt es keinen dokumentierten Weg, und xAI OAuth kann je nach Abonnementstufe HTTP 403 zurückgeben. Der normale Weg ist der API-Zugriff mit Zahlung pro Token.

Sind Hermes-4-Modelle dasselbe wie Hermes Agent?

Nein. Hermes 3 und Hermes 4 sind die Open-Weight-LLM-Familie von Nous Research, veröffentlicht als Hermes-4-405B, Hermes-4-70B und Hermes-4-14B auf Hugging Face. Hermes Agent ist die unter der MIT-Lizenz stehende Agent-Software. Nous rät ausdrücklich davon ab, Hermes 4 in Hermes Agent auszuführen, da es auf Chat und Schlussfolgerungen statt auf die schnelle Tool-Calling-Schleife abgestimmt ist, auf die der Agent angewiesen ist.

Gibt ein Nous-Portal-Abonnement einen Rabatt auf Claude-Modelle?

Nicht beim Tokenpreis. Im am 21. September 2026 gelesenen Portal-Katalog wiesen die Claude-Einträge keine Reduzierung gegenüber den von Anthropic veröffentlichten Preisen auf: Sonnet mit $2.00 Input und $10.00 Output pro Million Tokens, Opus 5 mit $5.00 und $25.00, Haiku mit $1.00 und $5.00, Fable 5.1 mit $10.00 und $50.00. Ein kostenpflichtiger Tarif bietet stattdessen einen Guthabenbonus von 10 Prozent, gebündelte Tool-Gateway-Nutzung und höhere Anfragegrenzen. Der eigene Portaltext verspricht kostenlose Optionen und Portal-exklusive Rabatte, doch der Katalog zeigt pro Eintrag nur einen Preis ohne danebenstehenden Referenzpreis; welche Einträge rabattiert sind, lässt sich auf der öffentlichen Seite daher nicht prüfen.

Die Seiten von Nous Research und Anthropic wurden am 21. September 2026 geprüft; der Repository-Stand und die neueste Veröffentlichung wurden am selben Tag anhand der GitHub API verifiziert. Die Kunavo-Tarife und alle oben genannten Summen werden aus dem Live-Modellkatalog berechnet und sind illustrative Schätzungen. Die Hermes-Konfiguration stammt aus Quelldokumenten, nicht aus einem Laufzeittest.