Die Installation von Hermes Agent kostet $0: Die Software ist Open Source unter der MIT-Lizenz, und die einzige unvermeidbare Rechnung betrifft Modell-Token. Alles andere ist optional und wird separat berechnet: ein Nous-Portal-Abonnement für $0, $20, $100 oder $200 pro Monat, Hermes-Cloud-Hosting ab $0.56 pro Tag sowie die Tool-Gateway-Nutzung, eine Funktion kostenpflichtiger Abonnements, für die kein Preis pro Nutzung veröffentlicht ist.
Auf dieser Seite geht es um Hermes Agent, den Open-Source-Agenten von Nous Research. Eine Live-Prüfung des Repositorys am 21. September 2026 ergab archived: false, eine MIT-Lizenz und einen Push am selben Tag; die neueste veröffentlichte Version ist Hermes Agent v0.21.3, gekennzeichnet durch v2026.9.14 am 14. September 2026. Es handelt sich nicht um Hermes 3 oder Hermes 4, die Open-Weight-Modellfamilie von Nous, und auch nicht um die gleichnamige Luxusgütermarke.
Vier getrennte Rechnungen, von denen nur eine verpflichtend ist
| Was Sie kaufen | Veröffentlichter Preis | Wo dies angegeben ist |
|---|---|---|
| Hermes-Agent-Software: CLI, Terminal-UI, Desktop, Messaging-Gateway | $0, MIT-lizenziert | Hermes-FAQ: Sie zahlen nur für die LLM-API-Nutzung Ihres gewählten Providers |
| Modell-Tokens | Was auch immer Ihr gewählter Provider berechnet | Die eigene Preisliste Ihres Providers |
| Nous-Portal-Abonnement (optional) | $0 / $20 / $100 / $200 pro Monat | Portal-Tarife |
| Nous Tool Gateway: Websuche, Bildgenerierung, TTS, Cloud-Browser | Eine Funktion kostenpflichtiger Abonnements; Abrechnung nach Nutzung innerhalb des Abonnements. Kein Preis pro Nutzung veröffentlicht. In derselben Dokumentation wird darauf hingewiesen, dass einige Konten stattdessen Anspruch auf ein kleines kostenloses Tool-Kontingent haben | Tool-Gateway-Dokumentation |
| Hermes-Cloud-Hosting (optional) | Medium $0.56/Tag im Betrieb, $0.03/Tag gestoppt; Large $1.09/Tag im Betrieb, $0.03/Tag gestoppt; zum Bereitstellen sind mindestens $2 Guthaben oder ein aktives Abonnement erforderlich | Hermes Cloud |
| Hermes Business / Enterprise | Kein Preis veröffentlicht. Beide sind in der Fußzeile des Portals verlinkt; keine der beiden Seiten antwortete am 21. September 2026 auf einen einfachen HTTP-Client, daher sind ihre Bedingungen hier nicht verifiziert | Business-Seite |
Hermes Cloud berechnet die Instanz täglich nachträglich, und auf der eigenen Seite steht, dass Inferenz- und Tool-Nutzung zusätzlich zum Instanzpreis separat abgerechnet werden. Ein Hosting-Angebot ist daher niemals die gesamte Rechnung. Lokale Modelle können laut derselben FAQ vollständig kostenlos ausgeführt werden, sobald Sie die Hardware besitzen. Alle Angaben wurden am 21. September 2026 geprüft. Dieselbe Aufschlüsselung in vier Rechnungen für einen anderen Agenten finden Sie unter OpenClaw-Preise.
Nous-Portal-Tarife: Sie kaufen Guthaben, keinen Tokenrabatt
| Stufe | Monatlicher Preis | Monatliches Guthaben | Übertragungslimit |
|---|---|---|---|
| Kostenlos | $0 | $0 — nur kostenlose Modelle, standardmäßige Ratenlimits | — |
| Plus | $20 | $22 (ein Bonus von 10 Prozent), gehostete Tool-Nutzung, hohe Ratenlimits | $10 |
| Super | $100 | $110 | $50 |
| Ultra | $200 | $220 | $100 |
| Einmalige Aufladung | +$10 / +$20 / +$50 / +$100 / +$200 oder ein beliebiger Betrag | Über Stripe bezahlt | — |
Das Guthaben ist das Produkt. Ein Abonnement für $20 kauft $22 an Modellausgaben; sein Vorteil gegenüber der Abrechnung pro Token ist daher der Bonus zusammen mit den gebündelten Tools und Limits — nicht ein günstigerer Preis für jedes Modell. Im öffentlichen Katalog vom 21. September 2026 wiesen die Claude-Einträge die von Anthropic veröffentlichten Preise auf — Opus 5 mit $5.00 Input / $25.00 Output, Fable 5.1 mit $10.00 / $50.00 — ohne erkennbare Reduzierung. Ob etwas anderes rabattiert ist, lässt sich auf dieser Seite nicht prüfen: Sie zeigt pro Eintrag einen Preis und keinen Referenzpreis daneben. Sie zeigt jedoch, dass ein Modell mehrfach zu unterschiedlichen Preisen erscheinen kann, weil regionale und Batch-Varianten als separate Einträge aufgeführt werden — Kimi K3 mit $1.70 / $8.50, sein :US-Eintrag mit $3.63 / $18.15, sein Batch-Eintrag mit $3.00 / $15.00. Kalkulieren Sie anhand der exakten Eintrags-ID, die Sie aufrufen werden, und versehen Sie zitierte Angaben mit einem Datum.
Drei Vorbehalte, bevor Sie budgetieren. Der kostenlose Tarif ist real, aber auf die Einträge beschränkt, deren Modell-ID das Suffix :free trägt — bei der Abfrage vom 21. September 2026 waren es sieben —, und diese Liste wird aus dem Live-Katalog neu erstellt; Empfehlungen wie „verwende das kostenlose Modell“ veralten daher schnell. Die eigenen Portaloberflächen nennen zwei unterschiedliche runde Zahlen für die Kataloggröße — eine kleinere auf jeder Karte eines kostenpflichtigen Tarifs, eine größere im Abschnitt über dem Katalog selbst —, während die veröffentlichte Liste bei dieser Abfrage 360 Einträge enthielt; behandeln Sie daher jede dieser Zahlen als Marketing und nicht als Budgetgrundlage. Auf den Tarifkarten erscheinen ebenfalls keine Zahlen für die Anfragerate; dort stehen nur „standardmäßige“ und „hohe“ Ratenlimits. Betrachten Sie die Nebenläufigkeit daher als unbestätigt, bis Sie sie in Ihrem eigenen Konto sehen. Die Tariftabelle befindet sich auf der Portal-Startseite und unter manage-subscription, wo ein einfacher HTTP-Client statt der Seite einen Vercel-Sicherheitscheck erhält — lesen Sie sie in einem Browser.
Wohin die Token tatsächlich fließen
Eine Preisliste bepreist einen Aufruf. Hermes berechnet eine Arbeitslast, und dazwischen liegen drei dokumentierte Multiplikatoren.
Zusätzliche Slots. Das Dashboard stellt 11 zusätzliche Aufgaben-Slots bereit — Titelerstellung, Vision, Komprimierung, Genehmigung, Web-Extraktion, Skills-Hub, MCP-Routing und weitere —, und jeder verwendet standardmäßig auto, was bedeutet, dass Hermes auch für diese Aufgabe Ihr Hauptmodell verwendet. Das eigene Dokumentationsbeispiel für Verschwendung ist die Komprimierung: Ein schnelles Chatmodell erledigt diese Aufgabe zu einem Fünfzigstel der Kosten eines Schlussfolgerungsmodells. Eine einzelne Benutzerrunde kann daher aus mehreren abgerechneten Aufrufen bestehen.
Delegation. Die Delegationsdokumentation besagt, dass ein paralleler Batch von Subagenten typischerweise den Großteil der Gesamttoken eines Laufs verbraucht; deshalb ist das Arbeitsmodell separat als delegation.model konfigurierbar. Der eigene Kostenhinweis besagt, dass max_spawn_depth: 3 zusammen mit max_concurrent_children: 3 bis zu 27 gleichzeitig laufende Blattagenten ergeben kann; die Standardtiefe beträgt 1.
Cache-Kontinuität. Dieselbe Modellkonfigurationsseite weist darauf hin, dass Prompt-Caches an das Modell gebunden sind, das die Anfrage verarbeitet. Jeder Modellwechsel mitten im Gespräch — ein expliziter Wechsel mit /model, ein automatischer Fallback oder eine Rotation des Anmeldedatenpools auf ein anderes Konto — führt dazu, dass die nächste Nachricht das gesamte Gespräch zum vollständigen Inputpreis erneut liest, statt zum Cachepreis, der dort mit ungefähr 75 bis 90 Prozent Rabatt angegeben wird. Eine standardmäßige Schutzmaßnahme, model.switch_context_confirm_tokens: 100000, existiert genau deshalb, weil dieses einmalige erneute Lesen den Tokenpreisunterschied zwischen den beiden Modellen übersteigen kann.
Bei geplanten Aufgaben wirkt sich dies am stärksten aus, und zwar nicht in der erhofften Richtung: Die Cron-Dokumentation besagt, dass ein Job ohne eigenes Modell mit dem Modell läuft, auf das hermes model oder /model zum Zeitpunkt seiner Ausführung gesetzt ist. Wenn Sie Ihr Chatmodell ändern, verschiebt sich beim nächsten Lauf daher die gesamte Cron-Flotte mit. Fixieren Sie den Job (hermes cron create/edit --pin, oder ausdrücklich --model / --provider) oder legen Sie mit cron.model einen Flottenstandard fest, wenn ein unbeaufsichtigter Job einem Wechsel nicht folgen darf. Nur-Skript-Jobs — der Modus no_agent aus der Dokumentation — greifen niemals auf die Inferenzebene zu. Statt dies zu schätzen, messen Sie es: Die FAQ dokumentiert /usage, /compress und hermes prompt-size, und das Web-Dashboard dokumentiert eine Analyseansicht mit Gesamttoken, Cache-Trefferquote und Aufschlüsselung nach Modell.
Das Modell für jede Aufgabe auswählen
Kein Benchmark auf dieser Seite stützt eine Qualitätsrangfolge; dies ist daher eine Tabelle dessen, was die jeweilige Auswahl bestimmt, keine Bestenliste.
| Aufgabe | Was tatsächlich entscheidet |
|---|---|
| Hauptrunde (die Tool-Calling-Schleife) | Zuverlässige Tool-Aufrufe und ausreichend Kontext. Ein Modell, das gut konversiert, aber Tools schlecht aufruft, verursacht durch Wiederholungen höhere Kosten, als sein Preis vermuten lässt |
| Komprimierung, Titel, Bewertung von Genehmigungen, Web-Extraktion | Das günstigste leistungsfähige Chatmodell. Die Dokumentation bezeichnet Schlussfolgerungsmodelle hier als Verschwendung |
| Delegations-Arbeitsmodelle | Wo das Volumen anfällt. Setzen Sie delegation.model ausdrücklich, statt das Hauptmodell zu übernehmen |
| Bildverständnis | Geben Sie model.supports_vision: true an, wenn sich das Modell nicht in models.dev befindet oder Bilder vorverarbeitet statt nativ weitergeleitet werden |
| Unbeaufsichtigte Cron-Jobs | Ein nicht fixierter Job läuft mit dem Hauptmodell, wie es bei seiner Ausführung eingestellt ist; fixieren Sie ihn daher oder setzen Sie cron.model. Halten Sie das Toolset klein — ein großes Tool-Schema vergrößert den Prompt bei jedem Aufruf |
Zwei offizielle Positionen sind wissenswert. Nous liefert einen kostengünstigen Standard: Das auf den 20. September 2026 datierte und am folgenden Tag gelesene Remote-Model-Manifest markiert z-ai/glm-5.2 als Standard, und die Katalogdokumentation besagt, dass der Standard bewusst ein leistungsfähiges, kostengünstiges Modell und niemals das teuerste Spitzenmodell ist. Nous rät außerdem davon ab, die eigenen Gewichte im Agenten zu verwenden: Die Portal-Integrationsseite sagt, Hermes 4 werde für die Verwendung innerhalb von Hermes Agent nicht empfohlen, da es auf Chat und Schlussfolgerungen statt auf die schnelle Tool-Calling-Schleife abgestimmt ist. Die Auswahlliste dieser Seite — Claude Sonnet 4.6 als agentisches Allzweckmodell, GPT-5.5 Pro, eine Vorschauversion von Gemini 3 Pro mit langem Kontext und DeepSeek V4 Pro als kostengünstiges Modell für Programmieraufgaben — hinkt sowohl dem Manifest als auch dem Live-Katalog hinterher. Betrachten Sie sie daher als Ausgangspunkt und bestätigen Sie, dass die Modell-ID aufgelöst wird.
Die beobachtete Nutzung ist ebenfalls keine Rangliste. Die am 21. September 2026 gelesene öffentliche App-Seite von OpenRouter für Hermes Agent zeigte beim 30-Tage-Tokenvolumen MiniMax M3 an der Spitze, einen unbeschrifteten Eintrag namens Ox Alpha, Ling 3.0 Flash Fin, GPT-4o-mini und zwei DeepSeek-V4-Flash-Versionen — günstige, schnelle Modelle statt Spitzenmodelle. Dies zeigt, was Menschen über einen Gateway ausgeführt haben, nicht, was bei Ihrer Aufgabe am besten funktioniert hat.
„Hermes-Modelle“ sind zwei verschiedene Fragen
Die eine Frage ist, auf welches Modell der Agent zeigen soll; sie wurde oben beantwortet. Die andere betrifft die Hermes-4-Open-Weight-Familie — Hermes-4-405B, -70B und -14B auf Hugging Face, mit Hermes 3, verteilt über Ollama. Dies sind Modellgewichte desselben Unternehmens, nicht der Agent, und Nous sagt, Hermes 4 nicht darin auszuführen. Eine Aussage hier ist unverifiziert: Die Portal-Integrationsdokumentation besagt, Hermes-4-Modelle seien im Portal zu stark rabattierten Preisen verfügbar, doch eine Suche nach „hermes“ und „nous“ im öffentlichen Live-Katalog lieferte am 21. September 2026 keine passenden Zeilen. Entweder sind sie nur nach der Anmeldung sichtbar oder die Dokumentation ist veraltet. Kalkulieren Sie nicht mit einem Hermes-4-Portalpreis, den Sie in Ihrem eigenen Konto nicht sehen können.
Beste und günstigste API für Hermes Agent
Dies sind unterschiedliche Aussagen und sollten getrennt bleiben. Der günstigste aufgeführte Preis ist eine Tatsache der Preisliste; die niedrigsten Kosten zum Abschließen der Aufgabe hängen von Wiederholungen, Kontextlänge und Cache-Treffern ab.
| Weg | Wann sie gewinnt | Zuerst prüfen |
|---|---|---|
| Nous-Portal-Abonnement | Sie möchten Tools, Modelle und Hosting über ein gemeinsames Guthaben. Quick Setup bezeichnet dies als empfohlenen schnellen Weg | Guthaben, kein Rabatt pro Token. Das Tool Gateway ist eine Funktion kostenpflichtiger Tarife |
| Direkter Vendor-API-Key | Eine Modellfamilie, keine Zwischenebene, zuerst die Funktionen des Vendors | Verbraucher-Chat-Tarife funktionieren größtenteils nicht: Claude Pro kann Hermes überhaupt nicht steuern, Claude Max benötigt gekaufte Guthaben für zusätzliche Nutzung, und für Google-Verbraucherpläne gibt es keinen dokumentierten Weg |
| Ein OpenAI-kompatibler Gateway eines Drittanbieters | Sie möchten einen bestimmten Modellsatz zu einem aufgeführten Preis unter einem Schlüssel | Setzen Sie transport ausdrücklich und aktivieren Sie Prompt-Caching für jedes Modell; beides wird nicht automatisch abgeleitet |
| Kostenlose Portal-Modelle | Erkundung und Arbeit, die Unterbrechungen toleriert | Auf die als kostenlos markierten Modelle beschränkt; diese Liste wird aus dem Live-Katalog neu erstellt |
| Lokale Inferenz | Sie betreiben bereits geeignete Hardware | Laut FAQ kostenlos ausführbar, doch die Qualität des Tool-Callings ist ein Problem des Serving-Stacks, nicht von Hermes |
Hermes dokumentiert, dass jeder Dienst mit einer OpenAI-kompatiblen API funktioniert, und seine Provider-Referenz enthält sogar Anleitungen für konkurrierende Gateways. Der Weg über einen benutzerdefinierten Endpunkt ist daher ein gleichwertiger Weg und kein Behelf. Kunavo ist enger gefasst als „am günstigsten“: Sein Katalog umfasst Claude- und GPT-Klassenmodelle sowie Medienmodelle, aber nicht die Open-Weight-Modelle, die die beobachtete Hermes-Nutzung dominieren. Wenn Ihr Setup bereits auf diesen läuft, ist Kunavo nicht der günstigere Weg. Es ist der Weg, um Claude- oder GPT-Hauptrunden zu einem aufgeführten Preis unter einem Schlüssel zu halten.
Dasselbe Modell, dieselben Token, zwei Preislisten
USD pro Million standardmäßiger, nicht gecachter Input- und Output-Tokens. Anthropics direkte Preise stammen von der eigenen Preisseite, geprüft am 21. September 2026; die Kunavo-Spalte liest den Live-Katalog.
| Modell | Anthropic direkt: Input / Output | Kunavo: Eingabe / Ausgabe | Vorgesehene Hermes-Rolle |
|---|---|---|---|
| Claude Haiku 4.5 | $1.00 / $5.00 | $0.70 / $3.50 | Zusätzliche Slots und Delegations-Arbeitsmodelle |
| Claude Sonnet 5 | $2.00 / $10.00 | $1.40 / $7.00 | Hauptrunde mit Tool-Calling |
| Claude Opus 5 | $5.00 / $25.00 | $3.50 / $17.50 | Schwierige Aufgaben und Eskalation |
Nun zur Berechnung. Nehmen wir einen Monat mit 20 Millionen nicht gecachten Input-Tokens und 2 Millionen Output-Tokens, gezählt über Hauptrunden, zusätzliche Slots und Delegations-Arbeitsmodelle zusammen — genau diese kombinierte Anzahl ist entscheidend, weil eine Schätzung pro Runde zwei der drei Bereiche verfehlt.
| Routing-Annahme | Katalogschätzung |
|---|---|
| Alles auf Claude Sonnet 5 | $42.00 |
| Hauptrunden auf Claude Sonnet 5 (4M Input / 0.6M Output); zusätzliche Slots und Delegations-Arbeitsmodelle auf Claude Haiku 4.5 (16M Input / 1.4M Output) | $25.90 |
| Alles auf Claude Sonnet 5, aber 16M des Inputs kommen als Cache-Lesevorgänge zu $0.14 pro Million | $21.84 |
Dies ist Tokenberechnung zu Katalogpreisen, keine gemessene Hermes-Aufgabe und keine Abrechnungshöchstgrenze. Cache-Schreibvorgänge sind ausgeschlossen — Claude-Cache-Schreibvorgänge werden hier mit dem 1,25-Fachen des Inputpreises berechnet, wie in der Caching-Dokumentation erläutert — ebenso kostenpflichtige Tools, Hosting und Steuern. Außerdem wird angenommen, dass das günstigere Modell seine zugewiesene Arbeit ohne zusätzliche Versuche abschließt. Diese Annahme und nicht der Preis entscheidet, ob die günstigere Zeile tatsächlich günstiger ist; Kostenoptimierung beschreibt, wie Sie dies testen.
Der Katalogbetrag von Kunavo ist ein Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Kosten meldet, wird der höhere Betrag aus Katalogkosten und Upstream-Kosten multipliziert mit dem geltenden Aufschlag berechnet. Das Minimum ist eine vorausbezahlte Aufladung von $10 ohne Abonnement — das für die Eröffnung eines finanzierten Kontos erforderliche Geld, nicht die Kosten einer Aufgabe. Siehe Abrechnung.
Einen Drittanbieter-Endpunkt in Hermes einbinden
Diese Konfiguration stammt aus der eigenen Provider-Referenz von Hermes, die am 21. September 2026 anhand der Quelldokumente geprüft wurde. Es wurde kein Hermes-Lauf gegen Kunavo durchgeführt, es gibt keine Kunavo-Einrichtungsanleitung für Hermes, und nichts Folgendes sollte als getestete Integration verstanden werden. Halten Sie Ihren bisherigen Arbeitsweg verfügbar, während Sie es ausprobieren.
# ~/.hermes/config.yaml
providers:
kunavo:
api: https://api.kunavo.com/v1
key_env: KUNAVO_API_KEY
transport: chat_completions # set it; do not rely on URL auto-detection
models:
claude-sonnet-5:
prompt_caching: true
model:
default: claude-sonnet-5
provider: custom:kunavoKUNAVO_API_KEY=your-keyFünf Dinge, die ein benutzerdefinierter Endpunkt nicht automatisch erledigt und die jeweils dokumentierte Kosten verursachen:
- Setze
transportausdrücklich. Wenn das Feld leer bleibt, greift die URL-basierte automatische Erkennung, die in der Provider-Referenz als Fallback für ein leeres Feld beschrieben und anhand genau einer Regel veranschaulicht wird — ein/anthropic-Pfad wird zuanthropic_messagesaufgelöst. Der übrige Teil dieser Heuristik wird auf keiner der hier gelesenen Seiten aufgelistet. Deshalb sollte der Transport benannt werden, statt anzunehmen, dass nichts ausgelöst wird. Hermes' eigener Regressionstest für diesen Pfad dokumentiert den Fehlerfall, den er absichert: Einopenai-api-Eintrag, der auf einen regionalen OpenAI-Host verwies, wurde stillschweigend zuchat_completionsstatt zu dem vom Provider selbst angegebenen Transport aufgelöst, und jeder Tool-Aufruf-Zyklus gab 400 zurück. Kunavo stellt/v1/chat/completions,/v1/messagesund/v1/responsesbereit, sodass alle drei dokumentierten Transporte auf dem Papier einen passenden Endpunkt haben — eine Übereinstimmung auf Dokumentationsebene, nicht eine getestete. Benenne den gewünschten Transport, statt die Erkennung wählen zu lassen. - Aktiviere Prompt-Caching für jedes Modell. Bei einem Gateway, das einen einfachen Modellalias auflöst, müssen Cache-Markierungen pro Modell angegeben werden; Hermes erklärt, dass die Cache-Unterstützung nicht anhand des Providernamens, Hosts oder der Modellfamilie abgeleitet wird. Wenn dies fehlt, wird der Tarif für zwischengespeicherte Eingaben stillschweigend nicht genutzt — der größte Hebel in einer langen Sitzung. Siehe Prompt-Caching.
- Setze
context_length, wenn der Standardwert falsch ist. Benutzerdefinierte OpenAI-kompatible Endpunkte erhalten keine automatische, katalogbasierte Ausgabebegrenzung — es gelten die Standardwerte des Servers, die niedriger als das Modellmaximum sein können. Das Kontextfenster wird über eine Kette aufgelöst, die bei models.dev endet, gefolgt von einem Fallback auf 128K. - Verstehe, was
extra_headersabdeckt. Die Modellkonfigurationsseite wendet es auf OpenAI-kompatible Routen und aufanthropic_messages-Routen an — gleichermaßen auf den Hauptclient, Modellwechsel über/model, Neuaufbauten und zusätzliche Clients — und nenntbedrock_converseals den einzigen Modus, der es nicht verwendet. Zucodex_responsesmacht sie keine Aussage, daher sollte diese Kombination als ungetestet betrachtet werden. Beim Anthropic-Protokoll verweist das Beispiel in der Provider-Dokumentation beiapiauf einen Pfad, ohne das von Hermes angehängte Suffix anzugeben. Prüfe daher beim ersten Aufruf den aufgezeichneten Request-Pfad — die Dokumentation zur Basis-URL behandelt dort die Verwechslung zwischen dem URL-Ursprung und/v1, die hinter den meisten 404-Fehlern steckt. - Verwende
hermes model, um einen Provider hinzuzufügen./modelwährend einer Sitzung wechselt zwischen bereits konfigurierten Endpunkten und kann keinen neuen hinzufügen — außerdem verwirft dieser Wechsel den Cache.
Führe für einen ersten Test eine begrenzte Aufgabe mit einem echten Tool-Aufruf aus und lies anschließend /usage sowie die Aufschlüsselung im Dashboard, bevor du geplante Arbeit verlegst. Kunavo-Konto erstellen, sobald du bereit bist, diese Route mit einem aufgeladenen Schlüssel zu testen. Du wählst noch zwischen den Agents statt zwischen ihren Providern? Hermes vs. OpenClaw vergleicht die beiden Workflows.
Häufig gestellte Fragen
Wie viel kostet Hermes Agent?
Die Hermes-Agent-Software kostet nichts: Sie ist Open Source unter der MIT-Lizenz, und die eigene FAQ besagt, dass Sie nur für die LLM-API-Nutzung Ihres gewählten Providers zahlen. Optionale kostenpflichtige Bestandteile sind ein Nous-Portal-Abonnement für $0, $20, $100 oder $200 pro Monat, Hermes-Cloud-Hosting ab $0.56 pro Tag für eine laufende Medium-Instanz sowie die Nutzung des Nous Tool Gateway, die in der Dokumentation als Funktion eines kostenpflichtigen Abonnements beschrieben wird — einige Konten erhalten stattdessen ein kleines kostenloses Tool-Kontingent —, wobei keine Preisliste pro Nutzung veröffentlicht ist. Die Preise wurden am 21. September 2026 auf den Nous-Seiten geprüft.
Welches Modell sollte ich in Hermes Agent verwenden?
Nous liefert bewusst einen kostengünstigen Standard: Das auf den 20. September 2026 datierte und am folgenden Tag gelesene Remote-Model-Manifest weist z-ai/glm-5.2 als Standardmodell aus, und die Katalogdokumentation besagt, dass der Standard als leistungsfähiges, kostengünstiges Modell und nicht als teuerstes Spitzenmodell ausgewählt wird. Die Integrationsseite des Nous-Portals führt Claude Sonnet 4.6 separat als agentisches Allzweckmodell auf, außerdem GPT-5.5 Pro, eine Vorschauversion von Gemini 3 Pro mit langem Kontext und DeepSeek V4 Pro als kostengünstiges Modell für Programmieraufgaben. Diese Textempfehlungen hinken dem Manifest und dem Live-Katalog hinterher; bestätigen Sie daher, dass die Modell-ID in Ihrem eigenen Konto aufgelöst wird. Kein Aufgaben-Benchmark stützt hier eine Qualitätsrangfolge.
Welche API ist für Hermes Agent am günstigsten?
Der günstigste aufgeführte Preis und die niedrigsten Kosten zum Abschließen einer Aufgabe sind unterschiedliche Fragen. Ein kostenloses Nous-Portal-Modell hat einen Tokenpreis von null, ist aber auf die als kostenlos markierten Modelle beschränkt; diese Liste wird aus dem Live-Katalog neu erstellt und ist nicht fest. Ein lokales Modell kann kostenlos ausgeführt werden, sobald Sie die Hardware besitzen. Unter den kostenpflichtigen Einträgen im eigenen Portal-Katalog am 21. September 2026 lagen die niedrigsten Preise bei Open-Weight-Modellen und nicht bei den Spitzenmodellen der Labore — ein Modell, das in einer Tool-Calling-Schleife scheitert und Wiederholungen benötigt, kann jedoch mehr kosten als ein teureres Modell, das die Aufgabe abschließt. Messen Sie mit dem eigenen /usage und den Dashboard-Analysen des Agents, statt nur anhand einer Preisliste zu entscheiden.
Kann ich mein Claude-Pro- oder Claude-Max-Abonnement mit Hermes Agent verwenden?
Claude Pro kann Hermes Agent überhaupt nicht steuern: Die Hermes-Provider-Dokumentation besagt, dass Pro-Abonnenten den OAuth-Pfad nicht verwenden können, und verweist stattdessen auf einen ANTHROPIC_API_KEY. Claude Max funktioniert nur mit gekauften Guthaben für zusätzliche Nutzung; sämtliche Hermes-Nutzung wird als zusätzliche Nutzung abgerechnet, während das enthaltene Max-Kontingent unberührt bleibt. Für Google-Verbraucherpläne gibt es keinen dokumentierten Weg, und xAI OAuth kann je nach Abonnementstufe HTTP 403 zurückgeben. Der normale Weg ist der API-Zugriff mit Zahlung pro Token.
Sind Hermes-4-Modelle dasselbe wie Hermes Agent?
Nein. Hermes 3 und Hermes 4 sind die Open-Weight-LLM-Familie von Nous Research, veröffentlicht als Hermes-4-405B, Hermes-4-70B und Hermes-4-14B auf Hugging Face. Hermes Agent ist die unter der MIT-Lizenz stehende Agent-Software. Nous rät ausdrücklich davon ab, Hermes 4 in Hermes Agent auszuführen, da es auf Chat und Schlussfolgerungen statt auf die schnelle Tool-Calling-Schleife abgestimmt ist, auf die der Agent angewiesen ist.
Gibt ein Nous-Portal-Abonnement einen Rabatt auf Claude-Modelle?
Nicht beim Tokenpreis. Im am 21. September 2026 gelesenen Portal-Katalog wiesen die Claude-Einträge keine Reduzierung gegenüber den von Anthropic veröffentlichten Preisen auf: Sonnet mit $2.00 Input und $10.00 Output pro Million Tokens, Opus 5 mit $5.00 und $25.00, Haiku mit $1.00 und $5.00, Fable 5.1 mit $10.00 und $50.00. Ein kostenpflichtiger Tarif bietet stattdessen einen Guthabenbonus von 10 Prozent, gebündelte Tool-Gateway-Nutzung und höhere Anfragegrenzen. Der eigene Portaltext verspricht kostenlose Optionen und Portal-exklusive Rabatte, doch der Katalog zeigt pro Eintrag nur einen Preis ohne danebenstehenden Referenzpreis; welche Einträge rabattiert sind, lässt sich auf der öffentlichen Seite daher nicht prüfen.
Die Seiten von Nous Research und Anthropic wurden am 21. September 2026 geprüft; der Repository-Stand und die neueste Veröffentlichung wurden am selben Tag anhand der GitHub API verifiziert. Die Kunavo-Tarife und alle oben genannten Summen werden aus dem Live-Modellkatalog berechnet und sind illustrative Schätzungen. Die Hermes-Konfiguration stammt aus Quelldokumenten, nicht aus einem Laufzeittest.