Retour aux guides
Tarification·18 septembre 2026·Mis à jour le 30 septembre 2026·9 min de lecture

Tarification de Hermes Agent : ce que son exécution coûte réellement

Le logiciel coûte 0 $. Votre facture correspond aux tokens — et à trois multiplicateurs qu’aucune grille tarifaire ne chiffre.

Dernière vérification le .

Hermes Agent coûte 0 $ à installer : le logiciel est open source sous licence MIT et la seule facture inévitable concerne les tokens du modèle. Tout le reste est facultatif et tarifé séparément : un abonnement Nous Portal à 0 $, 20 $, 100 $ ou 200 $ par mois, l’hébergement Hermes Cloud à partir de 0,56 $ par jour, et l’utilisation de Tool Gateway, une fonctionnalité réservée aux abonnements payants qui ne publie aucun tarif à l’usage.

Cette page concerne Hermes Agent, l’agent open source de Nous Research. Une vérification en direct de du dépôt le 21 septembre 2026 a renvoyé archived: false, une licence MIT et une poussée effectuée le même jour ; la dernière release publiée est Hermes Agent v0.21.3, marquée v2026.9.14 le 14 septembre 2026. Il ne s’agit ni de Hermes 3 ni de Hermes 4, la famille de modèles à poids ouverts de Nous, ni de la marque de produits de luxe du même nom.

Quatre factures distinctes, dont une seule est obligatoire

Ce que vous achetezPrix publiéOù cela est indiqué
Logiciel Hermes Agent : CLI, interface terminal, Desktop, passerelle de messagerie0 $, sous licence MITFAQ Hermes : vous ne payez que l’utilisation de l’API LLM du fournisseur choisi
Jetons de modèleCe que facture votre fournisseur choisiLa propre grille tarifaire de votre fournisseur
Abonnement Nous Portal (facultatif)0 $ / 20 $ / 100 $ / 200 $ par moisFormules Portal
Nous Tool Gateway : recherche web, génération d’images, TTS, navigateur cloudFonctionnalité réservée aux abonnements payants ; paiement à l’usage dans le cadre de l’abonnement. Aucun tarif à l’usage publié. Le même document précise que certains comptes disposent plutôt d’un petit pool d’outils gratuitDocumentation Tool Gateway
Hébergement Hermes Cloud (facultatif)Medium : 0,56 $/jour en fonctionnement, 0,03 $/jour à l’arrêt ; Large : 1,09 $/jour en fonctionnement, 0,03 $/jour à l’arrêt ; 2 $ minimum de crédits, ou un abonnement actif, pour déployerHermes Cloud
Hermes Business / EnterpriseAucun prix publié. Les deux sont accessibles depuis le pied de page de Portal ; aucune des deux pages n’a répondu à un client HTTP simple le 21 septembre 2026, leurs conditions ne sont donc pas vérifiées iciPage Business

Hermes Cloud facture l’instance quotidiennement à terme échu, et sa propre page indique que l’inférence et l’utilisation des outils sont facturées séparément en plus du prix de l’instance. Un devis d’hébergement ne constitue donc jamais la facture complète. Les modèles locaux, selon la même FAQ, sont entièrement gratuits à exécuter une fois le matériel acheté. Tous les montants ont été vérifiés le 21 septembre 2026. La même ventilation en quatre factures appliquée à un autre agent figure dans les tarifs d’OpenClaw.

Formules Nous Portal : vous achetez des crédits, pas une réduction sur les tokens

NiveauPrix mensuelCrédits mensuelsPlafond de report
Gratuit$00 $ — modèles gratuits uniquement, limites de débit standard—
Plus$2022 $ (bonus de 10 %), utilisation des outils hébergés, limites de débit élevées$10
Super$100$110$50
Ultra$200$220$100
Recharge ponctuelle+10 $ / +20 $ / +50 $ / +100 $ / +200 $, ou un montant librePayé via Stripe—

Les crédits sont le produit. Un abonnement de 20 $ achète 22 $ de consommation de modèles ; son avantage par rapport au paiement au token est donc le bonus, ainsi que les outils et limites inclus — pas un tarif moins élevé pour chaque modèle. Dans le catalogue public consulté le 21 septembre 2026, les entrées Claude appliquaient les tarifs qu’Anthropic publie — Opus 5 à 5,00 $ en entrée / 25,00 $ en sortie, Fable 5.1 à 10,00 $ / 50,00 $ — sans réduction affichée. La page ne permet pas de vérifier si autre chose est remisé : elle affiche un tarif par entrée et aucun prix de référence à côté. Elle montre en revanche qu’un même modèle peut apparaître plusieurs fois à des tarifs différents, car les variantes régionales et batch sont répertoriées comme des entrées distinctes — Kimi K3 à 1,70 $ / 8,50 $, son entrée :US à 3,63 $ / 18,15 $, son entrée batch à 3,00 $ / 15,00 $. Établissez votre budget à partir de l’identifiant d’entrée exact que vous appellerez et datez toute citation de prix.

Trois réserves avant d’établir votre budget. Le niveau gratuit existe réellement, mais il est limité aux entrées dont l’identifiant de modèle porte le suffixe :free — sept d’entre elles lors de la consultation du 21 septembre 2026 — et cette liste est reconstruite à partir du catalogue en direct ; les conseils du type « utilisez le modèle gratuit » deviennent donc rapidement obsolètes. Les propres interfaces de Portal affichent deux valeurs arrondies différentes pour la taille du catalogue — une plus petite sur chaque carte de formule payante, une plus grande dans la section située au-dessus du catalogue lui-même — tandis que la liste publiée comptait 360 entrées lors de cette consultation ; considérez donc ces valeurs comme du marketing plutôt que comme une donnée budgétaire. Aucun chiffre de débit des requêtes n’apparaît non plus sur les cartes de formules ; elles indiquent seulement des limites « standard » et « élevées ». Considérez donc la concurrence comme non vérifiée jusqu’à l’avoir observée dans votre propre compte. Le tableau des formules se trouve sur la page d’accueil de Portal et sur manage-subscription, où un client HTTP simple obtient un contrôle de sécurité Vercel au lieu de la page — consultez-la dans un navigateur.

Où vont réellement les tokens

Une grille tarifaire fixe le prix d’un appel. Hermes facture une charge de travail, et trois multiplicateurs documentés s’interposent entre les deux.

Emplacements auxiliaires. Le tableau de bord expose 11 emplacements de tâches auxiliaires — génération de titres, vision, compression, approbation, extraction web, hub de compétences, routage MCP et autres — et chacun utilise par défaut auto, ce qui signifie qu’Hermes essaie également votre modèle principal pour cette tâche. L’exemple de gaspillage donné par la documentation concerne la compression : un modèle de chat rapide réalise cette tâche pour un cinquantième du coût d’un modèle de raisonnement. Un seul tour utilisateur peut donc correspondre à plusieurs appels facturés.

Délégation. La documentation de la délégation indique qu’un lot parallèle de sous-agents consomme généralement la grande majorité des tokens totaux d’une exécution, raison pour laquelle le modèle de travail est configurable séparément via delegation.model. Son avertissement de coût précise que max_spawn_depth: 3 avec max_concurrent_children: 3 peut atteindre 27 agents feuilles concurrents ; la profondeur par défaut est de 1.

Continuité du cache. La même page de configuration des modèles avertit que les caches de prompts sont associés au modèle qui traite la requête ; tout changement de modèle en cours de conversation — un basculement explicite via /model, un repli automatique ou une rotation du pool d’identifiants vers un autre compte — oblige le message suivant à relire toute la conversation au tarif d’entrée complet au lieu du tarif mis en cache, indiqué comme bénéficiant d’une réduction d’environ 75 à 90 %. Une protection par défaut, model.switch_context_confirm_tokens: 100000, existe précisément parce que cette relecture ponctuelle peut éclipser largement la différence par token entre les deux modèles.

Le travail planifié est l’endroit où cela fait le plus mal, et pas dans le sens que vous espéreriez : la documentation cron indique qu’une tâche sans modèle propre s’exécute avec ce que hermes model ou /model est défini au moment où elle se déclenche, de sorte que modifier votre modèle de chat déplace toute la flotte cron lors de son prochain lancement. Épinglez la tâche (hermes cron create/edit --pin, ou un --model / --provider explicite) ou définissez une valeur par défaut pour la flotte avec cron.model lorsqu’une tâche sans surveillance ne doit pas suivre un changement. Les tâches uniquement scriptées — le mode no_agent de la documentation — ne touchent jamais la couche d’inférence. Plutôt que d’estimer tout cela, mesurez-le : la FAQ documente /usage, /compress et hermes prompt-size, et le tableau de bord web documente une vue analytique avec le total des tokens, le pourcentage de cache utilisé et une ventilation par modèle.

Choisir le modèle pour chaque tâche

Aucun benchmark présenté ici ne permet d’établir un classement de qualité ; il s’agit donc d’un tableau indiquant ce qui détermine chaque choix, pas d’un classement.

FonctionCe qui le détermine réellement
Tour principal (boucle d’appels d’outils)Des appels d’outils fiables et suffisamment de contexte. Un modèle qui dialogue bien mais appelle mal les outils coûte plus cher en nouvelles tentatives que ne le laisse penser son tarif
Compression, titres, évaluation des approbations, extraction webLe modèle de chat capable le moins cher. La documentation qualifie ici les modèles de raisonnement de gaspillage
Workers de délégationLà où le volume se concentre. Définissez explicitement delegation.model au lieu d’hériter du modèle principal
VisionDéclarez model.supports_vision: true lorsque le modèle n’est pas présent dans models.dev, ou lorsque les images sont prétraitées au lieu d’être routées nativement
Tâches cron sans surveillanceUne tâche non épinglée s’exécute avec votre modèle principal tel qu’il est défini au moment de son déclenchement ; épinglez-la donc ou définissez cron.model. Gardez un ensemble d’outils réduit — un schéma d’outils volumineux gonfle le prompt à chaque appel

Deux positions officielles méritent d’être connues. Nous fournit un modèle par défaut peu coûteux : le manifeste distant des modèles, daté du 20 septembre 2026 et consulté le lendemain, indique z-ai/glm-5.2 comme modèle par défaut, et la documentation du catalogue précise que le modèle par défaut est volontairement performant et peu coûteux, jamais le produit phare le plus cher. Nous déconseille également d’utiliser ses propres poids dans l’agent : la page d’intégration de Portal indique que Hermes 4 n’est pas recommandé dans Hermes Agent, car il est optimisé pour le chat et le raisonnement plutôt que pour la boucle d’appels d’outils à cadence rapide. La sélection de cette page — Claude Sonnet 4.6 comme choix généraliste pour les agents, GPT-5.5 Pro, un aperçu de Gemini 3 Pro à long contexte, DeepSeek V4 Pro comme modèle de codage économique — est en retard sur le manifeste et le catalogue en direct ; considérez-la comme un point de départ et vérifiez que l’identifiant du modèle fonctionne.

L’utilisation observée ne constitue pas non plus un classement. La page publique de l’application Hermes Agent sur OpenRouter, consultée le 21 septembre 2026, indiquait que le volume de tokens sur 30 jours était dominé par MiniMax M3, une entrée non étiquetée appelée Ox Alpha, Ling 3.0 Flash Fin, GPT-4o-mini et deux versions de DeepSeek V4 Flash — des modèles peu coûteux et rapides plutôt que des modèles phares. Cela enregistre ce que les utilisateurs ont fait passer par une passerelle, et non ce qui a donné les meilleurs résultats pour votre tâche.

« Modèles Hermes » recouvre deux questions différentes

L’une concerne le modèle vers lequel diriger l’agent, ce qui a été traité plus haut. L’autre est la famille Hermes 4 à poids ouverts — Hermes-4-405B, -70B et -14B sur Hugging Face, avec Hermes 3 distribué via Ollama. Il s’agit des poids de modèles de la même entreprise, pas de l’agent, et Nous indique de ne pas exécuter Hermes 4 dans celui-ci. Une affirmation reste non vérifiée : la documentation d’intégration de Portal indique que les modèles Hermes 4 sont disponibles sur Portal à des tarifs fortement réduits, mais une recherche de « hermes » et « nous » dans le catalogue public en direct n’a renvoyé aucune ligne correspondante le 21 septembre 2026. Ils sont peut-être visibles uniquement après connexion, ou la documentation est obsolète. N’établissez pas votre budget à partir d’un prix Hermes 4 Portal que vous ne pouvez pas voir dans votre propre compte.

Meilleure API et API la moins chère pour Hermes Agent

Ces affirmations sont différentes et doivent rester séparées. Le prix affiché le plus bas est un fait de grille tarifaire ; le coût minimal pour terminer la tâche dépend des nouvelles tentatives, de la longueur du contexte et des accès au cache.

FormuleQuand elle est avantageusePremière vérification
Abonnement Nous PortalVous voulez les outils, les modèles et l’hébergement sur un même solde. Quick Setup le présente comme le parcours rapide recommandéDes crédits, pas une réduction par token. Tool Gateway est une fonctionnalité réservée aux niveaux payants
Clé d’API directe du fournisseurUne seule famille de modèles, aucun intermédiaire, priorité aux fonctionnalités du fournisseurLes formules de chat grand public ne fonctionnent généralement pas : Claude Pro ne peut pas piloter Hermes, Claude Max nécessite des crédits d’utilisation supplémentaires achetés, et les offres grand public de Google ne disposent d’aucun parcours documenté
Une passerelle tierce compatible OpenAIVous voulez un ensemble précis de modèles à un tarif affiché sous une seule cléDéfinissez explicitement transport et activez la mise en cache des prompts pour chaque modèle ; ni l’un ni l’autre n’est déduit automatiquement
Modèles Portal gratuitsExploration et travail tolérant les interruptionsLimité aux modèles marqués comme gratuits, cette liste étant reconstruite à partir du catalogue en direct
Inférence localeVous disposez déjà d’un matériel adaptéGratuits à exécuter selon la FAQ, mais la qualité des appels d’outils relève de la pile de service, pas d’Hermes

Hermes précise que tout service doté d’une API compatible OpenAI fonctionne, et sa référence des fournisseurs contient même des recettes pour des passerelles concurrentes ; le parcours par point de terminaison personnalisé est donc une voie de premier ordre, pas une solution de contournement. La place de Kunavo est plus étroite que la notion de « moins cher » : son catalogue couvre les modèles de type Claude et GPT ainsi que les modèles multimédias, tandis que les modèles à poids ouverts qui dominent l’utilisation observée d’Hermes n’y figurent pas. Si votre configuration utilise déjà ces modèles, Kunavo n’est pas la voie la moins chère. C’est la voie qui permet de conserver des tours principaux Claude ou GPT à un tarif affiché sous une seule clé.

Le même modèle, les mêmes tokens, deux grilles tarifaires

USD par million de tokens standard d’entrée et de sortie non mis en cache. Les tarifs directs d’Anthropic proviennent de sa page de tarification vérifiée le 21 septembre 2026 ; la colonne Kunavo lit le catalogue en direct.

ModèleAnthropic en direct : entrée / sortieKunavo : entrée / sortieRôle Hermes candidat
Claude Haiku 4.5$1.00 / $5.00$0.70 / $3.50Emplacements auxiliaires et workers de délégation
Claude Sonnet 5$2.00 / $10.00$1.40 / $7.00Tour principal d’appels d’outils
Claude Opus 5$5.00 / $25.00$3.50 / $17.50Tâches difficiles et escalade

Passons aux calculs. Supposons un mois de 20 millions de tokens d’entrée non mis en cache et 2 millions de tokens de sortie, comptabilisés ensemble sur les tours principaux, les emplacements auxiliaires et les workers de délégation — ce total combiné est le point important, car une estimation par tour en néglige deux sur trois.

Hypothèse de routageEstimation du catalogue
Tout sur Claude Sonnet 5$42.00
Tours principaux sur Claude Sonnet 5 (4M entrée / 0,6M sortie) ; emplacements auxiliaires et workers de délégation sur Claude Haiku 4.5 (16M entrée / 1,4M sortie)$25.90
Tout sur Claude Sonnet 5, mais 16M de l’entrée arrivent sous forme de lectures du cache à $0.14 par million$21.84

Il s’agit d’un calcul de tokens aux tarifs du catalogue, pas d’une tâche Hermes mesurée ni d’un plafond de facture. Les écritures de cache sont exclues — les écritures de cache Claude sont facturées ici à 1,25 fois le tarif d’entrée, comme expliqué dans la documentation de mise en cache — ainsi que les outils payants, l’hébergement et les taxes. Cela suppose également que le modèle le moins cher termine le travail qui lui est attribué sans tentatives supplémentaires. C’est cette hypothèse, et non le tarif, qui détermine si la ligne la moins chère l’est réellement ; l’optimisation des coûts explique comment le tester.

Le montant du catalogue Kunavo constitue un plancher de facturation plutôt qu’un plafond : lorsque le fournisseur amont communique son montant, la facture correspond au plus élevé entre le coût du catalogue et le coût amont multiplié par la majoration applicable. Le minimum est une recharge prépayée de 10 $ sans abonnement ; il s’agit de la somme nécessaire pour ouvrir un compte approvisionné, et non du coût d’une tâche. Voir la facturation.

Connecter un point de terminaison tiers à Hermes

Cette configuration provient de la référence des fournisseurs d’Hermes, examinée comme document source le 21 septembre 2026. Aucune exécution d’Hermes avec Kunavo n’a été réalisée, il n’existe aucun guide de configuration Kunavo pour Hermes, et rien de ce qui suit ne doit être interprété comme une intégration testée. Conservez votre méthode opérationnelle actuelle pendant vos essais.

Un point de départ tiré de la documentation des fournisseurs d’Hermes
# ~/.hermes/config.yaml
providers:
  kunavo:
    api: https://api.kunavo.com/v1
    key_env: KUNAVO_API_KEY
    transport: chat_completions   # set it; do not rely on URL auto-detection
    models:
      claude-sonnet-5:
        prompt_caching: true

model:
  default: claude-sonnet-5
  provider: custom:kunavo
~/.hermes/.env
KUNAVO_API_KEY=your-key

Cinq choses qu’un endpoint personnalisé n’obtient pas gratuitement, chacune ayant un coût documenté :

  1. Définissez explicitement transport. Le laisser vide déclenche une détection automatique fondée sur l’URL, que la documentation du fournisseur décrit comme un mécanisme de secours pour un champ vide et illustre avec une seule règle — un chemin /anthropic qui se résout en anthropic_messages. Le reste de cette heuristique n’est énuméré sur aucune page consultée ici, d’où l’importance de nommer le transport plutôt que de supposer qu’aucune action ne sera déclenchée. Le test de régression propre à Hermes pour ce chemin consigne le mode de défaillance contre lequel il se prémunit : une entrée openai-api pointant vers un hôte OpenAI régional se résolvait silencieusement en chat_completions au lieu du transport déclaré par le fournisseur lui-même, et chaque tour avec appel d’outil renvoyait une erreur 400. Kunavo fournit /v1/chat/completions, /v1/messages et /v1/responses, de sorte que les trois transports documentés disposent théoriquement d’un endpoint correspondant — une simple correspondance au niveau de la documentation, pas un élément testé. Nommez le transport souhaité au lieu de laisser la détection le choisir.
  2. Activez la mise en cache des prompts pour chaque modèle. Pour une passerelle qui résout un alias de modèle simple, les marqueurs de cache doivent être déclarés pour chaque modèle ; Hermes indique qu’il n’inférera pas la prise en charge du cache à partir du nom, de l’hôte ou de la famille du modèle du fournisseur. Omettre ce réglage vous fait perdre silencieusement le tarif des entrées mises en cache, qui constitue le levier le plus important lors d’une longue session. Consultez la mise en cache des prompts.
  3. Définissez context_length lorsque la valeur par défaut est incorrecte. Les endpoints personnalisés compatibles avec OpenAI ne reçoivent automatiquement aucun plafond de sortie correspondant à la taille du catalogue — les valeurs par défaut du serveur s’appliquent, et elles peuvent être inférieures au maximum du modèle. La fenêtre de contexte est résolue par une chaîne qui aboutit à models.dev, puis à une valeur de repli de 128K.
  4. Sachez ce que couvre extra_headers. La page de configuration des modèles l’applique aux routes compatibles avec OpenAI et aux routes anthropic_messages — client principal, changements de modèle via /model, reconstructions et clients auxiliaires compris — et désigne bedrock_converse comme le seul mode qui ne l’utilise pas. Elle ne dit rien sur codex_responses, alors considérez cette combinaison comme non testée. Sur le protocole Anthropic, l’exemple de la documentation du fournisseur pointe api vers un chemin sans préciser le suffixe ajouté par Hermes ; vérifiez donc le chemin de requête enregistré lors du premier appel — la documentation de l’URL de base explique la confusion entre l’origine et /v1 à l’origine de la plupart des erreurs 404 dans ce contexte.
  5. Utilisez hermes model pour ajouter un fournisseur. En cours de session, /model permet de basculer entre des endpoints déjà configurés, mais ne permet pas d’en ajouter un nouveau — et ce basculement supprime le cache.

Pour un premier essai, exécutez une tâche limitée avec un véritable appel d’outil, puis consultez /usage et le détail du tableau de bord avant d’y transférer des tâches planifiées. Créez un compte Kunavo lorsque vous êtes prêt à tester cette route avec une clé approvisionnée. Vous hésitez encore entre l’agent et son fournisseur ? Hermes contre OpenClaw compare les deux flux de travail.

Questions fréquentes

Combien coûte Hermes Agent ?

Le logiciel Hermes Agent ne coûte rien : il est open source sous licence MIT, et sa FAQ indique que vous ne payez que l’utilisation de l’API LLM du fournisseur choisi. Les éléments payants facultatifs sont un abonnement Nous Portal à 0 $, 20 $, 100 $ ou 200 $ par mois, l’hébergement Hermes Cloud à partir de 0,56 $ par jour pour une instance Medium en fonctionnement, et l’utilisation de Nous Tool Gateway, que sa documentation décrit comme une fonctionnalité réservée aux abonnements payants — certains comptes bénéficient plutôt d’un petit pool d’outils gratuit — sans grille tarifaire à l’usage publiée. Prix vérifiés sur les pages de Nous le 21 septembre 2026.

Quel modèle dois-je utiliser dans Hermes Agent ?

Nous fournit par défaut un modèle volontairement peu coûteux : le manifeste distant des modèles, daté du 20 septembre 2026 et consulté le lendemain, indique z-ai/glm-5.2 comme modèle par défaut, et la documentation du catalogue précise que le modèle par défaut est choisi pour être performant et peu coûteux plutôt que le produit phare le plus cher. La page d’intégration de Nous Portal recommande séparément Claude Sonnet 4.6 comme choix généraliste pour les agents, ainsi que GPT-5.5 Pro, un aperçu de Gemini 3 Pro à long contexte et DeepSeek V4 Pro comme modèle de codage économique. Ces recommandations textuelles sont en retard sur le manifeste et le catalogue en direct ; vérifiez donc que l’identifiant du modèle fonctionne dans votre propre compte. Aucun benchmark de tâche ne permet d’établir ici un classement de qualité.

Quelle est l’API la moins chère pour Hermes Agent ?

Le prix affiché le plus bas et le coût minimal pour terminer une tâche sont deux questions différentes. Un modèle gratuit de Nous Portal a un prix de token nul, mais il est limité aux modèles marqués comme gratuits, et cette liste est reconstruite à partir du catalogue en direct plutôt que fixée. Un modèle local est gratuit à exécuter une fois le matériel acheté. Parmi les entrées payantes du catalogue de Portal le 21 septembre 2026, les tarifs les plus bas concernaient des modèles à poids ouverts plutôt que les modèles phares des laboratoires — mais un modèle qui échoue dans une boucle d’appel d’outils et réessaie peut coûter plus cher qu’un modèle plus cher qui termine la tâche. Mesurez avec les analyses de /usage et du tableau de bord de l’agent plutôt que de choisir uniquement selon une grille tarifaire.

Puis-je utiliser mon abonnement Claude Pro ou Claude Max avec Hermes Agent ?

Claude Pro ne peut pas du tout piloter Hermes Agent : la documentation des fournisseurs Hermes indique que les abonnés Pro ne peuvent pas utiliser le parcours OAuth et les oriente vers une ANTHROPIC_API_KEY. Claude Max ne fonctionne qu’avec des crédits d’utilisation supplémentaires achetés, et toute utilisation de Hermes est facturée comme une utilisation supplémentaire, tandis que le quota Max inclus reste intact. Les offres grand public de Google ne disposent d’aucun parcours documenté, et OAuth xAI peut renvoyer HTTP 403 selon le niveau d’abonnement. L’accès à l’API facturé au token est la voie normale.

Les modèles Hermes 4 sont-ils la même chose que Hermes Agent ?

Non. Hermes 3 et Hermes 4 sont la famille de LLM à poids ouverts de Nous Research, publiée sous les noms Hermes-4-405B, Hermes-4-70B et Hermes-4-14B sur Hugging Face. Hermes Agent est le logiciel d’agent sous licence MIT. Nous déconseille explicitement d’exécuter Hermes 4 dans Hermes Agent, en indiquant qu’il est optimisé pour le chat et le raisonnement plutôt que pour la boucle d’appels d’outils à cadence rapide dont dépend l’agent.

Un abonnement Nous Portal réduit-il le prix des modèles Claude ?

Pas sur le tarif des tokens. Dans le catalogue de Portal consulté le 21 septembre 2026, les entrées Claude ne comportaient aucune réduction par rapport aux tarifs publiés par Anthropic : Sonnet à 2,00 $ en entrée et 10,00 $ en sortie par million de tokens, Opus 5 à 5,00 $ et 25,00 $, Haiku à 1,00 $ et 5,00 $, Fable 5.1 à 10,00 $ et 50,00 $. Ce qu’un niveau payant ajoute, c’est un bonus de crédit de 10 %, l’utilisation de Tool Gateway incluse dans l’abonnement et des limites de requêtes plus élevées. Les textes de Portal promettent des options gratuites et des réductions réservées à Portal, mais le catalogue affiche un seul tarif par entrée, sans prix de référence à côté ; la page publique ne permet donc pas de vérifier quelles entrées sont remisées.

Pages de Nous Research et d’Anthropic consultées le 21 septembre 2026 ; l’état du dépôt et la dernière version ont été vérifiés via l’API GitHub le même jour. Les tarifs Kunavo et tous les totaux ci-dessus sont calculés à partir du catalogue de modèles en direct et constituent des estimations indicatives. La configuration de Hermes est rapportée à partir des documents sources, et non d’un test d’exécution.