Instalar Hermes Agent cuesta $0: el software tiene licencia MIT y es de código abierto, y la única factura inevitable corresponde a los tokens del modelo. Todo lo demás es opcional y tiene un precio separado: una suscripción a Nous Portal de $0, $20, $100 o $200 al mes, alojamiento de Hermes Cloud desde $0.56 al día y uso de Tool Gateway, una función de suscripción de pago que no publica una tarifa por uso.
Esta página trata sobre Hermes Agent, el agente de código abierto de Nous Research. Una comprobación activa de el repositorio el 21 de septiembre de 2026 devolvió archived: false, una licencia MIT y una publicación realizada ese mismo día; la versión publicada más reciente es Hermes Agent v0.21.3, etiquetada como v2026.9.14 el 14 de septiembre de 2026. No es Hermes 3 ni Hermes 4, la familia de modelos de pesos abiertos de Nous, ni la marca de artículos de lujo del mismo nombre.
Cuatro facturas independientes, de las cuales solo una es obligatoria
| Qué estás comprando | Precio publicado | Dónde se indica |
|---|---|---|
| Software de Hermes Agent: CLI, interfaz de terminal, Desktop, pasarela de mensajería | $0, con licencia MIT | Preguntas frecuentes de Hermes: solo pagas por el uso de la API del LLM de tu proveedor elegido |
| Tokens de modelo | Lo que cobre tu proveedor elegido | La propia tabla de tarifas de tu proveedor |
| Suscripción a Nous Portal (opcional) | $0 / $20 / $100 / $200 al mes | Planes de Portal |
| Nous Tool Gateway: búsqueda web, generación de imágenes, TTS, navegador en la nube | Una función de suscripción de pago; se paga según el uso con cargo a la suscripción. No se ha publicado ninguna tarifa por uso. El mismo documento indica que algunas cuentas tienen derecho, en su lugar, a un pequeño conjunto gratuito de herramientas | Documento de Tool Gateway |
| Alojamiento de Hermes Cloud (opcional) | Medium $0.56/día en ejecución, $0.03/día detenida; Large $1.09/día en ejecución, $0.03/día detenida; se requieren $2 en créditos como mínimo, o una suscripción activa, para desplegar | Hermes Cloud |
| Hermes Business / Enterprise | No se ha publicado ningún precio. Ambos están enlazados desde el pie de página del propio Portal; ninguna de las dos páginas respondió a un cliente HTTP simple el 21 de septiembre de 2026, por lo que sus condiciones no se han verificado aquí | Página de Business |
Hermes Cloud factura la instancia diariamente a mes vencido, y su propia página indica que la inferencia y el uso de herramientas se facturan por separado además del precio de la instancia. Por tanto, una cotización de alojamiento nunca es la factura completa. Los modelos locales, según las mismas preguntas frecuentes, son completamente gratuitos de ejecutar una vez que posees el hardware. Todas las cifras se comprobaron el 21 de septiembre de 2026. El mismo desglose de cuatro facturas aplicado a otro agente aparece en precios de OpenClaw.
Planes de Nous Portal: compras créditos, no un descuento por token
| Nivel | Precio mensual | Créditos mensuales | Límite de transferencia |
|---|---|---|---|
| Gratis | $0 | $0 — solo modelos gratuitos, límites de tarifas estándar | — |
| Plus | $20 | $22 (una bonificación del 10 por ciento), uso de herramientas alojadas, límites de tarifas altos | $10 |
| Super | $100 | $110 | $50 |
| Ultra | $200 | $220 | $100 |
| Recarga única | +$10 / +$20 / +$50 / +$100 / +$200, o una cantidad arbitraria | Pagado mediante Stripe | — |
Los créditos son el producto. Una suscripción de $20 compra $22 de gasto en modelos, por lo que su ventaja frente al pago por token es la bonificación más las herramientas y los límites incluidos, no una tarifa más barata para cada modelo. En el catálogo público consultado el 21 de septiembre de 2026, las entradas de Claude tenían las tarifas que publica Anthropic —Opus 5 a $5.00 de entrada / $25.00 de salida, Fable 5.1 a $10.00 / $50.00—, sin mostrar ninguna reducción. La página no permite comprobar si hay descuentos en otros elementos: muestra una tarifa por entrada y ningún precio de referencia junto a ella. Lo que sí muestra es que un mismo modelo puede aparecer varias veces con tarifas diferentes, porque las variantes regionales y por lotes figuran como entradas separadas: Kimi K3 a $1.70 / $8.50, su entrada :US a $3.63 / $18.15 y su entrada por lotes a $3.00 / $15.00. Presupuesta según el ID exacto de la entrada que vayas a llamar y fecha cualquier cifra que cites.
Tres advertencias antes de elaborar el presupuesto. El nivel gratuito es real, pero está restringido a las entradas cuyo ID de modelo lleva el sufijo :free —siete de ellas en la consulta del 21 de septiembre de 2026—, y esa lista se reconstruye a partir del catálogo activo, por lo que el consejo de «usar el gratuito» queda obsoleto rápidamente. Las propias superficies de Portal muestran dos cifras redondeadas diferentes para el tamaño del catálogo —una menor en cada tarjeta de plan de pago y otra mayor en la sección situada encima del catálogo—, mientras que la lista publicada contenía 360 entradas en esa consulta; por tanto, considera cualquiera de esas cifras como marketing, no como un dato para el presupuesto. Tampoco aparecen cifras de solicitudes por segundo en las tarjetas de plan; solo indican límites de tarifa «estándar» y «altos», así que considera la concurrencia no verificada hasta verla en tu propia cuenta. La tabla de planes aparece en la página de inicio de Portal y en manage-subscription, donde un cliente HTTP simple recibe un control de seguridad de Vercel en lugar de la página; consúltala en un navegador.
Adónde van realmente los tokens
Una tabla de tarifas pone precio a una llamada. Hermes factura una carga de trabajo, y entre ambas cosas hay tres multiplicadores documentados.
Ranuras auxiliares. El panel muestra 11 ranuras de tareas auxiliares —generación de títulos, visión, compresión, aprobación, extracción web, centro de habilidades, enrutamiento MCP y otras— y todas tienen como valor predeterminado auto, lo que significa que Hermes también intenta usar tu modelo principal para ese trabajo. El propio ejemplo de desperdicio de la documentación es la compresión: un modelo de chat rápido realiza esa tarea a una quincuagésima parte del coste de un modelo de razonamiento. Por tanto, un solo turno del usuario puede convertirse en varias llamadas facturadas.
Delegación. La documentación de delegación indica que un lote paralelo de subagentes suele consumir la gran mayoría de los tokens totales de una ejecución, por lo que el modelo de trabajo se puede configurar por separado como delegation.model. Su propia advertencia de costes indica que max_spawn_depth: 3 con max_concurrent_children: 3 puede alcanzar 27 agentes hoja simultáneos; la profundidad predeterminada es 1.
Continuidad de la caché. La misma página de configuración del modelo advierte que las cachés de indicaciones están asociadas al modelo que atiende la solicitud, por lo que cualquier cambio de modelo a mitad de la conversación —un cambio explícito mediante /model, un fallback automático o una rotación del grupo de credenciales hacia otra cuenta— hace que el siguiente mensaje vuelva a leer toda la conversación al precio completo de entrada en lugar de aplicar la tarifa en caché, que la página sitúa en un descuento aproximado del 75 al 90 por ciento. Existe precisamente una protección predeterminada, model.switch_context_confirm_tokens: 100000, porque esa relectura única puede eclipsar la diferencia por token entre los dos modelos.
El trabajo programado es donde esto afecta más, y no en la dirección que esperarías: la documentación de cron indica que un trabajo sin modelo propio se ejecuta con lo que hermes model o /model esté configurado en el momento en que se activa, por lo que cambiar el modelo de chat mueve todo el conjunto de trabajos cron en su siguiente ejecución. Fija el trabajo (hermes cron create/edit --pin, o un --model / --provider explícito) o establece un valor predeterminado para el conjunto con cron.model cuando un trabajo desatendido no deba seguir un cambio. Los trabajos que solo ejecutan scripts —el modo no_agent de la documentación— nunca acceden a la capa de inferencia. En lugar de estimar todo esto, mídelo: las preguntas frecuentes documentan /usage, /compress y hermes prompt-size, y el panel web documenta una vista de análisis con los tokens totales, el porcentaje de aciertos de caché y un desglose por modelo.
Elegir el modelo para cada trabajo
Ningún benchmark aquí respalda una clasificación de calidad, así que esta es una tabla de los factores que deciden cada elección, no una tabla de posiciones.
| Función | Qué lo decide realmente |
|---|---|
| Turno principal (el ciclo de llamadas a herramientas) | Llamadas fiables a herramientas y contexto suficiente. Un modelo que conversa bien pero llama mal a las herramientas cuesta más en reintentos de lo que su tarifa sugiere |
| Compresión, títulos, puntuación de aprobaciones, extracción web | El modelo de chat capaz más barato. La documentación considera que los modelos de razonamiento aquí son un desperdicio |
| Trabajadores de delegación | Dónde recae el volumen. Establece delegation.model explícitamente en lugar de heredar el modelo principal |
| Visión | Declara model.supports_vision: true cuando el modelo no esté en models.dev o las imágenes se preprocesen en lugar de enrutarse de forma nativa |
| Trabajos cron desatendidos | Un trabajo no fijado se ejecuta con tu modelo principal tal como esté configurado cuando se activa el trabajo, así que fíjalo o establece cron.model. Mantén pequeño el conjunto de herramientas: un esquema de herramientas grande aumenta la indicación en cada llamada |
Conviene conocer dos posturas oficiales. Nous ofrece un valor predeterminado de bajo coste: el manifiesto remoto de modelos, fechado el 20 de septiembre de 2026 y consultado al día siguiente, marca z-ai/glm-5.2 como predeterminado, y la documentación del catálogo indica que el valor predeterminado es deliberadamente un modelo capaz y de bajo coste, nunca el buque insignia más caro. Además, Nous desaconseja usar sus propios pesos dentro del agente: la página de integración de Portal indica que Hermes 4 no se recomienda dentro de Hermes Agent porque está ajustado para chat y razonamiento, no para el ciclo rápido de llamadas a herramientas. La selección de esa página —Claude Sonnet 4.6 como opción generalista para agentes, GPT-5.5 Pro, una versión preliminar de Gemini 3 Pro con contexto largo y DeepSeek V4 Pro como programador rentable— va por detrás tanto del manifiesto como del catálogo activo, así que considérala un punto de partida y confirma que el ID del modelo se resuelve.
El uso observado tampoco es una clasificación. La página pública de la aplicación Hermes Agent de OpenRouter, consultada el 21 de septiembre de 2026, mostraba que el volumen de tokens de 30 días estaba liderado por MiniMax M3, una entrada sin etiqueta llamada Ox Alpha, Ling 3.0 Flash Fin, GPT-4o-mini y dos versiones de DeepSeek V4 Flash: modelos baratos y rápidos, no buques insignia. Eso registra lo que la gente ejecutó a través de una pasarela, no lo que rindió mejor en tu tarea.
«Modelos Hermes» son dos preguntas diferentes
Una es a qué modelo dirigir el agente, respondida arriba. La otra es la familia de pesos abiertos Hermes 4 —Hermes-4-405B, -70B y -14B en Hugging Face, con Hermes 3 distribuido mediante Ollama. Son pesos de modelos de la misma empresa, no el agente, y Nous indica que no se debe ejecutar Hermes 4 dentro de él. Una afirmación aquí está sin verificar: el documento de integración de Portal indica que los modelos Hermes 4 están disponibles en Portal con tarifas muy rebajadas, pero una búsqueda de «hermes» y «nous» en el catálogo público activo no devolvió filas coincidentes el 21 de septiembre de 2026. O bien solo son visibles al iniciar sesión, o bien el documento está obsoleto. No presupuestes usando un precio de Hermes 4 en Portal que no puedas ver en tu propia cuenta.
La API mejor y más barata para Hermes Agent
Son afirmaciones diferentes y deben mantenerse separadas. El precio publicado más bajo es un dato de la tabla de tarifas; el coste más bajo para completar la tarea depende de los reintentos, la longitud del contexto y los aciertos de caché.
| Ruta | Cuándo gana | Qué comprobar primero |
|---|---|---|
| Suscripción a Nous Portal | Quieres herramientas, modelos y alojamiento en un mismo saldo. Quick Setup la presenta como la ruta rápida recomendada | Créditos, no un descuento por token. Tool Gateway es una función de los niveles de pago |
| Clave de API directa del proveedor | Una familia de modelos, sin capa intermedia, con prioridad para las funciones del proveedor | Los planes de chat para consumidores casi nunca funcionan: Claude Pro no puede ejecutar Hermes en absoluto, Claude Max necesita créditos de uso adicional comprados y los planes de consumo de Google no tienen una ruta documentada |
| Una pasarela de terceros compatible con OpenAI | Quieres un conjunto específico de modelos con una tarifa publicada bajo una sola clave | Establece transport explícitamente y activa la caché de indicaciones para cada modelo; ninguna de las dos cosas se infiere |
| Modelos gratuitos de Portal | Exploración y trabajo que tolera interrupciones | Restringidos a los modelos marcados como gratuitos, y esa lista se reconstruye a partir del catálogo activo |
| Inferencia local | Ya ejecutas hardware adecuado | Gratuitos de ejecutar según las preguntas frecuentes, pero la calidad de las llamadas a herramientas es un problema de la pila de servicio, no de Hermes |
Hermes documenta que cualquier servicio con una API compatible con OpenAI funciona, y su referencia de proveedores incluso incluye recetas para pasarelas competidoras, por lo que la ruta de endpoint personalizado es una opción de primera clase, no una solución alternativa. Kunavo encaja de forma más específica que «lo más barato»: su catálogo cubre modelos de las clases Claude y GPT, además de modelos multimedia, y los modelos de pesos abiertos que dominan el uso observado de Hermes no están disponibles en él. Si tu configuración ya se ejecuta con esos modelos, Kunavo no es la ruta más barata. Es la ruta para mantener los turnos principales con Claude o GPT a una tarifa publicada bajo una sola clave.
El mismo modelo, los mismos tokens, dos listas de precios
USD por millón de tokens estándar de entrada y salida sin caché. Las tarifas directas de Anthropic proceden de su página de precios, comprobada el 21 de septiembre de 2026; la columna de Kunavo lee el catálogo activo.
| Modelo | Anthropic directo: entrada / salida | Kunavo: entrada / salida | Rol candidato en Hermes |
|---|---|---|---|
| Claude Haiku 4.5 | $1.00 / $5.00 | $0.70 / $3.50 | Ranuras auxiliares y trabajadores de delegación |
| Claude Sonnet 5 | $2.00 / $10.00 | $1.40 / $7.00 | Turno principal de llamadas a herramientas |
| Claude Opus 5 | $5.00 / $25.00 | $3.50 / $17.50 | Tareas difíciles y escalado |
Ahora, la aritmética. Supón un mes con 20 millones de tokens de entrada sin caché y 2 millones de tokens de salida, contabilizados conjuntamente entre los turnos principales, las ranuras auxiliares y los trabajadores de delegación; ese total combinado es el punto importante, porque una estimación por turno omite dos de los tres elementos.
| Supuesto de enrutamiento | Estimación del catálogo |
|---|---|
| Todo en Claude Sonnet 5 | $42.00 |
| Turnos principales en Claude Sonnet 5 (4M de entrada / 0.6M de salida); ranuras auxiliares y trabajadores de delegación en Claude Haiku 4.5 (16M de entrada / 1.4M de salida) | $25.90 |
| Todo en Claude Sonnet 5, pero 16M de la entrada llegan como lecturas de caché a $0.14 por millón | $21.84 |
Esto es aritmética de tokens a las tarifas del catálogo, no una tarea de Hermes medida ni un límite máximo de facturación. Excluye las escrituras de caché —las escrituras de caché de Claude se facturan aquí a 1.25 veces la tarifa de entrada, como se explica en el documento de caché— y excluye las herramientas de pago, el alojamiento y los impuestos. También supone que el modelo más barato termina el trabajo asignado sin intentos adicionales. Esa suposición, no la tarifa, es lo que decide si la fila más barata es realmente más barata; optimización de costes explica cómo probarlo.
El importe del catálogo de Kunavo es un mínimo de facturación, no un límite máximo: cuando el proveedor ascendente informa de su cargo, la factura es el mayor de entre el coste del catálogo y el coste ascendente multiplicado por el margen aplicable. El mínimo es una recarga prepaga de $10 sin suscripción, que es el efectivo necesario para abrir una cuenta financiada, no el coste de una tarea. Consulta facturación.
Conectar un endpoint de terceros con Hermes
Esta configuración procede de la propia referencia de proveedores de Hermes, revisada como documentación fuente el 21 de septiembre de 2026. No se ha realizado ninguna ejecución de Hermes contra Kunavo, no existe una guía de configuración de Kunavo para Hermes y nada de lo que aparece a continuación debe interpretarse como una integración probada. Mantén disponible tu ruta de trabajo mientras la pruebas.
# ~/.hermes/config.yaml
providers:
kunavo:
api: https://api.kunavo.com/v1
key_env: KUNAVO_API_KEY
transport: chat_completions # set it; do not rely on URL auto-detection
models:
claude-sonnet-5:
prompt_caching: true
model:
default: claude-sonnet-5
provider: custom:kunavoKUNAVO_API_KEY=your-keyCinco cosas que un endpoint personalizado no obtiene gratis, cada una de las cuales tiene un coste documentado:
- Establece
transportexplícitamente. Dejarlo en blanco activa la autodetección basada en la URL, que la referencia del proveedor describe como un recurso alternativo para un campo vacío y ejemplifica con una única regla: una ruta/anthropicque resuelve enanthropic_messages. El resto de esa heurística no se enumera en ninguna página consultada, por lo que conviene indicar el transporte en lugar de asumir que no se activará ninguno. La prueba de regresión propia de Hermes para esa ruta registra el modo de fallo que protege: una entradaopenai-apiapuntada a un host regional de OpenAI se resolvía silenciosamente enchat_completionsen lugar del transporte declarado por el propio proveedor, y cada turno con llamadas a herramientas devolvía un 400. Kunavo ofrece/v1/chat/completions,/v1/messagesy/v1/responses, por lo que los tres transportes documentados tienen un endpoint correspondiente sobre el papel; es solo una coincidencia a nivel de documentación, no una coincidencia probada. Indica el transporte que quieres en lugar de dejar que lo elija la detección. - Habilita la caché de prompts para cada modelo. En un gateway que resuelve un alias de modelo sin más, los marcadores de caché deben declararse por modelo; Hermes indica que no inferirá la compatibilidad con la caché a partir del nombre, el host o la familia del modelo de un proveedor. Omitir esto hace perder silenciosamente la tarifa de entradas en caché, que es el mayor factor de ahorro en una sesión larga. Consulta caché de prompts.
- Establece
context_lengthcuando el valor predeterminado sea incorrecto. Los endpoints personalizados compatibles con OpenAI no reciben automáticamente un límite de salida del tamaño del catálogo; se aplican los valores predeterminados del propio servidor, que pueden ser inferiores al máximo del modelo. La ventana de contexto se resuelve mediante una cadena que termina en models.dev y después recurre a un valor de 128K. - Comprende qué cubre
extra_headers. La página de configuración del modelo lo aplica a las rutas compatibles con OpenAI y a las rutasanthropic_messages—cliente principal, cambios de modelo mediante/model, reconstrucciones y clientes auxiliares por igual—, y nombrabedrock_conversecomo el único modo que no lo utiliza. No dice nada sobrecodex_responses, así que considera no probada esa combinación. En el protocolo de Anthropic, el ejemplo de la documentación del proveedor apuntaapia una ruta sin indicar el sufijo que añade Hermes, por lo que debes comprobar la ruta de solicitud registrada en la primera llamada; la documentación de la URL base cubre la confusión entre el origen y/v1que provoca la mayoría de los errores 404 en ese caso. - Usa
hermes modelpara añadir un proveedor. Durante una sesión,/modelcambia entre endpoints que ya has configurado y no puede añadir uno nuevo; además, ese cambio descarta la caché.
Para una primera prueba, ejecuta una tarea acotada con una llamada real a una herramienta y, después, consulta /usage y el desglose del panel antes de trasladar el trabajo programado. Crea una cuenta de Kunavo cuando estés listo para probar esa ruta con una clave con fondos. ¿Sigues eligiendo el agente en lugar de su proveedor? Hermes frente a OpenClaw compara ambos flujos de trabajo.
Preguntas frecuentes
¿Cuánto cuesta Hermes Agent?
El software Hermes Agent no cuesta nada: tiene licencia MIT y es de código abierto, y sus propias preguntas frecuentes indican que solo se paga por el uso de la API del LLM del proveedor elegido. Las opciones de pago son una suscripción a Nous Portal de $0, $20, $100 o $200 al mes, el alojamiento de Hermes Cloud desde $0.56 al día para una instancia Medium en ejecución, y el uso de Nous Tool Gateway, que su documentación describe como una función de suscripción de pago —aunque algunas cuentas reciben en su lugar un pequeño conjunto gratuito de herramientas—, sin una tabla de tarifas por uso publicada. Precios comprobados en las páginas de Nous el 21 de septiembre de 2026.
¿Qué modelo debo usar en Hermes Agent?
Nous ofrece deliberadamente un valor predeterminado de bajo coste: el manifiesto remoto de modelos, fechado el 20 de septiembre de 2026 y consultado al día siguiente, marca z-ai/glm-5.2 como modelo predeterminado, y la documentación del catálogo indica que el valor predeterminado se elige por ser un modelo capaz y de bajo coste, no el buque insignia más caro. La página de integración de Nous Portal recomienda por separado Claude Sonnet 4.6 como opción generalista para agentes, además de GPT-5.5 Pro, una versión preliminar de Gemini 3 Pro con contexto largo y DeepSeek V4 Pro como programador rentable. Estas recomendaciones en prosa van por detrás del manifiesto y del catálogo activo, así que confirma que el ID del modelo se resuelve en tu propia cuenta. Ningún benchmark de tareas respalda aquí una clasificación de calidad.
¿Cuál es la API más barata para Hermes Agent?
El precio publicado más bajo y el coste más bajo para completar una tarea son preguntas distintas. Un modelo gratuito de Nous Portal tiene un precio de tokens de cero, pero está restringido a los modelos marcados como gratuitos, y esa lista se reconstruye a partir del catálogo activo en lugar de ser fija. Un modelo local es gratuito de ejecutar una vez que posees el hardware. Entre las entradas de pago del propio catálogo de Portal el 21 de septiembre de 2026, las tarifas más bajas correspondían a modelos de pesos abiertos, no a los buques insignia de los laboratorios; pero un modelo que falla en un ciclo de llamadas a herramientas y reintenta puede costar más que otro más caro que termina la tarea. Mide con el propio /usage del agente y con los análisis del panel, en lugar de elegir basándote solo en una tabla de tarifas.
¿Puedo usar mi suscripción Claude Pro o Claude Max con Hermes Agent?
Claude Pro no puede ejecutar Hermes Agent en absoluto: la documentación del proveedor de Hermes indica que los suscriptores Pro no pueden usar la ruta OAuth y los dirige a usar ANTHROPIC_API_KEY. Claude Max solo funciona con créditos de uso adicional comprados, y todo el uso de Hermes se factura como uso adicional, mientras que la asignación incluida de Max permanece intacta. Los planes de consumo de Google no tienen una ruta documentada, y OAuth de xAI puede devolver HTTP 403 según el nivel de suscripción. El acceso a la API con pago por token es la ruta habitual.
¿Los modelos Hermes 4 son lo mismo que Hermes Agent?
No. Hermes 3 y Hermes 4 son la familia de LLM de pesos abiertos de Nous Research, publicados como Hermes-4-405B, Hermes-4-70B y Hermes-4-14B en Hugging Face. Hermes Agent es el software de agentes con licencia MIT. Nous recomienda explícitamente no ejecutar Hermes 4 dentro de Hermes Agent, ya que está ajustado para chat y razonamiento, no para el ciclo rápido de llamadas a herramientas del que depende el agente.
¿Una suscripción a Nous Portal ofrece descuentos en los modelos Claude?
No en la tarifa por token. En el catálogo de Portal consultado el 21 de septiembre de 2026, las entradas de Claude no tenían ninguna reducción frente a las tarifas publicadas por Anthropic: Sonnet a $2.00 de entrada y $10.00 de salida por millón de tokens, Opus 5 a $5.00 y $25.00, Haiku a $1.00 y $5.00, y Fable 5.1 a $10.00 y $50.00. Lo que añade un nivel de pago es una bonificación de crédito del 10 por ciento, el uso incluido de Tool Gateway y límites de solicitudes más altos. El propio texto de Portal promete opciones gratuitas y descuentos exclusivos de Portal, pero el catálogo muestra una única tarifa por entrada sin un precio de referencia junto a ella, por lo que la página pública no permite comprobar qué entradas tienen descuento.
Páginas de Nous Research y Anthropic consultadas el 21 de septiembre de 2026; el estado del repositorio y la versión más reciente se verificaron con la API de GitHub ese mismo día. Las tarifas de Kunavo y todos los totales anteriores se calculan a partir del catálogo de modelos activo y son estimaciones ilustrativas. La configuración de Hermes se presenta a partir de documentos fuente, no de una prueba en tiempo de ejecución.