Se seus modelos do Ollama desapareceram do seletor do Hermes, verifique a versão antes de tocar na configuração: o bug do cache do catálogo nativo que produz exatamente esse sintoma foi encerrado como concluído em 17 de setembro de 2026, e sua correção está contida na tag v2026.9.21 (hermes-agent 0.21.4), mas não em v2026.9.14. No entanto, esse relatório encerrado não conta toda a história. Dois outros relatórios de modelos do Ollama ausentes de um seletor ainda estavam abertos em 21 de setembro de 2026; um terceiro issue aberto descreve um mecanismo do Hermes Desktop que produz o mesmo sintoma em qualquer provedor cuja lista de modelos visíveis tenha sido personalizada alguma vez, e li esse comportamento ainda presente no código-fonte distribuído naquela mesma tag. Uma quarta causa comum não é um defeito. Cada uma deixa um indício diferente, e os indícios são o objetivo desta página.
Primeiro, duas desambiguações, porque ambas colidem nos resultados de pesquisa. Hermes Agent é o agente Python da Nous Research (MIT, não arquivado, último push em 21 de setembro de 2026 segundo a API do GitHub). Hermes 3 e Hermes 4 são a família de LLMs de pesos abertos desse mesmo laboratório, um produto totalmente diferente, e também existe um mecanismo JavaScript não relacionado chamado Hermes — nenhum dos números de versão deles se aplica aqui. E Ollama local não é Ollama Cloud: o Hermes acessa o runtime local gratuito na porta 11434 pelo fluxo Custom Endpoint, enquanto o Ollama Cloud é um produto pago separado, implementado como seu próprio slug de provedor com seu próprio arquivo de cache. A ausência de um modelo em um não diz nada sobre o outro.
Três camadas precisam concordar, e apenas uma delas é o Ollama
"O modelo não está no seletor" é uma afirmação sobre a última das três camadas, e o diagnóstico consiste em encontrar a primeira que discorda.
| Camada | O que verificar | Como é a falha |
|---|---|---|
| Catálogo próprio do Ollama | /api/tags nativamente e /v1/models na superfície compatível com OpenAI | O modelo realmente está ausente ou foi removido depois da listagem que você está lendo |
| Descoberta e cache do Hermes | Para qual caminho de sondagem o endpoint se qualifica e o que há em provider_models_cache.json | O endpoint está saudável e o seletor ainda mostra zero modelos para ele |
| A interface do seletor | CLI hermes model versus o menu de modelos do desktop | A CLI está correta e o menu do desktop não, ou o grupo do provedor desaparece por completo |
# 1. Does Ollama itself list the model? This is the native catalog
# Hermes reads when the endpoint qualifies for the /api/tags branch.
curl -s http://127.0.0.1:11434/api/tags | jq '.models[].name'
# 2. Does the OpenAI-compatible surface list it too? This is what a
# generic custom endpoint is probed on.
curl -s http://127.0.0.1:11434/v1/models | jq '.data[].id'Uma coisa a descartar na camada um: ollama list inclui modelos de embeddings, e um modelo de embeddings não é um modelo de chat que um agente de programação possa selecionar. A Kunavo também não oferece nenhum modelo de embeddings, conversão de texto em fala ou fala em texto, portanto uma rota hospedada não resolve essa lacuna aqui.
Verifique primeiro sua versão e leia-a com atenção
O issue #112898 — "a lista de modelos Ollama locais pisca no seletor" — está encerrado como concluído, aberto em 16 de setembro de 2026 e encerrado em 17 de setembro de 2026. O pull request #113129 mesclou a correção como o commit d6d6565, e uma comparação no GitHub coloca esse commit dentro da tag v2026.9.21 e fora de v2026.9.14: comparar v2026.9.21…d6d6565 retorna o status behind com zero commits à frente, portanto o commit é um ancestral dessa tag, enquanto v2026.9.14…d6d6565 retorna o status ahead com zero atrás, portanto a tag é ancestral do commit, e não o contrário. O próprio #112900 do colaborador ainda está aberto, o que não é sinal de que a correção esteja ausente de main: seu conteúdo foi incorporado com a autoria preservada ao pull request mesclado. Todos os estados foram lidos na API do GitHub em 21 de setembro de 2026.
Agora vem a armadilha. Dois números de versão diferentes são enviados dentro dessa única tag: em v2026.9.21, pyproject.toml lê version = "0.21.4", enquanto apps/desktop/package.json lê "version": "0.17.6". Portanto, um relatório de bug intitulado "Hermes Desktop 0.17.6" está descrevendo uma compilação atual, não uma antiga — e descartar esse relatório como obsoleto fará você datar suas próprias evidências incorretamente. Observe também o limite da verificação de versão: trata-se de contenção do git em uma tag. Não foi verificado aqui se a versão do pip, a fórmula do Homebrew, a imagem do contêiner ou o canal de atualização automática do desktop que você realmente instalou contém esse commit.
Cinco causas e o indício que as diferencia
| Causa | O indício | Status em 21 de setembro de 2026 |
|---|---|---|
| O catálogo nativo do Ollama nunca foi gravado no cache compartilhado do seletor | A lista pisca: correta logo após uma sondagem, vazia na próxima abertura normal | Corrigido — #112898, na versão 0.21.4, na tag v2026.9.21 |
Snapshot do desktop hermes.desktop.visible-models congelado no localStorage, em um provedor cuja lista foi personalizada uma vez | A busca ainda encontra o modelo e a seleção ativa ainda é exibida; apenas o menu o omite | Aberto — #107391, registrado sobre o Copilot e a segunda de suas duas causas; comportamento analisado no código enviado em v2026.9.21 |
| Várias linhas de provedor compartilhando uma URL base com chaves diferentes | Alguns provedores configurados são exibidos, outros desaparecem do seletor | Corrigido — #106184, encerrado em 9 de setembro de 2026, enviado na versão 0.21.2 |
O endpoint não se qualifica para o branch nativo /api/tags | Zero modelos em uma entrada custom com nome simples que não está na porta 11434 e não corresponde à URL base configurada do Ollama | Comportamento documentado, não um defeito |
| Janela de contexto local abaixo do mínimo do Hermes | Uma recusa na inicialização que informa a janela servida — não um seletor vazio | Comportamento documentado; não o misture com o caso acima |
Duas dessas causas merecem sua própria frase. O congelamento do desktop é o que mais provavelmente será interpretado como um problema de cache: lendo apps/desktop/src/store/model-visibility.ts na tag v2026.9.21, quando um provedor tem quaisquer chaves armazenadas, o renderizador deixa completamente de mesclar os padrões do provedor; assim, modelos descobertos posteriormente nunca entram no menu. A issue #114369 reproduziu exatamente isso em um provedor personalizado com discover_models: true e foi encerrada como duplicata, não como corrigida; sua reprodução usou um endpoint vLLM, portanto trate o mecanismo como independente do provedor, e não como uma reprodução do Ollama. Permanecem abertas e sem solução confirmada mais duas: #89874 (zero modelos para um provedor Ollama personalizado, com um rótulo needs-repro, portanto um relatório não confirmado, e não um defeito estabelecido) e #71169 (modelos presentes na API do Ollama, ausentes no menu suspenso do desktop). Não está estabelecido se alguma delas compartilha uma causa-raiz com #112898.
O sintoma no desktop também é mais específico do que as pessoas esperam. Em model-catalog-menu.tsx nessa tag, um provedor cuja lista de famílias recolhida está vazia é ignorado por completo — por isso a reclamação geralmente é "meu provedor desapareceu", e não "meu provedor mostra uma lista vazia".
Por que uma abertura normal do seletor mostra uma lista obsoleta
Este é o mecanismo por trás de toda a classe de falhas, e vale a pena entendê-lo uma vez. Em uma abertura normal do seletor, apenas o endpoint personalizado atual é sondado ao vivo; todos os outros endpoints configurados são respondidos pelo cache em disco em $HERMES_HOME/provider_models_cache.json. HERMES_HOME assume ~/.hermes, mas pode ser substituído, portanto não presuma o caminho. Três janelas em hermes_cli na tag v2026.9.21 controlam novas sondagens:
| Janela | Valor | O que ela controla |
|---|---|---|
| TTL genérico do catálogo | Uma hora | Por quanto tempo a listagem em cache de qualquer provedor é considerada atualizada |
| TTL do catálogo nativo do Ollama | 300 segundos | Especificamente a listagem de /api/tags |
| Janela de disponibilização de dados obsoletos | Sete dias | Por quanto tempo uma listagem expirada ainda pode ser exibida em vez de descartada |
Essas são constantes internas do código-fonte, não configurações documentadas; nesta verificação, não foi encontrado nenhum controle voltado ao usuário para essas três. Vale conhecer uma exceção deliberada nesse código: um catálogo nativo vazio é considerado autoritativo apenas dentro do TTL curto e nunca é disponibilizado como obsoleto, precisamente para que um Ollama que não tinha modelos na primeira abertura não oculte um modelo baixado recentemente durante toda a janela de sete dias. As linhas do cache são indexadas pela URL normalizada mais uma impressão digital da credencial, do modo da API e dos cabeçalhos extras, porque várias linhas de provedor podem legitimamente compartilhar uma URL de proxy com chaves diferentes. A consequência prática: alternar uma chave, alterar o transporte ou editar extra_headers invalida a entrada de cache dessa linha, e a próxima abertura sem sondagem a renderiza vazia até que algo a atualize.
As verificações, em ordem
- Confirme que o Ollama o possui. Execute os dois curls acima. Se
/api/tagsnão listar o modelo, nada depois dele poderá fazê-lo. - Confirme a versão. Se você estiver em uma compilação anterior à tag v2026.9.21 e o sintoma for uma lista que alterna entre correta e vazia, você está diante de um bug que já foi corrigido — atualize antes de depurar.
- Force uma atualização. A flag
--refreshdehermes modeldeclara em seu próprio texto de ajuda que apaga o cache do seletor em disco e busca novamente a listagem ao vivo de todos os provedores; observe que ela limpa todos os provedores, não apenas um. Durante a sessão, a referência de comandos de barra documenta/model --refreshcomo uma nova busca da lista de modelos do provedor, e o desktop tem um controle explícito de "Atualizar modelos" que solicita um catálogo novo, enquanto as aberturas normais permanecem no cache de uma hora. - Verifique qual caminho de sondagem seu endpoint recebe. O branch nativo
/api/tagsé usado quando o provedor se chamaollama, quando o nome écustom:ollamaou termina em-ollama, quando a URL corresponde à URL base configurada do Ollama ou quando uma URL personalizada ambígua na porta 11434 realmente responde a/api/tags. Um Ollama servido em outra porta com um nome simplescustomsegue para a sondagem genérica de/v1/models— é isso que o caminho do código indica, e ele não foi executado aqui para confirmar se o fallback funciona na prática. - Se o próprio processo de descoberta for o problema, pare de descobrir.
discover_modelsassumetrue; defini-lo comofalsefaz o seletor mostrar a lista que você configurou, em vez de executar uma sondagem ao vivo. - Se apenas o menu do desktop estiver errado, você provavelmente está no território de #107391, que nenhuma atualização limpa — o backend retorna o modelo, e a camada de curadoria do renderizador o descarta.
providers:
# The published reference documents `api` for a providers entry.
local-ollama:
api: http://127.0.0.1:11434/v1
# No key for local Ollama. Discovery is on by default; turn it off and
# hand-write the list when the probe is the thing that is failing.
discover_models: false
models:
- qwen3-coder:30b
model:
default: qwen3-coder:30b
provider: custom:local-ollamaUm detalhe de configuração faz as pessoas tropeçarem repetidamente, e vale esclarecê-lo. A referência documenta api como a chave de URL base para uma entrada providers:, e a lista de campos dessa entrada nomeia base_url e url como aliases aceitos para ela; base_url é, separadamente, a chave no mapeamento model: de nível superior. Ela também registra que configurações antigas usavam uma lista custom_providers: de nível superior com base_url em vez de api, ainda funcional e migrada automaticamente em hermes update na configuração v12. Os relatórios de bugs no tracker são escritos das duas formas, exatamente como seria esperado quando ambas são lidas. Portanto, é improvável que uma entrada providers: que não produz efeito esteja falhando por causa do nome dessa chave — examine o endpoint e os outros campos da entrada.
Um detalhe separado também merece ser mencionado: A própria página do Ollama sobre o Hermes apresenta o prompt de configuração como "Context length in tokens [leave blank for auto-detect]", enquanto a documentação de provedores do Hermes exige pelo menos 64,000 tokens para uso por agentes e afirma que um endpoint local que sirva menos será recusado na inicialização. Ambos foram verificados em 21 de setembro de 2026. Deixar o campo em branco não está errado por si só, mas não resolve o problema de um servidor que serve apenas uma janela pequena — portanto, aumente a janela no servidor (ou fixe-a na configuração do Hermes) para o número do Hermes e lembre-se de que essa falha produz uma recusa na inicialização informando a janela servida, não uma linha ausente no seletor.
Verifique e depois decida se o uso local vale a pena
Depois de uma alteração, faça três coisas em ordem: reabra o seletor sem --refresh e confirme que o modelo está listado em uma abertura fria, selecione-o e envie uma solicitação limitada que retorne uma conclusão. A etapa intermediária importa porque uma lista correta apenas imediatamente após uma sondagem é a assinatura do bug de cache, e não uma correção. Estas são instruções para você executar — nenhuma instalação do Hermes, instância do Ollama ou seletor foi exercitada durante a redação desta página.
Se a resposta for que o uso local não vale o esforço para esta tarefa, a questão financeira se divide claramente em duas: quanto custa o software e quanto custa o uso do modelo.
| Item | Custo | Fonte, verificada em 21 de setembro de 2026 |
|---|---|---|
| O próprio Hermes Agent | US$ 0, MIT | FAQ do projeto e o campo de licença do repositório |
| Modelos do Ollama no seu próprio hardware | $0, ilimitado | Preços do Ollama: plano gratuito |
| Ollama Cloud Pro / Max / Team | $20 / $100 / $500 por mês | Preços do Ollama — um provedor separado no Hermes, não esta configuração local |
| Nous Portal Plus / Super / Ultra | $20 / $100 / $200 por mês | Planos do Portal; opcional, não necessário para executar o agente |
| Kunavo | Sem assinatura; crédito pré-pago | Recarga mínima de $10, cobrada por token |
O nível Pro do Ollama Cloud também é listado a $200 por ano, cobrado anualmente, e seus planos incluem créditos mensais de uso — $60 no Pro, $300 no Max, $1.000 compartilhados no Team. Eles pertencem ao produto na nuvem, não ao endpoint local que você está corrigindo.
Para a rota com cobrança por uso, segue uma aritmética ilustrativa de tokens, não um custo de tarefa medido nem um limite de cobrança. Suponha uma sessão que envie 200.000 tokens de entrada não armazenados em cache e receba 12.000 tokens de saída, sem leituras do cache e sem cobranças de ferramentas externas. As tarifas são os preços atuais do catálogo da Kunavo por milhão de tokens.
| Modelo | Entrada / saída por 1M | Estimativa para essa sessão |
|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.182 |
| Claude Sonnet 5 | $1.40 / $7.00 | $0.364 |
Escale pelo número de sessões por dia que você realmente faz antes de tratar isso como um orçamento e observe que a menor tarifa listada e o menor custo para concluir a tarefa são afirmações diferentes — um modelo barato que precisa de três tentativas pode custar mais do que um que precisa de uma. O valor do catálogo da Kunavo é um piso de cobrança, não um teto: quando o upstream informa sua cobrança, a fatura é o maior valor entre o custo do catálogo e o custo do upstream multiplicado pela margem aplicável. Consulte detalhes de cobrança.
A melhor rota depende do trabalho. Ollama local é melhor para tarefas pequenas, privadas ou offline, sem cobrança por solicitação, tendo o hardware e o mínimo de 64.000 tokens como restrições reais. Uma API direta do provedor é melhor quando você trabalha com o modelo principal de um único provedor e quer os próprios termos de cache e processamento em lote. Um gateway é melhor quando você troca de modelo conforme a tarefa e quer uma única chave e um único saldo. Uma assinatura é melhor quando o uso intenso e diário a preço fixo atende melhor às suas necessidades do que tokens cobrados por uso.
Apontando o Hermes para outro lugar
Se você decidir adicionar um endpoint hospedado ao lado do local, a mecânica é a mesma do fluxo de provedor personalizado — e vale conhecer um limite antes de tentar: adicionar um provedor acontece em hermes model executado fora de uma sessão, porque, durante a sessão, /model alterna entre provedores já configurados e não pode adicionar um nem aceitar uma chave. A documentação API personalizada do Hermes Agent detalha o formato da entrada, os transportes e a reversão; Preços do Hermes Agent cobre as quatro cobranças separadas. A Kunavo publica referências de configuração, e não testes de compatibilidade: o Hermes nunca foi testado em tempo de execução contra o endpoint da Kunavo neste trabalho, portanto nada aqui estabelece que a descoberta do Hermes funcione contra ele. Mantenha sua rota funcional enquanto testa. A API compatível com OpenAI do Ollama explica por que o mesmo código de cliente alcança ambos, e crie uma conta na Kunavo quando quiser financiar uma chave.
Ainda está escolhendo um cliente em vez de depurar um? Alternativas ao Hermes Agent e API compatível com OpenAI abrangem o campo mais amplo.
Perguntas frequentes
Por que meus modelos do Ollama não aparecem no Hermes?
Várias causas distintas produzem esse sintoma, e elas são diferenciadas pelo sintoma, não pela configuração; estas são as que esta página separa. Uma está resolvida: um catálogo nativo do Ollama que nunca foi gravado no cache compartilhado do seletor, relatado como o issue #112898 do hermes-agent, encerrado como concluído em 17 de setembro de 2026, com a correção contida na tag v2026.9.21 (hermes-agent 0.21.4) e não em v2026.9.14. Ainda abertos em 21 de setembro de 2026: o snapshot de modelos visíveis do Hermes Desktop que congela o conjunto de modelos de um provedor no localStorage (#107391 — um relatório aberto sobre modelos do GitHub Copilot e a segunda das duas causas que ele nomeia; o mecanismo em si não está vinculado a um único provedor), um provedor Ollama personalizado cujo seletor /model mostra zero modelos (#89874, com o rótulo needs-repro) e modelos presentes na API do Ollama, mas ausentes no menu suspenso do desktop (#71169). Há mais uma causa que não é um bug: uma entrada personalizada com nome explícito que não está na porta 11434 e cuja URL não corresponde a providers.ollama.base_url configurado não segue o caminho nativo /api/tags do Hermes, sendo sondada em /v1/models; já uma entrada chamada custom:ollama, ou cujo nome termina em -ollama, segue o caminho nativo independentemente da porta.
O bug do seletor Ollama do Hermes foi corrigido? Em qual versão?
Sim, para o relatório específico. O issue #112898 descreveu um endpoint Ollama local configurado cujo catálogo nativo nunca foi admitido em provider_models_cache.json, portanto qualquer abertura do seletor que não o consultasse ao vivo o renderizava vazio. O pull request #113129 foi mesclado em 17 de setembro de 2026 como o commit d6d6565, e uma comparação no GitHub mostra que esse commit está contido na tag v2026.9.21 e ausente de v2026.9.14. O próprio pull request #112900 do colaborador ainda está aberto, o que não é evidência de que a correção esteja ausente — seu conteúdo foi incorporado com a autoria preservada ao pull request mesclado. Isso é contenção do Git em uma tag; não foi verificado se o pacote pip, a fórmula do Homebrew, a imagem Docker ou o canal de atualização automática do desktop que você instalou a contém.
Por que hermes model --refresh mostra meus modelos, mas /model não?
Porque uma abertura normal do seletor não consulta todos os endpoints. Somente o endpoint personalizado atual é buscado ao vivo; todos os outros endpoints configurados são respondidos pelo cache em disco em $HERMES_HOME/provider_models_cache.json. Uma linha de cache fria, ou uma cuja impressão digital da credencial não corresponda mais, portanto renderiza zero modelos mesmo enquanto o endpoint está saudável. O próprio texto de ajuda da flag hermes model --refresh diz que ela apaga o cache em disco do seletor de modelos e busca novamente a listagem ao vivo de cada provedor, razão pela qual a execução atualizada parece correta e a próxima abertura simples não. Essa flag aparece no analisador de argumentos do comando; não foi encontrada na página de referência dos comandos CLI publicada, portanto trate a string de ajuda como sua fonte.
Meu modelo aparece no Ollama, mas não no menu do Hermes Desktop. É o mesmo bug?
Provavelmente não, e há um indício. O issue #107391 foi aberto sobre modelos do GitHub Copilot e nomeia duas causas combinadas; a relevante aqui é a segunda — um conjunto de modelos visíveis armazenado no localStorage do renderizador do desktop sob a chave hermes.desktop.visible-models. Depois que um provedor tem quaisquer chaves armazenadas, esse conjunto é respeitado exatamente, e os modelos recém-descobertos nunca são mesclados a ele. Ao ler apps/desktop/src/store/model-visibility.ts na tag v2026.9.21 em 21 de setembro de 2026, esse comportamento ainda estava no código-fonte distribuído e o issue continuava aberto. O indício é que a pesquisa ainda encontra o modelo e a seleção ativa ainda é exibida, enquanto o menu não o lista. O issue #114369 reproduziu o mesmo mecanismo em um provedor personalizado com discover_models true e foi encerrado como duplicata, não como corrigido — e usou um endpoint vLLM em vez do Ollama, portanto o mecanismo é independente do provedor, mas essa reprodução específica não é uma reprodução com Ollama.
Uma entrada de provedor do Hermes usa api ou base_url para a URL do endpoint?
Qualquer um dos dois. A referência de configuração publicada documenta api como a URL base do endpoint para uma entrada em providers:, e sua lista de campos dessa entrada nomeia base_url e url como aliases aceitos para ela. base_url é separadamente a chave no mapeamento de nível superior model:. A mesma documentação registra que configurações antigas usavam uma lista custom_providers: de nível superior com base_url em vez de api, e que isso continua funcionando e é migrado automaticamente para o dicionário providers: ao executar hermes update na configuração v12. Os relatórios de bugs no rastreador são escritos das duas formas, o que é consistente com a leitura de ambas. Portanto, a grafia dessa chave é uma explicação improvável para uma entrada de providers que não tem efeito — observe o endpoint e os outros campos da entrada.
Corrigir isso custa alguma coisa?
Não. O Hermes Agent é gratuito e licenciado sob MIT — sua FAQ afirma que você paga apenas pelo uso da API de LLM do provedor escolhido e que os modelos locais são totalmente gratuitos para executar — e executar modelos Ollama no seu próprio hardware é gratuito segundo a própria página de preços da Ollama, consultada em 21 de setembro de 2026. Todo valor em dólares que pudesse estar associado a este problema pertence a outra coisa para a qual você poderia mudar: planos do Ollama Cloud, que o Hermes trata como um slug de provedor separado de primeira classe, uma assinatura do Nous Portal ou uma chave de API cobrada por uso. A Kunavo não vende nada disso como assinatura; ela oferece crédito pré-pago com recarga mínima de $10.
O que foi verificado em 21 de setembro de 2026 e como: os estados de issues e pull requests, a contenção das tags para ambas as correções, a tag da versão mais recente e o status de licença e arquivamento do repositório vieram da API do GitHub; as constantes do cache, o controle de descoberta, o armazenamento de visibilidade do desktop, a string de ajuda --refresh e as citações da documentação foram lidos do código-fonte na tag v2026.9.21; a página de preços do Ollama, a própria página de integração do Ollama com o Hermes e a lista de planos do Nous Portal foram obtidas no mesmo dia. Não foi verificado: se o artefato do pip, Homebrew, contêiner ou atualização automática do desktop que você instalou contém alguma das duas correções. Nada aqui foi testado em tempo de execução — nenhuma instalação do Hermes foi executada, nenhum Ollama foi iniciado e nenhum seletor foi aberto. As tarifas de tokens da Kunavo vêm do catálogo atual, e o exemplo em dólares é uma aritmética ilustrativa de tokens, não um custo de tarefa medido.