Documentação

Documentação

Page Assist

O Page Assist foi criado para um Ollama local, mas a mesma tela também aceita um endpoint hospedado: Configurações → OpenAI Compatible API → Add Provider → Custom, três campos, e a barra lateral resume a aba aberta usando Claude ou GPT em vez do que couber na memória RAM do seu laptop.

Settings → OpenAI Compatible API → Add Provider → Custom: Provider Name, uma Base URL que mantém /v1 e a chave — depois marque os IDs de modelo da lista que o Page Assist busca por conta própria.

Settings → OpenAI Compatible API → Add Provider → Custom
Provider Name   Kunavo
Base URL        https://api.kunavo.com/v1
API Key         sk-kn-...
                [ Save ]

Model List      (appears after Save — fetched from GET /v1/models)
  [x] claude-haiku-4-5
  [x] claude-sonnet-5
  [x] gpt-5-6-terra
O Base URL mantém o sufixo /v1. A página OpenAI Compatible API não diz isso por si só — é o campo que informa. O texto de ajuda diz “A URL base do provedor da API OpenAI. ex. (http://localhost:1234/v1)”, e as duas páginas de provedores semelhantes que exibem uma URL concreta para o mesmo campo confirmam isso: na do LM Studio, “por padrão é http://localhost:1234/v1”, e na do LLaMA.cpp, http://localhost:8080/v1. O Page Assist acrescenta apenas a rota, então a origem simples retorna 404 em vez de 401 — o contrário dos clientes no estilo Anthropic, que querem apenas a origem.
A Model List é obtida do endpoint, não preenchida manualmente — em geral. Depois de Save, o Page Assist abre uma Model List com “Selecione os modelos de chat que você quer usar com este provedor”, preenchida com dados do endpoint. O Kunavo responde GET /v1/models, então a lista é preenchida automaticamente. Se ela vier vazia, a extensão diz “Nenhum modelo encontrado. Verifique se você adicionou um provedor correto com a URL base e a chave de API”, o que é preciso: uma lista vazia costuma indicar um problema na URL Base ou na chave, muito mais do que no catálogo. Verifique isso com o curl abaixo antes de mexer na extensão. Também é possível adicionar IDs manualmente por meio de Add Custom Model, cujo campo Model ID aceita, sem alterações, um slug da tabela nesta página.
Selecione Chat Model, não a outra opção. O formulário Add Custom Model oferece uma opção Model Type, e o Kunavo não disponibiliza nenhum modelo de embedding — nada no catálogo atende a esse endpoint, então a segunda opção não tem para onde apontar aqui. O recurso Knowledge Base depende disso: a página do próprio fornecedor diz que é preciso configurar um em RAG Settings e recomenda nomic-embed-text. Mantenha um Ollama local configurado junto com este provedor para essa tarefa — o Page Assist permite manter vários provedores ao mesmo tempo, e as duas funções não precisam vir do mesmo lugar.
As configurações de áudio são uma etapa separada. A seção Text-to-Speech do Page Assist oferece um provedor OpenAI TTS com seus próprios campos API Key, Base URL e TTS Model, e o Kunavo não disponibiliza nenhum modelo de conversão de texto em fala. O mesmo vale na direção oposta: o Kunavo não disponibiliza nenhum modelo de conversão de fala em texto, e a entrada de voz do Page Assist usa o próprio reconhecedor do navegador, configurado em Speech Recognition Language, em vez de fazer uma chamada de API. Deixe ambas as seções configuradas como já estão.
Esta configuração foi compilada a partir da documentação e dos textos da interface do fornecedor na data abaixo. O Kunavo não executou o Page Assist contra seu endpoint — nenhum build específico da extensão foi fixado, nenhuma sessão na barra lateral, nenhuma resposta transmitida por streaming e nenhum ciclo de chamada de ferramentas. Uma página de configuração publicada não é um teste, e nada aqui deve ser interpretado como tal. O que você pode verificar por conta própria em dez segundos é o curl; o comportamento da extensão sobre um endpoint funcional fica entre você e o Page Assist.
Ainda não tem uma chave? Crie uma conta na Kunavo, gere uma chave (ela começa com sk-kn-) e adicione crédito a partir de $10 — as chamadas são pagas com esse saldo, e chamadas malsucedidas não são cobradas. O painel então abre na configuração de Page Assist.

Passo a passo

  1. Crie uma chave em /app/keys e copie-a — ela é exibida uma única vez.
  2. Clique no ícone do Page Assist na barra de ferramentas do navegador, depois no ícone Settings e acesse a aba OpenAI Compatible API.
  3. Clique em Add Provider. O Kunavo não está entre as opções predefinidas no menu suspenso, então escolha Custom — esse é o caminho descrito na etapa 5 do fornecedor para qualquer opção que não esteja na lista.
  4. Preencha Provider Name, Base URL = https://api.kunavo.com/v1 e API Key, depois clique em Save.
  5. Na Model List que se abre, marque os IDs desejados. Dois costuma ser o número ideal: um modelo barato para resumir páginas e outro potente para as perguntas seguintes.
  6. Abra a barra lateral em uma página real — Ctrl+Shift+L abre a Web UI —, selecione o modelo e faça uma pergunta sobre a aba. Uma página com conteúdo de verdade informa mais do que uma saudação, porque é o texto da página que custa dinheiro.

Verificado em Página OpenAI Compatible API do Page Assist em 21 de setembro de 2026. As configurações de terceiros podem mudar; se o nome de um campo aqui já não corresponder ao que você vê, aquela página é a autoridade, não esta.

Verifique antes de depurar o cliente

Uma solicitação determina se a falha está no endpoint, na chave ou no arquivo de configuração. Se isto retornar JSON, a mesma URL base e a mesma chave funcionarão em Page Assist.

# Settles whether a failure is the endpoint, the key, or the client.
curl -sS https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer sk-kn-..."

Qual ID de modelo inserir no campo

Todo modelo de texto pode ser acessado como um ID de modelo — a lista atual está em GET /v1/models, e o catálogo com preços está na página de modelos. As tarifas são em USD por 1 milhão de tokens, entrada / saída.

ID do modeloEntrada / saída da KunavoOnde se encaixa em Page Assist
claude-haiku-4-5$0.70 / $3.50a opção padrão para uma barra lateral: resumos de páginas e perguntas de acompanhamento, em que o volume predomina
gpt-5-6-terra$0.70 / $4.20páginas longas — documentação, conversas, transcrições — enviadas inteiras, em vez de reduzidas
claude-sonnet-5$1.40 / $7.00a pergunta feita depois do resumo, quando a resposta precisa estar correta
gpt-5-6-sol$2.00 / $12.00uma segunda opinião de outra família; adicione-a como um segundo ID marcado, do mesmo provedor
A cobrança é por token, usando um saldo pré-pago e sem tarifa mensal — consulte billing. Em contextos repetidos — que representam a maior parte do que um editor ou cliente de chat envia — o cache de prompt altera a conta mais do que a escolha do modelo.

Quanto custa a página e o que sai do navegador

Um cliente de barra lateral cobra de forma diferente de um editor, e a diferença está na página. A cada interação em que o Page Assist conversa sobre a aba, o texto extraído dela é enviado como tokens de entrada — uma página de documentação ou uma conversa longa pode conter dezenas de milhares de tokens, e o texto é reenviado a cada pergunta de acompanhamento na mesma conversa. Por isso, a tabela de modelos acima começa pelos IDs baratos: neste cliente, o volume de entrada costuma superar o de saída em uma ordem de grandeza, e claude-haiku-4-5 ou gpt-5-6-terra processar uma página inteira custa menos do que usar um modelo mais potente com uma versão truncada dela.

Três configurações geram tráfego que você não pediu explicitamente, e as três estão listadas na página Settings do fornecedor:

  • Generate Title using AI — “Gera automaticamente um título para o chat com base na conversa”. Uma chamada extra por conversa, usando o modelo selecionado.
  • Internet Search, com Internet Search ON by default e Total Search Results — as páginas obtidas entram no prompt, então a conta de tokens aumenta com a quantidade de resultados.
  • Page Action, a extensão complementar — o modelo “começa lendo a página e depois executa as ações uma etapa por vez”, o que significa ler o DOM a cada etapa, não a cada conversa. A opção Require approval before each action vem ativada por padrão e vale a pena manter assim.

O limite de privacidade segue a mesma divisão. O Page Assist armazena chats, a base de conhecimento e as configurações localmente no armazenamento do navegador; o que atravessa a rede é o que você envia. Depois que este provedor é selecionado, isso significa que o texto da página, sua mensagem e o histórico da conversa vão para api.kunavo.com, e daí para o serviço upstream que atende o ID do modelo — consulte a política de privacidade para saber o que é armazenado deste lado. Se você não colaria uma página em uma janela de chat, volte a usar um Ollama local; a extensão permite manter os dois provedores configurados ao mesmo tempo justamente para que a troca seja feita em um único menu suspenso.

Se você chegou aqui pelo preset do OpenRouter

O OpenRouter não precisa do caminho Custom. Ele é uma das opções predefinidas listadas na página OpenAI Compatible API do fornecedor — junto com Ollama, LM Studio, Groq, Together, Mistral, xAI e cerca de vinte outras —, então o caminho é o mesmo nos quatro primeiros cliques; depois, selecione OpenRouter no menu suspenso em vez de Custom, informe a chave em API Key e clique em Save. O preset traz sua própria URL Base, e os IDs de modelo do OpenRouter incluem o prefixo do fornecedor — no formato anthropic/claude-sonnet-4.5 —, enquanto os IDs da tabela acima não têm prefixo. Escolher um provedor aqui é escolher qual espaço de nomes de IDs você vai usar.

Vale a pena mudar para este cliente especificamente se você quer uma única tela que também dê acesso a modelos que o Kunavo não oferece ou se já tem uma chave configurada e o custo adicional de configuração é zero. Vale a pena mudar para o Kunavo se você também usa os IDs da tabela nas ferramentas de programação, pois uma única chave atende aos dois casos, e o cache de prompt no contexto da página reenviado é onde está o custo real de uma barra lateral — consulte caching. Nada impede que você mantenha os dois provedores: o Page Assist lista ambos, e o seletor de modelos não depende de qual deles forneceu um modelo.

Perguntas frequentes

Como uso uma API personalizada com o Page Assist?

Clique no ícone do Page Assist na barra de ferramentas do navegador, abra Settings, acesse a aba OpenAI Compatible API e clique em Add Provider. Se o seu endpoint não estiver entre as opções predefinidas do menu suspenso, selecione Custom e preencha Provider Name, Base URL e API Key; depois, clique em Save. Em seguida, o Page Assist abre uma Model List obtida do endpoint, onde você marca os modelos de chat que quer usar com esse provedor. Também é possível inserir IDs manualmente por meio de Add Custom Model, caso a consulta não retorne nada.

A URL base do Page Assist precisa incluir /v1?

Sim, para um endpoint compatível com OpenAI. A página OpenAI Compatible API não diz isso, mas a própria ajuda do campo Base URL diz — “A URL base do provedor da API OpenAI. ex. (http://localhost:1234/v1)” — e as páginas do LM Studio e do LLaMA.cpp mostram o mesmo sufixo no mesmo campo: http://localhost:1234/v1 e http://localhost:8080/v1. Para o Kunavo, isso significa https://api.kunavo.com/v1. O Page Assist acrescenta apenas a rota, então omitir o sufixo resulta em 404, não em um erro de autenticação.

Por que o Page Assist não mostra modelos depois que adiciono um provedor?

A lista é obtida do endpoint usando a chave que você acabou de inserir, e a mensagem da própria extensão diz o que verificar: “Nenhum modelo encontrado. Verifique se você adicionou um provedor correto com a URL base e a chave de API.” Teste o mesmo par fora da extensão com um curl para /v1/models — se retornar JSON, o problema está nos dados do provedor; 401 indica problema na chave; 404 geralmente indica que falta /v1 na URL Base. Se isso não resolver, adicione os IDs manualmente por meio de Add Custom Model, que não depende da consulta.

O Page Assist pode usar Claude ou GPT em vez de um modelo local?

Sim. “OpenAI Compatible API” identifica o formato de comunicação, não o fornecedor, e o ID do modelo é encaminhado ao endpoint configurado na URL Base — então um ID Claude ou GPT é resolvido nesse endpoint, não dentro da extensão. Os recursos de modelos locais continuam disponíveis: o Page Assist permite manter vários provedores ao mesmo tempo, então uma opção Ollama e outra hospedada podem ficar lado a lado, e você pode alternar entre elas no seletor de modelos.

Qual modelo é o mais barato para usar com o Page Assist?

Neste cliente, o volume de entrada predomina, porque conversar sobre uma aba reenvia o texto extraído dela a cada interação da conversa. Por isso, o padrão ideal é um modelo barato com contexto longo — claude-haiku-4-5 para páginas comuns, gpt-5-6-terra para páginas longas —, com um ID mais potente, como claude-sonnet-5, marcado como segunda opção para as perguntas em que a resposta é importante. As tarifas por milhão de tokens de cada modelo estão na tabela desta página, e o cache de prompt afeta a conta de uma barra lateral mais do que a escolha do modelo.

A Knowledge Base do Page Assist pode usar o Kunavo?

Não para a etapa de indexação. A Knowledge Base é um recurso RAG, e a documentação do fornecedor diz que é preciso configurar um modelo de embedding em RAG Settings, recomendando nomic-embed-text; o Kunavo não disponibiliza nenhum modelo de embedding, então esse campo precisa usar outro provedor — normalmente um Ollama local, que funciona junto com este sem conflitos. A parte de chat não é afetada: depois que os documentos são indexados, qualquer ID de chat deste provedor pode responder a perguntas sobre eles.

O Kunavo testou o Page Assist?

Não. O que foi verificado, em 21 de setembro de 2026, foi a documentação OpenAI Compatible API do próprio Page Assist e os textos em inglês da interface da extensão — a navegação por Settings, os rótulos e a ordem dos campos, o exemplo de URL Base e a mensagem exibida quando a lista está vazia foram extraídos dessas fontes. O Kunavo não instalou a extensão, fixou uma versão específica nem enviou uma solicitação por meio dela, e não faz nenhuma afirmação sobre o streaming, a extração de páginas ou o funcionamento da consulta da Model List em qualquer versão específica. A parte que você pode verificar de forma independente é o curl nesta página.