Para escolher a melhor API para o OpenClaw, comece com um provedor de modelos documentado. Escolha o OpenRouter pela variedade de modelos, a Anthropic diretamente para uma configuração focada em Claude e compare o Kunavo quando a tarifa do modelo for seu principal critério de compra. Para a configuração sustentável mais barata, separe verificações rotineiras de trabalhos difíceis em vez de enviar toda tarefa para um único modelo caro.
Este guia compara a API de LLM que produz as respostas e chamadas de ferramentas do assistente. Serviços de pesquisa, navegação e imagem são compras separadas. Para hospedagem e o custo operacional completo, consulte preços do OpenClaw.
Escolha o provedor pelo que você está comprando
| Opção | Mais adequada | Trade-off da compra |
|---|---|---|
| Fornecedor direto de modelos, como a Anthropic | Você sabe qual família de modelos quer | Conta, tarifas e recursos do fornecedor; outra família exige outra conexão |
| OpenRouter | Você quer ampla escolha de modelos e roteamento de provedores | Inspecione as tarifas de cada modelo, os provedores disponíveis e as preferências de roteamento |
| Kunavo | Você quer os modelos Claude, GPT ou Gemini listados por ele nas tarifas publicadas da API | Use um provedor personalizado; confirme a API selecionada e o fluxo de ferramentas antes de migrar |
| Modelos hospedados gratuitos | Exploração e trabalhos que toleram interrupções | Limites de solicitações, disponibilidade do modelo e recursos compatíveis restringem o uso |
| Inferência local | Você tem hardware adequado e quer operar o modelo localmente | Capacidade do hardware, latência, manutenção e suporte a ferramentas tornam-se sua responsabilidade |
O OpenClaw publica um diretório de provedores, um guia de configuração do OpenRouter e uma referência separada de provedores personalizados. Um gateway listado em uma tabela de preços não é automaticamente uma integração integrada ao OpenClaw.
Use modelos diferentes para trabalhos diferentes
Para resumos curtos, classificação e verificações de heartbeat delimitadas, comece com Claude Haiku 4.5. Para programação comum e trabalho com ferramentas, selecione Claude Sonnet 5. Para mudanças complexas em repositórios e raciocínio prolongado, selecione Claude Opus 5. Esses pontos de partida seguem as orientações de seleção de modelos da Anthropic; não são resultados de benchmark do OpenClaw.
Torne explícita a regra de escalonamento. Uma verificação rotineira pode informar um status conhecido ou encaminhar uma condição desconhecida ao modelo mais forte. Ela não deve se transformar silenciosamente em uma grande tarefa de depuração. Se a verificação apenas compara um valor com um limite, faça essa comparação diretamente e reserve o modelo para interpretar exceções.
O nível de capacidade e o preço do provedor são decisões separadas. Compare a linha real do modelo que você quer; as tarifas de um gateway não precisam seguir a mesma ordem dos preços de tabela do fornecedor.
Uma comparação concreta de preços
Compare o mesmo modelo entre provedores. A tabela mostra USD por milhão de tokens padrão de entrada e saída sem cache: preços da API direta da Anthropic verificados em 17 de setembro de 2026, ao lado das atuais tarifas do catálogo do Kunavo. Cobranças de cache, ferramentas pagas e impostos são separados.
| Modelo | Anthropic diretamente: entrada / saída | Kunavo: entrada / saída | Função do candidato |
|---|---|---|---|
| Claude Haiku 4.5 | $1.00 / $5.00 | $0.70 / $3.50 | Trabalho rotineiro e delimitado |
| Claude Sonnet 5 | $2.00 / $10.00 | $1.40 / $7.00 | Programação e uso de ferramentas no dia a dia |
| Claude Opus 5 | $5.00 / $25.00 | $3.50 / $17.50 | Tarefas complexas e escalonamento |
Suponha que seu mês contenha 10 milhões de tokens de entrada sem cache e 1 milhão de tokens de saída. Colocar todos eles em Claude Opus 5 custa $52.50 nessas tarifas. Alocar 9 milhões de tokens de entrada e 900.000 tokens de saída a Claude Haiku 4.5, com o restante em Claude Opus 5, custa $14.70.
Isto é uma operação aritmética para uma divisão de carga de trabalho presumida, não uma economia prometida. Exclui cobranças de cache, ferramentas externas e infraestrutura, e pressupõe que o modelo menor consiga concluir o trabalho atribuído sem tentativas adicionais. Essa última condição determina se a tarifa menor produz uma conta menor.
Planeje o primeiro pagamento e o contexto recorrente
O Kunavo começa com uma recarga pré-paga de $10, sem assinatura obrigatória e com saldo que não expira. Uma tarefa pequena consome parte desse saldo; seu custo em tokens não é o dinheiro necessário para abrir uma conta financiada. O guia de cobrança também explica por que uma estimativa do catálogo não é um teto de preço: a cobrança final pode ser maior quando o faturamento baseado no custo upstream excede essa estimativa.
Os termos de crédito do OpenRouter estabelecem uma compra mínima de $5. Sua taxa padrão de cartão no pagamento conforme o uso é de 5,5%, com mínimo de $0.80 por recarga. Isso faz com que $5 em créditos custem $5.80 antes dos impostos, ou que $100 custem $105.50. A taxa é paga ao financiar a conta, não adicionada novamente a cada chamada da API. Compare o crédito financiado que você realmente consumirá.
Para um assistente que envia repetidamente as mesmas instruções, compare os acertos de cache informados antes de escolher com base no preço de entradas novas. Sonnet 5 direto custa $0.20 por milhão de tokens lidos do cache, $2.50 para gravações de cinco minutos e $4 para gravações de uma hora; a tarifa de leitura do cache do catálogo do Kunavo para o mesmo modelo é $0.14. As gravações de cache do Claude no Kunavo são cobradas a 1,25 vezes a tarifa de entrada. Essas tarifas de cobrança não estabelecem que toda rota do OpenClaw use cache: verifique o uso retornado antes de orçar verificações rotineiras como acertos de cache.
Os preços da Anthropic incluem a janela de contexto compatível de 1M às tarifas padrão para Sonnet 5 e Opus 5; a Kunavo também não cobra sobretaxa por contexto longo para esses modelos Claude. Um histórico mais longo ainda significa mais tokens cobrados. Mantenha as verificações recorrentes limitadas e inclua separadamente uma estimativa mensal de entrada nova, gravações no cache, leituras do cache e saída.
Quando o OpenRouter, o gratuito ou o local é a melhor opção de compra
Escolha o OpenRouter quando precisar comparar famílias de modelos ou controlar as preferências do provedor upstream. A documentação de roteamento oferece suporte a prioridades como preço, latência e throughput. Selecione um modelo concreto e verifique seu preço atual, em vez de presumir que uma rota automática sempre escolherá o resultado aceitável mais barato.
Use endpoints gratuitos para a exploração inicial ou para trabalhos não urgentes. O OpenRouter documenta os limites de solicitações de modelos gratuitos, portanto um preço de token zero não garante capacidade suficiente para um assistente sempre ativo. Evite fazer uma rotina sensível ao tempo depender de uma cota que você ainda não verificou.
Escolha a inferência local quando o hardware já estiver disponível e sua operação for aceitável. A configuração do Ollama no OpenClaw verifica os recursos do modelo, incluindo suporte a ferramentas. Um modelo que conversa bem, mas não consegue executar o fluxo de trabalho de ferramentas necessário, não é uma boa opção para esse trabalho.
Compre uma rota funcional antes de adicionar complexidade de fallback
Primeiro escolha a função do modelo e o provedor. Confirme o ID do modelo, o endpoint, o streaming, as chamadas de ferramentas e os relatórios de uso com uma tarefa limitada. Depois, adicione rotas de fallback com um orçamento conhecido; caso contrário, uma falha pode transferir silenciosamente o trabalho para outra faixa de preço ou capacidade.
Configure uma rota da Kunavo no OpenClaw
Esta é uma configuração inicial somente de texto, baseada no esquema de provedor personalizado do OpenClaw e no endpoint Messages da Kunavo. Ela não foi validada aqui com uma tarefa paga do OpenClaw. Mantenha sua rota atual em funcionamento durante o teste.
- Crie uma chave da Kunavo em API keys e adicione fundos à conta em billing quando estiver pronto para enviar solicitações pagas.
- Defina
KUNAVO_API_KEYno ambiente do gateway. O OpenClaw também lê~/.openclaw/.env, onde você pode adicionarKUNAVO_API_KEY=your-key; uma variável de processo existente tem precedência. Consulte a referência de ambiente. Mantenha a chave real fora dos arquivos do projeto. - Faça backup da configuração e mescle os campos abaixo em
~/.openclaw/openclaw.json, preservando seus outros provedores, agentes e canais. O guia de configuração aborda locais de arquivo não padrão.
{
"models": {
"mode": "merge",
"providers": {
"kunavo": {
"baseUrl": "https://api.kunavo.com",
"apiKey": "${KUNAVO_API_KEY}",
"api": "anthropic-messages",
"authHeader": true,
"models": [
{
"id": "claude-haiku-4-5",
"name": "Claude Haiku 4.5",
"input": [
"text"
],
"contextWindow": 200000,
"maxTokens": 1024
}
]
}
}
},
"agents": {
"defaults": {
"model": {
"primary": "kunavo/claude-haiku-4-5"
}
}
}
}A URL base é a origem: este adaptador acrescenta /v1/messages. O prefixo kunavo/ identifica o provedor do OpenClaw; o ID do modelo da solicitação permanece claude-haiku-4-5. Aqui, 1024 é um limite de saída deliberadamente pequeno para o primeiro teste, não o máximo nativo do modelo. O exemplo declara apenas entrada de texto.
openclaw config validate
openclaw gateway restart
openclaw models list --provider kunavoA validação da configuração verifica a configuração, enquanto a listagem de modelos verifica o catálogo carregado; nenhuma das duas comprova que uma tarefa paga funciona. Reinicie antes da listagem para que um gateway em execução carregue o novo provedor. Abra uma sessão nova e confirme o modelo ativo: uma sessão ou agente existente pode manter uma substituição do padrão.
Para a primeira tarefa, peça que ele leia um README pequeno de teste e o resuma; depois faça uma pergunta de acompanhamento sobre esse arquivo. Verifique o resultado da ferramenta, o streaming da resposta e a cobrança registrada na Kunavo antes de transferir trabalhos agendados. Um 401 exige verificar a chave no ambiente do gateway; um erro de modelo não encontrado exige verificar o prefixo do provedor e o ID do modelo. A ausência de metadados locais de custo pode mostrar uma estimativa zero mesmo quando o provedor cobrou a solicitação.
Perguntas frequentes
Qual é a melhor API para o OpenClaw?
Escolha um provedor documentado diretamente, como a Anthropic, quando quiser um único fornecedor de modelos e uma configuração simples. Escolha o OpenRouter quando uma seleção ampla de modelos e o roteamento de provedores forem requisitos centrais. Considere o Kunavo quando suas tarifas publicadas forem adequadas aos modelos selecionados, com uma etapa de verificação do provedor personalizado. Use inferência local quando puder operar o hardware e o modelo atender aos seus requisitos de uso de ferramentas.
Qual é o modelo mais barato para o OpenClaw?
Endpoints de modelos gratuitos podem ter preço de inferência zero, mas também limites de uso e restrições de disponibilidade. Para trabalhos pagos, escolha o modelo menos caro que conclua a tarefa com um esforço de revisão aceitável. Haiku 4.5 é um candidato concreto para trabalhos rotineiros delimitados; um modelo mais forte pode ser mais econômico para uma tarefa difícil se evitar tentativas malsucedidas repetidas.
Posso usar um modelo barato para verificações de heartbeat?
Sim, se a verificação tiver uma entrada delimitada e uma decisão clara, e o modelo escolhido oferecer suporte às ferramentas necessárias. Mantenha programação complexa ou investigação aberta em uma rota separada. Uma verificação determinística de status talvez nem precise de um modelo.
Uma API de pesquisa é a API que o OpenClaw usa para pensar?
Não. A API do modelo principal gera respostas e chamadas de ferramentas. Uma API de pesquisa na web fornece informações como ferramenta e pode ter uma cobrança separada. Comprar créditos de pesquisa não financia as solicitações ao modelo do assistente.
Documentação oficial verificada em 17 de setembro de 2026. As tarifas da Kunavo e os totais ilustrativos são calculados a partir do catálogo de modelos atual.