A melhor API para o Cherry Studio é qualquer provedor que responda nos protocolos de que seus recursos precisam, porque o próprio Cherry Studio é gratuito e não cobra nada: ele é um software de código aberto AGPL-3.0, e cada centavo gasto é cobrado pelo provedor por trás da caixa do endpoint. A própria documentação do gateway de API da Cherry explica isso claramente — "o uso e as cobranças continuam sendo gerados pelo provedor real do modelo" — portanto, "preço do Cherry Studio" é, na prática, uma pergunta sobre tarifas de tokens, multiplicadas por algumas configurações padrão que silenciosamente enviam mais solicitações do que você pediu.
Quatro coisas compartilham o nome, e nenhuma delas é o cliente desktop gratuito. O Cherry Studio Enterprise é um produto separado, implantável de forma privada, vendido mediante orçamento no README. O CherryAI é o provedor gratuito integrado. O CherryIN é o gateway pago que o Cherry Studio fornece como provedor integrado, em open.cherryin.ai. E a listagem "Cherry Studio" na Apple App Store (id 6476445971) é um aplicativo de Saúde e fitness de um desenvolvedor não relacionado; portanto, não a trate como a versão móvel. Esta página trata apenas do cliente desktop de CherryHQ/cherry-studio.
Uma observação sobre versões antes de qualquer tutorial que você seguir, inclusive os mais antigos deste site. O repositório está ativo e não arquivado, usa a licença AGPL-3.0 e tem mais de 52.000 estrelas; o último push ocorreu em 21 de setembro de 2026 (API do GitHub, verificado em 21 de setembro de 2026). A v2.0.0 foi lançada em 5 de agosto de 2026 — dois dias depois da versão final da v1 — e a v2.1.0 em 18 de setembro de 2026 (API de releases, mesma verificação; a última versão da v1, v1.9.13, é datada de 3 de agosto de 2026). A caixa de diálogo de provedor personalizado mudou na v2 — uma única lista suspensa "Type: OpenAI" tornou-se um conjunto de URLs base independentes por protocolo. Capturas de tela e nomes de campos de um tutorial da era v1 não correspondem mais.
Preços do Cherry Studio: a linha do software e a linha do modelo
| Item | Quanto custa | Fonte |
|---|---|---|
| Cherry Studio Community Edition (Windows, macOS, Linux) | US$ 0, AGPL-3.0 | Campo de licença do repositório e o README |
| Uso comercial da edição comunitária | US$ 0 se você cumprir a AGPL-3.0; caso contrário, uma licença comercial mediante contato | Seção de licença do README |
| CherryAI, o provedor gratuito integrado | US$ 0; cotas e limites de tarifa não são publicados | Documentação do provedor CherryAI |
| Cada chamada de modelo, inclusive por meio do gateway de API local da Cherry | Tarifa do seu provedor por token ou por imagem | Documentação do gateway de API |
| Cherry Studio Enterprise | Um produto diferente; nenhum preço é publicado — veja abaixo | Tabela comparativa do README e documentação empresarial |
A linha empresarial é onde os resultados de pesquisa enganam, porque a página oficial mais bem posicionada para "cherry studio pricing" nos resultados amostrados para esta página é a documentação empresarial — e ela não publica preço algum de plano. O corpo é renderizado por JavaScript; uma busca simples em 21 de setembro de 2026 retornou apenas a própria linha de descrição da página, que menciona planos baseados em assinatura mais uso baseado em tokens, com suporte a Alipay e transferência bancária. A comparação de edições do README não é mais específica: informa o custo empresarial como "Buyout / Subscription Fee" em contraste com a licença AGPL-3.0 da edição comunitária e orienta os interessados a solicitar um orçamento. O site de marketing empresarial é uma aplicação JavaScript cujos valores esta página não conseguiu ler, portanto nenhum valor dele é citado aqui. Se a edição empresarial é o que você quer, obtenha o orçamento por escrito.
Para todo o restante, o cliente é gratuito; a questão é quanto custam as chamadas.
As configurações padrão que cobram mais do que você pediu
Esta é a parte que uma tabela de preços não consegue mostrar. O Cherry Studio cobra várias funções de modelo separadamente, e a configuração padrão de compressão do histórico coloca silenciosamente o seu modelo mais caro em um trabalho que não precisa dele.
| O que dispara uma solicitação | Padrão | Efeito na cobrança |
|---|---|---|
| Comparação de modelos em uma mensagem | Você escolhe quantos | "Selecionar vários modelos ao mesmo tempo enviará solicitações separadas" — três modelos significam três cobranças por uma pergunta |
| Modelo Quick | Definido em Settings → Default Model | Nomeação de conversas e extração de palavras-chave de pesquisa; a documentação da Cherry recomenda um modelo leve "barato e rápido", não um modelo de raciocínio |
| Modelo de tradução | Definido separadamente | A tradução de mensagens e páginas é cobrada por conta própria, não contra o seu modelo de chat |
| Modelo de pintura | Definido separadamente | O padrão para geração de imagens, cobrado pelo provedor que o fornece |
| Compressão automática do histórico | Ativada, modelo de compressão "Follow the current model" | Resumir o histórico anterior é cobrado à tarifa do seu modelo principal, a menos que você o direcione para outro modelo |
| Nova tentativa de chamada do modelo | Desativada; quando ativada, até 3 tentativas com espera exponencial, além de modelos de fallback ordenados | A nova tentativa e o fallback só entram em vigor antes do início da saída, portanto cada tentativa adicional é outra solicitação enviada ao seu provedor |
| Truncamento da saída de ferramentas | 50.000 caracteres | Limita quanto da saída de ferramentas pode ser inserido no prompt de uma só vez |
Consultado nas páginas do Cherry Studio sobre modelos padrão, contexto e compressão e comparação de modelos, verificadas em 21 de setembro de 2026. Vale repetir a própria recomendação da Cherry sobre o recurso de comparação: quando tarifas, velocidade ou dados confidenciais estiverem envolvidos, confirme primeiro com uma pergunta curta e só depois envie o material extenso.
O valor de custo no aplicativo é uma estimativa e aparece alto em um gateway com desconto
O painel Usage Statistics do Cherry Studio mostra um custo total, uma taxa de acerto de cache e uma divisão por provedor, modelo, chave de API e assistente nos últimos 30 dias, 90 dias ou ano. Esse total não é uma leitura da sua conta. A documentação afirma que o custo "é uma estimativa: ele é convertido de acordo com o preço público do modelo", enquanto a cobrança real continua vindo de cada provedor de modelos, e que modelos gratuitos e locais não geram cobrança.
A consequência é específica e fácil de ignorar: se você comprar o mesmo modelo abaixo do preço público de lista, o Cherry Studio informará sistematicamente um valor maior do que o que você gastou. A correção está na lista de modelos — a documentação de provedor personalizado diz que você pode abrir as configurações de um modelo e editar seu nome, tipo e preço; assim, inserir suas tarifas reais torna o painel utilizável novamente. A taxa de acerto de cache é o outro número que vale acompanhar; a página Usage Statistics acima a define como leituras de cache acertadas divididas pela entrada observável; em uma rota compatível com cache de prompt, essa proporção é o que torna baratos os contextos longos repetidos.
Uma estimativa calculada para duas formas de turno no Cherry Studio
Estas são operações aritméticas ilustrativas de tokens, não custos medidos de tarefas nem um teto de cobrança. Suponha uma pergunta curta com 1.500 tokens de entrada e 600 de saída, e um turno com documento contendo 120.000 tokens de entrada sem cache e 1.500 de saída — aproximadamente um artigo longo colado no contexto. As tarifas são os preços ativos do catálogo da Kunavo por milhão de tokens.
| Modelo | Entrada / saída por 1M | Pergunta curta | Turno com documento |
|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.0032 | $0.089 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.0036 | $0.090 |
| Claude Sonnet 5 | $1.40 / $7.00 | $0.0063 | $0.178 |
| Claude Opus 5 | $3.50 / $17.50 | $0.0158 | $0.446 |
Duas leituras importam mais do que a classificação. Primeiro, a distribuição: fazer a mesma pergunta sobre o documento a Claude Sonnet 5, GPT-5.6 Terra e Claude Haiku 4.5 juntos não gera uma cobrança, mas três, $0.358 sob estas suposições — esse é o motivo central da recomendação da Cherry de testar primeiro com uma pergunta curta. Segundo, a compressão: uma passagem de sumarização presumida sobre 60.000 tokens de entrada e 1.200 de saída custa $0.0924 quando segue Claude Sonnet 5, contra $0.0462 quando é direcionada para Claude Haiku 4.5. Nenhum dos dois valores é alto isoladamente; ambos se repetem ao longo do dia.
Dimensione pela sua própria conversação antes de tratar isto como um orçamento. O valor do catálogo da Kunavo é um piso de cobrança, não um teto: quando o upstream informa sua cobrança, a conta é o maior valor entre o custo do catálogo e o custo do upstream multiplicado pela margem aplicável. As cobranças de cache e a geração de imagens ficam fora deste exemplo. O recarregamento mínimo é de $10 em crédito pré-pago, o que é um mínimo de financiamento, não uma taxa de tarefa nem uma assinatura — consulte detalhes de cobrança.
Melhor API para o Cherry Studio: qual rota vence em cada situação
| Opção | Vantagens | O que você abre mão |
|---|---|---|
| API direta do fornecedor | Você vive no modelo principal de um fornecedor e quer os próprios termos de cache e processamento em lote | Um segundo fornecedor significa uma segunda entrada de provedor e um segundo saldo |
| CherryIN, o gateway que acompanha o Cherry Studio | Você quer o provedor pago integrado, cuja lista de modelos publicada inclui tipos de endpoint OpenAI e Anthropic, sem configuração de terceiros | Nos modelos Claude comparados abaixo, suas tarifas publicadas correspondem às tarifas listadas pelo fornecedor |
| Um gateway de terceiros compatível com OpenAI e Anthropic | Você troca de modelo por tarefa, quer uma chave e um saldo e quer tarifas abaixo do preço de lista | Você o configura manualmente, e a estimativa de custo no aplicativo fica alta até que você edite o preço de cada modelo |
| CherryAI, o provedor gratuito integrado | Chat casual sem nada para configurar e nada para pagar | Lista de modelos, cotas e limites de tarifa não divulgados, todos controlados pelo servidor e alterados a critério da Cherry |
| Um modelo local | Trabalho pequeno, privado ou offline sem cobrança por solicitação | Diferença de capacidade em relação aos modelos de ponta hospedados e ao seu próprio hardware |
A comparação com Claude é a única com duas fontes, por isso é a que esta página reproduz. Os valores da CherryIN são calculados a partir de seus próprios dados públicos de preços no único grupo padrão, cuja proporção é 1 e não aplica desconto; para os quatro modelos, eles correspondem exatamente à tarifa do fornecedor.
| Modelo | Catálogo da Kunavo, entrada / saída por 1M | Tarifa publicada da CherryIN | Tarifa publicada da Anthropic |
|---|---|---|---|
| Claude Opus 5 | $3.50 / $17.50 | $5.00 / $25.00 | $5.00 / $25.00 |
| Claude Sonnet 5 | $1.40 / $7.00 | $2.00 / $10.00 | $2.00 / $10.00 |
| Claude Sonnet 4.6 | $2.10 / $10.50 | $3.00 / $15.00 | $3.00 / $15.00 |
| Claude Haiku 4.5 | $0.70 / $3.50 | $1.00 / $5.00 | $1.00 / $5.00 |
A CherryIN corresponde à tarifa publicada da Anthropic nos quatro modelos, portanto toda a diferença está na coluna da Kunavo. Fontes: preços da CherryIN (calculados a partir de seus dados públicos de preços, grupo padrão, proporção 1) e claude.com/pricing, ambos consultados em 21 de setembro de 2026 — todos os quatro valores da coluna da Anthropic foram obtidos diretamente dessa página. As tarifas da CherryIN para modelos da OpenAI e do Google não são reproduzidas aqui porque não foi possível conciliá-las com as páginas de preços publicadas por esses fornecedores. Para uma comparação mais ampla de gateways, consulte melhor gateway de LLM e alternativas ao OpenRouter.
Melhor modelo para o Cherry Studio, função por função
Como o Cherry Studio cobra as funções separadamente, a resposta útil é uma atribuição, não um único nome. Coloque o modelo de ponta onde ocorre o julgamento e em nenhum outro lugar: Claude Opus 5 ou Claude Sonnet 5 para o assistente principal, GPT-5.6 Terra como alternativa de preço intermediário. Coloque um modelo barato, rápido e sem raciocínio no campo Quick — Claude Haiku 4.5 — pois ele apenas nomeia conversas e extrai palavras-chave de pesquisa. Dê o mesmo tratamento à tradução e direcione a compressão automática para a opção barata, em vez de deixá-la seguir o modelo principal. Opus vs Sonnet vs Haiku explica onde essa linha de julgamento geralmente se situa.
Duas armadilhas ao escolher. Primeiro, o ID do modelo: o Cherry Studio não mescla mais modelos com nomes semelhantes e mostra o ID da API retornado pelo provedor abaixo do nome de exibição, precisamente para que você não escolha um modelo gêmeo com data ou prefixo do fornecedor — copie o slug exato, com hífens, como seu provedor o escreve. Segundo, a base de conhecimento, onde o aviso habitual é afirmado de forma forte demais: a página de criação da Cherry inicia o campo de embeddings como "Do Not Use", e sua página de configurações de recuperação afirma que a base de conhecimento continua funcionando sem um modelo desses, usando recuperação de palavras-chave BM25 — um modelo de embeddings é o que acrescenta a recuperação vetorial paralelamente. A Kunavo não fornece um modelo de embeddings, portanto essa parte vetorial vem de um modelo local baixado no Cherry Studio ou de um segundo provedor. LibreChat vs Open WebUI compara dois clientes que separam modelos de recuperação dos modelos de chat da mesma maneira.
O que colar em cada caixa de endpoint
Na v2, a caixa de diálogo de provedor personalizado recebe um nome de provedor, uma chave de API e URLs base independentes por protocolo: OpenAI e Anthropic por padrão, com OpenAI Responses, Gemini, geração de imagens e edição de imagens por trás de um alternador de endpoints adicionais. O cliente identifica esse acordeão como 更多设置 (Mais opções), correspondendo à documentação More Settings; o rótulo 更多端点 (Mais endpoints) pertence a um fluxo diferente, que duplica um provedor predefinido (corrigido em 2026-10-01 com base no código-fonte da v2.1.0 e da v2.1.4). O Cherry Studio constrói a URL final por conta própria — o código-fonte da v2.1.0 normaliza o host, acrescenta /v1 a menos que o endereço já contenha um segmento de versão ou termine em #, e depois acrescenta o caminho do protocolo. Portanto, https://api.kunavo.com e https://api.kunavo.com/v1 chegam ao mesmo lugar; um # final é o que o interrompe, pois desativa completamente o acréscimo da versão.
| Caixa do endpoint | Caminho anexado pelo Cherry Studio | Kunavo |
|---|---|---|
| OpenAI | /chat/completions | Atendido |
| Anthropic | /messages | Atendido |
| OpenAI Responses (mais configurações) | /responses | Atendido |
| Geração de imagens (mais configurações) | /images/generations | Atendido |
| Edição de imagens (mais configurações) | /images/edits | Atendido |
| Gemini (mais configurações) | /models/{model}:generateContent | Não exposto — deixe vazio |
Caminhos lidos do código-fonte v2.1.0 em 21 de setembro de 2026. Preencha as caixas da OpenAI e da Anthropic, se puder. A página Coding Partner do Cherry — que inicia Claude Code, OpenAI Codex, Gemini CLI, OpenCode e outros usando um provedor do Cherry Studio — afirma que filtra a lista pelo tipo de interface exigido por cada CLI e que provedores incompatíveis não são listados (verificado em 21 de setembro de 2026). O runtime do Agent passa pelo mesmo gateway local, que a própria documentação do Cherry chama de serviço interno necessário para a operação do Agent, e sua página de criação de agentes afirma que o seletor de modelos filtra os modelos incompatíveis com o modo de execução escolhido. Quais dos seus modelos sobrevivem a esse filtro não foi testado aqui; portanto, configure ambas as caixas em vez de apostar em um único protocolo.
Três observações operacionais da documentação de provedores, verificadas em 21 de setembro de 2026. O botão Enable é a causa mais comum de “minha chave não funciona”: um provedor configurado permanece desativado e seus modelos nunca aparecem no seletor até que você o ative. Get Model List busca a lista de modelos do próprio provedor usando a chave que você acabou de inserir, portanto uma lista vazia geralmente aponta para a chave ou o endereço, não para o Cherry Studio. E um provedor pode conter várias chaves, usadas em rotação da primeira para a última, o que é uma forma prática de distribuir os limites de taxa.
Configure-o e verifique a primeira cobrança
A Kunavo publica uma referência de configuração para este cliente. Trata-se de um guia de configuração publicado, não de um teste de compatibilidade — o Cherry Studio não foi testado em runtime aqui com o endpoint da Kunavo, e tudo acima foi lido da própria documentação do Cherry, de seu código-fonte v2.1.0 e dos dados públicos de preços citados no texto. Observe que o documento de configuração foi escrito para o diálogo da v1 e descreve um único campo Type; o fluxo da v2 acima é o atual. Mantenha uma rota funcional disponível enquanto testa, execute uma tarefa limitada e compare a estimativa do Cherry Studio com o que sua conta realmente registrou em uso. Comece pelo guia de integração do Cherry Studio e crie uma conta Kunavo quando estiver pronto para adicionar fundos a uma chave.
Perguntas frequentes
Quanto custa o Cherry Studio?
O cliente desktop do Cherry Studio não custa nada. Ele é de código aberto sob a AGPL-3.0, o repositório CherryHQ/cherry-studio mantém essa licença, e o README declara que o uso comercial é permitido desde que haja conformidade total com a AGPL-3.0, com uma licença comercial separada disponível mediante contato com o projeto. O que você paga é a cobrança do modelo do provedor que configurar nele. O Cherry Studio Enterprise é um produto diferente, implantável de forma privada e vendido mediante orçamento, e seus termos não dizem nada sobre quanto paga uma pessoa que executa o cliente desktop gratuito.
Qual é a melhor API para o Cherry Studio?
A melhor API para o Cherry Studio é aquela que cobre os protocolos de que os recursos que você usa realmente precisam, a uma tarifa que você aceita. O Cherry Studio v2 configura um provedor personalizado como URLs base independentes por protocolo — OpenAI e Anthropic por padrão, além de OpenAI Responses, Gemini, geração de imagens e edição de imagens por trás do alternador de endpoints adicionais da caixa de diálogo — portanto, um provedor que responde apenas em chat completions ativará a janela de chat e poderá deixar os recursos de Agent e de CLI de programação fora do seletor. Um provedor que responde tanto a chat completions da OpenAI quanto a mensagens da Anthropic cobre a superfície mais ampla. A tarifa vem em segundo lugar: o Cherry Studio envia uma solicitação cobrada por modelo selecionado quando você compara modelos, portanto, uma diferença por token é multiplicada pelo número de modelos para os quais você distribui a solicitação.
Qual é a API mais barata para o Cherry Studio?
A tarifa mais baixa listada e a maneira mais barata de concluir o trabalho são perguntas diferentes, e no Cherry Studio a diferença é especialmente grande porque uma pergunta pode gerar várias solicitações cobradas. Antes de comparar tarifas por token, defina o modelo Quick como um modelo leve e barato, direcione a compressão automática do histórico para um modelo barato em vez de deixá-la seguir o seu modelo principal e lembre-se de que selecionar três modelos na visualização de comparação cobra três solicitações. O provedor CherryAI integrado do Cherry Studio é gratuito, mas a documentação afirma que a lista de modelos, as cotas e os limites de tarifa são fornecidos em tempo real pelo servidor da Cherry e ajustados periodicamente, portanto não é possível fazer um orçamento com base nele. Nenhum provedor deve ser descrito como tendo absolutamente o menor preço; compare as rotas usando a sua própria carga de trabalho.
Qual é o melhor modelo para o Cherry Studio?
Não existe um único melhor modelo, porque o Cherry Studio cobra separadamente pelo menos quatro funções. O modelo principal de chat ou assistente é onde um modelo de ponta justifica sua tarifa. O modelo Quick cuida da nomeação de conversas e da extração de palavras-chave de pesquisa, e a própria documentação do Cherry Studio recomenda para ele um modelo barato, rápido e sem raciocínio. O modelo de tradução e o modelo de pintura são definidos separadamente e devem ser escolhidos pela mesma lógica de custo. Uma armadilha prática: modelos com nomes semelhantes não são mais mesclados, e o ID real do modelo na API é mostrado abaixo do nome de exibição; portanto, copie o slug exato, não o rótulo.
Por que a exibição de custos do Cherry Studio não corresponde ao que meu provedor cobrou?
Porque é uma estimativa calculada a partir dos preços públicos de lista, não uma leitura da sua conta. A documentação de Estatísticas de uso do Cherry Studio afirma claramente que o custo "é uma estimativa: ele é convertido de acordo com o preço público do modelo", enquanto a cobrança real continua vindo de cada provedor de modelos. Portanto, se você comprar por meio de um gateway com desconto, o valor exibido no aplicativo ficará alto. A correção está na lista de modelos: o Cherry Studio permite abrir as configurações de um modelo e editar seu nome, tipo e preço; assim, inserir suas tarifas reais por token alinha novamente a estimativa. De qualquer forma, faça a conciliação com o próprio registro de uso do seu provedor.
A base de conhecimento do Cherry Studio pode funcionar com um provedor exclusivo de chat?
Sim, com uma ressalva sobre a qualidade da recuperação. A própria página de criação de uma base de conhecimento do Cherry Studio orienta usuários iniciantes a definir o modelo de embeddings como [Do Not Use], e sua página sobre modelos e recuperação afirma que a base de conhecimento continua funcionando sem um modelo desses, usando recuperação de palavras-chave BM25; o que um modelo de embeddings acrescenta é a recuperação vetorial executada paralelamente ao BM25. Se você quiser isso, a documentação oferece duas rotas — um modelo de embeddings na nuvem de um serviço que forneça um, ou um modelo de embeddings local baixado em Settings e depois em Local Models. A Kunavo não fornece nenhum modelo de embeddings, portanto a parte vetorial dessa configuração precisa vir de um modelo local ou de um segundo provedor.
Uma assinatura Claude Pro ou Max funciona dentro do Cherry Studio?
Não como provedor. Claude Pro e Max são assinaturas de chat e não fornecem uma chave de API, portanto não há nada para colar em uma entrada de provedor do Cherry Studio; a Anthropic publica o Pro a US$ 17 por mês em uma assinatura anual cobrada como US$ 200 adiantados, ou US$ 20 com cobrança mensal, e o Max a partir de US$ 100 por mês (claude.com/pricing, verificado em 21 de setembro de 2026). A rota descrita pela documentação da Cherry é a página Coding Partner, que inicia uma CLI externa, como o Claude Code, que faz login na própria conta — e então somente dentro dessa CLI, não na janela de chat do Cherry Studio.
Verificado em 21 de setembro de 2026: o repositório CherryHQ/cherry-studio e a API de releases, o README, as páginas da documentação do Cherry Studio vinculadas acima, os dados públicos de preços do CherryIN, as tarifas publicadas de assinatura e API do claude.com e o código-fonte dos caminhos de endpoint do Cherry Studio v2.1.0. Nenhum preço é informado para o Cherry Studio Enterprise, porque nenhuma página oficial publica um preço que uma busca simples consiga ler. As tarifas de tokens da Kunavo vêm do catálogo ativo; todo exemplo em dólares nesta página é uma aritmética ilustrativa de tokens, não o custo medido de uma tarefa, e nada aqui foi testado em runtime com o endpoint da Kunavo.