Voltar aos guias
Comparar·21 de setembro de 2026·Atualizado em 24 de setembro de 2026·10 min de leitura

Gemini CLI vs Qwen Code: protocolos, planos e custo total

O mesmo programa, bifurcado: um fala quatro protocolos de API e permite apontar uma entrada de modelo para uma URL base própria; o outro fala apenas o protocolo nativo do Google — e os níveis gratuitos anunciados por ambos terminaram durante 2026.

Última revisão em .

Gemini CLI e Qwen Code são a origem e o fork do mesmo programa, e a escolha entre eles agora depende de uma assimetria: o Qwen Code fala quatro protocolos de API e permite que uma entrada de modelo aponte para uma URL base própria, enquanto o Gemini CLI fala apenas o protocolo nativo do Google. O README do Qwen Code afirma que ele "foi originalmente baseado no Google Gemini CLI v0.8.2" e parou de sincronizar com o upstream em sua própria v0.1. Ambos os clientes são Apache-2.0 e não custam nada; ambos perderam seu nível gratuito destacado durante 2026; portanto, a decisão real é em qual relação de cobrança você quer estar inserido.

Primeiro, dois nomes a distinguir. QwenLM/Qwen3-Coder é a família de modelos de pesos abertos — suas pontuações de benchmark e contagens de parâmetros pertencem ao modelo, não ao cliente em QwenLM/qwen-code. E eliben/gemini-cli é um programa Go de terceiros diferente e arquivado; o da Google é google-gemini/gemini-cli, que a API do GitHub reportou como archived: false com um push em 21 de setembro de 2026.

O que você está realmente comparando em 21 de setembro de 2026

Gemini CLIQwen Code
MantenedorGoogleEquipe Qwen, Alibaba
LicençaApache-2.0 (API do GitHub)Apache-2.0 segundo o repositório; o registro do npm não contém um campo de licença
Última releasev0.60.0, publicado em 15 de setembro de 2026npm 0.24.3, publicado em 21 de setembro de 2026
Estrelas107,11228,046
Nível gratuitoO login de consumidor deixou de atender solicitações em 18 de junho de 2026O nível gratuito do Qwen OAuth foi descontinuado em 15 de abril de 2026
Entrada paga disponívelLicença Gemini Code Assist Standard/Enterprise, chave da Gemini API, chave da Gemini Enterprise Agent PlatformPlanos e chaves do Alibaba ModelStudio, nove provedores de terceiros nomeados ou qualquer endpoint compatível com OpenAI

Fatos sobre o repositório e os pacotes obtidos nas APIs do GitHub e do npm para ambos os projetos — @google/gemini-cli e @qwen-code/qwen-code — verificados em 21 de setembro de 2026. Ambos são lançados rapidamente — o Gemini CLI também publica os canais npm preview e nightly — portanto, verifique a versão no seu próprio ambiente em vez de confiar em qualquer número exibido em uma página.

Vale nomear três armadilhas nas fontes oficiais. O README do Gemini CLI em main ainda anuncia “Nível gratuito: 60 solicitações/min e 1.000 solicitações/dia com uma conta pessoal do Google”, quatro meses depois de o anúncio de 19 de maio do Google afirmar que esse caminho deixaria de atender solicitações em 18 de junho de 2026. A tabela de cotas de geminicli.com contradiz o próprio banner na mesma página. E o Antigravity, sucessor nomeado pelo Google, é um produto diferente: sua página de preços mostra um nível Individual de $0 e não exibe preço algum para Pro ou Ultra; por isso, os valores desses níveis publicados em blogs de terceiros não são usados aqui como referência. O guia Cotas do Gemini CLI analisa qual caminho ainda oferece uma franquia.

Quem deve escolher qual

Escolha o Qwen Code se o endpoint for o fator decisivo. Sua referência de provedores de modelos define quatro protocolos — openai, anthropic, gemini e vertex-ai — e sua documentação de autenticação nomeia DeepSeek, Grok, MiniMax, Z.AI, Kimi, Idealab, ModelScope, OpenRouter e Requesty como rotas de terceiros compatíveis, além de “qualquer endpoint compatível com OpenAI”. Usar seu próprio endpoint é um caminho autorizado nesse caso, não uma solução alternativa — com a limitação indicada na mesma página: um baseUrl precisa ser compatível com o formato de API do transporte declarado pela entrada correspondente. Se você espera trocar de família de modelos no próximo ano, esse é todo o argumento.

Escolha o Gemini CLI se você já estiver dentro do sistema de cobrança do Google. Se sua organização tiver licenças do Gemini Code Assist, o CLI será um recurso incluído nas duas edições pagas, segundo a página de preços do Google Cloud, e o item Enterprise promete “limites diários de uso maiores” para trabalhos no CLI e no modo agente. Uma chave da Gemini API também funciona. O que você perde é escolha: nada no enum de autenticação da v0.60.0 menciona um protocolo que não seja do Google.

Escolha com base no formato do plano se o orçamento for fixo. A rota de tarifa fixa do Qwen Code é um Alibaba Coding Plan mensal de $50 com limites de solicitações; a do Gemini CLI é uma licença cuja taxa o Google exibe por hora e vende pelo console de administração do Gemini ou por sua equipe de vendas. Se uma pessoa física — em oposição a uma organização — pode contratar por conta própria uma licença Gemini Code Assist Standard não é algo que nenhuma página verificada aqui confirme ou negue; portanto, trate isso como não verificado antes de basear seu planejamento nessa possibilidade.

Escolha o Qwen Code se precisar de interfaces além de um terminal. Seu README anuncia um aplicativo para desktop, VS Code, Zed e plugins para JetBrains, canais do Telegram, DingTalk, WeChat e Feishu, SDKs de TypeScript, Python e Java, e um daemon experimental qwen serve que se comunica por HTTP e SSE. Essas são alegações do fornecedor sobre o próprio produto; nenhuma foi testada aqui, e o fornecedor marca a interface web e o daemon como experimentais.

O que não deve decidir a escolha: subagentes, hooks e skills. Uma busca de código nos diretórios docs/ dos dois repositórios em 21 de setembro de 2026 encontrou os três documentados em ambos os lados; portanto, são requisitos básicos, não um diferencial.

Fluxo de trabalho: o que o fork manteve e onde eles se separaram

DimensãoGemini CLIQwen Code
InterfacesTerminal, além do companion para VS Code documentado no READMETerminal, desktop, interface web experimental, plugins de editor, canais de chat, daemon ACP
Sem interfacegemini -p "...", com --output-format json ou stream-jsonqwen -p "...", além de três SDKs
Sandboxgemini -s; os mesmos quatro tópicos de benefícios em sua documentaçãoMesmo conceito herdado do fork; perfil padrão do Seatbelt no macOS permissive-open
Prefixo de ambienteGEMINI_*QWEN_*, com a documentação admitindo que algumas variáveis do sandbox usaram GEMINI_* historicamente
Configuração do endpointSomente variáveis de ambiente: GOOGLE_GEMINI_BASE_URL, GOOGLE_VERTEX_BASE_URLmodelProviders estruturado em settings.json, recarregado automaticamente sem reinicialização
Pesquisa integradaGrounding com o Google Search, cobrado separadamenteControlado pelo host; o controle não foi verificado novamente nesta rodada

Documentação lida em main para ambos os projetos, e código-fonte do Gemini CLI na tag lançada v0.60.0, em 21 de setembro de 2026. A linha do sandbox representa similaridade na documentação, não equivalência de comportamento testada.

Modelos e endpoints: a assimetria que decide a escolha

A referência de configuração do Gemini CLI documenta GOOGLE_GEMINI_BASE_URL como substituto da “URL base padrão para solicitações da Gemini API (ao usar a autenticação gemini-api-key)”, exigindo HTTPS, a menos que a URL aponte para localhost. Seguem-se duas limitações. Esse recurso não é acessível pelo caminho de login do Google; portanto, nunca aumenta, estende ou redefine uma franquia do lado do Google — ele muda você para uma relação de cobrança diferente. E, no código-fonte da v0.60.0, defini-lo sozinho seleciona um AuthType.GATEWAY que não aparece em nenhuma página de documentação publicada encontrada aqui; a solicitação ainda sai como uma chamada nativa do Google com um cabeçalho x-goog-api-key. Trate isso como informação do código-fonte, não como um contrato de recurso.

O Qwen Code inverte cada uma dessas características. Seu comando /auth lista três opções de nível superior — Alibaba ModelStudio, Provedores de terceiros e Provedor personalizado — enquanto as rotas Anthropic e Gemini são definidas em modelProviders, e não na caixa de diálogo. As credenciais nunca são gravadas nas configurações; o runtime as lê de process.env[envKey]. Vale ler três armadilhas documentadas antes de se comprometer: um ID de provedor que não seja integrado nem mapeado pela configuração de nível superior providerProtocol tem toda a sua entrada “ignorada com um aviso”; providerProtocol é lido uma vez na inicialização e requer reinicialização, enquanto modelProviders é recarregado automaticamente; e qualquer valor de chave de API que alcance uma entrada Vertex “muda o SDK do Google para o modo Vertex Express, que ignora o projeto, o local e suas credenciais ADC”.

Um alerta sobre os padrões, nos dois sentidos. A constante DEFAULT_GEMINI_MODEL da v0.60.0 do Gemini CLI é gemini-2.5-pro e DEFAULT_QWEN_MODEL do Qwen Code é coder-model, mas nenhuma das duas constantes é o que responde à pergunta: o lado do Gemini passa um ID solicitado por um resolvedor que o reescreve a partir de um contexto como canal de lançamento e acesso de prévia; no lado do Qwen, a mesma string coder-model também é o valor de DEFAULT_QWEN_FLASH_MODEL, portanto, ela tampouco nomeia uma versão específica do modelo. Nomeie o modelo explicitamente se a tarifa for importante.

A Kunavo não oferece modelo de embeddings, portanto nenhum dos padrões de embeddings dos clientes — gemini-embedding-001 no lado do Gemini e text-embedding-v4 no lado do Qwen — pode ser apontado para cá, e qualquer etapa de indexação precisa de seu próprio provedor.

Planos e tarifas de tokens em uma única referência

OpçãoPreço publicadoO que isso compra
Ambos os clientes$0, Apache-2.0Somente o software; todo o custo é de inferência
Alibaba Coding Plan Pro (internacional)$50 por mêsAté 6.000 solicitações por 5 horas, 45.000 por semana, 90.000 por mês
Gemini Code Assist Standard$0.031232877 por hora, compromisso mensal; $0.026027397 por hora em um compromisso de 12 mesesLicença que inclui o Gemini CLI, adquirida pelo console de administração do Gemini ou pela equipe de vendas
Gemini Code Assist Enterprise$0.073972603 por hora, compromisso mensal; $0.061643836 por hora em um compromisso de 12 mesesO mesmo, mais “limites diários de uso maiores”
Gemini API, gemini-3.1-pro-preview$2.00 de entrada / $12.00 de saída por 1M para prompts de 200k tokens ou menos; $4.00 / $18.00 acima dissoChave com cobrança por uso; a coluna Free Tier diz “Não disponível”
Gemini API, gemini-3.8-flash$0.75 / $3.75 por 1M até 31 de dezembro de 2026; depois, $1.50 / $7.50Chave com cobrança por uso; o aumento de 2027 está impresso na página hoje
Alibaba, qwen3-coder-plus (Singapura)$1 / $5 até 32K; $1.8 / $9 até 128K; $3 / $15 até 256K; $6 / $60 até 1MPague conforme o uso, com preço baseado no comprimento da entrada da solicitação
Alibaba, qwen3-coder-next (Singapura)$0.3 / $1.5 até 32K; $0.5 / $2.5 até 128K; $0.8 / $4 até 256KNenhum nível de 256K ou mais listado

Preços consultados em 21 de setembro de 2026 no Google Cloud, na página de preços da Gemini API, na página do Coding Plan da Alibaba e em sua tabela de preços de modelos. Quatro ressalvas envolvem dinheiro de verdade. O Google exibe a taxa da licença por hora atrás de um seletor mensal que não foi renderizado no código-fonte da página lido aqui; portanto, multiplicar por 730 horas resulta em aproximadamente $22.80 e $19.00 para Standard e $54.00 e $45.00 para Enterprise — isso é uma operação aritmética sobre os valores horários do Google, não um preço mensal lido literalmente. A coluna da China da Alibaba é uma oferta comercial separada da coluna de Singapura, não uma conversão de moeda, e misturá-las produz uma resposta errada. O nível barato Coding Plan Lite ainda citado em publicações nas redes sociais deixou de aceitar novas assinaturas em 20 de março de 2026 e renovações e upgrades em 13 de abril de 2026. E um Coding Plan não é “o preço do Qwen Code”: a Alibaba lista Claude Code, Cline e Cursor entre as ferramentas compatíveis; portanto, a cota que outro cliente consome é cota que o Qwen Code deixa de ter.

Mais um item de custo atual no lado do Gemini: o Google Search grounding, que o Gemini CLI oferece como ferramenta integrada, tem 5.000 solicitações de pesquisa gratuitas por mês compartilhadas entre os modelos Gemini 3.x e custa $14 por 1.000 solicitações depois disso.

Uma estimativa calculada para uma sessão

Este é um cálculo ilustrativo de tokens, não o custo medido de uma tarefa nem um teto da fatura. Suponha uma sessão que envie 200.000 tokens de entrada não armazenados em cache e receba 12.000 tokens de saída, com cada solicitação individual pequena o bastante para permanecer no nível de comprimento mais baixo de cada fornecedor. Cache, chamadas de ferramentas e novas tentativas são excluídos.

OpçãoTarifa por 1M, entrada / saídaEstimativa para a sessão presumida
Gemini API, gemini-3.1-pro-preview$2.00 / $12.00$0.544
Gemini API, gemini-3.8-flash$0.75 / $3.75$0.195
Alibaba, qwen3-coder-plus$1.00 / $5.00$0.260
Alibaba, qwen3-coder-next$0.30 / $1.50$0.078
Gemini 3.8 Flash, na Kunavo dentro do Qwen Code$0.525 / $2.625$0.137
Gemini 3.1 Pro, na Kunavo dentro do Qwen Code$0.70 / $4.20$0.190
Claude Haiku 4.5, na Kunavo dentro do Qwen Code$0.70 / $3.50$0.182
Claude Sonnet 4.6, na Kunavo dentro do Qwen Code$2.10 / $10.50$0.546

Duas observações. Primeiro, o limite do nível movimenta mais dinheiro do que a escolha do fornecedor: a mesma sessão no qwen3-coder-plus sobe de $0.260 para $0.468 quando as solicitações ultrapassam 32K de entrada, algo que um agente que carrega vários arquivos faz rotineiramente. Segundo, uma comparação de tarifas não é uma comparação de resultados — não existe benchmark comparando esses dois clientes, e um modelo que precisa de três tentativas pode custar mais do que um mais caro que precisa de uma única passagem.

As linhas da Kunavo são tarifas do catálogo atual para modelos que você executaria pelo protocolo openai do Qwen Code; a Kunavo não vende nenhum modelo de texto Qwen, portanto, não é uma rota mais barata para inferência Qwen. O valor do catálogo é um piso de cobrança, não um teto: quando o upstream informa sua cobrança, a fatura é o maior valor entre o custo do catálogo e o custo do upstream multiplicado pela margem aplicável. O recarregamento mínimo é de $10 em crédito pré-pago, o que é um mínimo de financiamento, não uma assinatura — consulte os detalhes de cobrança.

Custo de migração, nos dois sentidos

Passar do Gemini CLI para o Qwen Code é a mudança mais barata, e o fork explica o motivo: a superfície de comandos, o conceito de sandbox e o formato geral de uma sessão foram herdados, então o modelo mental é amplamente transferido. O que não é transferido automaticamente é a configuração. O Gemini CLI mantém seu endpoint em variáveis de ambiente; o Qwen Code o mantém em um bloco settings.json estruturado, e a documentação alerta que um formato de prévia anterior que envolvia os modelos em { protocol, models } “foi revertido” e é silenciosamente ignorado em um arquivo $version: 4. Copiar uma configuração de um tutorial antigo é a maneira mais provável de perder uma tarde.

Fazer o caminho inverso custa mais, porque você abandona todos os endpoints que não são do Google de uma vez. Se o motivo da mudança for uma licença do Code Assist pela qual você já paga, isso pode valer a pena. Se o motivo for uma cota gratuita sobre a qual você leu, verifique primeiro a data da página em que leu essa informação.

Uma ressalva que se aplica aos dois sentidos e não pode ser resolvida pelas páginas publicadas: se uma chave da Gemini API não paga ainda funciona dentro do Gemini CLI depois de 18 de junho de 2026. A publicação do Google de 19 de maio diz que o CLI continua acessível por meio de chaves pagas; nenhuma página de primeira parte encontrada aqui esclarece o caso não pago, portanto, não faça seu orçamento contando com isso.

Configurando a rota de terceiros

Se a resposta for Qwen Code mais um gateway, a Kunavo publica uma referência de configuração para isso: declare o endpoint em modelProviders com o ID de provedor integrado openai — portanto, nenhum mapeamento providerProtocol é necessário — aponte baseUrl para a raiz /v1, em vez do caminho completo de chat-completions, e leia a chave de uma variável de ambiente. Esse é um guia de configuração publicado, não um teste de compatibilidade: o Qwen Code não foi testado em runtime com o endpoint da Kunavo aqui, e a própria documentação do Qwen Code observa que a API de rede responses não tem detecção de endpoint nem fallback automático; portanto, comece com chat completions. Mantenha uma rota funcional disponível, execute uma tarefa limitada e depois leia o que sua conta realmente registrou. Comece pelo guia de integração do Qwen Code, compare as rotas de planos em preços do Qwen Code e crie uma conta Kunavo quando estiver pronto para financiar uma chave.

Escolhendo outro cliente em vez desses? Qwen Code vs Claude Code e API compatível com OpenAI cobrem as decisões vizinhas.

Perguntas frequentes

O Qwen Code é apenas um Gemini CLI rebatizado?

Ele começou como um fork e já não é uma cópia. O próprio README do Qwen Code afirma que o projeto "foi originalmente baseado no Google Gemini CLI v0.8.2" e que "A partir do Qwen Code v0.1, paramos de sincronizar com o upstream e iniciamos um desenvolvimento independente como um framework de agentes multiprotocolo e multiplataforma" (leitura feita em 21 de setembro de 2026). A versão estável atual do Gemini CLI é a v0.60.0, dezenas de versões menores além do ponto do fork, portanto as duas bases de código vêm divergindo há bastante tempo. A herança ainda aparece em alguns lugares: a documentação do sandbox do Qwen Code observa que algumas variáveis de ambiente do sandbox historicamente usavam o prefixo GEMINI_ e que todas as novas usam QWEN_.

O Gemini CLI pode executar modelos Qwen, ou o Qwen Code pode executar modelos Gemini?

Apenas uma direção funciona, conforme documentado. A referência de provedores de modelos do Qwen Code define quatro protocolos — openai, anthropic, gemini e vertex-ai — portanto os modelos do Google são um caminho integrado ali, embora os caminhos Anthropic e Gemini sejam recursos do arquivo de configurações, e não entradas da caixa de diálogo /auth. O Gemini CLI não tem equivalente: no código-fonte v0.60.0, o enum de autenticação contém oauth-personal, gemini-api-key, vertex-ai, cloud-shell, compute-default-credentials e gateway, sem membro OpenAI-compatible ou Anthropic, e uma busca de código no GitHub por OPENAI_BASE_URL em todo o repositório retorna zero resultados. Ambas as afirmações são baseadas na documentação e no código-fonte consultados em 21 de setembro de 2026, não em testes de runtime.

Algum dos dois ainda tem um nível gratuito?

Ambos os níveis gratuitos destacados foram retirados em 2026. A documentação de autenticação do Qwen Code afirma que "O nível gratuito do Qwen OAuth foi descontinuado em 2026-04-15" e que tokens armazenados em cache podem funcionar brevemente antes que novas solicitações sejam rejeitadas. O Google anunciou em 19 de maio de 2026 que, em 18 de junho de 2026, o Gemini CLI "pararia de atender solicitações de usuários do Google AI Pro e Ultra, bem como daqueles que o utilizassem gratuitamente por meio do Gemini Code Assist para indivíduos". Tutoriais que citam 2.000 solicitações gratuitas do Qwen por dia ou 1.000 solicitações gratuitas do Gemini por dia descrevem caminhos que já não atendem. A única concessão sem custo verificável em 21 de setembro de 2026 era a cota gratuita na tabela de preços de modelos da Alibaba — 1 milhão de tokens por modelo, oferecida somente em Singapura e válida por 90 dias a partir da ativação do Model Studio, do lançamento do modelo ou da aprovação da aplicação, o que ocorrer por último. Isso é um teste, não um nível recorrente.

Qual é mais barato de executar, Gemini CLI ou Qwen Code?

Nenhum dos clientes cobra qualquer valor; ambos são open source Apache-2.0 segundo seus repositórios, portanto toda a comparação está na cobrança de inferência por trás deles. Nas tarifas de lista publicadas e verificadas em 21 de setembro de 2026, o qwen3-coder-next da Alibaba em Singapura tinha a menor tarifa anunciada entre os caminhos comparados aqui: $0,30 por milhão de tokens de entrada e $1,50 por milhão de saída para solicitações de até 32K, contra $2,00 e $12,00 do gemini-3.1-pro-preview para prompts de 200 mil tokens ou menos. Mas a menor tarifa anunciada e o menor custo para concluir uma tarefa são afirmações diferentes, e não existe benchmark comparando esses dois clientes. Duas armadilhas estruturais importam mais do que o destaque: a Alibaba cobra pela extensão da entrada da solicitação, portanto o qwen3-coder-plus salta de $1/$5 para $1,8/$9 quando uma solicitação ultrapassa 32K, e as colunas da China e de Singapura da Alibaba são ofertas comerciais separadas, com números materialmente diferentes.

O Gemini CLI foi descontinuado?

Não, mas sua entrada para consumidores foi encerrada. O repositório está ativo e não arquivado, com lançamentos semanais: o GitHub informou archived false com um push em 21 de setembro de 2026, e a versão estável v0.60.0 foi publicada em 15 de setembro de 2026. O que foi encerrado é o caminho de login — o próprio aviso de descontinuação do Google afirma que Google AI Pro, Google AI Ultra e o Gemini Code Assist gratuito para indivíduos deixaram de ser atendidos em 18 de junho de 2026, e geminicli.com exibe um banner dizendo que o CLI foi substituído pelo Antigravity CLI nessa data para usuários sem pagamento e usuários do Google One. A página de preços do Google Cloud ainda lista o Gemini CLI como recurso incluído nas duas edições pagas do Gemini Code Assist, portanto o produto continua tendo suporte nas modalidades de acesso pagas. Trate o texto do README do repositório, "60 solicitações/min e 1.000 solicitações/dia com uma conta pessoal do Google", como texto não corrigido, não como uma concessão vigente.

Posso apontar qualquer um dos clientes para um gateway de terceiros, como a Kunavo?

Qwen Code sim, conforme documentado; Gemini CLI não. O protocolo openai do Qwen Code aceita uma URL base fornecida por você, desde que ela fale o formato de API esperado por esse caminho, e a Kunavo publica uma referência de configuração para ele; isso é um guia de configuração, não um teste de compatibilidade, e o Qwen Code não foi testado em runtime contra o endpoint da Kunavo. GOOGLE_GEMINI_BASE_URL do Gemini CLI é documentado no caminho gemini-api-key e, no código-fonte v0.60.0, defini-lo seleciona um tipo de autenticação de gateway; em qualquer das leituras, a solicitação ainda sai como uma chamada nativa do Google com um cabeçalho x-goog-api-key, portanto um endpoint compatível com OpenAI ou Anthropic Messages não é um destino de troca direta para ele — essa é uma inferência baseada no formato do protocolo e no inventário de caminhos, e não uma rejeição observada. Observe também que a documentação de planos do Google Antigravity, sucessor para o qual o Google direciona os usuários do Gemini CLI, lista entre os itens que atualmente não oferece suporte a "Trazer sua própria chave ou seu próprio endpoint para limites de taxa adicionais".

Repositórios, registros do npm, páginas oficiais de preços e a documentação dos dois projetos verificados em 21 de setembro de 2026; comportamento do Gemini CLI lido na tag lançada v0.60.0 e documentação do Qwen Code no branch main. Nenhum dos clientes foi instalado ou executado, não existe benchmark comparando os dois, e todo valor em dólares acima é uma tarifa publicada de terceiros ou um cálculo ilustrativo de tokens com base no catálogo atual da Kunavo.