O próprio Qwen Code é gratuito: o cliente é open source sob a licença Apache-2.0, sem nível pago; portanto, cada euro de um orçamento do Qwen Code é destinado à inferência do modelo, adquirida separadamente. A oferta gratuita Qwen OAuth, ainda descrita pela maioria dos tutoriais, foi encerrada em 15 de abril de 2026. Em 2026, um orçamento começa, portanto, com um endpoint pago: um Coding Plan do Alibaba Cloud Model Studio, um pacote do Credits Token Plan, cobrança por uso baseada em tokens ou um endpoint de terceiros que você mesmo configurar.
Essas quatro opções são medidas em quatro unidades diferentes — solicitações, Credits, tokens e o que seu próprio provedor cobrar — e é por isso que uma comparação pelo preço inicial produz a resposta errada. Esta página separa o custo do software do custo da inferência, fornece uma estimativa recalculável e sinaliza o que não pôde ser verificado. A versão detalhada em inglês é Qwen Code pricing.
O software é gratuito; os modelos, não
O repositório QwenLM/qwen-code está sob a licença Apache-2.0 e é desenvolvido ativamente; a API do GitHub o registrava como não arquivado em 1º de outubro de 2026, com um push no mesmo dia. As versões são lançadas pelo menos semanalmente: a v0.24.7 foi publicada no npm (@qwen-code/qwen-code) em 29 de setembro de 2026. A instalação pode ser feita por script autônomo, npm (Node.js 22 ou superior) ou Homebrew. O mesmo repositório gratuito fornece um aplicativo para desktop, uma interface web (qwen serve --open), extensões para VS Code, Zed e JetBrains e SDKs TypeScript, Python e Java; nenhuma dessas superfícies é uma opção paga e nenhuma inclui inferência.
Uma relação que deve ser desconsiderada: o Qwen Code inicialmente era baseado no Google Gemini CLI v0.8.2, mas o projeto não é mais sincronizado com ele desde a v0.1. As cotas e tarifas do Gemini CLI não se aplicam.
O limite gratuito: o que foi encerrado e quando
A documentação de autenticação informa que a oferta gratuita Qwen OAuth foi encerrada em 2026-04-15 e que os tokens já armazenados em cache podem funcionar brevemente, mas novas solicitações são recusadas. Na interface, selecionar Qwen OAuth agora exibe “Discontinued — switch to Coding Plan or API Key”.
| Período | Cota gratuita do OAuth | Fonte |
|---|---|---|
| Até a v0.9.0 (npm, 3 de fevereiro de 2026) | 2.000 solicitações/dia, 60 solicitações/minuto | Documentação de autenticação na tag v0.9.0 |
| A partir da v0.10.0 (npm, 9 de fevereiro de 2026) | 1.000 solicitações/dia, 60 solicitações/minuto | Mesmo arquivo nas tags v0.10.0 a v0.14.0 |
| A partir de 15 de abril de 2026 | Nenhuma — encerrado | Documentação atual; issue #3316 |
A data exata da mudança de 2.000 para 1.000 solicitações não foi anunciada em lugar algum: o intervalo acima vem da tag de versão em que a documentação mudou. O número de 100 solicitações por dia que circula não aparece em nenhuma das tags verificadas; considere-o sem fundamentação. Além disso, os modelos Qwen OAuth são definidos no código e não podem ser redirecionados por meio de modelProviders.
Três endpoints oficiais, três unidades de cobrança
Em /auth, o Alibaba ModelStudio abre um submenu com Coding Plan, Token Plan e Standard API Key. Não são três formas de pagar a mesma fatura: a documentação fornece a cada um seu host e sua chave, e solicita que o baseUrl seja concedido ao plano da chave. As chaves do Coding Plan começam com sk-sp-.
| Caminho | Cobrado em | Preço publicado (1º de outubro de 2026) | Host |
|---|---|---|---|
| Coding Plan Pro (internacional) | Solicitações | $50/mês | coding-intl.dashscope.aliyuncs.com |
| Coding Plan Pro (site chinês) | Solicitações | ¥200/mês; ¥39,90 no primeiro mês para um novo cliente | coding.dashscope.aliyuncs.com |
| Token Plan, Personal | Créditos | Lite $8 (promoção $6), Essential $16 ($10), Standard $25 ($18), Pro $80 ($68) por mês | token-plan.ap-southeast-1.maas.aliyuncs.com |
| Token Plan, Team | Créditos | Standard $30 ($20), Pro $100 ($75), Max $200 por assento e por mês | Mesmo host de Singapura |
| Chave de API padrão | Tokens | Por modelo, por faixa de comprimento da entrada | dashscope.aliyuncs.com |
A página do Coding Plan aplica três limites simultâneos ao Pro: até 6.000 solicitações por 5 horas, 45.000 por semana e 90.000 por mês; assim que qualquer um deles é atingido, as chamadas são suspensas. A cota de 5 horas é liberada continuamente, a cota semanal reinicia na segunda-feira às 0h (UTC+8) e a mensal, na data de renovação. Em 1º de outubro de 2026, a página também indicava disponibilidade limitada: vagas limitadas, por ordem de chegada, reabastecidas diariamente (0h UTC+8 internacionalmente, 9h30 UTC+8 no site chinês). A oferta Lite não existe mais: novas assinaturas foram encerradas em 20 de março de 2026, e renovações e upgrades, em 13 de abril de 2026. E ¥200 não é a conversão de $50: trate as duas vitrines como ofertas distintas.
O que uma solicitação realmente custa: cada pergunta consome cota de acordo com o número de chamadas de modelo, e a Alibaba informa de 5 a 10 chamadas para uma tarefa simples e de 10 a 30 ou mais para uma tarefa complexa. Uma instrução, portanto, vale várias solicitações; nesse ritmo, 90.000 solicitações por mês representam aproximadamente entre 3.000 e 18.000 tarefas — mas a Alibaba apresenta esses números como típicos, não garantidos. Meça na sua conta antes de dimensionar.
O Token Plan exige duas observações. Primeiro, ele mudou: em 1º de outubro de 2026, a página do Token Plan atribuía aos planos Personal uma cota mensal (ciclo de 30 dias a partir da assinatura) de 11.500, 25.500, 45.000 e 180.000 Credits para Lite, Essential, Standard e Pro, suspendia o serviço quando a cota era atingida, vendia pacotes adicionais a $15 por 20.000 Credits e especificava que a cota não utilizada não era acumulada. Depois, nenhuma conversão de Credits → tokens é publicada ali, nem há multiplicador por modelo: nada permite dizer quantos tokens $18 por mês compram. A oferta é vendida somente na região de Singapura.
Pagamento conforme o uso, por token
A página de preços do Model Studio apresenta preços em dólares por milhão de tokens, por faixa de comprimento de entrada de cada solicitação. A coluna de Singapura está abaixo; as tarifas da China (Pequim) são diferentes e consideravelmente mais baixas, portanto verifique sua região de cobrança.
| Modelo | Entrada 0-32K | 32K-128K | 128K-256K | 256K-1M |
|---|---|---|---|---|
| qwen3-coder-plus | $1 entrada / $5 saída | $1,8 / $9 | $3 / $15 | $6 / $60 |
| qwen3-coder-next | $0,3 entrada / $1,5 saída | $0,5 / $2,5 | $0,8 / $4 | Não listado |
Leia a última faixa antes de fazer o orçamento de uma sessão longa de agente: a saída do qwen3-coder-plus passa de $5 para $60 por milhão assim que a entrada de uma solicitação ultrapassa 256K. Novas contas de Singapura recebem 1 milhão de tokens gratuitos por modelo, válidos por 90 dias — um teste, não uma oferta gratuita. Cuidado também com a página oficial de redução de preço do qwen3-coder-plus: o desconto de cache anunciado por ela vigorou de 24 de julho a 23 de agosto de 2025.
Conectar o Qwen Code a outro endpoint
O Qwen Code usa quatro protocolos — OpenAI Chat Completions, OpenAI Responses, Anthropic e Gemini/Vertex — e cada um aceita uma URL base personalizada; a própria documentação cita OpenRouter e Fireworks AI como alternativas após o encerramento do OAuth. A Kunavo fornece /v1/chat/completions, /v1/responses e /v1/messages em https://api.kunavo.com/v1.
Vamos deixar claro o que isso oferece. O catálogo da Kunavo não contém nenhum modelo de texto Qwen: não é uma forma mais barata de executar o Qwen, mas de executar Claude ou GPT no Qwen Code com um único saldo pré-pago. A Kunavo também não executou o Qwen Code nesses endpoints; a configuração abaixo vem da documentação do Qwen Code, assim como a página de configuração do Qwen Code em inglês.
{
"modelProviders": {
"openai": [
{
"id": "claude-sonnet-5",
"name": "Claude Sonnet 5",
"baseUrl": "https://api.kunavo.com/v1",
"envKey": "KUNAVO_API_KEY"
}
]
},
"security": {
"auth": {
"selectedType": "openai"
}
},
"model": {
"name": "claude-sonnet-5"
}
}Quatro fatos que evitam horas de depuração, extraídos da referência de provedores de modelos: o baseUrl termina em /v1 (o SDK adiciona o caminho; com /v1/chat/completions, ocorre um 404); a chave é lida na variável nomeada por envKey, de preferência por meio de .qwen/.env em vez de em texto simples em settings.json; a entrada modelProviders selecionada tem precedência sobre as opções de CLI --openai-base-url e --openai-api-key, dando a impressão de que elas são ignoradas; e wireApi: "responses" não tem detecção de endpoint nem fallback automático — comece com Chat Completions.
Duas limitações a considerar. A ferramenta integrada web_search usa a pesquisa no lado do servidor da DashScope: ativa com uma Standard API Key ou um Token Plan, inativa com o Coding Plan (não verificada neste endpoint) e inativa com um provedor de terceiros ou um endpoint em outro host. A alternativa documentada é um servidor de pesquisa MCP. E uma rota da Kunavo fornece apenas chat: sem embeddings, síntese ou reconhecimento de voz.
Uma estimativa mensal recalculável
Suponha um mês com 20 milhões de tokens de entrada não armazenados em cache e 1 milhão de tokens de saída. Nas tarifas atuais do catálogo da Kunavo:
| Modelo | Entrada / saída por milhão | Mês estimado | Possível função |
|---|---|---|---|
| Claude Haiku 4.5 | $0,70 / $3,50 | $17,50 | Alterações limitadas e alto volume |
| GPT-5.6 Terra | $0,70 / $4,20 | $18,20 | Raciocínio e ferramentas combinados |
| Claude Sonnet 5 | $1,40 / $7,00 | $35,00 | Alterações difíceis no repositório |
Isso é aritmética baseada em uma carga presumida, não uma tarefa do Qwen Code medida nem um limite de cobrança; cache, ferramentas externas e impostos estão excluídos, e a estimativa presume que o modelo mais barato conclui o trabalho sem uma nova tentativa. O valor do catálogo da Kunavo é um piso de cobrança, não um teto: quando o upstream declara seu custo, a cobrança é o maior valor entre o custo do catálogo e o custo do upstream multiplicado pela margem aplicável. Esta tabela não deve ser comparada ao Coding Plan de $50 (que contabiliza chamadas, não tokens) nem ao Token Plan (Credits sem conversão publicada): para comparar um plano e um contador, você precisa do seu próprio consumo medido nos dois lados.
A Kunavo começa com uma recarga pré-paga de $10, sem assinatura — o valor para abrir uma conta com saldo, não o preço de uma tarefa. O checkout da Stripe aceita cartões (Visa, Mastercard, American Express), Apple Pay, Google Pay e Link; o débito automático SEPA não é oferecido no momento.
Qual caminho escolher e quando
| Escolha | Quando é adequado | O que você abre mão |
|---|---|---|
| Coding Plan | Uso diário e regular do Qwen que permanece dentro dos limites de solicitações | Chamadas suspensas a cada limite; sem pesquisa na web integrada; cota compartilhada com qualquer outra ferramenta que use a chave; vagas limitadas |
| Pagamento conforme o uso por token | Uso irregular ou pontual, sessões longas para calcular com precisão | Faixas de comprimento de entrada que elevam a tarifa em solicitações grandes |
| Credits do Token Plan | Você confirmou a taxa em Credits dos seus modelos no seu console | Sem conversão pública, cota mensal que suspende o serviço quando esgotada, somente Singapura |
| Um gateway como a Kunavo | Você quer Claude ou GPT no Qwen Code com um único saldo pré-pago | Sem modelos Qwen; configuração manual; sem pesquisa na web integrada |
| Inferência local | Você tem o hardware adequado e o modelo gerencia suas ferramentas | Hardware, manutenção e confiabilidade das chamadas de ferramentas passam a ser responsabilidade sua |
Mantenha as duas perguntas separadas: o preço por milhão de tokens é lido em uma página; o menor custo para concluir sua tarefa é uma medida que ninguém publicou para este cliente, inclusive nós. Execute as mesmas três tarefas — uma pequena alteração, uma correção de bug, uma investigação em vários arquivos — em duas rotas e compare os valores registrados. Para experimentar a rota de gateway, crie uma conta na Kunavo e siga o quickstart.
Perguntas frequentes
Quanto custa o Qwen Code?
O cliente Qwen Code não custa nada: ele é open source sob a licença Apache-2.0 no GitHub (QwenLM/qwen-code), sem nível pago, assento ou assinatura, e o aplicativo para desktop, a interface web, as extensões de editor e os SDKs estão no mesmo repositório gratuito. O que você paga é a inferência do modelo, adquirida separadamente do endpoint que você configurar.
O Qwen Code ainda é gratuito? Qual é o limite gratuito?
O software continua gratuito; a inferência hospedada gratuita, não. A documentação de autenticação do Qwen Code informa que a oferta gratuita Qwen OAuth foi encerrada em 15 de abril de 2026, e o OAuth não pode mais ser selecionado no menu /auth. Os tutoriais que anunciam 2.000 solicitações por dia descrevem a cota oferecida até a v0.9.0 de fevereiro de 2026. Ainda existe, da parte da Alibaba, um crédito de teste para novas contas: 1 milhão de tokens por modelo na região de Singapura, válido por 90 dias — um teste, não uma oferta gratuita.
Quanto custa o Coding Plan da Alibaba para o Qwen Code?
No site internacional, o Coding Plan Pro custa $50 por mês, com três limites simultâneos: 6.000 solicitações por período de 5 horas, 45.000 por semana e 90.000 por mês; assim que um limite é atingido, as chamadas são suspensas. Uma solicitação corresponde a uma chamada de modelo, e a Alibaba informa que uma tarefa simples geralmente consome de 5 a 10, e uma tarefa complexa, de 10 a 30 ou mais. No site chinês, o mesmo Pro custa ¥200 por mês (¥39,90 no primeiro mês para um novo cliente). Em 1º de outubro de 2026, a oferta estava com disponibilidade limitada, com vagas reabastecidas diariamente. A antiga oferta Lite não é mais vendida.
Qual é a API mais barata para o Qwen Code?
O menor preço por milhão de tokens e o menor custo para concluir uma tarefa são duas questões diferentes, e apenas a primeira pode ser lida em uma tabela de preços. Entre as tarifas publicadas pela Alibaba para Singapura, qwen3-coder-next, a $0,30 de entrada e $1,50 de saída por milhão (faixa de 0-32K), é mais barato que qwen3-coder-plus, a $1 e $5. Saber se um modelo mais barato é realmente mais barato no seu repositório depende do número de tentativas de que ele precisa, algo que nenhuma tabela de preços mede.
Posso pagar por modelos Qwen com crédito da Kunavo?
Não. O catálogo da Kunavo não contém nenhum modelo de texto Qwen, portanto a Kunavo não é uma opção mais barata para usar Qwen. O que a Kunavo pode fazer é disponibilizar modelos Claude e GPT por meio de endpoints compatíveis com OpenAI (Chat Completions e Responses) e Anthropic Messages, formatos que o Qwen Code sabe usar. A Kunavo não executou o Qwen Code contra esses endpoints: trata-se de uma configuração documentada para ser testada, não de uma integração verificada.
Verificado em 1º de outubro de 2026: repositório, versões e documentação do Qwen Code (branch main e tags v0.9.0 a v0.15.0 para o histórico da cota gratuita), registro npm, páginas do Coding Plan (internacional e site chinês), Token Plan e preços do Model Studio. Os preços da Kunavo vêm do catálogo ao vivo; os totais mensais são uma aritmética ilustrativa de tokens, não custos de tarefas medidos.