Volver a las guías
Precios·18 de septiembre de 2026·Actualizado el 1 de octubre de 2026·9 min de lectura

Precios de Qwen Code: planes, costes de API y opciones de proveedores

El cliente es gratuito. El nivel gratuito de OAuth desapareció. Todo lo demás es inferencia que compras.

Última revisión: .

Qwen Code es gratuito: el cliente es software de código abierto con licencia Apache-2.0 y sin nivel de pago, por lo que cada dólar del presupuesto de Qwen Code corresponde a inferencia del modelo adquirida por separado. El nivel gratuito de Qwen OAuth que todavía describen la mayoría de los tutoriales se suspendió el 15 de abril de 2026, lo que significa que un presupuesto de 2026 parte de un endpoint de pago: un Coding Plan de Alibaba Cloud Model Studio, un paquete de Token Plan Credit, facturación de tokens de pago por uso o un endpoint de terceros al que dirijas tú mismo el cliente.

Esas cuatro rutas se miden en cuatro unidades distintas: solicitudes, Credits, tokens y lo que facture tu propio proveedor. Por eso, compararlas solo por el precio destacado produce una respuesta equivocada. Esta página separa el coste del software del coste de la inferencia, muestra una estimación de tokens que puedes recalcular y señala las cifras que no pudieron verificarse.

Cuánto cuesta el software y cuánto cuestan los modelos

El repositorio QwenLM/qwen-code tiene licencia Apache-2.0 y se desarrolla activamente; la API de GitHub lo registraba como no archivado el 21 de septiembre de 2026. Las versiones se publican semanalmente o con mayor frecuencia: v0.24.0 llegó a npm como @qwen-code/qwen-code el 16 de septiembre de 2026 y le siguió v0.24.2 el 20 de septiembre, así que consulta el registro en lugar de confiar en la versión impresa en una página. La instalación se realiza mediante npm (Node.js 22 o posterior), Homebrew o un instalador independiente.

Llamarlo ahora una CLI de terminal se queda corto. El titular del README lo describe como un agente de programación de IA de código abierto para terminal, editor, escritorio, navegador y chat, y el proyecto incluye una aplicación de escritorio, una interfaz web iniciada con qwen serve --open, complementos para VS Code, Zed y JetBrains, SDK de TypeScript, Python y Java, y canales de chat. El campo de descripción de GitHub del repositorio todavía lo denomina un agente que vive en tu terminal, por lo que ambos difieren; el README es el que enumera las superficies adicionales. Ninguna de esas superficies es una mejora de pago: todas están en el mismo repositorio gratuito y ninguna incluye inferencia.

Conviene descartar una herencia: Qwen Code se basó originalmente en Google Gemini CLI v0.8.2, pero el proyecto afirma que dejó de sincronizarse con el upstream en v0.1 y que se desarrolla de forma independiente. Las cuotas y los precios de Gemini CLI no se transfieren.

Límite gratuito de Qwen Code: qué terminó y cuándo

La documentación de autenticación indica que el nivel gratuito de Qwen OAuth se suspendió el 2026-04-15 y que los tokens almacenados en caché existentes podrían seguir funcionando brevemente mientras se rechazan las solicitudes nuevas. OAuth ya no es una opción seleccionable en el cuadro de diálogo /auth; solo permanece documentado como proveedor suspendido. Este es el dato más desactualizado en los resultados de búsqueda sobre este tema.

PeriodoAsignación gratuita de OAuthEvidencia
Hasta v0.9.0 (npm, 3 de febrero de 2026)2,000 solicitudes/día, 60 solicitudes/minutoLa documentación de autenticación se publicó en la etiqueta v0.9.0
Desde v0.10.0 (npm, 9 de febrero de 2026)1,000 solicitudes/día, 60 solicitudes/minutoEl mismo archivo en las etiquetas v0.10.0 a v0.14.0
Desde el 15 de abril de 2026Ninguna; suspendidoDocumentación de autenticación actual; incidencia n.º 3316, abierta el 16 de abril y cerrada

Hay dos advertencias sobre esta tabla. No se anunció en ningún lugar que pudiéramos encontrar la fecha exacta en la que la cuota diaria bajó de 2,000 a 1,000; el intervalo anterior se deduce de la etiqueta de versión en la que cambió la documentación publicada, no de un anuncio de Qwen. Y la afirmación muy repetida de que la cuota bajó a 100 al día antes del cierre no aparece en ninguna de las etiquetas de versión que comprobamos: v0.9.0 a v0.14.0 son las versiones que indican alguna cuota; primero dicen 2,000 y luego 1,000, y desde v0.15.0 el archivo indica que no hay cuota porque el nivel ya se había suspendido. Considera que la cifra de 100 al día no tiene respaldo. Tampoco se encontró ninguna publicación oficial de blog ni comunicado de prensa sobre el cierre, por lo que se documentó en lugar de anunciarse.

Hay otras dos restricciones importantes para quien espere recuperar la ruta gratuita. Los modelos de Qwen OAuth están codificados y no pueden anularse mediante modelProviders, por lo que la ruta suspendida no puede simplemente redirigirse a otro endpoint. Además, OAuth nunca fue utilizable sin interfaz: la documentación señala que, en entornos de CI, SSH o contenedores, normalmente no se puede completar el flujo de inicio de sesión en el navegador.

Tres endpoints oficiales, tres unidades de facturación

Dentro de /auth, Alibaba ModelStudio abre un submenú con Coding Plan, Token Plan y Standard API Key. No son tres formas de pagar la misma factura: la documentación proporciona a cada uno su propio host de endpoint y su propia clave, y te indica que hagas coincidir baseUrl con el plan al que pertenece la clave. Las claves de Coding Plan empiezan por sk-sp-; las claves de Token Plan no exigen ningún prefijo.

RutaFacturado enPrecio publicadoHost del endpoint
Coding Plan Pro (internacional)Solicitudes$50/mescoding-intl.dashscope.aliyuncs.com
Coding Plan Pro (sitio de China)Solicitudes¥200/mes, primer mes ¥39.90 para clientes nuevoscoding.dashscope.aliyuncs.com
Token Plan, PersonalCréditosLite $8 ($6 promocionales), Essential $16 ($10), Standard $25 ($18), Pro $80 ($68) al mestoken-plan.ap-southeast-1.maas.aliyuncs.com
Token Plan, TeamCréditosStandard $30 ($20), Pro $100 ($75), Max $200 por puesto al mesMismo host de Singapur
Clave de API estándarTokensPor modelo, escalonado según la longitud de entradadashscope.aliyuncs.com

La página de Coding Plan establece el precio de Pro en $50 al mes con tres límites simultáneos: hasta 6,000 solicitudes cada 5 horas, 45,000 por semana y 90,000 al mes. Cuando se alcanza cualquiera de los límites, las llamadas se pausan. La cuota semanal se restablece los lunes a las 00:00:00 UTC+08:00 y la mensual en tu fecha de renovación. Alibaba afirma que no son acumulativas ni representan una capacidad distribuida uniformemente a lo largo del tiempo. El 1 de octubre de 2026, la página también marcaba Pro como de disponibilidad limitada: las plazas se asignan por orden de llegada y se reponen diariamente a las 00:00 UTC+08:00, por lo que es posible que no puedas comprar una suscripción el día que lo intentes.

Lo que realmente te cuesta una solicitud: la misma página indica que cada consulta consume cuota según el número de llamadas al modelo y que las tareas sencillas suelen usar entre 5 y 10 llamadas, mientras que las complejas usan 10-30 o más. Por tanto, una instrucción equivale a muchas solicitudes. Tomando la cifra al pie de la letra, 90,000 solicitudes al mes equivalen aproximadamente a entre 3,000 y 18,000 tareas; pero Alibaba presenta esas cantidades de llamadas como habituales, no garantizadas, y afirma que el consumo real varía según la complejidad de la tarea, el contexto y el uso de herramientas. Mídelo en tu propia cuenta antes de dimensionar un plan.

Hay que descartar dos cifras obsoletas. El nivel Lite de Coding Plan ya no existe: la página de China registra que las nuevas suscripciones cesaron el 20 de marzo de 2026 y las renovaciones y mejoras el 13 de abril de 2026; por tanto, cualquier sitio de comparación que siga ofreciendo un nivel Lite más barato como opción activa está desactualizado. Y el precio de ¥200 en China no es el precio internacional de $50 convertido: ¥200 está materialmente por debajo de $50 con cualquier tipo de cambio reciente, así que considera las dos tiendas como ofertas comerciales independientes y confirma el precio, la divisa y la elegibilidad en tu propia consola en lugar de asumir que una se convierte en la otra.

Token Plan requiere dos aclaraciones. Primero, hay una contradicción: la descripción general de Token Plan vende cuotas fijas mensuales de Credits; el 1 de octubre de 2026, todos los niveles Personal funcionaban con un mes de suscripción de 30 días (usaban una ventana de 7 días cuando se escribió esta página por primera vez), mientras que Team funcionaba con un ciclo mensual; pausa el servicio cuando se alcanza la cuota, vende Extra Bundles a $15 por 20,000 Credits y afirma que la cuota no utilizada no se transfiere; mientras tanto, la documentación de autenticación de Qwen Code describe Token Plan como facturación basada en el uso para equipos y empresas. Esas descripciones no coinciden; la página de Alibaba es la que lo vende y se presenta como una suscripción. Segundo, Alibaba afirma que Token Plan actualmente solo está disponible en la región de Singapur, aunque la documentación del cliente también enumera un host de Token Plan en Beijing. Confirma la disponibilidad regional al finalizar la compra.

Por último, la página que vende los Credits no los convierte a tokens. La descripción general de Token Plan publica una cantidad de Credits por nivel —11,500, 25,500, 45,000 y 180,000 Credits al mes para Personal Lite, Essential, Standard y Pro el 1 de octubre de 2026—, pero no indica ninguna tasa de conversión de Credits a tokens ni ningún multiplicador por modelo, por lo que nada en esa página permite afirmar qué compras en tokens por $18 al mes. Si existe una tasa en otro lugar de tu consola, consúltala allí en lugar de confiar en la conversión de un tercero.

Tarifas de pago por uso y una página oficial caducada

La página de precios de Model Studio enumera las tarifas en USD por millón de tokens, escalonadas según la longitud de entrada de cada solicitud. La tabla siguiente corresponde a la columna de Singapur; la misma página muestra tarifas separadas y materialmente inferiores para China (Beijing), así que comprueba en qué región se factura tu cuenta antes de usar estas cifras.

ModeloEntrada de 0-32K32K-128K128K-256K256K-1M
qwen3-coder-plus$1 de entrada / $5 de salida$1.8 / $9$3 / $15$6 / $60
qwen3-coder-next$0.3 de entrada / $1.5 de salida$0.5 / $2.5$0.8 / $4No indicado

Consulta el nivel superior antes de presupuestar una sesión larga del agente: la salida de qwen3-coder-plus pasa de $5 a $60 por millón de tokens cuando la entrada de una solicitud supera 256K. Una conversación de agente con contexto largo no se tarifica como una corta. Las cuentas nuevas de la región de Singapur también reciben una concesión gratuita de 1 millón de tokens por modelo, válida durante 90 días desde la activación, la publicación del modelo o la aprobación, lo que ocurra más tarde; es una concesión de prueba, no un nivel gratuito.

Conviene mencionar una trampa porque está en el dominio oficial y aún aparece en los resultados: la página de reducción de precio de qwen3-coder-plus anuncia un descuento de caché de contexto cuyo periodo promocional transcurrió del 24 de julio al 23 de agosto de 2025. Es oficial y, al mismo tiempo, ha caducado. No hemos impreso aquí las tarifas de los demás modelos Qwen porque la tabla de qwen3.7-plus separa la salida con razonamiento de la salida sin razonamiento en columnas distintas y nuestra lectura no fue lo bastante fiable como para publicarla.

Mejor API para Qwen Code: dirigir el cliente a otro lugar

Qwen Code admite cuatro protocolos: OpenAI Chat Completions, OpenAI Responses, Anthropic y Gemini/Vertex; cada uno puede dirigirse a una URL base personalizada. La propia documentación menciona OpenRouter y Fireworks AI como alternativas a las que cambiar tras el cierre de OAuth, por lo que un endpoint de terceros es una ruta admitida y no un recurso provisional. Kunavo sirve /v1/chat/completions, /v1/responses y /v1/messages bajo https://api.kunavo.com/v1, que son tres de esos cuatro formatos de comunicación.

Deja claro qué compras con esto. El catálogo de Kunavo no contiene ningún modelo de texto Qwen, por lo que esta no es una forma más barata de ejecutar Qwen. Es una forma de ejecutar modelos Claude o GPT dentro de Qwen Code con un único saldo prepago. Kunavo tampoco ha probado Qwen Code en tiempo de ejecución con estos endpoints, aunque ahora existe una página de configuración de Qwen Code, escrita a partir de la propia documentación de Qwen Code, igual que las páginas de Cline y OpenCode. Considera la configuración siguiente un punto de partida documentado y mantén disponible tu ruta funcional mientras la pruebas.

Ruta compatible con OpenAI, solo variables de entorno
export OPENAI_API_KEY="your-kunavo-key"
export OPENAI_BASE_URL="https://api.kunavo.com/v1"
export OPENAI_MODEL="claude-sonnet-5"

La URL base conserva su sufijo /v1; todos los ejemplos de OPENAI_BASE_URL en la documentación terminan ahí, y Qwen Code añade la ruta por sí mismo. QWEN_MODEL es un alias aceptado de OPENAI_MODEL. La configuración equivalente en un solo archivo se encuentra en ~/.qwen/settings.json.

Combina estos campos en ~/.qwen/settings.json
{
  "modelProviders": {
    "openai": [
      {
        "id": "claude-sonnet-5",
        "name": "Claude Sonnet 5",
        "baseUrl": "https://api.kunavo.com/v1",
        "envKey": "OPENAI_API_KEY"
      }
    ]
  },
  "env": {
    "OPENAI_API_KEY": "your-kunavo-key"
  },
  "security": {
    "auth": {
      "selectedType": "openai"
    }
  },
  "model": {
    "name": "claude-sonnet-5"
  }
}

Cuatro datos de configuración de la referencia de proveedores de modelos y de la documentación de autenticación enlazada anteriormente te ahorran tiempo real de depuración. Solo las credenciales compatibles con OpenAI tienen indicadores de la CLI: existen --openai-api-key y --openai-base-url, y no hay equivalentes para Anthropic o Gemini. Las claves de entorno específicas del proveedor no seleccionan por sí solas el tipo de autenticación, así que exporta OPENAI_API_KEY en lugar de una variable con el nombre del proveedor si configuras esto únicamente mediante variables de entorno. La precedencia de credenciales coloca la entrada modelProviders seleccionada por encima de los indicadores de la CLI: sus valores baseUrl y envKey tienen prioridad sobre --openai-base-url y --openai-api-key, que es el orden que la mayoría de la gente invierte; después vienen los indicadores de la CLI, luego las variables de entorno y finalmente settings.json. Solo los valores introducidos mediante /auth durante la sesión en ejecución se sitúan por encima de modelProviders. Las variables de entorno incluyen lo que aporte el primer archivo .env encontrado, y ese archivo solo completa las variables que aún no están definidas; las variables no se combinan entre varios archivos. Las modificaciones de modelProviders se recargan en caliente durante una sesión en ejecución, mientras que providerProtocol se lee una vez al iniciar y requiere un reinicio.

Hay dos límites que conviene tener en cuenta. La herramienta integrada web_search utiliza la búsqueda del servidor de DashScope, así que lo que la activa es el host, no el plan: está activa para Standard API Key y Token Plan de ModelStudio, y para una entrada personalizada o modelProviders que apunte a un host de DashScope Responses reconocido con una clave directa. Está desactivada para proveedores de terceros y para endpoints personalizados en cualquier otro host; también está desactivada para Coding Plan, porque ese endpoint no está verificado para esta API. Esa última fila lo deja claro: es una restricción del host, no una penalización por aportar tu propia clave. Las alternativas documentadas son un servidor de búsqueda MCP o dirigir tools.webSearch.model a una clave de DashScope compatible independiente mientras el modelo principal se ejecuta en otro lugar. Por separado, wireApi: "responses" requiere un endpoint realmente compatible con Responses y la documentación indica que no hay detección del endpoint ni fallback automático cuando falla una llamada. No hemos probado la ruta Responses de Kunavo con los requisitos de Qwen Code, así que empieza con Chat Completions.

Una estimación mensual que puedes recalcular

Supón un mes con 20 millones de tokens de entrada sin caché y 1 millón de tokens de salida. Con las tarifas actuales del catálogo de Kunavo, el cálculo da:

ModeloEntrada/salida por 1MMes estimadoFunción del candidato
Claude Haiku 4.5$0.70 / $3.50$17.50Ediciones acotadas de gran volumen y trabajo rutinario de programación
GPT-5.6 Terra$0.70 / $4.20$18.20Razonamiento y uso de herramientas combinados
Claude Sonnet 5$1.40 / $7.00$35.00Cambios difíciles en repositorios

Esto es aritmética de tokens basada en una carga de trabajo supuesta, no una tarea de Qwen Code medida ni un límite máximo de factura. Excluye los cargos de caché, las herramientas externas y los impuestos, y supone que el modelo más barato termina el trabajo sin intentos adicionales; esa es la condición que realmente determina si una tarifa menor produce una factura menor. El importe del catálogo de Kunavo es un mínimo de facturación, no un límite máximo: cuando el upstream informa de su cargo, la factura es el mayor de entre el coste del catálogo y el coste del upstream multiplicado por el margen aplicable. Consulta los detalles de facturación.

Ten en cuenta lo que esta tabla no puede hacer. No se puede comparar con el Coding Plan de $50, porque ese plan mide las llamadas al modelo y esta estimación mide tokens, y un recuento de llamadas no incluye ningún recuento de tokens. Tampoco se puede comparar con Token Plan, porque Credits no tienen una conversión de tokens publicada. Comparar una suscripción con la facturación por uso requiere tus propios datos de uso medidos en ambos casos.

Kunavo comienza con una recarga prepaga de $10 sin suscripción. Ese es el dinero necesario para abrir una cuenta con fondos, no el coste de una tarea.

La API más barata para Qwen Code: qué ruta gana cuando

ElegirCuándo encajaA qué renuncias
Suscripción a Coding PlanUso diario constante de Qwen que se mantiene dentro de los límites de solicitudesLlamadas pausadas al alcanzar cualquier límite; sin búsqueda web integrada; cuota compartida con cualquier otra herramienta que use la clave
Tokens estándar de pago por usoUso irregular u ocasional, y sesiones con contexto largo cuyo precio quieres calcular con precisiónTramos según la longitud de entrada que elevan considerablemente la tarifa en solicitudes grandes
Credits de Token PlanHas confirmado la tarifa de Credits para tus modelos en tu propia consolaSin conversión pública, una cuota mensual que pausa el servicio al agotarse, disponibilidad en Singapur
Una pasarela como KunavoQuieres modelos Claude o GPT en Qwen Code con un único saldo prepagoSin modelos Qwen; configuración de proveedor personalizado; sin búsqueda web integrada
Inferencia localTienes hardware adecuado y el modelo gestiona tu flujo de trabajo con herramientasEl hardware, el mantenimiento y la fiabilidad de las llamadas a herramientas pasan a ser tu responsabilidad

Mantén separadas las dos preguntas. El precio más bajo publicado por millón de tokens es un dato que puedes leer en una página; el coste más bajo para completar tu tarea es una medición que nadie ha publicado para este cliente, incluidos nosotros. Ejecuta las mismas tres tareas —una edición pequeña, una corrección de errores y una investigación de varios archivos— en dos rutas y compara los cargos registrados antes de comprometerte.

Si la ruta del gateway es la que quieres probar, crea una cuenta de Kunavo y sigue la guía de inicio rápido y la referencia de Chat Completions para consultar el endpoint y los identificadores de modelo. Para tomar la misma decisión con otros clientes, consulta los precios de OpenCode, los precios de Cline y la guía de la API compatible con OpenAI.

Preguntas frecuentes

¿Cuánto cuesta Qwen Code?

El cliente de Qwen Code no cuesta nada. Es software de código abierto con licencia Apache-2.0 en GitHub, en QwenLM/qwen-code, sin nivel de pago, sin puestos y sin suscripción; la aplicación de escritorio, la interfaz web, los complementos para editores y los SDK se distribuyen en el mismo repositorio gratuito. Lo que pagas es la inferencia del modelo, adquirida por separado del endpoint que configures.

¿Qwen Code sigue siendo gratuito? ¿Cuál es el límite gratuito de Qwen Code?

El software sigue siendo gratuito. La inferencia alojada gratuita no: la propia documentación de autenticación de Qwen Code indica que el nivel gratuito de Qwen OAuth se suspendió el 2026-04-15 y que OAuth ya no es una opción seleccionable en el cuadro de diálogo /auth. Los tutoriales que citan 2,000 solicitudes al día describen la cuota disponible hasta v0.9.0 en febrero de 2026. La asignación gratuita restante en la plataforma de Alibaba es una concesión para cuentas nuevas de 1 millón de tokens por modelo en la región de Singapur, válida durante 90 días, lo que constituye una concesión de prueba y no un nivel gratuito.

¿Cuál es la mejor API para Qwen Code?

Depende del modelo que quieras. En concreto, para los modelos Qwen, Alibaba Cloud Model Studio es la fuente oficial: una suscripción a Coding Plan si tu uso es estable y tiene forma de solicitudes, o facturación de tokens de pago por uso si es variable. La propia documentación de Qwen Code también menciona OpenRouter y Fireworks AI como alternativas tras el cierre de OAuth. Si quieres ejecutar modelos Claude, GPT o Gemini dentro de Qwen Code, cualquier endpoint compatible con OpenAI, Anthropic o Gemini puede configurarse como proveedor personalizado.

¿Cuál es la API más barata para Qwen Code?

El precio más bajo publicado por millón de tokens y el coste más bajo para terminar una tarea son preguntas distintas, y solo la primera puede responderse a partir de una página de precios. Entre las tarifas publicadas por Alibaba para Singapur, qwen3-coder-next, a $0.30 de entrada y $1.50 de salida por millón de tokens (nivel de entrada de 0-32K), es más barato que qwen3-coder-plus, a $1 y $5. Que un modelo más barato sea realmente más económico para tu repositorio depende de cuántos intentos necesite, algo que ninguna tabla de precios publicada mide.

¿Una suscripción a Coding Plan solo funciona con Qwen Code?

No. La página de Coding Plan de Alibaba Cloud incluye Claude Code, Cline, Cursor, Codex, OpenCode, OpenClaw, Qoder, Lingma, Cherry Studio, Chatbox y otras herramientas entre las compatibles, y su lista de modelos incluye modelos que no son Qwen, como glm-5, kimi-k2.5 y MiniMax-M2.5. Una suscripción no está vinculada a un solo cliente, lo que también significa que la cuota consumida por otra herramienta deja de estar disponible para Qwen Code.

¿Puedo usar crédito de Kunavo para pagar modelos Qwen en Qwen Code?

No. El catálogo de Kunavo no contiene ningún modelo de texto Qwen, por lo que Kunavo no puede ser una vía más barata para la inferencia de Qwen. Lo que Kunavo sí puede hacer es servir modelos Claude y GPT mediante endpoints compatibles con OpenAI, Responses y Anthropic Messages, que son formatos de comunicación compatibles según la documentación de Qwen Code. Kunavo no ha probado Qwen Code en tiempo de ejecución con esos endpoints, así que considera esa configuración una ruta documentada que puedes probar, no una integración verificada.

Repositorio de Qwen Code, datos de versiones y documentación comprobados el 21 de septiembre de 2026 frente a github.com/QwenLM/qwen-code, el registro de npm y la documentación incluida en la rama principal y en las etiquetas de versión v0.9.0 a v0.15.0. Las páginas de Alibaba Cloud Coding Plan, Token Plan y precios de modelos se comprobaron el mismo día y se revisaron de nuevo el 1 de octubre de 2026, cuando aquí se actualizaron las condiciones de cuota de Token Plan y la nota de disponibilidad de Coding Plan. Las tarifas de tokens de Kunavo se leen del catálogo activo; los totales mensuales son cálculos ilustrativos de tokens, no costes medidos de tareas.