Volver a las guías
Precios·1 de octubre de 2026·Actualizado el 3 de octubre de 2026·9 min de lectura

Precios de Qwen Code: Coding Plan, Token Plan y API de pago por uso

El cliente es gratuito. La oferta OAuth gratuita ya no existe. Todo lo demás es inferencia comprada, en cuatro unidades diferentes.

Qwen Code en sí es gratuito: el cliente es de código abierto bajo Apache-2.0, sin nivel de pago, por lo que cada euro de un presupuesto de Qwen Code se destina a la inferencia del modelo, adquirida aparte. La oferta gratuita de Qwen OAuth que todavía describen la mayoría de los tutoriales se suspendió el 15 de abril de 2026. En 2026, un presupuesto parte por tanto de un endpoint de pago: un Coding Plan de Alibaba Cloud Model Studio, un plan de Credits Token Plan, una facturación por uso basada en tokens o un endpoint de terceros que usted configure por su cuenta.

Estas cuatro vías se miden en cuatro unidades diferentes —solicitudes, Credits, tokens y lo que facture su propio proveedor—, y por eso una comparación basada en el precio inicial da la respuesta equivocada. Esta página separa el coste del software del de la inferencia, ofrece una estimación recalculable y señala lo que no se pudo verificar. La versión detallada en inglés es Qwen Code pricing.

El software es gratuito; los modelos, no

El repositorio QwenLM/qwen-code está bajo Apache-2.0 y se desarrolla activamente; la API de GitHub lo daba como no archivado el 1 de octubre de 2026, con un push ese mismo día. Las versiones se publican al menos semanalmente: la v0.24.7 se publicó en npm (@qwen-code/qwen-code) el 29 de septiembre de 2026. Instalación mediante script autónomo, npm (Node.js 22 o posterior) o Homebrew. El mismo repositorio gratuito incluye una aplicación de escritorio, una interfaz web (qwen serve --open), extensiones para VS Code, Zed y JetBrains, y SDK de TypeScript, Python y Java; ninguna de estas superficies es una opción de pago y ninguna incluye inferencia.

Una relación que conviene descartar: al principio Qwen Code se basaba en Google Gemini CLI v0.8.2, pero el proyecto dejó de sincronizarse con él desde la v0.1. Las cuotas y tarifas de Gemini CLI no se aplican.

El límite gratuito: qué se detuvo y cuándo

La documentación de autenticación indica que la oferta gratuita de Qwen OAuth se suspendió el 2026-04-15 y que los tokens ya almacenados en caché pueden funcionar brevemente, pero que las nuevas solicitudes se rechazan. En la interfaz, seleccionar Qwen OAuth ahora muestra « Discontinued — switch to Coding Plan or API Key ».

PeriodoCuota OAuth gratuitaFuente
Hasta la v0.9.0 (npm, 3 de febrero de 2026)2.000 solicitudes/día, 60 solicitudes/minutoDocumentación de autenticación en la etiqueta v0.9.0
A partir de la v0.10.0 (npm, 9 de febrero de 2026)1.000 solicitudes/día, 60 solicitudes/minutoMismo archivo en las etiquetas v0.10.0 a v0.14.0
A partir del 15 de abril de 2026Ninguna — suspendidaDocumentación actual; issue #3316

La fecha exacta del cambio de 2.000 a 1.000 solicitudes no se anunció en ninguna parte: el intervalo anterior procede de la etiqueta de versión en la que cambió la documentación. La cifra de 100 solicitudes al día que circula no aparece en ninguna de las etiquetas verificadas; considérela sin fundamento. Además, los modelos Qwen OAuth están codificados de forma fija y no se pueden redirigir mediante modelProviders.

Tres endpoints oficiales, tres unidades de facturación

En /auth, Alibaba ModelStudio abre un submenú de Coding Plan, Token Plan y Standard API Key. No son tres formas de pagar la misma factura: la documentación proporciona a cada uno su host y su clave, y exige conceder el baseUrl al plan de la clave. Las claves de Coding Plan comienzan por sk-sp-.

VíaFacturado enPrecio publicado (1 de octubre de 2026)Host
Coding Plan Pro (internacional)Solicitudes$50/mescoding-intl.dashscope.aliyuncs.com
Coding Plan Pro (sitio chino)Solicitudes¥200/mes; ¥39,90 el primer mes para un cliente nuevocoding.dashscope.aliyuncs.com
Token Plan, PersonalCréditosLite $8 (promoción $6), Essential $16 ($10), Standard $25 ($18), Pro $80 ($68) al mestoken-plan.ap-southeast-1.maas.aliyuncs.com
Token Plan, TeamCréditosStandard $30 ($20), Pro $100 ($75), Max $200 por asiento y mesMismo host de Singapur
Clave API estándarTokensPor modelo, por tramo de longitud de entradadashscope.aliyuncs.com

La página de Coding Plan aplica tres límites simultáneos al plan Pro: hasta 6.000 solicitudes por 5 horas, 45.000 por semana y 90.000 al mes; cuando se alcanza cualquiera de ellos, las llamadas se suspenden. La cuota de 5 horas se libera progresivamente, la cuota semanal se reinicia el lunes a las 0:00 (UTC+8) y la mensual en la fecha de renovación. El 1 de octubre de 2026, la página también señalaba una disponibilidad limitada: plazas limitadas, por orden de llegada, reabastecidas diariamente (0:00 UTC+8 a nivel internacional, 9:30 UTC+8 en el sitio chino). La oferta Lite ya no existe: nuevas suscripciones suspendidas el 20 de marzo de 2026, renovaciones y mejoras de plan el 13 de abril de 2026. Y ¥200 no es la conversión de $50: trate ambas vitrinas como ofertas distintas.

Lo que realmente cuesta una solicitud: cada pregunta consume cuota según el número de llamadas al modelo, y Alibaba indica entre 5 y 10 llamadas para una tarea sencilla, y entre 10 y 30 o más para una tarea compleja. Por tanto, una instrucción equivale a varias solicitudes; a ese ritmo, 90.000 solicitudes al mes representan aproximadamente entre 3.000 y 18.000 tareas, pero Alibaba presenta estas cifras como típicas, no garantizadas. Mida el consumo en su cuenta antes de dimensionar.

El Token Plan requiere dos observaciones. Primero, ha cambiado: el 1 de octubre de 2026, la página de Token Plan asignaba a los planes Personal una cuota mensual (ciclo de 30 días desde la suscripción) de 11.500, 25.500, 45.000 y 180.000 Credits para Lite, Essential, Standard y Pro, suspendía el servicio una vez alcanzada la cuota, vendía paquetes adicionales a $15 por 20.000 Credits y especificaba que la cuota no utilizada no se acumula. Segundo, allí no se publica ninguna conversión de Credits → tokens ni ningún multiplicador por modelo: nada permite decir cuántos tokens se compran por $18 al mes. La oferta solo se vende en la región de Singapur.

Pago por uso, por token

La página de precios de Model Studio proporciona precios en dólares por millón de tokens, según el tramo de longitud de entrada de cada solicitud. A continuación, la columna de Singapur; las tarifas de China (Pekín) son distintas y considerablemente más bajas, así que verifique su región de facturación.

ModeloEntrada 0-32K32K-128K128K-256K256K-1M
qwen3-coder-plus$1 entrada / $5 salida$1,8 / $9$3 / $15$6 / $60
qwen3-coder-next$0,3 entrada / $1,5 salida$0,5 / $2,5$0,8 / $4No listado

Lea el último tramo antes de presupuestar una sesión larga de agente: la salida de qwen3-coder-plus pasa de $5 a $60 por millón en cuanto la entrada de una solicitud supera 256K. Las cuentas nuevas de Singapur reciben 1 millón de tokens gratuitos por modelo, válidos durante 90 días —una prueba, no una oferta gratuita—. Tenga cuidado también con la página oficial de reducción de precio de qwen3-coder-plus: el descuento de caché que anuncia estuvo vigente del 24 de julio al 23 de agosto de 2025.

Conectar Qwen Code a otro endpoint

Qwen Code habla cuatro protocolos —OpenAI Chat Completions, OpenAI Responses, Anthropic y Gemini/Vertex— y cada uno acepta una URL base personalizada; su propia documentación cita OpenRouter y Fireworks AI como alternativas tras la suspensión de OAuth. Kunavo sirve /v1/chat/completions, /v1/responses y /v1/messages bajo https://api.kunavo.com/v1.

Dejemos claro qué aporta esto. El catálogo de Kunavo no contiene ningún modelo de texto Qwen: no es una forma más barata de ejecutar Qwen, sino de ejecutar Claude o GPT en Qwen Code con un único saldo prepago. Kunavo tampoco ha ejecutado Qwen Code contra estos endpoints; la configuración siguiente procede de la documentación de Qwen Code, como la página de configuración de Qwen Code en inglés.

Para fusionar en ~/.qwen/settings.json
{
  "modelProviders": {
    "openai": [
      {
        "id": "claude-sonnet-5",
        "name": "Claude Sonnet 5",
        "baseUrl": "https://api.kunavo.com/v1",
        "envKey": "KUNAVO_API_KEY"
      }
    ]
  },
  "security": {
    "auth": {
      "selectedType": "openai"
    }
  },
  "model": {
    "name": "claude-sonnet-5"
  }
}

Cuatro hechos que evitan horas de depuración, extraídos de la referencia de proveedores de modelos: el baseUrl se detiene en /v1 (el SDK añade la ruta; con /v1/chat/completions, devuelve un 404); la clave se lee en la variable indicada por envKey, preferiblemente mediante .qwen/.env en lugar de dejarla en texto claro en settings.json; la entrada modelProviders seleccionada prevalece sobre las opciones CLI --openai-base-url y --openai-api-key, de ahí la impresión de que se ignoran; y wireApi: "responses" no tiene detección de endpoint ni fallback automático: empiece con Chat Completions.

Hay que prever dos limitaciones. La herramienta integrada web_search utiliza la búsqueda del lado del servidor de DashScope: está activa con una Standard API Key o un Token Plan, inactiva con el Coding Plan (no verificado en este endpoint) e inactiva con un proveedor de terceros o un endpoint en otro host. La alternativa documentada es un servidor de búsqueda MCP. Además, una vía de Kunavo solo sirve para chat: no ofrece embeddings, síntesis ni reconocimiento de voz.

Una estimación mensual recalculable

Supongamos un mes de 20 millones de tokens de entrada no almacenados en caché y 1 millón de tokens de salida. Según las tarifas actuales del catálogo de Kunavo:

ModeloEntrada / salida por millónMes estimadoPosible función
Claude Haiku 4.5$0,70 / $3,50$17,50Modificaciones acotadas y alto volumen
GPT-5.6 Terra$0,70 / $4,20$18,20Razonamiento y herramientas combinados
Claude Sonnet 5$1,40 / $7,00$35,00Cambios difíciles en el repositorio

Esto es aritmética sobre una carga supuesta, no una tarea de Qwen Code medida ni un límite de facturación; se excluyen la caché, las herramientas externas y los impuestos, y se supone que el modelo más barato termina el trabajo sin nuevos intentos. El importe del catálogo de Kunavo es un mínimo de facturación, no un máximo: cuando el proveedor ascendente declara su coste, la factura es el mayor entre el coste del catálogo y el coste ascendente multiplicado por el recargo aplicable. Esta tabla no se puede comparar con el Coding Plan de $50 (que cuenta llamadas, no tokens) ni con el Token Plan (Credits sin conversión publicada): para comparar un plan y un contador, necesita su propio consumo medido en ambos lados.

Kunavo comienza con una recarga prepaga de $10, sin suscripción: el importe para abrir una cuenta con saldo, no el precio de una tarea. El checkout de Stripe acepta tarjetas (Visa, Mastercard, American Express), Apple Pay, Google Pay y Link; el débito directo SEPA no se ofrece por ahora.

Qué ruta elegir y cuándo

ElegirCuándo convieneA qué renuncia
Coding PlanUso diario y regular de Qwen que se mantenga por debajo de los límites de solicitudesLlamadas suspendidas al alcanzar cada límite; sin búsqueda web integrada; cuota compartida con cualquier otra herramienta que utilice la clave; plazas limitadas
Pago por uso, por tokenUso irregular u ocasional, sesiones largas que haya que cuantificar con precisiónTramos de longitud de entrada que elevan la tarifa en solicitudes grandes
Créditos de Token PlanHa confirmado en su consola la tasa en Credits de sus modelosSin conversión pública, cuota mensual que suspende el servicio al agotarse, solo Singapur
Una pasarela como KunavoQuiere Claude o GPT en Qwen Code con un único saldo prepagoSin modelos Qwen; configuración manual; sin búsqueda web integrada
Inferencia localTiene el hardware adecuado y el modelo gestiona sus herramientasEl hardware, el mantenimiento y la fiabilidad de las llamadas a herramientas pasan a ser responsabilidad suya

Mantenga separadas las dos preguntas: el precio por millón de tokens se lee en una página; el coste más bajo para terminar su tarea es una medida que nadie ha publicado para este cliente, nosotros incluidos. Ejecute las mismas tres tareas —una modificación pequeña, una corrección de errores y una investigación en varios archivos— por dos vías y compare los importes registrados. Para probar la vía de pasarela, cree una cuenta de Kunavo y siga la guía de inicio rápido.

Preguntas frecuentes

¿Cuánto cuesta Qwen Code?

El cliente Qwen Code no cuesta nada: es de código abierto bajo Apache-2.0 en GitHub (QwenLM/qwen-code), sin nivel de pago, sin plazas ni suscripción, y la aplicación de escritorio, la interfaz web, las extensiones del editor y los SDK están en el mismo repositorio gratuito. Lo que paga es la inferencia del modelo, adquirida por separado al configurar el endpoint.

¿Qwen Code sigue siendo gratuito? ¿Cuál es el límite gratuito?

El software sigue siendo gratuito, pero la inferencia alojada gratuita no. La documentación de autenticación de Qwen Code indica que la oferta gratuita Qwen OAuth se suspendió el 15 de abril de 2026, y OAuth ya no se puede seleccionar en el menú /auth. Los tutoriales que anuncian 2 000 solicitudes al día describen la cuota disponible hasta la v0.9.0 de febrero de 2026. Por parte de Alibaba, sigue habiendo un crédito de prueba para cuentas nuevas: 1 millón de tokens por modelo en la región de Singapur, válido durante 90 días; es una prueba, no una oferta gratuita.

¿Cuánto cuesta el Coding Plan de Alibaba para Qwen Code?

En el sitio internacional, el Coding Plan Pro cuesta $50 al mes, con tres límites simultáneos: 6 000 solicitudes por cada periodo de 5 horas, 45 000 por semana y 90 000 al mes; cuando se alcanza cualquiera de ellos, las llamadas se suspenden. Una solicitud corresponde a una llamada al modelo, y Alibaba indica que una tarea sencilla suele consumir entre 5 y 10, y una tarea compleja entre 10 y 30 o más. En el sitio chino, el mismo Pro cuesta ¥200 al mes (¥39,90 el primer mes para un cliente nuevo). El 1 de octubre de 2026, la oferta tenía disponibilidad limitada, con plazas repuestas cada día. La antigua oferta Lite ya no se vende.

¿Cuál es la API más barata para Qwen Code?

El precio más bajo por millón de tokens y el coste más bajo para terminar una tarea son dos preguntas distintas, y solo la primera se puede leer en una tabla de precios. Entre las tarifas publicadas por Alibaba para Singapur, qwen3-coder-next a $0,30 de entrada y $1,50 de salida por millón (tramo 0-32K) es más barato que qwen3-coder-plus a $1 y $5. Que un modelo más barato sea realmente más barato para su repositorio depende del número de intentos que necesite, algo que ninguna tabla de precios mide.

¿Puedo pagar modelos Qwen con crédito de Kunavo?

No. El catálogo de Kunavo no contiene ningún modelo de texto Qwen, por lo que Kunavo no es una vía más barata para usar Qwen. Lo que Kunavo puede hacer es servir modelos Claude y GPT mediante endpoints compatibles con OpenAI (Chat Completions y Responses) y Anthropic Messages, formatos que Qwen Code sabe utilizar. Kunavo no ha ejecutado Qwen Code contra estos endpoints: es una configuración documentada que se puede probar, no una integración verificada.

Verificado el 1 de octubre de 2026: repositorio, versiones y documentación de Qwen Code (rama main y etiquetas v0.9.0 a v0.15.0 para el historial de la cuota gratuita), registro npm, páginas de Coding Plan (internacional y sitio chino), Token Plan y precios de Model Studio. Los precios de Kunavo proceden del catálogo en directo; los totales mensuales son una aritmética ilustrativa de tokens, no costes de tareas medidos.