DeepSeek Harness no cuesta nada; la factura corresponde al modelo y, en su ruta integrada, es la API de DeepSeek: deepseek-flash a $0.30 por millón de tokens de entrada y $1.20 por millón de tokens de salida en horas punta, la mitad fuera de ellas y $0.006 por millón en caso de acierto de caché. Lo que hace que el harness importe para la factura es lo que envía: en una ejecución registrada de 0.2.0-rc.2, cada turno incluía 24 definiciones de herramientas, solicitaba hasta 256,000 tokens de salida con thinking activado y cada sesión nueva añadía una solicitud de título. Precios consultados el 1 de octubre de 2026.
Para dsh frente al agente de Anthropic, consulta DeepSeek Harness vs Claude Code; para dirigirlo a otro endpoint, consulta la página de configuración de DeepSeek Harness de Kunavo.
El harness es gratuito; el modelo no
DeepSeek Harness (dsh) tiene licencia MIT y se instala desde npm como @deepseek-ai/dsh; 0.2.0-rc.2 (29 de septiembre de 2026) es la etiqueta actual, y el README todavía lo denomina una vista previa para desarrolladores con "compatibility-breaking changes" pendientes. De fábrica, dirige las solicitudes a la API oficial de DeepSeek con el modelo deepseek-flash, mediante el endpoint con formato Anthropic de DeepSeek y usando tu clave de DeepSeek. Puedes añadir otros proveedores; no puedes comprar nada desde dsh.
Precios de DeepSeek
| Modelo | Entrada, acierto de caché | Entrada, fallo de caché | Salida |
|---|---|---|---|
deepseek-flash (DeepSeek-V4.1-Flash) | $0.006 en horas punta / $0.003 fuera de horas punta | $0.3 / $0.15 | $1.2 / $0.60 |
deepseek-v4-pro | $0.044 en horas punta / $0.022 fuera de horas punta | $1.32 / $0.66 | $3.96 / $1.98 |
Por millón de tokens, según la página de precios de DeepSeek del 1 de octubre de 2026. Las tarifas fuera de horas punta son la mitad de las tarifas punta; las horas punta son de 01:00–04:00 y de 06:00–10:00 UTC, de lunes a viernes, excepto los días festivos públicos chinos. deepseek-flash funciona con DeepSeek-V4.1-Flash; el nombre anterior deepseek-v4-flash todavía se acepta y se factura al precio de Flash. Los cargos se descuentan de un saldo prepago de DeepSeek.
Qué envía un turno — medición
Ejecutamos dsh 0.2.0-rc.2 sin interfaz gráfica contra un endpoint sustituto local que registra las solicitudes, con una tarea que lee un archivo y responde: tres sesiones nuevas por ruta, las nueve completando el intercambio de herramientas y con tamaños de solicitud idénticos en cada ejecución. En la ruta integrada de DeepSeek:
| Solicitud | Tamaño | Qué contiene |
|---|---|---|
| Turno del agente, primera llamada | 65 321 bytes | 24 definiciones de herramientas (18,606), prompt del sistema (2,734), tarea más contexto de ejecución, max_tokens: 256000, thinking activado, output_config.effort: "high" y dos campos que no son del modelo: dsh_session_log (33,342) y dsh_plugin_packages (5,800) |
| Título de la sesión | 39 906 bytes | max_tokens: 64, thinking desactivado, el primer prompt y los mismos dos campos que no son del modelo |
| Turno del agente después del resultado de la herramienta | 36 189 bytes | La conversación hasta ese momento, con el registro de sesión enviado ahora de forma incremental |
De aquí se derivan tres consecuencias para el coste. La llamada de título ocurre por sesión, consume pocos tokens pero tiene un coste real y se envía al mismo modelo. Thinking está activado con esfuerzo alto de forma predeterminada, y los tokens de razonamiento se facturan como salida, por lo que la configuración de esfuerzo del selector de modelos controla el coste. El prefijo del prompt es estable: las herramientas y el prompt del sistema eran idénticos byte por byte entre ejecuciones, que es lo que recompensa el precio de acierto de caché de DeepSeek. Los dos campos dsh_ no son entrada del modelo; no está documentado si DeepSeek los cuenta para algo, y aquí no se presupone que lo haga. Son bytes de solicitud de un sustituto, no recuentos de tokens de DeepSeek.
Cuánto cuesta una sesión
Aritmética de tokens, no una factura medida. Una sesión que envía 200,000 tokens de entrada y recibe 12,000 tokens de salida, con precios punta:
| Ruta | Sin caché | 80% de entrada en caché | Facturado por |
|---|---|---|---|
deepseek-flash, horas punta | $0.074 | $0.027 | DeepSeek |
deepseek-v4-pro, horas punta | $0.312 | $0.107 | DeepSeek |
deepseek-flash, fuera de horas punta | $0.037 | $0.014 | DeepSeek |
| Claude Haiku 4.5 a través de Kunavo | $0.182 | — | Kunavo |
| Claude Sonnet 5 a través de Kunavo | $0.364 | — | Kunavo |
La columna con caché supone que la caché automática de DeepSeek sirve el 80% de la entrada, algo plausible con un prefijo estable, pero que solo tu propia página de uso puede confirmar. Las filas de Kunavo son tarifas actuales del catálogo sin caché, para quienes quieran Claude detrás del mismo harness; Kunavo no vende modelos de DeepSeek, factura por token desde un saldo prepago con una recarga mínima de $10 (facturación) y trata el importe de su catálogo como un mínimo, no como un máximo. La diferencia de precio es real, y también lo es la diferencia entre la tarifa más baja y la tarea terminada más barata.
Otros proveedores y qué cambia
Una API de modelo personalizada acepta una URL base y un protocolo. En la ejecución, openai-completions con una URL base terminada en /v1 publicó en /v1/chat/completions; anthropic-messages con la raíz sin más publicó en /v1/messages?beta=true, y con /v1 al final publicó en /v1/v1/messages: un 404 en cualquier pasarela real. Estas rutas solicitaron max_tokens: 32768 en lugar de 256,000, no enviaron ninguno de los campos dsh_ y su solicitud de título ocupó menos de 800 bytes.
El campo del registro de sesión es la otra mitad de privacidad de esta elección. En la ruta integrada, el plugin dsh-session-log-deepseek está activado de forma predeterminada y envía eventos de la sesión, incluida la ruta de tu directorio de trabajo, con cada solicitud, a cualquier URL base que use la ruta. Desactívalo en Settings → General, "Upload Session Log when using the official model API". La exportación de comentarios de OpenTelemetry de dsh es otro valor predeterminado independiente, dirigido al recopilador de DeepSeek; DSH_TELEMETRY_MODE=DISABLED la desactiva, que es como se realizaron estas ejecuciones.
Preguntas frecuentes
¿Cuánto cuesta DeepSeek Harness?
El harness es gratuito: DeepSeek Harness (dsh) tiene licencia MIT, y 0.2.0-rc.2 en npm (29 de septiembre de 2026) sigue siendo una vista previa para desarrolladores. Lo que pagas es el modelo. Su ruta integrada envía las solicitudes a la API propia de DeepSeek, donde deepseek-flash figura a $0.30 por millón de tokens de entrada en caso de fallo de caché, $0.006 en caso de acierto de caché y $1.20 por millón de tokens de salida en horas punta, y exactamente la mitad fuera de ellas; deepseek-v4-pro cuesta $1.32, $0.044 y $3.96 en horas punta. Las horas punta son de 01:00–04:00 y de 06:00–10:00 UTC, de lunes a viernes. No existe una suscripción de dsh.
¿Qué envía un turno de DeepSeek Harness?
En la ruta integrada de DeepSeek en 0.2.0-rc.2, la primera solicitud de una tarea de una sola línea ocupó 65,321 bytes: 24 definiciones de herramientas (18,606 bytes), un prompt del sistema de 2,734 bytes, la tarea con una nota de contexto de ejecución y dos campos que no son entrada del modelo —dsh_session_log (33,342 bytes en esa primera llamada) y dsh_plugin_packages (5,800). Solicita max_tokens 256,000 con thinking activado y effort "high". Cada sesión nueva también envía una solicitud de título breve. Esas cifras son bytes de solicitud registrados por un endpoint sustituto, no el recuento de tokens de DeepSeek.
¿DeepSeek Harness sube mi sesión?
En su ruta integrada de DeepSeek, sí, de forma predeterminada. El plugin dsh-session-log-deepseek está habilitado de fábrica y añade un campo dsh_session_log —los eventos de la sesión, incluida la ruta del directorio de trabajo— a las solicitudes normales del agente, de compactación y de título, hasta 8 MiB por solicitud; el modelo no lo ve. En la ejecución de aquí, el campo se envió a cualquier dirección a la que apuntara DEEPSEEK_BASE_URL, no solo a DeepSeek. El interruptor de la interfaz web Settings → General → "Upload Session Log when using the official model API" lo desactiva, al igual que enabled: false para ese plugin. Los proveedores personalizados de pi-ai no lo incluían.
¿Cuál es la forma más barata de ejecutar DeepSeek Harness?
Según el precio de lista, deepseek-flash fuera de horas punta con caché activa: $0.15 por millón de tokens de entrada en caso de fallo, $0.003 en caso de acierto y $0.60 por millón de tokens de salida. Para una sesión que envía 200,000 tokens de entrada y recibe 12,000 de salida, son aproximadamente $0.014 fuera de horas punta con el 80% de la entrada en caché, $0.037 fuera de horas punta sin aciertos de caché y $0.074 en horas punta sin aciertos. La tarifa más baja de la lista y la forma más barata de terminar la tarea son preguntas distintas: un modelo que necesita tres intentos cuesta más que uno que necesita uno.
¿DeepSeek Harness puede usar otra API, como Claude a través de una pasarela?
Sí. Una API de modelo personalizada en Settings → Models (almacenada en cordis.patch.yml del perfil) acepta una URL base y un protocolo: openai-completions, openai-responses o anthropic-messages. En la ejecución de 0.2.0-rc.2, openai-completions con una URL base terminada en /v1 publicó en /v1/chat/completions, y anthropic-messages publicó en /v1/messages?beta=true cuando se le proporcionó la raíz sin más; con una URL base terminada en /v1 publicó en /v1/v1/messages, lo que una pasarela real respondería con 404. La página de DeepSeek Harness de Kunavo contiene la configuración de openai-completions.
Ejecución del 1 de octubre de 2026: @deepseek-ai/dsh 0.2.0-rc.2 de npm, dsh --profile headless, telemetría desactivada, claves falsas, contra un sustituto local de registro que devuelve una llamada de herramienta y una respuesta fija: tres rutas, tres sesiones cada una. El sustituto no es DeepSeek, Kunavo ni un modelo: muestra lo que envía dsh, no lo que factura un proveedor ni si acepta los campos adicionales. Precios de la página de precios de DeepSeek y del catálogo actual de Kunavo del mismo día; comportamiento del paquete según los README distribuidos de dsh-llm-deepseek y dsh-session-log-deepseek.