DeepSeek Harness ne coûte rien à exécuter ; la facture concerne le modèle et, sur sa route intégrée, il s'agit de l'API de DeepSeek — deepseek-flash à $0.30 par million de tokens d'entrée et $1.20 par million de tokens de sortie en période de pointe, moitié moins en dehors des heures de pointe, et $0.006 par million en cas de succès du cache. Ce qui rend le harness pertinent pour la facture, c'est ce qu'il envoie : lors d'une exécution enregistrée de 0.2.0-rc.2, chaque tour transportait 24 définitions d'outils, demandait jusqu'à 256 000 tokens de sortie avec la réflexion activée, et chaque nouvelle session ajoutait une requête de titre. Prix relevés le 1er octobre 2026.
Pour dsh avec l'agent d'Anthropic, consultez DeepSeek Harness vs Claude Code ; pour le pointer vers un autre endpoint, consultez la page de configuration DeepSeek Harness de Kunavo.
Le harness est gratuit ; le modèle ne l'est pas
DeepSeek Harness (dsh) est sous licence MIT et s'installe depuis npm sous le nom @deepseek-ai/dsh ; 0.2.0-rc.2 (29 septembre 2026) est le tag actuel, et le README le décrit toujours comme une version préliminaire pour développeurs avec des « compatibility-breaking changes » à venir. Par défaut, il utilise l'API officielle de DeepSeek avec le modèle deepseek-flash, via l'endpoint au format Anthropic de DeepSeek, avec votre clé DeepSeek. Vous pouvez ajouter d'autres fournisseurs ; vous ne pouvez rien acheter auprès de dsh.
Tarifs de DeepSeek
| Modèle | Entrée, cache réussi | Entrée, cache manqué | Sortie |
|---|---|---|---|
deepseek-flash (DeepSeek-V4.1-Flash) | $0.006 en période de pointe / $0.003 en dehors des heures de pointe | $0.3 / $0.15 | $1.2 / $0.60 |
deepseek-v4-pro | $0.044 en période de pointe / $0.022 en dehors des heures de pointe | $1.32 / $0.66 | $3.96 / $1.98 |
Par million de tokens, d'après la page tarifaire de DeepSeek le 1er octobre 2026. Les tarifs hors pointe correspondent à la moitié des tarifs de pointe ; les heures de pointe sont 01:00–04:00 et 06:00–10:00 UTC, du lundi au vendredi, hors jours fériés chinois. deepseek-flash est fourni par DeepSeek-V4.1-Flash ; l'ancien nom deepseek-v4-flash est toujours accepté et facturé au tarif Flash. Les frais sont prélevés sur un solde DeepSeek prépayé.
Ce qu'envoie un tour — mesuré
Nous avons exécuté dsh 0.2.0-rc.2 sans interface contre un endpoint substitut local qui enregistre les requêtes, avec une tâche lisant un fichier et répondant — trois nouvelles sessions par route, les neuf terminant l'aller-retour avec l'outil, les tailles de requête étant identiques d'une exécution à l'autre. Sur la route DeepSeek intégrée :
| Requête | Taille | Ce qu'il contient |
|---|---|---|
| Tour de l’agent, premier appel | 65 321 octets | 24 définitions d’outils (18 606), invite système (2 734), tâche et contexte d’exécution, max_tokens: 256000, réflexion activée, output_config.effort: "high", et deux champs qui ne font pas partie de l’entrée du modèle : dsh_session_log (33 342) et dsh_plugin_packages (5 800) |
| Titre de session | 39 906 octets | max_tokens: 64, réflexion désactivée, première invite — et les deux mêmes champs ne concernant pas le modèle |
| Tour de l’agent après le résultat de l’outil | 36 189 octets | La conversation jusqu’ici, le journal de session étant désormais envoyé progressivement |
Trois éléments influent sur le coût. L’appel du titre est facturé par session, il ne représente que peu de tokens mais reste réel, et il est envoyé au même modèle. La réflexion est activée par défaut avec un niveau d’effort élevé, et les tokens de raisonnement sont facturés comme sortie : le réglage de l’effort dans le sélecteur de modèle contrôle donc le coût. Le préfixe de l’invite est stable — les outils et l’invite système étaient identiques au niveau des octets entre les exécutions —, ce qui permet au tarif des accès au cache de DeepSeek de s’appliquer. Les deux champs dsh_ ne constituent pas une entrée du modèle ; la documentation n’indique pas si DeepSeek les compte dans un quelconque calcul, et rien ici ne suppose que ce soit le cas. Il s’agit d’octets de requête provenant d’un substitut, pas de nombres de tokens DeepSeek.
Coût d’une session
Arithmétique des tokens, pas une facture mesurée. Une session qui envoie 200,000 tokens d’entrée et reçoit 12,000 tokens de sortie, aux tarifs maximaux :
| Formule | Sans cache | 80 % de l’entrée mise en cache | Facturé par |
|---|---|---|---|
deepseek-flash, heures pleines | $0.074 | $0.027 | DeepSeek |
deepseek-v4-pro, heures pleines | $0.312 | $0.107 | DeepSeek |
deepseek-flash, heures creuses | $0.037 | $0.014 | DeepSeek |
| Claude Haiku 4.5 via Kunavo | $0.182 | — | Kunavo |
| Claude Sonnet 5 via Kunavo | $0.364 | — | Kunavo |
La colonne mise en cache suppose que le cache automatique de DeepSeek sert 80 % de l’entrée, ce qu’un préfixe stable rend plausible, mais que seule votre propre page d’utilisation peut confirmer. Les lignes Kunavo correspondent aux tarifs catalogue en vigueur, sans mise en cache, pour les lecteurs qui souhaitent utiliser Claude derrière le même harnais ; Kunavo ne vend pas de modèles DeepSeek, facture chaque token à partir d’un solde prépayé avec un rechargement minimal de $10 (facturation) et traite le montant de son catalogue comme un plancher, non comme un plafond. L’écart de prix est réel — tout comme l’écart entre le tarif le moins cher et la tâche terminée la moins chère.
Autres fournisseurs et éléments qui changent
Une API de modèle personnalisée prend une URL de base et un protocole. Lors de l’exécution, openai-completions avec une URL de base se terminant par /v1 a publié vers /v1/chat/completions ; anthropic-messages avec la racine nue a publié vers /v1/messages?beta=true, et avec /v1 à la fin vers /v1/v1/messages — un 404 sur toute passerelle réelle. Ces routes demandaient max_tokens: 32768 plutôt que 256,000, n’envoyaient aucun des champs dsh_, et leur requête de titre faisait moins de 800 octets.
Le champ du journal de session constitue l’autre aspect, lié à la confidentialité, du même choix. Sur la route intégrée, le plugin dsh-session-log-deepseek est activé par défaut et envoie les événements de session, notamment le chemin de votre répertoire de travail, avec chaque requête — vers toute URL de base utilisée par la route. Désactivez-le sous Settings → General, « Upload Session Log when using the official model API ». L’export de télémétrie OpenTelemetry de dsh est un réglage par défaut distinct, vers le collecteur de DeepSeek ; DSH_TELEMETRY_MODE=DISABLED le désactive, comme pour ces exécutions.
Questions fréquentes
Combien coûte DeepSeek Harness ?
Le harness est gratuit : DeepSeek Harness (dsh) est sous licence MIT, et la version 0.2.0-rc.2 sur npm (29 septembre 2026) est toujours une version préliminaire pour développeurs. Ce que vous payez, c'est le modèle. Sa route intégrée utilise l'API de DeepSeek, où deepseek-flash est tarifé $0.30 par million de tokens d'entrée en cas d'absence de cache, $0.006 en cas de succès du cache et $1.20 par million de tokens de sortie en période de pointe, et exactement moitié moins en dehors des heures de pointe ; deepseek-v4-pro coûte $1.32, $0.044 et $3.96 en période de pointe. Les heures de pointe sont 01:00–04:00 et 06:00–10:00 UTC, du lundi au vendredi. Il n'existe aucun abonnement dsh.
Que transmet un tour de DeepSeek Harness ?
Sur la route DeepSeek intégrée de 0.2.0-rc.2, la première requête d'une tâche d'une ligne faisait 65,321 octets : 24 définitions d'outils (18,606 octets), une invite système de 2,734 octets, la tâche avec une note de contexte d'exécution, et deux champs qui ne constituent pas une entrée du modèle — dsh_session_log (33,342 octets lors de ce premier appel) et dsh_plugin_packages (5,800). Elle demande max_tokens 256,000, avec la réflexion activée et l'effort « high ». Chaque nouvelle session envoie également une courte requête de titre. Ces chiffres sont les octets de la requête enregistrés par un endpoint substitut, et non le nombre de tokens de DeepSeek.
DeepSeek Harness téléverse-t-il ma session ?
Sur sa route DeepSeek intégrée, oui par défaut. Le plugin dsh-session-log-deepseek est activé par défaut et ajoute un champ dsh_session_log — les événements de la session, y compris le chemin du répertoire de travail — aux requêtes normales d'agent, de compression et de titre, jusqu'à 8 MiB par requête ; le modèle ne le voit pas. Dans l'exécution présentée ici, le champ a été envoyé à l'adresse indiquée par DEEPSEEK_BASE_URL, et pas uniquement à DeepSeek. Le bouton Settings → General → « Upload Session Log when using the official model API » de l'interface Web le désactive, tout comme enabled: false pour ce plugin. Les fournisseurs pi-ai personnalisés ne le transmettaient pas.
Quel est le moyen le moins cher d'exécuter DeepSeek Harness ?
Au tarif catalogue, deepseek-flash en dehors des heures de pointe avec un cache chaud coûte $0.15 par million de tokens d'entrée en cas d'absence de cache, $0.003 en cas de succès du cache et $0.60 par million de tokens de sortie. Pour une session qui envoie 200,000 tokens d'entrée et reçoit 12,000 tokens de sortie, cela représente environ $0.014 en dehors des heures de pointe avec 80% de l'entrée mise en cache, $0.037 en dehors des heures de pointe sans succès du cache et $0.074 en période de pointe sans succès du cache. Le tarif catalogue le plus bas et le moyen le moins cher de terminer la tâche sont deux questions différentes : un modèle qui nécessite trois tentatives coûte plus cher qu'un modèle qui n'en nécessite qu'une.
DeepSeek Harness peut-il utiliser une autre API, comme Claude via une passerelle ?
Oui. Un modèle API personnalisé dans Settings → Models (stocké dans le profil cordis.patch.yml) prend une URL de base et un protocole : openai-completions, openai-responses ou anthropic-messages. Lors de l'exécution 0.2.0-rc.2, openai-completions avec une URL de base se terminant par /v1 a publié vers /v1/chat/completions, et anthropic-messages a publié vers /v1/messages?beta=true avec la racine nue ; avec une URL de base se terminant par /v1, il a publié vers /v1/v1/messages, ce qui renverrait 404 avec une véritable passerelle. La page DeepSeek Harness de Kunavo contient la configuration openai-completions.
Exécution le 1er octobre 2026 : @deepseek-ai/dsh 0.2.0-rc.2 depuis npm, dsh --profile headless, télémétrie désactivée, fausses clés, contre un substitut local d’enregistrement qui renvoie un appel d’outil et une réponse fixe — trois routes, trois sessions chacune. Le substitut n’est ni DeepSeek, ni Kunavo, ni un modèle : il montre ce que dsh envoie, pas ce qu’un fournisseur facture ni s’il accepte les champs supplémentaires. Tarifs issus de la page de tarification de DeepSeek et du catalogue Kunavo en vigueur le même jour ; comportement du paquet d’après les README fournis de dsh-llm-deepseek et dsh-session-log-deepseek.