DeepSeek Harness kostet nichts für den Betrieb; die Rechnung betrifft das Modell, und auf seiner integrierten Route ist das die DeepSeek-API – deepseek-flash kostet zu Spitzenzeiten $0.30 pro Million Eingabetokens und $1.20 pro Million Ausgabe, außerhalb der Spitzenzeiten die Hälfte und bei einem Cache-Hit $0.006 pro Million. Entscheidend für die Rechnung ist, was das Harness sendet: In einem aufgezeichneten Durchlauf mit 0.2.0-rc.2 enthielt jeder Turn 24 Tooldefinitionen, forderte bis zu 256.000 Ausgabetokens bei aktiviertem Thinking an, und jede neue Sitzung fügte eine Titelanfrage hinzu. Preise vom 1. Oktober 2026.
Für dsh mit dem Agenten von Anthropic siehe DeepSeek Harness vs Claude Code; um es auf einen anderen Endpunkt zu richten, siehe Kunavos Einrichtungsseite für DeepSeek Harness.
Das Harness ist kostenlos; das Modell nicht
DeepSeek Harness (dsh) steht unter der MIT-Lizenz und wird von npm als @deepseek-ai/dsh installiert; 0.2.0-rc.2 (29. September 2026) ist der aktuelle Tag, und die README bezeichnet es weiterhin als Entwicklervorschau mit bevorstehenden „kompatibilitätsbrechenden Änderungen“. Ab Werk wird über den Anthropic-Format-Endpunkt von DeepSeek mit Ihrem DeepSeek-Schlüssel an die offizielle API von DeepSeek und das Modell deepseek-flash weitergeleitet. Sie können weitere Anbieter hinzufügen; über dsh können Sie nichts kaufen.
Die Preise von DeepSeek
| Modell | Input, Cache-Hit | Input, Cache-Miss | Output |
|---|---|---|---|
deepseek-flash (DeepSeek-V4.1-Flash) | $0.006 Spitzenzeit / $0.003 außerhalb der Spitzenzeit | $0.3 / $0.15 | $1.2 / $0.60 |
deepseek-v4-pro | $0.044 Spitzenzeit / $0.022 außerhalb der Spitzenzeit | $1.32 / $0.66 | $3.96 / $1.98 |
Pro Million Tokens, von DeepSeeks Preisseite am 1. Oktober 2026. Tarife außerhalb der Spitzenzeiten entsprechen der Hälfte der Spitzenzeittarife; Spitzenzeiten sind Montag bis Freitag 01:00–04:00 und 06:00–10:00 UTC, ausgenommen chinesische Feiertage. deepseek-flash wird von DeepSeek-V4.1-Flash bereitgestellt; der ältere Name deepseek-v4-flash wird weiterhin akzeptiert und zum Flash-Preis abgerechnet. Die Gebühren werden vom vorausbezahlten DeepSeek-Guthaben abgezogen.
Was ein Turn sendet – gemessen
Wir haben dsh 0.2.0-rc.2 ohne Benutzeroberfläche gegen einen lokalen Stand-in-Endpunkt ausgeführt, der Anfragen aufzeichnet, mit einer Aufgabe, die eine Datei liest und antwortet – drei frische Sitzungen pro Route, alle neun mit abgeschlossenem Tool-Roundtrip und bei jedem Durchlauf identischen Anfragegrößen. Auf der integrierten DeepSeek-Route:
| Anfrage | Größe | Was darin enthalten ist |
|---|---|---|
| Agenten-Turn, erster Aufruf | 65.321 Bytes | 24 Tooldefinitionen (18.606), System-Prompt (2.734), Aufgabe plus Laufzeitkontext, max_tokens: 256000, Thinking aktiviert, output_config.effort: "high" und zwei Nicht-Modellfelder: dsh_session_log (33.342) und dsh_plugin_packages (5.800) |
| Sitzungstitel | 39.906 Bytes | max_tokens: 64, Thinking deaktiviert, der erste Prompt – und dieselben zwei Nicht-Modellfelder |
| Agenten-Turn nach dem Tool-Ergebnis | 36.189 Bytes | Der bisherige Gesprächsverlauf, wobei das Sitzungsprotokoll nun inkrementell gesendet wird |
Daraus folgen drei Dinge für die Kosten. Der Titelaufruf erfolgt pro Sitzung, ist in Tokens klein, aber real, und geht an dasselbe Modell. Thinking ist standardmäßig mit hohem Aufwand aktiviert, und Reasoning-Tokens werden als Ausgabe berechnet; daher ist die Aufwandseinstellung im Modellauswahldialog eine Kostensteuerung. Der Prompt-Präfix ist stabil – Tools und System-Prompt waren über alle Durchläufe hinweg byteidentisch –, was der Cache-Hit-Preis von DeepSeek belohnt. Die beiden dsh_-Felder sind keine Modelleingabe; ob DeepSeek sie auf etwas anrechnet, ist nicht dokumentiert, und hier wird dies nicht vorausgesetzt. Dies sind Anfragebytes von einem Stand-in, keine Tokenanzahlen von DeepSeek.
Was eine Sitzung kostet
Tokenrechnung, keine gemessene Abrechnung. Eine Sitzung, die 200,000 Eingabetokens sendet und 12,000 Ausgabetokens empfängt, zu Spitzenpreisen:
| Weg | Kein Cache | 80% des Inputs gecacht | Abgerechnet von |
|---|---|---|---|
deepseek-flash, Spitzenzeit | $0.074 | $0.027 | DeepSeek |
deepseek-v4-pro, Spitzenzeit | $0.312 | $0.107 | DeepSeek |
deepseek-flash, außerhalb der Spitzenzeit | $0.037 | $0.014 | DeepSeek |
| Claude Haiku 4.5 über Kunavo | $0.182 | — | Kunavo |
| Claude Sonnet 5 über Kunavo | $0.364 | — | Kunavo |
Die gecachte Spalte setzt voraus, dass der automatische Cache von DeepSeek 80 % der Eingabe bereitstellt, was ein stabiler Präfix plausibel macht, aber nur Ihre eigene Nutzungsseite bestätigen kann. Die Kunavo-Zeilen sind aktuelle Katalog-Tarife ohne Caching für Leser, die Claude hinter demselben Harness verwenden möchten; Kunavo verkauft keine DeepSeek-Modelle, rechnet pro Token von einem vorausbezahlten Guthaben mit einer Mindestaufladung von $10 (Abrechnung) ab und behandelt den Katalogbetrag als Untergrenze statt als Obergrenze. Der Preisunterschied ist real – ebenso wie der Unterschied zwischen dem günstigsten Tarif und der günstigsten abgeschlossenen Aufgabe.
Andere Anbieter und was sich ändert
Eine benutzerdefinierte Modell-API verwendet eine Basis-URL und ein Protokoll. Im Durchlauf sendete openai-completions bei einer auf /v1 endenden Basis-URL an /v1/chat/completions; anthropic-messages mit der reinen Root-Adresse sendete an /v1/messages?beta=true, und mit /v1 am Ende an /v1/v1/messages – bei jedem echten Gateway ein 404-Fehler. Diese Routen forderten max_tokens: 32768 statt 256.000 an, sendeten keines der beiden dsh_-Felder, und ihre Titelanfrage war kleiner als 800 Bytes.
Das Sitzungsprotokollfeld ist die Datenschutzseite derselben Entscheidung. Auf der integrierten Route ist das Plugin dsh-session-log-deepseek standardmäßig aktiviert und sendet bei jeder Anfrage Sitzungsereignisse einschließlich des Pfads Ihres Arbeitsverzeichnisses – an die Basis-URL, die die Route verwendet. Deaktivieren Sie es unter Settings → General mit „Upload Session Log when using the official model API“. Der OpenTelemetry-Feedback-Export von dsh ist ein separater Standardwert an den Collector von DeepSeek; DSH_TELEMETRY_MODE=DISABLED deaktiviert ihn, so wurden diese Durchläufe ausgeführt.
Häufig gestellte Fragen
Wie viel kostet DeepSeek Harness?
Das Harness ist kostenlos: DeepSeek Harness (dsh) steht unter der MIT-Lizenz, und 0.2.0-rc.2 auf npm (29. September 2026) ist weiterhin eine Entwicklervorschau. Bezahlt wird das Modell. Die integrierte Route sendet an die eigene API von DeepSeek, wo deepseek-flash mit $0.30 pro Million Eingabetokens bei einem Cache-Miss, $0.006 bei einem Cache-Hit und $1.20 pro Million Ausgabetokens zu Spitzenzeiten aufgeführt ist; außerhalb der Spitzenzeiten kostet es exakt die Hälfte. deepseek-v4-pro kostet zu Spitzenzeiten $1.32, $0.044 und $3.96. Die Spitzenzeiten sind Montag bis Freitag 01:00–04:00 und 06:00–10:00 UTC. Es gibt kein dsh-Abonnement.
Was sendet ein DeepSeek-Harness-Turn?
Auf der integrierten DeepSeek-Route in 0.2.0-rc.2 umfasste die erste Anfrage einer einzeiligen Aufgabe 65.321 Bytes: 24 Tooldefinitionen (18.606 Bytes), einen 2.734 Byte großen System-Prompt, die Aufgabe mit einem Laufzeitkontexthinweis sowie zwei Felder, die keine Modelleingabe sind – dsh_session_log (33.342 Bytes bei diesem ersten Aufruf) und dsh_plugin_packages (5.800). Angefordert werden max_tokens 256.000, aktiviertes Thinking und die Einstellung effort „high“. Jede neue Sitzung sendet außerdem eine kurze Titelanfrage. Diese Angaben sind von einem Stand-in-Endpunkt aufgezeichnete Anfragebytes, nicht die Tokenanzahl von DeepSeek.
Lädt DeepSeek Harness meine Sitzung hoch?
Auf seiner integrierten DeepSeek-Route standardmäßig ja. Das Plugin dsh-session-log-deepseek ist ab Werk aktiviert und fügt normalen Agenten-, Kompaktierungs- und Titelanfragen ein Feld dsh_session_log hinzu – die Ereignisse der Sitzung einschließlich des Pfads des Arbeitsverzeichnisses –, mit bis zu 8 MiB pro Anfrage; das Modell sieht es nicht. Im hier ausgeführten Durchlauf ging das Feld an die Adresse, auf die DEEPSEEK_BASE_URL verwies, nicht ausschließlich an DeepSeek. Der Schalter „Upload Session Log when using the official model API“ unter Settings → General in der Weboberfläche deaktiviert dies ebenso wie enabled: false für dieses Plugin. Benutzerdefinierte pi-ai-Anbieter übertrugen es nicht.
Wie kann ich DeepSeek Harness am günstigsten ausführen?
Zum Listenpreis: deepseek-flash außerhalb der Spitzenzeiten mit warmem Cache kostet $0.15 pro Million Eingabetokens bei einem Miss, $0.003 bei einem Hit und $0.60 pro Million Ausgabe. Für eine Sitzung mit 200.000 Eingabetokens und 12.000 Ausgabetokens sind das ungefähr $0.014 außerhalb der Spitzenzeiten bei 80 % gecachtem Input, $0.037 außerhalb der Spitzenzeiten ohne Cache-Hits und $0.074 zu Spitzenzeiten ohne Cache-Hits. Der günstigste aufgeführte Tarif und der günstigste Weg, die Aufgabe abzuschließen, sind unterschiedliche Fragen: Ein Modell, das drei Versuche benötigt, kostet mehr als eines, das einen benötigt.
Kann DeepSeek Harness eine andere API verwenden, etwa Claude über ein Gateway?
Ja. Ein benutzerdefiniertes Modell-API unter Settings → Models (gespeichert in cordis.patch.yml des Profils) verwendet eine Basis-URL und ein Protokoll: openai-completions, openai-responses oder anthropic-messages. Im Durchlauf mit 0.2.0-rc.2 sendete openai-completions bei einer auf /v1 endenden Basis-URL an /v1/chat/completions, und anthropic-messages sendete bei Verwendung der reinen Root-Adresse an /v1/messages?beta=true – bei einer auf /v1 endenden Basis-URL jedoch an /v1/v1/messages, was bei einem echten Gateway einen 404-Fehler ergeben würde. Die DeepSeek-Harness-Seite von Kunavo enthält die Einrichtung für openai-completions.
Durchlauf am 1. Oktober 2026: @deepseek-ai/dsh 0.2.0-rc.2 von npm, dsh --profile headless, Telemetrie deaktiviert, gefälschte Schlüssel, gegen einen lokalen aufzeichnenden Stand-in, der einen Tool-Aufruf und eine feste Antwort zurückgibt – drei Routen, je drei Sitzungen. Der Stand-in ist weder DeepSeek noch Kunavo noch ein Modell: Er zeigt, was dsh sendet, nicht, was ein Anbieter berechnet oder ob er die zusätzlichen Felder akzeptiert. Preise von der Preisseite von DeepSeek und dem aktuellen Katalog von Kunavo am selben Tag; das Paketverhalten aus den ausgelieferten READMEs von dsh-llm-deepseek und dsh-session-log-deepseek.