ガイド一覧へ戻る
料金·2026年10月1日·読了8分

DeepSeek Harnessの料金:ハーネスは無料、モデルは無料ではない — 各ターンが送信する内容

請求額はDeepSeekのトークン単価です。ハーネスが追加するのは各リクエストの形式です。24個のツール、thinking有効時の256,000トークン出力上限、セッションごとのタイトル呼び出し、アップロードされたセッションログが含まれます。

最終確認日:。

DeepSeek Harnessの実行自体には費用がかかりません。請求されるのはモデルで、組み込みルートではDeepSeekのAPIです。deepseek-flashはピーク時に入力トークン100万個あたり$0.30、出力トークン100万個あたり$1.20、オフピークはその半額、キャッシュヒット時は100万個あたり$0.006です。ハーネス自体が料金に関係するのは、送信内容です。0.2.0-rc.2の記録実行では、すべてのターンに24個のツール定義が含まれ、thinkingを有効にして最大256,000出力トークンを要求し、新しいセッションごとにタイトルリクエストが追加されました。価格は2026年10月1日時点のものです。

Anthropicのエージェントに対するdshについては、DeepSeek Harness vs Claude Codeを参照してください。別のエンドポイントを指定する方法については、KunavoのDeepSeek Harness設定ページを参照してください。

ハーネスは無料ですが、モデルは無料ではありません

DeepSeek Harness(dsh)はMITライセンスで、npmから@deepseek-ai/dshとしてインストールします。0.2.0-rc.2(2026年9月29日)が現在のタグで、READMEでは引き続き、今後「互換性を壊す変更」が予定されている開発者向けプレビューとされています。初期状態では、DeepSeekの公式APIに、DeepSeekのAnthropic形式エンドポイントを通じて、モデルdeepseek-flashで、あなたのDeepSeekキーを使ってルーティングします。他のプロバイダーを追加できます。dshから何かを購入することはできません。

DeepSeekの料金

モデル入力、キャッシュヒット入力、キャッシュミス出力
deepseek-flash (DeepSeek-V4.1-Flash)ピーク時$0.006 / オフピーク時$0.003$0.3 / $0.15$1.2 / $0.60
deepseek-v4-proピーク時$0.044 / オフピーク時$0.022$1.32 / $0.66$3.96 / $1.98

2026年10月1日時点のDeepSeekの料金ページに基づく、トークン100万個あたりの料金です。オフピーク料金はピーク料金の半額です。ピーク時間は、月曜日から金曜日の01:00–04:00および06:00–10:00 UTCで、中国の祝日を除きます。deepseek-flashはDeepSeek-V4.1-Flashによって提供されます。旧名deepseek-v4-flashも引き続き受け付けられ、Flashの料金で課金されます。料金は前払いのDeepSeek残高から差し引かれます。

1ターンで送信される内容 — 実測

リクエストを記録するローカルのスタンドインエンドポイントに対して、dsh 0.2.0-rc.2をヘッドレスで実行しました。ファイルを読み取って回答する1つのタスクについて、各ルートで新規セッションを3回実行し、9回すべてがツールの往復を完了しました。リクエストサイズは実行ごとに同一でした。組み込みDeepSeekルートでは次のとおりです。

リクエストサイズ含まれるもの
エージェントターン、初回呼び出し65,321バイト24個のツール定義(18,606)、システムプロンプト(2,734)、ランタイムコンテキスト付きタスク、max_tokens: 256000、thinking有効、output_config.effort: "high"、およびモデル以外の2つのフィールド:dsh_session_log(33,342)とdsh_plugin_packages(5,800)
セッションタイトル39,906バイトmax_tokens: 64、thinking無効、最初のプロンプト、および同じ2つのモデル以外のフィールド
ツール結果後のエージェントターン36,189バイトセッションログが差分形式で送信されるようになった、それまでの会話

コストについて3つ分かります。タイトル呼び出しはセッションごとに1回で、トークン数は少ないものの実際に発生し、同じモデルに送信されます。thinkingはデフォルトで高い努力度で有効で、推論トークンは出力として課金されるため、モデル選択画面の努力度設定はコスト管理になります。プロンプトのプレフィックスは安定しています。ツールとシステムプロンプトは実行間でバイト単位で同一でした。これがDeepSeekのキャッシュヒット料金の対象になります。2つのdsh_フィールドはモデル入力ではありません。DeepSeekがこれらを何かに算入するかは文書化されておらず、ここでは算入されるとは仮定していません。これらはスタンドインのリクエストバイト数であり、DeepSeekのトークン数ではありません。

セッションの料金

測定済みの請求額ではなく、トークン計算です。入力トークン200,000を送信し、出力トークン12,000を受信する1セッションのピーク時料金:

ルートキャッシュなし入力の80%をキャッシュ課金元
deepseek-flash、ピーク時$0.074$0.027DeepSeek
deepseek-v4-pro、ピーク時$0.312$0.107DeepSeek
deepseek-flash、オフピーク時$0.037$0.014DeepSeek
Kunavo経由のClaude Haiku 4.5$0.182—Kunavo
Kunavo経由のClaude Sonnet 5$0.364—Kunavo

キャッシュ列では、DeepSeekの自動キャッシュが入力の80%を提供すると仮定しています。安定したプレフィックスなら妥当と考えられますが、確認できるのはあなた自身の利用ページだけです。Kunavoの行は、同じハーネスの背後でClaudeを使いたい読者向けの、キャッシュなしの実際のカタログ料金です。KunavoはDeepSeekモデルを販売しておらず、前払い残高からトークン単位で課金し、$10の最低チャージ額(請求)を設け、カタログ金額を上限ではなく下限として扱います。料金差は現実に存在し、最安料金とタスクを最安で完了する方法の差も現実に存在します。

その他のプロバイダーと、変更される点

カスタムモデル API には、ベース URL と 1 つのプロトコルを指定します。実行時、openai-completions は /v1 で終わるベース URL を使用して /v1/chat/completions に POST しました。anthropic-messages はルート URL のみの場合は /v1/messages?beta=true に、末尾に /v1 がある場合は /v1/v1/messages に POST しました。この最後の送信先では、実際のどのゲートウェイでも 404 になります。これらのルートは 256,000 ではなく max_tokens: 32768 を要求し、dsh_ のどちらのフィールドも送信せず、タイトルのリクエストは 800 バイト未満でした。

セッションログフィールドは、同じ選択におけるプライバシー面です。組み込みルートでは、dsh-session-log-deepseekプラグインがデフォルトで有効になっており、作業ディレクトリのパスを含むセッションイベントを、各リクエストとともに、そのルートが使用する任意のベースURLへ送信します。Settings → General の「Upload Session Log when using the official model API」で無効にしてください。dshのOpenTelemetryフィードバックエクスポートは別のデフォルト機能で、DeepSeekのコレクターへ送信されます。DSH_TELEMETRY_MODE=DISABLEDで無効になり、今回の実行はこの設定で行いました。

よくある質問

DeepSeek Harnessの料金はいくらですか?

ハーネスは無料です。DeepSeek Harness (dsh)はMITライセンスで、npm上の0.2.0-rc.2(2026年9月29日)も引き続き開発者向けプレビューです。支払うのはモデルの料金です。組み込みルートはDeepSeek独自のAPIに送信します。そこではdeepseek-flashが、キャッシュミス時は入力トークン100万個あたり$0.30、キャッシュヒット時は$0.006、ピーク時の出力トークン100万個あたり$1.20で、オフピークは正確にその半額です。deepseek-v4-proはピーク時に$1.32、$0.044、$3.96です。ピーク時間は月曜日から金曜日の01:00–04:00および06:00–10:00 UTCです。dshのサブスクリプションはありません。

DeepSeek Harnessの1ターンでは何が送信されますか?

0.2.0-rc.2の組み込みDeepSeekルートでは、1行のタスクに対する最初のリクエストは65,321バイトでした。24個のツール定義(18,606バイト)、2,734バイトのシステムプロンプト、ランタイムコンテキストの注記付きタスク、そしてモデル入力ではない2つのフィールド、dsh_session_log(初回呼び出しでは33,342バイト)とdsh_plugin_packages(5,800)が含まれていました。thinkingを有効にし、max_tokens 256,000、effort「high」を指定します。新しいセッションごとに短いタイトルリクエストも送信されます。これらの数値はスタンドインエンドポイントが記録したリクエストバイト数であり、DeepSeekのトークン数ではありません。

DeepSeek Harnessはセッションをアップロードしますか?

組み込みDeepSeekルートでは、デフォルトでアップロードします。dsh-session-log-deepseekプラグインは初期状態で有効で、通常のエージェント、圧縮、タイトルのリクエストに、セッションのイベント(作業ディレクトリのパスを含む)を含むdsh_session_logフィールドを追加します。1リクエストあたり最大8 MiBです。モデルはこれを見ません。今回の実行では、このフィールドの送信先はDEEPSEEK_BASE_URLが指す先であり、DeepSeekに限定されていませんでした。Web UIのSettings → General → 「Upload Session Log when using the official model API」スイッチをオフにすると無効になります。このプラグインでenabled: falseを指定しても無効になります。カスタムpi-aiプロバイダーには含まれませんでした。

DeepSeek Harnessを実行する最も安い方法は何ですか?

表示価格では、キャッシュにデータが蓄積されているオフピーク時のdeepseek-flashが最安です。入力トークン100万個あたり、キャッシュミス時は$0.15、キャッシュヒット時は$0.003、出力トークン100万個あたり$0.60です。入力トークン200,000個を送信し、出力トークン12,000個を受信するセッションなら、入力の80%がキャッシュされるオフピーク時で約$0.014、キャッシュヒットなしのオフピーク時で$0.037、キャッシュヒットなしのピーク時で$0.074です。表示上の最安料金と、タスクを完了する最安の方法は別の問題です。3回の試行が必要なモデルは、1回で済むモデルより高くつきます。

DeepSeek Harnessは、Claudeをゲートウェイ経由で使うように、別のAPIを利用できますか?

はい。Settings → ModelsにあるカスタムモデルAPI(プロファイルのcordis.patch.ymlに保存されます)では、ベースURLと、openai-completions、openai-responses、anthropic-messagesのいずれか1つのプロトコルを指定します。0.2.0-rc.2の実行では、/v1で終わるベースURLを指定したopenai-completionsは/v1/chat/completionsにPOSTし、anthropic-messagesはルートだけを指定すると/v1/messages?beta=trueにPOSTしました。/v1で終わるベースURLを指定すると/v1/v1/messagesにPOSTし、実際のゲートウェイなら404になります。KunavoのDeepSeek Harnessページにはopenai-completionsの設定があります。

2026年10月1日の実行:npmの@deepseek-ai/dsh 0.2.0-rc.2、dsh --profile headless、テレメトリ無効、偽のキーを使用し、1回のツール呼び出しと固定回答を返すローカル記録スタンドインに対して実行しました。3つのルートで、それぞれ3セッションです。このスタンドインはDeepSeekでもKunavoでもモデルでもありません。dshが送信する内容を示すものであり、プロバイダーが請求する料金や追加フィールドを受け入れるかどうかを示すものではありません。料金は同日付のDeepSeekの料金ページとKunavoのライブカタログから取得し、パッケージの挙動はdsh-llm-deepseekおよびdsh-session-log-deepseekに同梱されたREADMEから確認しました。