返回指南
定價·2026年10月1日·閱讀約 8 分鐘

DeepSeek Harness 定價:harness 免費,但模型不免費——以及每個回合傳送的內容

帳單取決於 DeepSeek 的每 token 價格。harness 增加的是每個請求的形狀:24 個工具、開啟 thinking 時 256,000 token 的輸出上限、每工作階段一次的標題呼叫,以及上傳的工作階段記錄。

最後審核於 。

執行 DeepSeek Harness 不需要費用;帳單是模型的費用,而在其內建路由中就是 DeepSeek 的 API——deepseek-flash 在尖峰時段每百萬個輸入 token $0.30、每百萬個輸出 token $1.20,離峰時段為其一半,快取命中時每百萬個 token $0.006。真正會影響帳單的是 Harness 傳送的內容:在 0.2.0-rc.2 的一次記錄執行中,每個回合都攜帶 24 個工具定義,要求最多 256,000 個輸出 token 並啟用思考,而且每個新工作階段都會加入標題請求。價格讀取日期為 2026 年 10 月 1 日。

如需了解 dsh 與 Anthropic 的代理程式,請參閱 DeepSeek Harness 與 Claude Code 的比較;如需將其指向其他端點,請參閱 Kunavo 的 DeepSeek Harness 設定頁面。

Harness 免費;模型不免費

DeepSeek Harness (dsh) 採用 MIT 授權,並可從 npm 安裝為 @deepseek-ai/dsh;0.2.0-rc.2(2026 年 9 月 29 日)是目前的標籤,而 README 仍稱其為開發者預覽版,並表示未來會有「會破壞相容性的變更」。預設情況下,它會使用你的 DeepSeek 金鑰,透過 DeepSeek 的 Anthropic 格式端點路由至 DeepSeek 官方 API,模型為 deepseek-flash。你可以加入其他提供者;但無法從 dsh 購買任何項目。

DeepSeek 的價格

模型輸入,快取命中輸入,快取未命中輸出
deepseek-flash (DeepSeek-V4.1-Flash)尖峰 $0.006/離峰 $0.003$0.3 / $0.15$1.2 / $0.60
deepseek-v4-pro尖峰 $0.044/離峰 $0.022$1.32 / $0.66$3.96 / $1.98

每百萬個 token,來源為 2026 年 10 月 1 日的 DeepSeek 價格頁面。離峰費率為尖峰的一半;尖峰時段為週一至週五 UTC 01:00–04:00 與 06:00–10:00,不包括中國公共假日。deepseek-flash由 DeepSeek-V4.1-Flash 提供;較舊的 deepseek-v4-flash 名稱仍可使用,並按 Flash 價格計費。費用會從預付的 DeepSeek 餘額中扣除。

一次傳送的內容——實測

我們讓 dsh 0.2.0-rc.2 以無頭模式執行,對著會記錄請求的本機替代端點,使用一項會讀取檔案並回答的任務——每個路由建立三個全新工作階段,九次執行皆完成工具往返,且每次執行的請求大小都相同。在內建 DeepSeek 路由中:

請求大小其中包含的內容
代理程式回合,第一次呼叫65,321 位元組24 個工具定義(18,606)、系統提示(2,734)、任務加上執行階段內容、max_tokens: 256000、啟用 thinking、output_config.effort: "high",以及兩個非模型欄位:dsh_session_log(33,342)和 dsh_plugin_packages(5,800)
工作階段標題39,906 位元組max_tokens: 64、停用 thinking、第一個提示,以及相同的兩個非模型欄位
工具結果後的代理程式回合36,189 位元組截至目前的對話內容,此時工作階段記錄會以增量方式傳送

成本上有三點需要注意。標題呼叫是每個工作階段一次,以 token 計算雖然很少,但確實會產生費用,而且會傳送至相同模型。預設會以高 effort 啟用 thinking,推理 token 會按輸出計費,因此模型選擇器中的 effort 設定是成本控制項。提示前綴是穩定的——工具和系統提示在各次執行中逐 byte 相同——這正是 DeepSeek 快取命中價格所獎勵的內容。兩個 dsh_ 欄位不是模型輸入;DeepSeek 是否將其計入任何項目並未記錄,本文也沒有假設會計入。這些是替代端點的請求 bytes,不是 DeepSeek 的 token 計數。

工作階段的成本

Token 算術,不是實測帳單。某個工作階段傳送 200,000 個輸入 token 並接收 12,000 個輸出 token,尖峰價格:

方式無快取輸入有 80% 快取計費方
deepseek-flash,尖峰$0.074$0.027DeepSeek
deepseek-v4-pro,尖峰$0.312$0.107DeepSeek
deepseek-flash,離峰$0.037$0.014DeepSeek
透過 Kunavo 的 Claude Haiku 4.5$0.182—Kunavo
透過 Kunavo 的 Claude Sonnet 5$0.364—Kunavo

快取欄假設 DeepSeek 的自動快取提供 80% 的輸入內容;穩定的前綴使此假設合理,但只有你自己的使用量頁面才能確認。Kunavo 欄是未使用快取的即時 目錄費率,供希望在相同 Harness 後使用 Claude 的讀者參考;Kunavo 不販售 DeepSeek 模型,會從預付餘額中按 token 計費,最低儲值金額為 $10(帳單),並將其目錄金額視為下限而非上限。價格差距確實存在,而最低費率與最低完成任務成本之間也確實存在差距。

其他提供者,以及會有哪些變化

自訂模型 API 需要基礎 URL 和一種協定。在此次執行中,openai-completions 使用以 /v1 結尾的基礎 URL 時會張貼至 /v1/chat/completions;anthropic-messages 使用裸根目錄時會張貼至 /v1/messages?beta=true,而在結尾加上 /v1 時會張貼至 /v1/v1/messages——在任何真實閘道上都會是 404。這些路由要求的是 max_tokens: 32768,而非 256,000;不會傳送 dsh_ 欄位,且其標題請求小於 800 bytes。

工作階段記錄欄位是同一選擇的隱私面。在內建路由中,dsh-session-log-deepseek 外掛程式預設啟用,會在每次請求中傳送工作階段事件,包括你的工作目錄路徑——傳送至該路由使用的任何基礎 URL。請在 Settings → General 中關閉「Upload Session Log when using the official model API」。dsh 的 OpenTelemetry 回饋匯出是另一個預設功能,會傳送至 DeepSeek 的收集器;DSH_TELEMETRY_MODE=DISABLED 可將其關閉,這也是這些執行所採用的設定。

常見問題

DeepSeek Harness 的費用是多少?

Harness 免費:DeepSeek Harness (dsh) 採用 MIT 授權,而 npm 上的 0.2.0-rc.2(2026 年 9 月 29 日)仍是開發者預覽版。你付費的是模型。其內建路由會傳送至 DeepSeek 自有 API;deepseek-flash 在尖峰時段的價格為:每百萬個輸入 token,快取未命中時 $0.30、快取命中時 $0.006;每百萬個輸出 token $1.20。離峰時段的上述價格則正好減半;deepseek-v4-pro 在尖峰時段的價格為 $1.32、$0.044 和 $3.96。尖峰時段為週一至週五 UTC 01:00–04:00 與 06:00–10:00。dsh 沒有訂閱方案。

一次 DeepSeek Harness 回合會傳送什麼?

在 0.2.0-rc.2 的內建 DeepSeek 路由中,一行任務的第一次請求為 65,321 bytes:24 個工具定義(18,606 bytes)、2,734 bytes 的系統提示、包含執行階段內容註記的任務,以及兩個不是模型輸入的欄位——dsh_session_log(第一次呼叫為 33,342 bytes)和 dsh_plugin_packages(5,800)。它要求 max_tokens 256,000,並啟用 thinking,effort 為 "high"。每個新工作階段也會傳送簡短的標題請求。這些數字是由替代端點記錄的請求 bytes,不是 DeepSeek 的 token 計數。

DeepSeek Harness 會上傳我的工作階段嗎?

在其內建 DeepSeek 路由中,預設會。dsh-session-log-deepseek 外掛程式預設啟用,並在一般代理程式、壓縮和標題請求中加入 dsh_session_log 欄位——包含工作目錄路徑在內的工作階段事件——每個請求最多 8 MiB;模型看不到該欄位。在此處的執行中,該欄位會傳送至 DEEPSEEK_BASE_URL 指向的任何位置,而不僅是 DeepSeek。Web UI 的 Settings → General → "Upload Session Log when using the official model API" 開關可將其關閉;對該外掛程式設定 enabled: false 也可以。自訂 pi-ai 提供者不會攜帶該欄位。

執行 DeepSeek Harness 最便宜的方法是什麼?

依牌價計算,deepseek-flash 在離峰時段且快取暖機時:快取未命中每百萬個輸入 token $0.15、命中時 $0.003,每百萬個輸出 token $0.60。若某工作階段傳送 200,000 個輸入 token 並接收 12,000 個輸出 token,輸入有 80% 快取時,離峰約為 $0.014;完全沒有快取命中時,離峰約為 $0.037;尖峰時段且完全沒有快取命中時約為 $0.074。最低列示費率和完成任務的最低成本是不同問題:需要三次嘗試的模型,成本會高於一次完成的模型。

DeepSeek Harness 可以使用不同的 API,例如透過閘道使用 Claude 嗎?

可以。Settings → Models 中的自訂模型 API(儲存在設定檔的 cordis.patch.yml 中)需要基礎 URL 和一種協定:openai-completions、openai-responses 或 anthropic-messages。在 0.2.0-rc.2 的執行中,base URL 以 /v1 結尾的 openai-completions 會張貼至 /v1/chat/completions;使用裸根目錄時,anthropic-messages 會張貼至 /v1/messages?beta=true——若 base URL 以 /v1 結尾,則會張貼至 /v1/v1/messages,真實閘道會回傳 404。Kunavo 的 DeepSeek Harness 頁面提供 openai-completions 設定。

執行日期為 2026 年 10 月 1 日:npm 上的 @deepseek-ai/dsh 0.2.0-rc.2、dsh --profile headless、停用遙測、使用虛構金鑰,對著會記錄內容的本機替代端點執行;該端點回傳一次工具呼叫和固定答案——三個路由,每個路由三個工作階段。替代端點不是 DeepSeek、Kunavo 或模型:它顯示的是 dsh 傳送的內容,而不是提供者的計費內容,或提供者是否接受額外欄位。價格來自同日的 DeepSeek 價格頁面與 Kunavo 即時目錄;套件行為來自 dsh-llm-deepseek 和 dsh-session-log-deepseek 隨附的 README。