工作流程的成本就是它的扇出,但所有工作流程指南都沒有提到這點。 Anthropic 的官方文件是了解動態工作流程及其撰寫方式的正確來源。本頁回答你接下來會立即提出的問題:執行一個工作流程要花多少錢,以及哪個設定會改變費用。
簡短答案——一個扇出至五個子代理的工作流程,大約需要五個代理的 token,而不是一個代理的量。這就是它的用途,也就是它的帳單。
計算方式
# A workflow's cost is not "one task". It is the fan-out.
#
# workflow_cost = orchestrator_steps x step_cost
# + subagents x subagent_steps x step_cost
#
# A step is 25,000 in / 1,200 out — the same sizing used on
# every other cost page here, so these numbers are comparable.
#
# Claude Sonnet 5 $0.043 / step
# Claude Haiku 4.5 $0.022 / step
#
# Same job, three shapes:
#
# one thread, 20 steps, all Sonnet
# = 20 x $0.043 = $0.868
#
# 5 subagents x 8 steps + 6 orchestrator steps, all Sonnet
# = 46 x $0.043 = $2.00
#
# same fan-out, subagents on Haiku, orchestrator on Sonnet
# = 40 x $0.022 + 6 x $0.043 = $1.13
#
# The fan-out costs more than the single thread. Mapping the fan-out
# to the cheap tier is what buys most of it back.把三種形狀視為以三種方式完成同一項工作。每個案例中,扇出都比單一執行緒昂貴——差異在於貴多少,而這幾乎完全取決於子代理執行在哪個層級。
會改變成本的那一行
工作流程中的子代理工作通常有明確界線且偏機械式:讀取檔案、摘要差異、檢查條件、回報結果。這正是小型模型適合處理的工作。協調器則相反——它掌握計畫,而錯誤的計畫會浪費底下每個子代理的工作,因此強大模型的價格在這裡才值得。
# The one line that changes every workflow run: the tier the
# background and sub-task work lands on.
export ANTHROPIC_BASE_URL=https://api.kunavo.com
export ANTHROPIC_AUTH_TOKEN=sk-kn-...
export ANTHROPIC_MODEL=claude-sonnet-5 # orchestration
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5 # agents that ask for opus
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5 # agents that ask for sonnet
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5 # the fan-outClaude Code 會將自動子任務呼叫路由至對應 Haiku 層級的模型,因此無論您是否明確使用工作流程,此映射都會在每次執行時發揮作用。保留 Opus 這一行,是因為 Claude Code 的內建預設值及其 opus 別名都會解析至最新的 Opus;如果 Kunavo 尚未提供該模型,任何回退至它的請求都會傳回 404。即使是 Opus 5.5(claude-opus-5-5)也需要 Claude Code v2.1.280 或更新版本(較舊版本請執行 claude update)。Sonnet 這一行對工作流程更重要:sonnet 別名會要求 Sonnet 5.5,而 Kunavo 不提供該模型;沒有這一行時,所有設定為 model: sonnet 的子代理程式、opusplan 的執行階段以及 /model sonnet 都會傳回 404。協調器層級的損益平衡點——較便宜的模型必須差多少,才會不再比較便宜——請參閱 Opus 與 Sonnet 與 Haiku 的比較。
估算會漏掉的兩件事
重試。 失敗並重新執行的子代理會被計費兩次,而扇出會提高至少一個子代理失敗的機率。這在計畫階段的估算中不可見,只會出現在使用量紀錄中。
快取的上下文。 另一個方向是:由同一個協調器啟動的子代理通常會共用穩定的前綴,而快取命中會按輸入費率的一小部分計費。在長工作流程中,這是可取得的最大單項降幅——比上述層級變更還大。其機制,以及透過閘道路由時破壞快取的三種方式,請參閱 Claude 提示快取。
決定是否要扇出
工作流程不是成本最佳化,這一點值得說清楚,因為框架會決定答案。它們帶來的是延遲與廣度:多個子代理同時工作,比單一執行緒逐項處理相同清單更快,也能涵蓋更多內容。問題在於這是否值得該倍數,而上方的計算會提供你自身工作形狀所對應的倍數。
至於功能本身——如何定義工作流程、如何協調子代理、語法為何——Anthropic 的文件是權威來源,本頁不試圖重述。底層實際執行模型的是基礎 URL 與金鑰;同一決策中關於訂閱與 token 的部分,請參閱 Claude Pro 與 Max 限制。
常見問題
Claude Code 工作流程的成本是多少?
成本會高於在單一執行緒中完成相同工作,因為工作流程的成本取決於其扇出規模。計算方式是協調器的步驟數,加上子代理數量乘以各自的步驟數,再將總數乘以單一步驟的成本。按 Kunavo 費率,一個包含 25,000 個輸入 token 和 1,200 個輸出 token 的步驟,在 Claude Sonnet 5 上的成本為 $0.043:單一執行緒執行 20 步約為 $0.868,而五個子代理各執行八步,再加上六個協調器步驟,共 46 步,約為 $2.00。扇出帶來平行處理能力與廣度,但不會帶來折扣。
如何在保留扇出功能的情況下降低工作流程成本?
將扇出放在最便宜的層級,並讓協調工作使用強大的模型。工作流程中的子任務通常有明確界線且偏機械式——讀取這個、摘要那個、檢查另一項——這正是小型模型適合處理的工作;協調器則負責掌握計畫,因此必須正確。以相同的 46 步驟範例這樣配置,成本約為 $1.13,而不是 $2.00;所需變更只是一個環境變數,不必重寫。
如果工作流程成本更高,還值得使用嗎?
通常值得,但要用正確的角度判斷。工作流程不是成本最佳化,而是延遲與廣度最佳化:多個子代理同時工作,比單一執行緒依序完成相同工作更快,也能涵蓋更多內容。應該問的是並行處理是否值得這個倍數,而不是倍數是否存在——它確實存在,任何告訴你相反內容的頁面都沒有真正計算過。
協調器應該使用哪個模型?
協調器負責制定計畫並讀取結果,因此這是能力較弱的模型讓你付出最大代價的地方——糟糕的計畫會浪費其下每個子代理的工作。Claude Sonnet 5 每 1M token 的價格為 $1.40 / $7.00,是實務上的預設選擇;Claude Opus 5.5 的價格為 $2.80 / $14.00,在確實存在歧義的工作上值得付出這個價格。兩個層級之間以嘗試次數計算的損益平衡點,請參閱層級比較頁面。
工作流程能透過自訂 API 端點運作嗎?
可以——工作流程是用戶端的協調功能,因此只要 Claude Code 能執行,就能在該處運作;Claude Code 原生讀取 ANTHROPIC_BASE_URL。每次子代理呼叫都會前往與協調器相同的端點,這也是成本能集中顯示在同一處的原因:工作流程的扇出會在單一使用量檢視中顯示為一批請求,而不是分散在多個帳戶中。
如何查看工作流程實際花了多少費用?
請按請求逐一讀取,而不要根據計畫估算,因為子代理步驟數是在執行期間決定的,很少會與你的猜測一致。對按 token 計費的金鑰而言,扇出中的每次呼叫都是可加總的一筆費用,包括失敗子代理產生的重試——這些都會計費,且在事前估算中不可見。