Dify 定價有兩個層次,分別由兩個不同的對象計費:平台方案與模型權杖。 Dify Cloud 列出的 Sandbox 為 $0,Professional 為每個工作區每月 $59(每年 $590),Team 為每個工作區每月 $159(每年 $1,590);自託管的 Community Edition 免費,Enterprise 為客製報價。方案的訊息額度用完後,這些數字都不包括您的模型 API 支出——Dify 自己的方案卡片如此說明。
以下所有數字均於 2026 年 9 月 19 日從 Dify 自己的頁面讀取:dify.ai/pricing/dify-cloud 與 dify.ai/pricing/dify-enterprise。有一項容易導致摘要出錯的閱讀注意事項:方案卡片預設顯示年度數字,而月費數字位於切換選項後方。月費值存在於標記中(data-monthly="59" 與 data-monthly="159"),同一頁面下方的比較表則以純文字列印「$59 Per workspace/month」與「$159 Per workspace/month」。任何只引用年度價格的第三方頁面都應視為不完整。
Dify 平台的費用
| 管道 | 公布價格 | 訊息額度 | 卡片上的主要限制 |
|---|---|---|---|
| Dify Cloud — Sandbox | 免費 | 200(卡片未顯示「/ month」後綴) | 1 個工作區、1 位成員、5 個應用程式、50 份知識文件、50MB 知識儲存空間、30 天日誌歷史記錄 |
| Dify Cloud — Professional | 每個工作區每月 $59,或每年 $590 | 每月 5,000 | 3 位成員、50 個應用程式、500 份知識文件、5GB 儲存空間、每月 20,000 個觸發事件、無限日誌歷史記錄 |
| Dify Cloud — Team | 每個工作區每月 $159,或每年 $1,590 | 每月 10,000 | 50 位成員、200 個應用程式、1,000 份知識文件、20GB 儲存空間、無限觸發事件 |
| Community Edition(自託管) | 免費軟體 | 無 | 單一工作區;伺服器、向量資料庫及所有模型權杖均由您提供 |
| Dify Enterprise | 客製報價 | 無 | 自託管部署上的授權金鑰;多個工作區、SSO、商業授權授權 |
| Dify Premium on AWS | 僅在 AWS Marketplace 報價 | 無 | 允許自訂品牌的 AMI;文件頁面未列出價格,因此此處不重現任何價格 |
選擇方案前有兩項值得了解的限制。Dify FAQ 回答了 Professional 方案達到限制後是否能獨立購買更多向量空間或團隊席位,答案是建議升級方案;如果 Team 方案不足,則應聯絡其支援地址。因此,文件記載的限制解決方式是升級至下一個方案,而不是儲值。現階段付款方式也是信用卡:同一份 FAQ 表示正在探索銀行轉帳,目前尚未提供,且只適用於年度 Team 訂閱。列出的價格不包括適用稅金。
訊息額度是試用配額,不是預算
這是大多數「Dify 定價」摘要出錯的地方。三個 Cloud 方案卡片上的工具提示都表示,額度是為了協助您試用 OpenAI、Anthropic、Gemini、xAI 與 Tongyi 的模型,額度會依模型類型消耗,且用完後可以切換至您自己的 API 金鑰。額度不是權杖預算:Dify FAQ 表示,額度會以已發布的模型費率按每次 AI 回應消耗。
以下費率取自 Dify 於 2026 年 9 月 19 日的 FAQ,是其清單中的部分選擇而非完整清單:每個級距列出的模型比此處引用的範例更多,發布的階梯中也包含本表省略的 3 額度級距。它們描述的是 Dify 對回應收取額度的方式,而不是對這些供應商自身目錄的聲明。回應次數是根據已發布配額進行的算術計算,不是 Dify 的報價。
| 每次 AI 回應的額度 | Dify 清單中的範例 | Sandbox 200 額度 | Professional 每月 5,000 | Team 每月 10,000 |
|---|---|---|---|---|
| 25 | gpt-5.6-sol、gpt-5.5 | 8 次回應 | 200 | 400 |
| 20 | Claude Opus 4.7/4.6/4.5、grok-4.5、grok-4.6 | 10 | 250 | 500 |
| 15 | gpt-5.6-terra、gpt-5.4 | 13 | 333 | 666 |
| 10 | Claude Sonnet 4.6/4.5、Gemini 3.5 Flash、qwen3-max | 20 | 500 | 1,000 |
| 5 | Claude Haiku 4.5、gpt-5.6-luna、gemini-3.7-flash | 40 | 1,000 | 2,000 |
| 1 | gpt-5-mini、Gemini 2.5 Flash、qwen-turbo | 200 | 5,000 | 10,000 |
由此可得出三點。第一,使用每次回應耗用 10 額度的模型時,正式聊天應用程式在回答 500 次後就會耗盡 Professional 的每月配額;對任何面向客戶的應用程式而言,這只是一天中很少的回應量。第二,同一頁面註明,由於模型成本,部分模型完全無法使用額度,必須使用您自己的金鑰——因此您想要的最新模型可能從未包含在配額內。第三,嵌入模型也出現在該額度清單中,這表示建立知識庫索引會與聊天競爭同一個額度池;Dify 沒有定義批次嵌入請求中的一次「回應」代表什麼,因此任何索引額度估算都應視為上限,而不是費率。
本頁不會聲稱的一件事:Sandbox 的 200 額度是否會補充。Sandbox 卡片顯示「200 message credits」,沒有「/ month」後綴,而兩個付費卡片都顯示「/ month」;FAQ 中也沒有任何句子說明是否會補充。
自帶金鑰:Dify 會限制什麼,以及不會限制什麼
對於規劃第二層成本的人來說,好消息是:附加您自己的供應商金鑰不是付費功能。在 Dify 的 Cloud 比較表中,「Model Vendor Management — Supports adding and configuring API keys from different model providers for the workspace」這一列,在 Sandbox、Professional 與 Team 上都標有勾號;自託管比較表則在 Community 與 Enterprise 上都標有勾號。因此,免費工作區可以新增並設定自己的供應商金鑰,而不必為此付費。該列沒有說明 Cloud 工作區會接受哪些端點 URL,而本頁也未測試這一點。
確實受到方案限制的是在同一個模型背後使用多把金鑰。「LLM API Load Balancing — Adds multiple API keys to models, effectively bypassing the API rate limits」在 Sandbox 欄顯示破折號,在 Professional 和 Team 欄顯示勾選標記;在自行託管版本的比較表中,Community 欄顯示破折號,Enterprise 欄則顯示勾選標記。對開源版本來說,最後這個儲存格的標示令人意外,而本頁並未測試 Community 二進位檔是否實際強制實施這項限制——如實的說法是,Dify 自己的比較表將其列為 Enterprise 功能。如果你需要金鑰層級的容錯移轉,又不想為此付費,這項工作應由閘道處理,而非 Dify。另請注意,「Local Models — Supports integration with locally deployed models」出現在自行託管版本的比較表中,但在 Cloud 比較表的標記內容中完全沒有出現。
將 OpenAI 相容端點串接到 Dify
Dify 官方的OpenAI-API-compatible 外掛版本為 0.0.66,由 langgenius 撰寫——兩項資訊均取自外掛自己的資訊清單。其宣告的設定說明了大多數「我的閘道在 Dify 中故障」的報告,以下每一項均於 2026 年 9 月 19 日從該結構描述、資訊清單及同級第一方供應商檔案讀取。
| 結構描述中的欄位 | 宣告的預設值 | 這對成本或行為的重要性 |
|---|---|---|
endpoint_url(API 基礎 URL) | 必要;預留位置是 /v1 基礎 | 這是基礎 URL,而不是完整的 chat-completions 路徑。Kunavo 的基礎 URL 是 https://api.kunavo.com/v1。 |
api_key | 選填(required: false) | 無金鑰的本機端點有效,因此同一個外掛也能服務 LM Studio 與 llama.cpp |
context_size(模型上下文大小) | 必要,預設為 4096 | 由您自行輸入。如果在 RAG 應用程式中保留 4096,擷取的區塊會在模型看到它們之前就被截斷。 |
function_calling_type | no_call | 在您設定之前,工具呼叫處於關閉狀態。Agent 與工具節點會在其他方面正常的模型上失敗。 |
vision_support, structured_output_support | no_support / not_supported | 每項能力都是獨立的開關,預設全部關閉 |
api_type | chat_completions,替代方案為 responses | 依模型選擇 /chat/completions 或 /responses |
| 定價欄位 | 不存在 | 737 行中有零個 pricing 項目,因此 Dify 沒有可用來乘算您 token 數量的費率 |
有兩項結構性限制值得事先規劃。此外掛僅宣告 configurate_methods: customizable-model — 沒有預先定義的模型清單,也沒有模型自動探索功能,因此十個模型就代表十個表單。此外,它恰好宣告五種模型類型:llm、rerank、text-embedding、speech2text 和 tts。圖像生成不在其中,因此閘道後方的圖像模型完全無法透過此外掛作為 Dify 的「模型」使用。
另外有兩條值得了解的路徑。第一方 openai provider 接受自訂的 openai_api_base,但其 api_protocol 欄位預設為 responses — 因此,不實作 /v1/responses 的閘道會在此失敗,直到您將其切換為 Chat Completions。anthropic provider 接受選填的 anthropic_api_url 以及必要的金鑰,並支援預先定義和可自訂的模型;這條路徑能保留 Claude 模型內建的參數組合。Kunavo 同時提供 OpenAI 形狀和 Anthropic 形狀的介面,因此三條路徑都可設定 — 但請有意識地選擇,不要誤打誤撞,並注意 Kunavo 尚未在實際運作的 Dify 工作區中對上述任何內容進行執行期測試。這些是外掛記載的設定,不是相容性認證。
知識庫:RAG 成本實際出現的地方
Dify 的 索引方法文件提供兩個成本形態截然不同的選項。高品質模式「使用嵌入模型將內容區塊轉換為向量表示」,並支援向量、全文或混合檢索。經濟模式每個區塊使用 10 個關鍵字,表示不會消耗 token,但檢索準確度會降低,且只提供倒排索引與 TopK 設定。同一頁也警告,知識庫以高品質模式建立後,之後無法切換至經濟模式,因此這是一扇單向門,應當慎重決定後再通過。
請明確了解由誰處理嵌入步驟,因為不是我們:Kunavo 不提供嵌入服務,也不提供重新排序服務。如果您選擇高品質索引,該步驟會呼叫外部 provider 或本機部署的模型,並在 Dify 中設定為獨立的 provider 項目 — Dify 的重新排序欄位同樣不是我們提供的服務;該欄位需要 /rerank 端點或明確的 Rerank Endpoint URL。閘道在此能涵蓋的是 llm 類型:工作流程中的生成節點。請分開編列這兩項預算。RAG 實作會更深入介紹檢索端。
自託管部署還有一項順序細節:Docker Compose 堆疊會執行 ssrf_proxy,因此端點必須能從容器網路內連線,而不只是能從您筆電上的瀏覽器連線。
模型層的實際估算
這是說明性的 token 算術,不是測得的工作流程成本,也不是帳單上限。假設一次 RAG 回答傳送 12,000 個輸入 token(系統提示、檢索到的區塊和簡短歷史記錄,全部未快取),並回傳 600 個輸出 token,且工作流程每個回答執行 一次 LLM 呼叫。費率是目前 Kunavo 目錄中每百萬 token 的價格。
| 模型 | 每 1M 的輸入/輸出 | 每次回答的估算 | 每 1,000 次回答的估算 |
|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.01050 | $10.50 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.01092 | $10.92 |
| Claude Sonnet 4.6 | $2.10 / $10.50 | $0.03150 | $31.50 |
| Claude Opus 5 | $3.50 / $17.50 | $0.05250 | $52.50 |
對照上方的點數表,兩個層次就會清楚浮現。模型若被 Dify 以每次 10 點計費,1,000 次回答需要 10,000 點 — 也就是 $159 方案的全部 Team 額度;同樣數量的 token 流量,在 Claude Sonnet 4.6 上的目錄估算為 $31.50,在 Claude Haiku 4.5 上則為 $10.50。哪一層主導您的帳單,完全取決於每個節點執行哪個模型,而此表中的差距約為 5×。
有兩項坦誠的注意事項。輸入 token 會主導 RAG 請求,因此最能推動帳單金額的數字,是您檢索多少區塊以及每個區塊有多長 — 而不是輸出長度。此外,Kunavo 的目錄金額是計費下限,而非上限:上游回報其費用時,帳單會採用目錄成本與上游成本乘以適用加成兩者之較高者。快取行為和外部工具呼叫不在此範例範圍內。最低加值為$10 的預付額度 — 這是資金最低門檻,不是任務費或訂閱費。請參閱 計費詳細資訊。
Dify 最佳且最便宜的 API:按層選擇
| 方式 | 適用時機 | 你放棄的功能 |
|---|---|---|
| Dify 訊息點數 | 第一週評估五家供應商的模型,完全不需要設定 | 點數會用完,有些模型完全不包含在點數中,而 Dify FAQ 對已達方案上限的方案所建議的補救方式,是升級至下一個層級 |
| 直接使用供應商 API | 一家供應商涵蓋每個節點,而您希望使用該供應商自己的快取和批次折扣 | 第二家供應商意味著第二個帳戶、第二次金鑰輪替,以及第二個支出儀表板 |
| OpenAI 相容閘道 | 節點會切換模型,而您希望在背後使用一個金鑰和一筆預付餘額 | 相容外掛沒有模型目錄,因此每個模型都是手動輸入的表單,且能力開關預設為關閉 |
| Anthropic 相容端點 | 您已統一採用 Claude 模型,並希望使用其內建的參數組合 | 它是與 OpenAI 相容方案分開的 provider 項目,需要獨立設定和獨立提供金鑰 |
| 本機模型 | 私有或低價值節點,不收取每次請求費用 | 硬體與營運;Dify 在自託管比較中列出 Local Models,但 Cloud 比較中沒有列出 |
談到「最便宜」時,請分開看待兩個問題。列出的最低費率是價格表的屬性;完成工作流程的最低成本則是圖表的屬性:其中每個 LLM 節點都是獨立的模型呼叫,具有自己的帳單,因此一個迫使您重試、進行第二次擷取,或產生更長回答的弱模型,可能不如一次就答對的較昂貴模型划算。實務方法是按照真實請求形狀定價 — 計算檢索到的區塊,而不是猜測 — 然後執行相同的工作流程兩次,比較每個 provider 帳戶實際記錄的內容。AI 成本最佳化介紹這套方法;LLM 閘道和 OpenRouter 替代方案則比較閘道選項本身。
Dify 仍然是適合標準化採用的平台嗎?
是,根據目前可取得的證據。langgenius/dify 儲存庫未被封存,最近一次推送為 2026 年 9 月 18 日,目前有 156,347 顆星;最新版本為 1.17.1,發布於 2026 年 9 月 10 日,另有 1.17.0 於 8 月 25 日發布,以及 1.16.1 於 7 月 28 日發布(GitHub API,2026 年 9 月 19 日)。請注意,標籤不帶 v 前綴 — 以 /releases/tag/v1.17.1 建立的 URL 會回傳 404。背後的公司是 LangGenius, Inc.,這個名稱出現在網站頁尾及 Dify 自己的付款 FAQ 中。
商業部署前,務必閱讀授權條款。Dify 的 LICENSE開頭說明,專案採用經修改的 Apache 2.0 版本授權,並附加其他條件:未經書面授權,不得使用原始碼營運多租戶環境 — 其中一個租戶定義為一個工作區;也不得移除或修改 Dify 主控台前端中的標誌或著作權資訊。如果移除 Dify 品牌對您很重要,文件記載的途徑是 Enterprise 協議或 Dify Premium AMI;其文件頁面表示該方案「允許自訂品牌」,並指示您前往 AWS Marketplace 查詢價格。
如果計畫自託管,請如實評估主機規模。Docker Compose 指南列出的先決條件是 CPU >= 2 Core 和 RAM >= 4 GiB,接著啟動 7 個核心服務和 8 個相依元件;其 macOS 列則要求 Docker VM 至少具備 2 個虛擬 CPU 和 8 GiB 記憶體。軟體免費,基礎設施付費。
設定完成後,檢查第一筆費用
如果您透過 Kunavo 路由 Dify 的 LLM 節點,請將上述設定視為起點,而不是已驗證的整合:Kunavo 目前沒有發布 Dify 專用的設定頁面,也沒有任何 Dify 工作區針對此處的端點完成執行期測試。先透過 OpenAI API 相容外掛新增一個模型,在進行其他操作前設定 context size 和 Function Call Type,執行一個有界限的工作流程,並查看您的帳戶記錄的費用 — 因為對於連接閘道的模型,Dify 不會顯示美元金額。OpenAI 相容 API 指南介紹端點形狀,整合索引則列出已有發布設定頁面的用戶端。準備好為金鑰加值時,請建立 Kunavo 帳戶;最低金額為 $10 的預付額度。
常見問題
Dify 的費用是多少?
Dify Cloud 有三個自助式方案,資料取自 2026 年 9 月 19 日的 dify.ai/pricing/dify-cloud:Sandbox 為 $0,Professional 為每個工作區每月 $59 或每年 $590,Team 為每個工作區每月 $159 或每年 $1,590。列出的價格不含稅。自託管的 Community Edition 是免費軟體,而 Dify Enterprise 則是透過授權金鑰啟用的客製報價。這些數字都不包括 Cloud 方案所附訊息額度以外的模型 API 支出。
Dify 的訊息額度涵蓋我的模型使用量嗎?
只能作為試用。Dify 自己的方案卡片將訊息額度描述為試用 OpenAI、Anthropic、Gemini、xAI 與 Tongyi 模型的方式,並表示額度用完後可切換至您自己的 API 金鑰。額度是按每次 AI 回應、依模型費率消耗,而不是按權杖消耗:Dify FAQ 列出的費率從 1 額度到 25 額度不等。因此 Professional 每月 5,000 額度,在費率為 10 額度的模型上可購買 500 次回應;同一頁面的註記還表示,部分模型完全無法使用額度。查閱日期為 2026 年 9 月 19 日。
Dify 最佳的 API 是什麼?
這取決於您要最佳化哪一層。當單一供應商的模型涵蓋您建構的一切,而且您希望使用該供應商自己的快取與批次折扣時,直接供應商 API 勝出。當您的工作流程會依節點切換模型,且您希望背後共用一個金鑰與一個餘額時,OpenAI 相容閘道勝出;代價是 Dify 的相容外掛不提供模型目錄,因此每個模型都必須手動輸入表單。Dify 的訊息額度只有在評估階段勝出,因為它會用完。對於私密或低價值步驟,本機部署的模型勝出——不過 Dify 在自託管比較中列出 Local Models,在 Cloud 比較中則沒有列出。
Dify 最便宜的 API 是什麼?
列出的最低費率與完成工作流程的最低成本是兩個不同問題。Dify 工作流程中的每個 LLM 節點都是獨立的模型呼叫,獨立計費,因此需要重試節點或第二次擷取流程的便宜模型,成本可能高於較昂貴模型的一次準確呼叫。先依照實際請求形式定價——在 RAG 應用程式中,擷取的區塊會主導輸入權杖——然後在兩個模型上測量相同工作流程,再做決定。任何供應商都無法承諾絕對最低價格,因為總成本取決於您的圖表發出多少次呼叫。
Dify 最佳的模型是什麼?
請按節點選擇,而不是按應用程式選擇,因為 Dify 允許每個節點使用自己的模型。分類、路由與短篇擷取節點使用小型快速模型即可接受,而且大多數呼叫量都集中在這些節點。最終寫作者節點的品質會直接呈現給使用者,值得使用更強的模型。Dify 有一項特別注意事項:透過 OpenAI-API-compatible 外掛新增的模型,其 Function Call Type 預設為 no_call,而 Vision 與 Structured Output 預設為關閉,因此 Agent 或工具使用節點在設定這些切換前無法運作,無論模型本身的能力有多強。
Dify 會顯示我的模型呼叫成本嗎?
對於透過 OpenAI-API-compatible 外掛新增的模型,不會。Dify 第一方預先定義的模型檔案包含定價區塊——例如 Anthropic Claude 檔案會以輸入與輸出費率及每權杖單位結尾——而相容外掛的 737 行供應商結構描述完全沒有定價欄位;查閱日期為 2026 年 9 月 19 日。因此,Dify 沒有每權杖費率可用來乘以閘道連接模型的權杖數量。請改從該供應商自己的儀表板讀取金額。
自託管 Dify 真的免費嗎?
軟體免費,但基礎設施不免費。Dify 的 Community Edition 免費,其自己的定價頁面也將其列為免費並支援單一工作區。Docker Compose 部署會啟動 7 個核心服務與 8 個相依元件;快速入門頁面列出的先決條件為 CPU >= 2 Core 和 RAM >= 4 GiB,而其 macOS 列則要求 Docker VM 至少具備 2 個虛擬 CPU 和 8 GiB。您還要支付向量資料庫費用及每個模型權杖的費用。另請注意,該授權是修改版 Apache 2.0:未經書面授權,不得營運多租戶環境,也不得移除主控台的標誌或著作權資訊。
Dify 方案價格、比較表標記、點數費率、外掛結構描述、索引和自託管文件、授權條款與儲存庫狀態,均於 2026 年 9 月 19 日從 Dify 自己的頁面和儲存庫取得;功能標記是根據定價頁面本身的標記解析,而不是根據渲染後的截圖。Kunavo 權杖費率來自即時目錄。本文每個美元範例都是說明性的權杖算術,不是測得的工作流程成本,且未執行 Dify 對 Kunavo 的執行期測試。