Difyの料金には、異なる2者が請求する2つの層があります。プラットフォームプランとモデルトークンです。 Dify CloudはSandboxが$0、Professionalがワークスペースあたり月額$59(年額$590)、Teamがワークスペースあたり月額$159(年額$1,590)です。セルフホスト型のCommunity Editionは無料で、Enterpriseは個別見積もりです。プランのメッセージクレジットを使い切った後のモデルAPI利用料は、これらの金額に含まれません。Dify自身のプランカードにもその旨が記載されています。
以下の金額はすべて、2026年9月19日にDify公式ページのdify.ai/pricing/dify-cloudとdify.ai/pricing/dify-enterpriseから確認しました。要約時に混同しやすい点として、プランカードでは年額がデフォルトで表示され、月額は切り替えの背後にあります。月額の値はマークアップ内のdata-monthly="59"とdata-monthly="159"にあり、同じページ下部の比較表には「$59 Per workspace/month」と「$159 Per workspace/month」がプレーンテキストで表示されています。年額だけを掲載する第三者ページは不完全なものとして扱ってください。
Difyプラットフォームの料金
| チャネル | 掲載価格 | メッセージクレジット | カードに記載された主な上限 |
|---|---|---|---|
| Dify Cloud — Sandbox | 無料 | 200(カードには「/ month」サフィックスなし) | 1ワークスペース、1メンバー、5アプリ、ナレッジドキュメント50件、ナレッジストレージ50MB、ログ履歴30日間 |
| Dify Cloud — Professional | $59 / ワークスペース / 月、または$590 / 年 | 月間5,000 | 3メンバー、50アプリ、ナレッジドキュメント500件、ストレージ5GB、月間トリガーイベント20,000件、ログ履歴無制限 |
| Dify Cloud — Team | $159 / ワークスペース / 月、または$1,590 / 年 | 月間10,000 | 50メンバー、200アプリ、ナレッジドキュメント1,000件、ストレージ20GB、トリガーイベント無制限 |
| Community Edition(セルフホスト型) | 無料ソフトウェア | なし | 単一ワークスペース。サーバー、ベクトルデータベース、すべてのモデルのトークンは利用者が用意します |
| Dify Enterprise | 個別見積もり | なし | セルフホスト型デプロイメントのライセンスキー。複数ワークスペース、SSO、商用ライセンス認証 |
| AWS上のDify Premium | AWS Marketplaceでのみ見積もり提示 | なし | カスタムブランディングを可能にするAMI。ドキュメントページには価格の記載がないため、ここでは再掲しません |
ティアを選ぶ前に知っておくべき制約が2つあります。DifyのFAQでは、上限に達したProfessionalプランがベクトル容量やチーム席を個別に追加購入できるかという質問に対し、プランのアップグレードを推奨しています。また、Teamプランで不足する場合はサポートアドレスへ連絡するよう案内しています。つまり、上限への記載上の対応は追加購入ではなく次のティアへの移行です。現在、支払いはカードのみです。同じFAQでは、銀行振込での支払いを検討中ですがまだ利用できず、対象は年額Teamサブスクリプションのみと説明されています。表示価格には適用される税金が含まれません。
メッセージクレジットは予算ではなく試用枠です
これは、ほとんどの「Dify料金」要約が誤っている部分です。3つすべてのCloudプランカードのツールチップには、OpenAI、Anthropic、Gemini、xAI、Tongyiのモデルを試すためにクレジットが提供され、モデル種別に応じて消費され、使い切ると自分のAPIキーに切り替えられると記載されています。クレジットはトークン予算ではありません。DifyのFAQには、クレジットは公開されたモデルごとの料金でAI応答1回ごとに消費されると記載されています。
以下の消費クレジット数は、2026年9月19日にDifyのFAQから確認したものです。全リストではなく、その一部を示しています。各段階にはここで引用した例より多くのモデルが含まれ、公開された段階表にはこの表に含めていない3クレジットのティアもあります。これらはDifyがどのモデルの利用に対してクレジットを消費させるかを示すものであり、各ベンダー自身のカタログについての記述ではありません。応答数は公開された付与枠に基づく算術計算であり、Difyが提示した数値ではありません。
| AI応答1回あたりのクレジット | Difyのリストからの例 | Sandbox 200クレジット | Professional 月間5,000 | Team 月間10,000 |
|---|---|---|---|---|
| 25 | gpt-5.6-sol、gpt-5.5 | 8応答 | 200 | 400 |
| 20 | Claude Opus 4.7 / 4.6 / 4.5、grok-4.5、grok-4.6 | 10 | 250 | 500 |
| 15 | gpt-5.6-terra、gpt-5.4 | 13 | 333 | 666 |
| 10 | Claude Sonnet 4.6 / 4.5、Gemini 3.5 Flash、qwen3-max | 20 | 500 | 1,000 |
| 5 | Claude Haiku 4.5、gpt-5.6-luna、gemini-3.7-flash | 40 | 1,000 | 2,000 |
| 1 | gpt-5-mini、Gemini 2.5 Flash、qwen-turbo | 200 | 5,000 | 10,000 |
ここから3つのことが分かります。第一に、10クレジットのモデルを使う本番チャットアプリでは、Professionalの月間枠を500回の回答で使い切ります。顧客向けの用途では、1日分の処理量としても少ない数字です。第二に、同じページには、モデルのコストによりクレジットをまったく利用できず、自分のキーが必要なモデルもあるという注記があります。つまり、利用したい最新モデルは、最初から枠内に含まれていなかった可能性があります。第三に、埋め込みモデルもそのクレジットリストに含まれています。ナレッジベースのインデックス作成とチャットが同じプールを奪い合うということです。Difyはバッチ埋め込みリクエストで何を「1応答」と数えるかを定義していないため、インデックス作成のクレジット見積もりは消費率ではなく上限として扱ってください。
このページで断定していない点が1つあります。Sandboxの200クレジットが補充されるかどうかです。Sandboxカードには「200 message credits」と表示されますが「/ month」サフィックスはありません。一方、有料カードはどちらも「/ month」と記載されています。また、FAQにも補充ポリシーを明記する文はありません。
自分のキーを持ち込む:Difyが制限するもの、制限しないもの
2つ目の層の予算を考える人にとって朗報なのは、自分のプロバイダーキーを接続することは有料機能ではないことです。DifyのCloud比較表では、「Model Vendor Management — Supports adding and configuring API keys from different model providers for the workspace」という行に、Sandbox、Professional、Teamのすべてでチェックマークがあります。セルフホスト版の表でも、CommunityとEnterpriseの両方にチェックがあります。したがって、無料ワークスペースでも、特権のために支払うことなく自分のプロバイダーキーを追加・設定できます。ただし、この行はCloudワークスペースがどのエンドポイントURLを受け付けるかを示しておらず、このページでもテストしていません。
制限されているのは、1つのモデルで複数のキーを使うことです。「LLM API Load Balancing — Adds multiple API keys to models, effectively bypassing the API rate limits」は、Sandboxではダッシュ、ProfessionalとTeamではチェックマークです。セルフホスト版の表では、Communityがダッシュ、Enterpriseがチェックです。この最後のセルの内容はオープンソース版としては意外ですが、Communityのバイナリが実際にこの制限を強制するかは、このページではテストしていません。正確に言えるのは、Dify自身の比較表がこれをEnterprise機能として示している、ということです。料金を支払わずにキー単位のフェイルオーバーが必要なら、その役割はDifyではなくゲートウェイに任せてください。なお、「Local Models — Supports integration with locally deployed models」はセルフホスト版の比較には表示されますが、Cloud版比較のマークアップにはどこにも表示されません。
OpenAI互換エンドポイントをDifyに接続する
Dify公式のOpenAI-API-compatibleプラグインはバージョン0.0.66で、langgeniusが作成しています。どちらもプラグイン独自のマニフェストから確認しました。その宣言済み設定は、「Difyでゲートウェイが動かない」という報告の大半を説明します。以下の各項目は、2026年9月19日にこのスキーマ、マニフェスト、同系列のファーストパーティプロバイダーファイルから確認したものです。
| スキーマ内のフィールド | 宣言されたデフォルト値 | 料金または動作にとって重要な理由 |
|---|---|---|
endpoint_url(API Base URL) | 必須。プレースホルダーは/v1ベース | これは完全なchat-completionsパスではなく、ベースです。Kunavoのベースはhttps://api.kunavo.com/v1です。 |
api_key | 任意(required: false) | キーなしのローカルエンドポイントも有効です。そのため同じプラグインでLM Studioとllama.cppを利用できます |
context_size(モデルのコンテキストサイズ) | 必須。デフォルトは4096です | 自分で入力します。RAGアプリで4096のままにすると、モデルが見る前に取得チャンクが切り捨てられます。 |
function_calling_type | no_call | 設定するまでツール呼び出しは無効です。正常なモデルでもAgentノードとツールノードは失敗します。 |
vision_support, structured_output_support | no_support / not_supported | 各機能は個別のスイッチで、デフォルトではすべてオフです |
api_type | chat_completions、代替としてresponses | モデルごとに/chat/completionsまたは/responsesを選択します |
| 料金フィールド | 存在しません | 737行にpricingエントリは0件です。そのためDifyには、トークン数に掛ける料金がありません |
計画時に考慮すべき構造上の制限が2つあります。プラグインが宣言するのはconfigurate_methods: customizable-modelだけです。事前定義モデルリストもモデル自動検出もないため、10モデルなら10個のフォームが必要です。また、宣言されているモデル種別は正確に5つです。llm、rerank、text-embedding、speech2text、ttsです。画像生成はその中にないため、ゲートウェイ背後の画像モデルは、このプラグインを通じてDifyの「モデル」として到達できません。
知っておく価値のある別のルートが2つあります。1つ目のファーストパーティopenaiプロバイダーはカスタムopenai_api_baseを受け付けますが、api_protocolフィールドのデフォルトはresponsesです。そのため、/v1/responsesを実装していないゲートウェイでは、Chat Completionsに切り替えるまで失敗します。anthropicプロバイダーは、必須キーに加えて任意のanthropic_api_urlを受け付け、事前定義モデルとカスタマイズ可能なモデルの両方をサポートします。Claudeモデルの組み込みパラメータセットを維持できるのはこちらのルートです。KunavoはOpenAI形式とAnthropic形式の両方のインターフェースを提供するため、3つすべてのルートを設定できます。ただし、偶然ではなく意図的に選択してください。また、これらはいずれも、Kunavoが稼働中のDifyワークスペース内で実行時テストを行ったものではありません。これは互換性の保証ではなく、プラグインに記載された設定です。
ナレッジベース:RAGの費用が実際に発生する場所
Difyのインデックス作成方法のドキュメントには、コスト構造が大きく異なる2つの選択肢があります。High Qualityは「埋め込みモデルを使用してコンテンツチャンクをベクトル表現に変換」し、ベクトル検索、全文検索、ハイブリッド検索をサポートします。Economicalはチャンクごとに10個のキーワードを使用し、検索精度が低下する代わりにトークンは消費しないと説明され、TopK設定の逆インデックスのみを提供します。同じページでは、ナレッジベースをHigh Qualityで作成すると、後からEconomicalに切り替えられないと警告しています。意図を持って進むべき一方通行の選択です。
埋め込み処理を誰が担当するかを明確にしてください。私たちではありません。Kunavoは埋め込みを提供せず、再ランキングも提供しません。High Qualityインデックスを選択すると、その処理は外部プロバイダーまたはローカルにデプロイしたモデルを呼び出し、Difyで独自のプロバイダーエントリとして設定します。また、/rerankエンドポイントまたは明示的なRerank Endpoint URLを必要とするDifyのrerankスロットも、私たちが提供するものではありません。ここでゲートウェイが対応できるのはllm種別、つまりワークフローの生成ノードです。2つは別々に予算化してください。RAGの実装では検索側をさらに詳しく説明しています。
セルフホスト型デプロイメントでは、もう1つ順序に関する注意点があります。Docker Composeスタックはssrf_proxyを実行するため、エンドポイントはノートパソコンのブラウザーからアクセスできるだけでは不十分で、コンテナネットワーク内から到達できなければなりません。
モデル層の計算例
これは実測したワークフローの費用でも請求上限でもなく、トークンに基づく参考計算です。1回のRAG回答で入力トークン12,000個(システムプロンプト、取得チャンク、短い履歴。すべてキャッシュなし)を送信し、出力トークン600個を返し、ワークフローが回答ごとにLLMを1回呼び出すと仮定します。料金は、100万トークンあたりのKunavoカタログの現在の価格です。
| モデル | 100万トークンあたりの入力/出力 | 回答1回あたりの見積もり | 1,000回答あたりの見積もり |
|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.01050 | $10.50 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.01092 | $10.92 |
| Claude Sonnet 4.6 | $2.10 / $10.50 | $0.03150 | $31.50 |
| Claude Opus 5 | $3.50 / $17.50 | $0.05250 | $52.50 |
上のクレジット表と照らし合わせると、2つの層の違いが明確になります。Difyが10クレジットと設定するモデルで、1,000回答を1か月に処理すると、10,000クレジットが必要です。これは$159のプランにおけるTeamの全許容量です。一方、同量のトークントラフィックのカタログ見積もりは、Claude Sonnet 4.6では$31.50、Claude Haiku 4.5では$10.50です。請求額を左右する層は各ノードが実行するモデルに完全に依存し、この表での差はおよそ5倍です。
正直な注意点が2つあります。RAGリクエストでは入力トークンが支配的なため、請求額を最も大きく動かすのは出力の長さではなく、取得するチャンク数とその長さです。また、Kunavoのカタログ金額は上限ではなく請求額の下限です。上流プロバイダーが料金を報告すると、請求額はカタログ料金と、適用されるマークアップを掛けた上流料金のうち大きい方になります。キャッシュの動作と外部ツール呼び出しはこの例の対象外です。前払いクレジットの最低チャージ額は$10です。これは資金投入の最低額であり、タスク料金やサブスクリプションではありません。請求の詳細を参照してください。
Difyに最適で最も安いAPI:レイヤーごとに選ぶ
| ルート | 有利な場面 | 失うもの |
|---|---|---|
| Difyのメッセージクレジット | 初週に5社のベンダーにわたってモデルを評価。設定は不要 | 使い切ることがあり、一部のモデルは完全に対象外で、上限に達したプランへの対処としてDifyのFAQが推奨しているのは、次の上位ティアです |
| ベンダーの直接 API | 1社のベンダーですべてのノードをカバーし、そのベンダー独自のキャッシュとバッチ割引を利用したい場合 | 2社目のベンダーを使うと、もう1つのアカウント、別のキーのローテーション管理、もう1つの支出ダッシュボードが必要になります |
| OpenAI 互換ゲートウェイ | ノードがモデルを切り替え、ノードの背後に1つのキーと1つのプリペイド残高を置きたい場合 | 互換プラグインにはモデルカタログがないため、すべてのモデルを手入力するフォームになり、機能スイッチはデフォルトでオフです |
| Anthropic互換エンドポイント | Claudeモデルに標準化しており、組み込みのパラメータセットを使いたい場合 | OpenAI互換のエントリとは別のプロバイダーエントリで、個別に設定し、独自のキーを設定します |
| ローカルモデル | プライベートまたは低価値のノード。リクエストごとの料金なし | ハードウェアと運用。Difyはセルフホスト比較にはLocal Modelsを掲載していますが、Cloudの比較には掲載していません |
「最安」については、2つの問いを分けて考えてください。掲載料金が最安であることは、価格表の性質です。ワークフローを完了する方法が最安であることは、グラフの性質です。グラフ内の各LLMノードは、それぞれ個別に課金される別のモデル呼び出しだからです。そのため、再試行、2回目の抽出パス、またはより長い回答を必要とする弱いモデルは、1回で正しく処理する高価なモデルに負ける可能性があります。実践的な方法は、実際のリクエスト形状に基づいて料金を計算することです。推測ではなく、取得したチャンク数を数えてください。その後、同じワークフローを2回実行し、各プロバイダーのアカウントに実際に記録された内容を比較します。AIコスト最適化ではこの方法を説明し、LLMゲートウェイとOpenRouterの代替ではゲートウェイの選択肢自体を比較します。
Difyは今も標準化先として適切なプラットフォームですか?
はい、入手可能な証拠に基づけば適切です。langgenius/difyリポジトリはアーカイブされておらず、2026年9月18日に最後のプッシュが行われ、156,347個のスターを獲得しています。最新リリースは1.17.1で、2026年9月10日に公開されました。1.17.0は8月25日、1.16.1は7月28日に公開されています(GitHub API、2026年9月19日)。タグにはvプレフィックスがない点に注意してください。/releases/tag/v1.17.1として構築したURLは404を返します。その背後にある会社はLangGenius, Inc.で、サイトのフッターとDify独自の支払いFAQに記載されている名称です。
商用導入の前に、ライセンスを確認する価値があります。DifyのLICENSEは、プロジェクトが追加条件付きのApache 2.0の改変版でライセンスされていると冒頭で説明しています。書面による許可なしに、ソースを使ってマルチテナント環境を運用することはできません。ここでいう1テナントは1ワークスペースと定義されています。また、Difyコンソールのフロントエンドにあるロゴや著作権情報を削除・変更することもできません。Difyのブランディングを削除する必要がある場合、文書化されている方法はEnterprise契約またはDify Premium AMIです。そのドキュメントページには「カスタムブランディングが可能」と記載され、価格についてはAWS Marketplaceを案内しています。
セルフホストを計画している場合は、必要な環境を正直に見積もってください。Docker Composeガイドには、CPU >= 2 Core、RAM >= 4 GiBという前提条件が記載され、その後、7つのコアサービスと8つの依存コンポーネントを起動します。ガイド内のmacOS行では、Docker VMに少なくとも2つの仮想CPUと8 GiBのメモリを求めています。ソフトウェアは無料でも、インフラストラクチャは有料です。
設定後、最初の請求を確認する
DifyのLLMノードをKunavo経由でルーティングする場合は、上記の設定を検証済みの統合ではなく出発点として扱ってください。KunavoはまだDify専用のセットアップページを公開しておらず、ここで示すエンドポイントに対してDifyワークスペースのランタイムテストも行われていません。OpenAI-API互換プラグインでモデルを1つ追加し、まずコンテキストサイズとFunction Call Typeを設定し、制限したワークフローを1つ実行して、アカウントに記録された料金を確認してください。Difyはゲートウェイに接続したモデルのドル金額を表示しないためです。OpenAI互換APIガイドではエンドポイントの形式を説明し、統合インデックスにはセットアップページが公開されているクライアントを掲載しています。キーへの入金準備ができたらKunavoアカウントを作成してください。プリペイドクレジットの最低額は$10です。
よくある質問
Difyの料金はいくらですか?
Dify Cloudには、2026年9月19日にdify.ai/pricing/dify-cloudで確認した、セルフサービス型の3つの料金ティアがあります。Sandboxは$0、Professionalはワークスペースあたり月額$59または年額$590、Teamはワークスペースあたり月額$159または年額$1,590です。表示価格に税金は含まれません。セルフホスト型のCommunity Editionは無料ソフトウェアで、Dify Enterpriseはライセンスキーで有効化する個別見積もりです。これらの金額には、Cloudプランに付属するメッセージクレジットを超えるモデルAPI利用料は含まれません。
Difyのメッセージクレジットでモデル利用料を賄えますか?
試用の場合に限ります。Dify独自のプランカードでは、メッセージクレジットはOpenAI、Anthropic、Gemini、xAI、Tongyiのモデルを試すためのものと説明されており、使い切ると自分のAPIキーに切り替えると記載されています。クレジットはトークン単位ではなく、モデルごとの料金でAI応答1回ごとに消費されます。DifyのFAQには、1クレジットから25クレジットまでの料金が記載されています。したがって、Professionalの月間5,000クレジットでは、10クレジットのモデルで500回応答できます。同じページには、クレジットをまったく利用できないモデルもあるという注記があります。2026年9月19日確認。
Difyに最適なAPIは何ですか?
どのレイヤーを最適化するかによって異なります。構築するすべての機能を1社のモデルで賄え、そのプロバイダー独自のキャッシュやバッチ割引を利用したい場合は、直接のベンダーAPIが有利です。ワークフロー内のノードごとにモデルを切り替え、1つのキーと残高で一元管理したい場合は、OpenAI互換ゲートウェイが有利です。ただし、Difyの互換プラグインにはモデルカタログがないため、各モデルをフォームに手入力する必要があります。Difyのメッセージクレジットが有利なのは評価用途だけです。クレジットは使い切られるためです。プライベートな処理や価値の低い処理には、ローカルにデプロイしたモデルが有利です。ただしDifyは、セルフホスト版の比較にはLocal Modelsを掲載していますが、Cloud版の比較には掲載していません。
Difyで最も安いAPIは何ですか?
掲載料金が最も安いことと、ワークフローを完了する方法が最も安いことは別の問題です。Difyワークフロー内の各LLMノードは、それぞれ独立したモデル呼び出しとして個別に課金されます。そのため、再試行ノードや2回目の抽出処理が必要な安価なモデルは、高価なモデルによる正確な1回の呼び出しより高くつく場合があります。まず実際のリクエスト形式に基づいて料金を見積もってください。RAGアプリでは、取得したチャンクが入力トークンの大部分を占めます。そのうえで、決定する前に同じワークフローを2つのモデルで測定してください。グラフが何回呼び出すかによって最も安い合計額は変わるため、絶対的な最低価格を保証できるプロバイダーはありません。
Difyに最適なモデルは何ですか?
アプリ単位ではなくノード単位で選択してください。Difyでは各ノードが独自のモデルを持てるためです。分類、ルーティング、短い抽出を行うノードは、小型で高速なモデルでも十分に実行でき、呼び出し量の大部分を占めます。最終的な文章作成ノードはユーザーに品質が見える部分なので、より強力なモデルを使う価値があります。Dify固有の注意点として、OpenAI-API-compatibleプラグインで追加したモデルは、Function Call Typeのデフォルトがno_call、VisionとStructured Outputのデフォルトがoffです。そのため、モデル自体の能力に関係なく、これらのスイッチを設定するまでAgentノードやツール使用ノードでは動作しません。
Difyはモデル呼び出しの費用を表示しますか?
OpenAI-API-compatibleプラグインで追加したモデルについては表示しません。Difyファーストパーティの事前定義モデルファイルには料金ブロックがあります。たとえばAnthropic Claudeのファイルは、入力・出力料金とトークン単位で終わっています。一方、互換プラグインの737行のプロバイダースキーマには料金フィールドがありません。これは2026年9月19日に確認しました。そのためDifyには、ゲートウェイ接続モデルについてトークン数に掛けるトークン単価がありません。料金はそのプロバイダー自身のダッシュボードで確認してください。
Difyのセルフホスティングは本当に無料ですか?
ソフトウェアは無料ですが、インフラは無料ではありません。DifyのCommunity Editionは無料で、独自の料金ページでも単一ワークスペースの無料版として掲載されています。Docker Composeによるデプロイでは7つのコアサービスと8つの依存コンポーネントが起動します。クイックスタートページの前提条件はCPU >= 2 Core、RAM >= 4 GiBで、同ページのmacOS欄ではDocker VMに少なくとも2仮想CPUと8 GiBを求めています。さらに、ベクトルデータベースとすべてのモデルのトークン料金も支払う必要があります。なお、ライセンスは変更版Apache 2.0です。書面による許可なしにマルチテナント環境を運用すること、およびコンソールのロゴや著作権情報を削除することを禁止しています。
Difyのプラン価格、比較表の印、クレジット料金、プラグインスキーマ、インデックス作成およびセルフホストのドキュメント、ライセンスとリポジトリの状態は、すべて2026年9月19日にDify独自のページとリポジトリから取得しました。機能の印は、表示されたスクリーンショットではなく、価格ページ自体のマークアップから判定しています。Kunavoのトークン料金はライブカタログから取得しています。ここで示すすべてのドル例は説明用のトークン計算であり、実測したワークフロー料金ではありません。また、DifyからKunavoへのランタイムテストは実施していません。