Open WebUI 完全沒有公布價格表:openwebui.com/pricing 和 openwebui.com/enterprise 都回傳 404,而且聊天介面可以免費自行託管,不設席位上限,也不設請求上限。企業版授權限制的是移除 Open WebUI 品牌識別,以及 Terminals 等企業專屬附加功能,而不是使用者人數。買方實際需要的數字,是該專案不會向您收費的三項成本 — 機器、模型 token,以及 Open WebUI 內部會悄悄傳送您未輸入之 token 的設定。以下將提供這三項成本,並附上來源和查核日期。
這個問題流傳著三個錯誤價格,因此先釐清。每席位每年 $60是真實且官方的價格,但它是 Open WebUI Computer 的 Supporter 等級 — cptr 套件;這是同一團隊推出、採用不同授權的獨立產品,其免費方案本身標示為「永遠 $0」。搜尋結果中歸給 Open WebUI 的年度企業版價格來自第三方託管供應商,且沒有出現在任何官方頁面上,因此本文不予重述。此外,每月 $19 的「Pro」方案屬於 openwebui.net — 這是一個外觀相似但並非 openwebui.com 的網域,其應用程式在自己的文案中標示為「NextChat」(查核日期:2026 年 9 月 21 日)。本文提及它是為了讓您辨認,並刻意不提供連結。
軟體的費用,以及授權實際限制的內容
專案首頁銷售的是安裝方式,而不是方案:「pip install open-webui / 一個指令。60 秒。不需要帳戶。」儲存庫仍在運作,且未被封存;其於 main 的最新提交日期為 2026 年 9 月 4 日。目前版本為 v0.11.3,其檔案於 2026 年 8 月 31 日發布至 PyPI。請注意一項官方資訊不一致之處:首頁的部落格卡片仍以 8 月 25 日的 v0.11.1 為標題。那是部落格文章,不是版本橫幅;GitHub Releases 才是版本發布的依據。
授權條款同樣需要仔細解讀。GitHub 將其回報為 NOASSERTION/「Other」,而第三方文章通常仍稱其為 BSD-3。兩種說法都只對了一半。LICENSE 檔案是 BSD-3 文字加上第四條款;該條款於 v0.6.6 引入,禁止變更、移除、遮蔽或替換 Open WebUI 品牌識別,但以下情況除外:「在任何連續 30 天期間,終端使用者總數 … 不超過五十 (50) 人」、您取得書面許可,或您持有企業版授權。專案的授權頁面明確表示:「品牌識別要求僅適用於較大型的部署(總計 50+ 位使用者)」,以及「任何人仍可從 v0.6.5 分叉,且不受任何限制」。因此:目前它不是 OSI 核准的授權,也不是使用量上限 — 該門檻限制的是變更品牌識別,而不是執行程式。
| 項目 | 費用 | 來源,查核日期:2026 年 9 月 21 日 |
|---|---|---|
| Open WebUI,自行託管,保留品牌識別 | $0 — 列為「標準使用 … 免費」 | Open WebUI for Enterprise |
| 將介面白標或重新命名品牌 | 需要企業版授權;未公布價格 | 同一頁面,同一張表格 |
| 企業版授權本身 | 以席位數私下報價 | 「請告知我們您部署的終端使用者數量(席位)」 |
| 個人使用者的企業版授權 | 不出售 | 「僅提供給已註冊的實體和組織 … 無法接納個人使用者」 |
Open WebUI Computer(cptr),不同的產品 | 永遠 $0;Supporter 每席位每年 $60;企業版客製化 | openwebui.com/computer |
| 模型權杖 | 供應商的每 token 費率 | 供應商自行計費 |
專案自己的說法是,企業版授權授予的內容包括:「白標、重新命名品牌、修改原始品牌識別,或 Terminals 等企業專屬方案」。Terminals 的文件將其說明為 Open Terminal 的編排層:它會為每位使用者佈建獨立工作區,包括檔案、程序、套件環境、資源限制和網路邊界;這也是授權限制功能中明確列出的唯一範例,而非品牌識別。第三方供應商提供的託管「Open WebUI」則是另一回事:那是由他人基礎架構承擔的伺服器費用。本文未取得任何託管主機的已驗證價格 — 查核的一個供應商方案頁面在直接抓取時顯示價格佔位符而非數字 — 因此不引用任何價格。
「Open WebUI API 費用」中其實包含兩個不同問題
這個查詢確實有歧義,而兩個部分的答案不同。
對外呼叫才會產生成本。Open WebUI 沒有自帶模型,因此每個 token 都由您設定的端點收費。Open WebUI 自己的 API不收費:在已發布的 v0.11.3 標籤中,backend/open_webui/main.py 提供 GET /api/models (L874)、POST /api/chat/completions (L1085),以及較新且容易忽略的 Anthropic 形式 POST /api/v1/messages (L1976),旁邊還有 POST /api/v1/messages/count_tokens (L1907)。您要使用自己的 Open WebUI 金鑰進行驗證,而不是使用供應商金鑰。Open WebUI 不會向您收取這些請求的費用,因為它們只是入口:每個請求仍會抵達您設定的上游端點,並由該端點計費。將自己的指令碼指向 Open WebUI,而不是供應商,只會改變路由,不會改變帳單。
您未輸入、但仍會計費的呼叫
這是費率比較容易忽略的部分。在 v0.11.3 標籤的 backend/open_webui/config.py 中,四個背景產生器預設為啟用,一個預設停用。
| 設定 | v0.11.3 的預設值 | 消耗內容 |
|---|---|---|
ENABLE_TITLE_GENERATION (L2312) | True | 每個新聊天額外產生一次完成,用於命名 |
ENABLE_TAGS_GENERATION (L2310) | True | 每個新聊天額外產生一次完成,用於加上標籤 |
ENABLE_RETRIEVAL_QUERY_GENERATION (L2317) | True | 每次執行檢索時額外產生一次完成 |
ENABLE_SEARCH_QUERY_GENERATION (L2315) | True | 使用網路搜尋時額外產生一次完成 |
ENABLE_AUTOCOMPLETE_GENERATION (L2346) | False | 除非您啟用它,否則不消耗任何內容 |
TASK_MODEL / TASK_MODEL_EXTERNAL (L2193, L2195) | 空白 | 空白表示這些工作會使用您的聊天模型執行 |
本文未測量實際上會增加多少 token,任何聲稱具體百分比的說法都會是捏造的。可以確認的是其運作形式:這些旗標已啟用,但任務模型尚未設定,因此在您於 TASK_MODEL_EXTERNAL 中指定便宜的 ID 之前,命名和標籤流量會按照該對話當下使用的聊天模型計費。Open WebUI 自己的常見問題也說明了相同內容 —「預設情況下,這些工作會使用您正在聊天的同一模型」— 並建議相同的修正方式。在預算之前,還有兩個相反的預設值值得了解:網路搜尋已停用(ENABLE_WEB_SEARCH,L1155),圖片生成已停用(ENABLE_IMAGE_GENERATION,L1336),而程式碼解譯器已啟用(L422)。
四個子系統、四個端點欄位 — 以及一項值得再讀一次的預設值
聊天相容性不會延伸到產品的其他部分。檢索嵌入、語音轉文字、文字轉語音和圖片生成各自都有自己的基礎 URL 與金鑰配對,而每一項的回退值都是單一的 OPENAI_API_BASE_URL。令人意外的是:在 v0.11.3 標籤中,建立連線清單後,config.py 的第 365 行會無條件重新指派 OPENAI_API_BASE_URL = 'https://api.openai.com/v1'。因此,之後評估的每個子系統預設值 — RAG_OPENAI_API_BASE_URL (L1092)、IMAGES_OPENAI_API_BASE_URL (L1490)、AUDIO_STT_OPENAI_API_BASE_URL (L1565)、AUDIO_TTS_OPENAI_API_BASE_URL (L1606) — 無論您為聊天設定哪個變數,都會解析至 OpenAI 的端點。這是從原始碼讀取到的模組層級預設值;這些值會初始化持久化設定,之後管理員 UI 可以覆寫它們,而本文未在執行中的實例中重現此行為。Issue #22084 描述了相同症狀;該問題於 2026 年 3 月 1 日提出,目前已關閉並標記為完成,因此請將上述原始碼解讀視為 v0.11.3 的模組層級預設值,而不是尚未結案的錯誤問題。
好消息是,在預設設定下,這四個欄位都不會產生 API 支出。
| 子系統 | v0.11.3 的預設值 | 預設費用 |
|---|---|---|
| 文件檢索 | RAG_EMBEDDING_ENGINE 為空白 (L996);模型 sentence-transformers/all-MiniLM-L6-v2 (L1002) | API 支出為零 — 嵌入步驟在本機、使用您自己的 CPU 和 RAM 執行 |
| 語音轉文字 | AUDIO_STT_ENGINE 為空白 (L1571),本機 Whisper | API 支出為零;改由本機運算 |
| 文字轉語音 | AUDIO_TTS_ENGINE 為空白 (L1620) | API 支出為零 — 引擎未設定時,伺服器自己的 /audio/speech 路由會回傳 404,而不是對外呼叫(routers/audio.py L559) |
| 影像生成 | 停用 (L1336) | 在您啟用它並選擇端點之前,不會產生任何費用 |
Kunavo 不提供嵌入、語音轉文字或文字轉語音服務。
這項邊界決定了您究竟能否將其中哪些欄位指向閘道:RAG_OPENAI_API_BASE_URL、AUDIO_STT_OPENAI_API_BASE_URL 和 AUDIO_TTS_OPENAI_API_BASE_URL 都不是應指向此處的欄位。讓檢索步驟維持本機預設值 — 這既是隨附的設定,也是免費的設定 — 或將它傳送給確實提供此步驟的供應商。您的檢索帳單中唯一會抵達聊天供應商的部分,是檢索到的文字;它會以普通輸入 token 的形式放入下一個提示中。RAG 實作 說明區塊大小和 top-k 如何轉化為輸入數量。
# The chat connection. This is the only slot the setup guides cover.
OPENAI_API_BASE_URL=https://api.kunavo.com/v1
OPENAI_API_KEY=sk-kn-...
# Titles, tags and retrieval queries run on the CHAT model unless you say
# otherwise. TASK_MODEL_EXTERNAL defaults to empty (config.py L2195).
TASK_MODEL_EXTERNAL=claude-haiku-4-5
# Leave the document-embedding step alone: empty means local, and local
# means no API spend at all (config.py L996 and L1002).
RAG_EMBEDDING_ENGINE=
RAG_EMBEDDING_MODEL=sentence-transformers/all-MiniLM-L6-v2一天聊天的實際估算
這是說明用途的 token 算術,不是測量所得的成本,也不是帳單上限。假設一個人在聊天視窗中工作一天:40 次助理回合,每次傳送 6,000 個未快取的輸入 token(可見對話串加上任何檢索到的區塊),並回傳 700 個輸出 token — 總計 240,000 個輸入 token 和 28,000 個輸出 token。假設當天有 8 個新聊天,而 Open WebUI 的預設標題、標籤和檢索查詢產生器在每個聊天中額外發出三次呼叫,每次包含 2,000 個輸入 token 和 40 個輸出 token。每次呼叫的大小是估計值,並未經測量。費率是目前的 Kunavo 目錄每百萬 token 價格。
| 模型 | 每 1M 的輸入/輸出 | 40 次聊天回合 | 背景工作 | 當日總計 |
|---|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.266 | $0.037 | $0.303 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.286 | $0.038 | $0.323 |
| Claude Sonnet 4.6 | $2.10 / $10.50 | $0.798 | $0.111 | $0.909 |
| Claude Sonnet 5 | $1.40 / $7.00 | $0.532 | $0.074 | $0.606 |
請閱讀最後一欄,而不是聊天欄。在這些假設下,背景流量約占一天的 12% — $0.074/Claude Sonnet 5 天,即 $0.606 — 花在聊天命名和加標籤上。將 TASK_MODEL_EXTERNAL 設為 Claude Haiku 4.5 後,該部分會降至 $0.037,當日總額則為 $0.569,而任何人實際閱讀的內容不變。單一這項設定對此帳單的影響,大於在相同等級間切換供應商的影響。
在將其視為預算前,請依照您自己的使用者人數和天數換算,並注意算術未包含的內容:提示快取、圖片或影片生成,以及程式碼解譯器呼叫的任何工具。Kunavo 目錄金額是計費下限,而不是上限 — 上游回報費用時,帳單會取目錄成本與上游成本乘以適用加價後兩者中的較高者。Kunavo 預付額度的最低儲值為 $10 的預付額度;這是資金下限,不是訂閱費或每席位費用。請參閱計費詳情以及使用量中的每次請求帳本。Open WebUI 也會顯示自己的檢視:v0.11.3 README 說明管理員儀表板可以「追蹤不同使用者和模型的訊息量、token 消耗量與成本」。本文未使用此功能,而且兩個計量器若計算相同流量,不會逐一精確對齊 token,因此請以您實際提供資金的那一方作為核對依據。
哪條路由勝出,以及何時勝出
| 方式 | 適用時機 | 你放棄的功能 |
|---|---|---|
| 直接使用供應商 API | 一家供應商的模型涵蓋使用者所做的一切 | 另一個模型系列代表您需要第二個連線、第二把金鑰和第二個需要監控的餘額 |
| 閘道(Kunavo 及其替代方案) | 您希望在單一選擇器中,透過一把金鑰提供多個模型系列,並在同一處查看各模型價格 | 位於您與供應商之間的一層;原生提示快取等供應商特定附加功能在不同閘道上的行為可能不同,依賴前值得測試 |
| 透過 Ollama 或 llama.cpp 使用本機模型 | 私人或低風險工作、不按請求收費,而且 Open WebUI 原生記錄了兩者 | 相較於託管前沿模型,需要硬體且能力存在差距;檢索和長對話串消耗的是 RAM,而不是美元 |
| 消費者聊天訂閱 | 您主要想使用某一家供應商自己的產品 | 無法連線:Open WebUI 需要 API 端點,而聊天訂閱不是 API 端點 |
| 託管的 Open WebUI | 您不想執行容器 | 在 token 費用之上的伺服器費用;由於無法驗證價格,本文未引用任何價格 |
有一項協定細節,比供應商選擇更能決定設定方式。Open WebUI 明確以協定為導向 — 它實作 OpenAI Chat Completions 協定,並拒絕在核心中加入供應商專屬 API — 因此您應提供給它的是 OpenAI 形式的 /v1 根路徑,即使使用 Claude 模型也是如此。它自己的 Anthropic 頁面將 https://api.anthropic.com/v1 設定為 OpenAI 連線,並轉述 Anthropic 的警告:相容性層是用於測試,而非生產環境。每個連線還有一個 API Type 切換選項,可選擇 Open Responses;文件將其標示為實驗性功能,並警告「可能無法與所有供應商正常運作」。Kunavo 提供 Responses 形式的路由,但本文未對這種組合進行執行時測試,因此請將 chat-completions 路徑視為已知可用的路徑,並把此切換選項當作可在備用連線上嘗試的功能。
如果您比較的是前端本身,而不是供應商?LibreChat 與 Open WebUI以及 AnythingLLM 與 Open WebUI會介紹這項選擇,而最佳 LLM 閘道則根據費率和資金條款比較閘道層,而非整合深度。
完成設定後,檢查第一天的費用
連線位於 Settings → Admin → Connections →「Manage OpenAI API Connections」→「Add Connection」,其中包含 URL 和 API Key 欄位;也可以在容器啟動時,使用上方的兩個環境變數完成相同設定。請保留 URL 中的 /v1 — Open WebUI 會自行附加路徑,而原始碼會移除結尾斜線。
有一種故障模式值得事先了解,因為它看起來像整合失效,但其實不是。Open WebUI 自己的文件指出,儲存連線不會測試連線;Verify 按鈕會呼叫供應商的 /models 端點;如果該呼叫失敗,「這不代表供應商不相容:聊天完成仍會運作」— 您應改為在每個連線的 Model IDs 允許清單中輸入模型 ID。無論如何,都值得填寫這份允許清單:在包含圖片、影片和音樂模型的目錄中,空白篩選器會將聊天視窗無法呼叫的模型放入選擇器。
Kunavo 為此用戶端發布了設定指南。那是已發布的設定參考,而不是相容性測試 — 本文未在執行時測試 Open WebUI 是否能使用 Kunavo 的端點,以上內容也全部來自 Open WebUI 已發布的原始碼及其自有文件。嘗試時請保留一條可運作的路由,執行一天的受限測試,然後查看您的帳戶實際記錄了什麼。請從 Open WebUI 整合指南開始,準備好為金鑰儲值時,再建立 Kunavo 帳戶。
常見問題
Open WebUI 要花多少錢?
軟體免費,且沒有可供查閱的價目表:openwebui.com/pricing 和 openwebui.com/enterprise 都回傳 404,而首頁自己的安裝文字是「pip install open-webui / 一個指令。60 秒。不需要帳戶。」(截至 2026 年 9 月 19 日檢查)。執行它沒有席位上限,也沒有請求上限。你實際支付的是執行它的機器、它送出的模型 token,以及——如果你想移除 Open WebUI 品牌,或想取得 Terminals 等僅限企業版的附加功能——企業授權費;目前未公布金額,專案會在你提供席位數後報價。
Open WebUI 有定價頁面或已公布的企業版價格嗎?
沒有。其企業版文件要求你提供終端使用者數量(席位),並表示企業授權僅提供給已註冊的實體與組織,不提供給個人使用者。任何官方 Open WebUI 頁面都沒有出現美元金額。第三方託管供應商和內容網站會發布「Open WebUI pricing」的方案表與年度金額,但專案本身並未發布這些內容;請將其視為供應商內容。另一個外觀相似的網域 openwebui.net 為一款品牌名為「NextChat」的應用程式銷售每月 $19 的「Pro」方案;它不是 openwebui.com,也不是由該專案營運。
我需要企業版授權才能讓 Open WebUI 執行超過 50 位使用者嗎?
根據該專案自己的企業版表格,不需要;表格將「標準使用 — 保留原始品牌識別的內部使用 —」列為免費,只有白標、重新命名品牌或企業專屬方案才需要企業版授權。五十位使用者的門檻位於 LICENSE 第 4 條,且只限制一件事:在任何連續三十天期間內,您是否可以未經許可變更、移除、遮蔽或替換 Open WebUI 品牌識別。大規模部署前請自行閱讀授權條款;這是摘要,不構成法律建議。
Open WebUI 最適合使用哪個 API?
這取決於您希望在選擇器中提供多少家供應商。如果您要使用的所有功能都由某一家供應商的模型涵蓋,而且希望採用該供應商自己的快取與批次條款,直接使用供應商 API 最合適;如果您希望透過一個連線、單一金鑰和單一餘額,在模型選擇器中提供多個模型系列,閘道最合適;如果是私人或低風險工作,且不想按請求付費,透過 Ollama 或 llama.cpp 使用本機伺服器最合適。直接使用供應商 API 和使用閘道的設定量相同 — Open WebUI 的 OpenAI 相容連線表單在兩種情況下都只需要 URL 和 API 金鑰。本機伺服器則不同:您還必須安裝並執行它,而 Open WebUI 會在各自的連線頁面中說明 Ollama 和 llama.cpp。
Open WebUI 最便宜的 API 是哪個?
標價最低,與取得答案最便宜,是兩個不同的問題。聊天 UI 每次互動都會針對整個可見對話串計費,因此在低費率模型上進行長對話,可能比在高費率模型上進行短對話更昂貴;而需要第二次嘗試的模型,成本會加倍。以下三項設定對聊天費用的影響大於費率表:預設標題、標籤和檢索查詢產生使用哪個模型、每個提示中填入多少檢索到的文件文字,以及您讓對話串在開始新對話前增長多長。先調整這些設定,再比較費率。
Open WebUI 最適合使用哪個模型?
請根據內容視窗實際執行的工作來選擇,而不是根據基準排名。長篇貼上的文件和 RAG 對話串需要較大的上下文視窗與較低的輸入費率,因為聊天 UI 消耗最多的是輸入 token。工具呼叫和內建程式碼解譯器需要在您實際使用的端點上,函式呼叫可靠的模型 — Open WebUI 自己的供應商文件警告,Google 的 OpenAI 相容端點會捨棄串流工具呼叫;這是該端點的特性,而不是模型本身的特性。如果使用者會貼上螢幕截圖,視覺能力就很重要。一個合理的設定是使用兩個連線:以便宜模型作為預設模型,並提供一個強大的模型供使用者切換。
Open WebUI 和 text-generation-webui 是同一個東西嗎?
不是。Open WebUI 是 open-webui/open-webui,由 Open WebUI Inc. 維護,最新版本為 v0.11.3。oobabooga 的 text-generation-webui 是由不同維護者開發的另一個專案,現在已重新命名為 TextGen,並移至 github.com/oobabooga/textgen。兩者都提供 OpenAI 相容 API,因此其中一者的設定片段放在另一者中看起來可能合理,但兩者並不相容。
Open WebUI 頁面、儲存庫、提交歷史和套件已於 2026 年 9 月 19 日查核,並於 2026 年 9 月 21 日再次查核;openwebui.com/pricing 和 openwebui.com/enterprise 的 404 回應是直接擷取的,而本文引用的每個設定預設值都在已發布的 v0.11.3 標籤中讀取,而非 main。未查核的內容包括:託管服務價格、任何企業版金額、預設背景工作的 token 額外開銷、Open WebUI 自己的使用量儀表板,以及 Open WebUI 對 Kunavo 的任何端到端執行。Kunavo token 費率來自即時目錄,本文每個美元範例都是說明用途的 token 算術。