O Open WebUI não publica nenhuma lista de preços: openwebui.com/pricing e openwebui.com/enterprise retornam 404, e a interface de chat é gratuita para auto-hospedagem, sem limite de assentos e sem limite de solicitações. O que uma licença empresarial controla é a remoção da marca do Open WebUI e de complementos exclusivos para empresas, como Terminals, não o número de pessoas que o utilizam. Os números de que um comprador realmente precisa são os três pelos quais o projeto não cobra — a máquina, os tokens do modelo e as configurações dentro do Open WebUI que enviam silenciosamente tokens que você não digitou. Os três aparecem abaixo, com fontes e datas de verificação.
Três preços incorretos circulam para esta consulta, então vamos esclarecê-los primeiro. $60 por assento por ano é real e oficial, mas corresponde ao nível Supporter do Open WebUI Computer — o pacote cptr, um produto separado da mesma equipe, sob uma licença diferente, cujo próprio nível gratuito informa “$0 para sempre”. Um valor empresarial anual atribuído ao Open WebUI nos resultados de busca vem de um fornecedor de hospedagem terceirizado e não aparece em nenhuma página oficial, portanto não é repetido aqui. E um plano “Pro” de $19 por mês pertence ao openwebui.net — um domínio parecido que não é openwebui.com e cujo aplicativo é identificado como “NextChat” em seu próprio texto (verificado em 21 de setembro de 2026). Ele é mencionado aqui para que você o reconheça e deliberadamente não é vinculado.
Quanto o software custa e o que a licença realmente controla
A página inicial do projeto vende a instalação, não um plano: “pip install open-webui / Um comando. 60 segundos. Nenhuma conta necessária.” O repositório está ativo e não arquivado, e seu commit mais recente em main é datado de 4 de setembro de 2026. A versão atual é v0.11.3, cujos arquivos foram publicados no PyPI em 31 de agosto de 2026. Observe uma divergência oficial: o cartão do blog na página inicial ainda destaca a v0.11.1 de 25 de agosto. Essa é uma publicação de blog, não um banner de versão; GitHub Releases é a fonte definitiva da versão.
A licença exige o mesmo cuidado. O GitHub a informa como NOASSERTION / “Other”, enquanto textos de terceiros frequentemente ainda a chamam de BSD-3. Ambos estão parcialmente certos. O arquivo LICENSE contém o texto BSD-3 mais uma quarta cláusula, introduzida na v0.6.6, que proíbe alterar, remover, ocultar ou substituir a marca do Open WebUI, exceto quando “o número total de usuários finais … não exceder cinquenta (50) em qualquer período móvel de 30 dias”, quando você tiver permissão por escrito ou quando possuir uma licença empresarial. A página de licença do projeto afirma claramente: “Os requisitos de marca aplicam-se apenas a implantações maiores (50+ usuários, no total)” e “qualquer pessoa ainda pode fazer um fork da v0.6.5 sem restrições”. Portanto: atualmente não é uma licença aprovada pela OSI, mas também não é um limite de uso — o limite controla o rebranding, não a execução.
| Item | Quanto custa | Fonte, verificada em 21 de setembro de 2026 |
|---|---|---|
| Open WebUI, auto-hospedado, com a marca intacta | $0 — listado como “Standard Use … Free” | Open WebUI for Enterprise |
| Aplicar white-label ou rebranding à interface | Licença empresarial obrigatória; nenhum valor publicado | Mesma página, mesma tabela |
| A própria licença empresarial | Cotado em particular com base na quantidade de assentos | “Informe a quantidade de usuários finais (assentos) da sua implantação” |
| Licença empresarial para uma pessoa física | Não vendido | “exclusivamente para entidades e organizações registradas … incapazes de atender usuários individuais” |
Open WebUI Computer (cptr), um produto diferente | $0 para sempre; $60 / assento / ano Supporter; Enterprise personalizado | openwebui.com/computer |
| Tokens do modelo | Tarifa por token do seu provedor | Cobrança do próprio provedor |
O que a licença empresarial concede, nas próprias palavras do projeto, é “White-labeling, rebranding, modifications to original branding, or enterprise-exclusive offerings like Terminals”. Terminals é documentado como a camada de orquestração do Open Terminal: ele provisiona um workspace separado — arquivos, processos, ambiente de pacotes, limites de recursos e limite de rede — por usuário, e é o exemplo nomeado de um recurso que a licença controla, além da marca. A “hospedagem do Open WebUI” gerenciada por fornecedores terceirizados é outra questão: trata-se de uma cobrança de servidor na infraestrutura de outra pessoa. Nenhum valor verificado para qualquer host gerenciado foi obtido para esta página — a única página de plano de fornecedor verificada exibe placeholders de preço em vez de números em uma busca simples — portanto nenhum é citado.
Duas perguntas diferentes estão ocultas em “custo da API do Open WebUI”
A consulta é genuinamente ambígua, e as duas partes têm respostas diferentes.
As chamadas de saída são as que custam dinheiro. O Open WebUI não oferece nenhum modelo próprio, portanto cada token é cobrado pelo endpoint que você configurou. A própria API do Open WebUI não custa nada: na tag lançada v0.11.3, backend/open_webui/main.py serve GET /api/models (L874), POST /api/chat/completions (L1085) e — mais recente e fácil de não perceber — um POST /api/v1/messages no formato do Anthropic (L1976), com POST /api/v1/messages/count_tokens ao lado (L1907). Você se autentica nesses endpoints com uma chave própria do Open WebUI, e não com a chave do seu provedor. O Open WebUI não cobra por eles porque são uma porta de entrada: cada solicitação ainda chega ao upstream que você configurou e é cobrada lá. Apontar seus próprios scripts para o Open WebUI em vez de para o provedor muda o roteamento, não a conta.
As chamadas faturáveis que você não digitou
Esta é a parte que uma comparação de tarifas não mostra. Lido na tag v0.11.3 em backend/open_webui/config.py, quatro geradores em segundo plano estão ativados por padrão e um está desativado.
| Configuração | Padrão na v0.11.3 | No que gasta |
|---|---|---|
ENABLE_TITLE_GENERATION (L2312) | Verdadeiro | Uma conclusão adicional por novo chat, para nomeá-lo |
ENABLE_TAGS_GENERATION (L2310) | Verdadeiro | Uma conclusão adicional por novo chat, para classificá-lo com uma tag |
ENABLE_RETRIEVAL_QUERY_GENERATION (L2317) | Verdadeiro | Uma conclusão adicional sempre que a recuperação é executada |
ENABLE_SEARCH_QUERY_GENERATION (L2315) | Verdadeiro | Uma conclusão adicional quando a busca na web é usada |
ENABLE_AUTOCOMPLETE_GENERATION (L2346) | Falso | Nada, a menos que você o ative |
TASK_MODEL / TASK_MODEL_EXTERNAL (L2193, L2195) | Vazio | Vazio significa que essas tarefas são executadas no seu modelo de chat |
Não foi medido para esta página quantos tokens adicionais isso representa na prática, e qualquer porcentagem que afirmasse o contrário seria inventada. O que pode ser verificado é o formato: as flags estão ativadas, o modelo de tarefas não está definido, portanto o tráfego de nomeação e classificação por tags é cobrado no modelo de chat que a conversa já estiver usando até que você informe um id barato em TASK_MODEL_EXTERNAL. O FAQ do próprio Open WebUI diz a mesma coisa — “Por padrão, essas tarefas usam o mesmo modelo com o qual você está conversando” — e recomenda a mesma correção. Duas configurações padrão funcionam no sentido oposto e vale a pena conhecê-las antes de fazer o orçamento: a busca na web está desativada (ENABLE_WEB_SEARCH, L1155) e a geração de imagens está desativada (ENABLE_IMAGE_GENERATION, L1336), enquanto o interpretador de código está ativado (L422).
Quatro subsistemas, quatro slots de endpoint — e um padrão que vale a pena ler duas vezes
A compatibilidade de chat não se estende ao restante do produto. Embeddings de recuperação, fala para texto, texto para fala e geração de imagens têm, cada um, seu próprio par de URL base e chave, e o fallback de cada um é o singular OPENAI_API_BASE_URL. Aqui está a parte que surpreende as pessoas: na tag v0.11.3, depois que a lista de conexões foi criada, a linha 365 de config.py reatribui OPENAI_API_BASE_URL = 'https://api.openai.com/v1' incondicionalmente. Portanto, todo padrão de subsistema avaliado posteriormente — RAG_OPENAI_API_BASE_URL (L1092), IMAGES_OPENAI_API_BASE_URL (L1490), AUDIO_STT_OPENAI_API_BASE_URL (L1565), AUDIO_TTS_OPENAI_API_BASE_URL (L1606) — resolve para o endpoint da OpenAI, independentemente da variável definida para o chat. Este é o padrão em nível de módulo lido no código-fonte; esses valores inicializam uma configuração persistida que a interface administrativa pode substituir, e o comportamento não foi reproduzido em uma instância em execução para esta página. A Issue #22084 descreve o mesmo sintoma; ela foi aberta em 1º de março de 2026 e agora está encerrada como concluída, portanto trate a leitura do código acima como o padrão em nível de módulo da v0.11.3, não como um bug aberto.
A boa notícia é que nenhum desses quatro slots gera gasto de API nas configurações padrão.
| Subsistema | Padrão na v0.11.3 | Custo padrão |
|---|---|---|
| Recuperação de documentos | RAG_EMBEDDING_ENGINE vazio (L996); modelo sentence-transformers/all-MiniLM-L6-v2 (L1002) | Nada em gasto de API — a etapa de embedding é executada localmente, na sua própria CPU e RAM |
| Fala para texto | AUDIO_STT_ENGINE vazio (L1571), Whisper local | Nada em gasto de API; computação local em vez disso |
| Texto para fala | AUDIO_TTS_ENGINE vazio (L1620) | Nada em gasto de API — com o mecanismo não definido, a própria rota /audio/speech do servidor responde 404 em vez de fazer uma chamada externa (routers/audio.py L559) |
| Geração de imagens | Desativado (L1336) | Nada até que você o ative e escolha um endpoint |
Kunavo não oferece embeddings, não oferece fala para texto e não oferece texto para fala.
Esse limite determina para quais desses slots você pode apontar um gateway: RAG_OPENAI_API_BASE_URL, AUDIO_STT_OPENAI_API_BASE_URL e AUDIO_TTS_OPENAI_API_BASE_URL não são slots para apontar para cá. Deixe a etapa de recuperação em seu padrão local — essa é tanto a configuração fornecida quanto a gratuita — ou envie-a para um provedor que ofereça essa etapa mediante cobrança. A única linha da sua conta de recuperação que chega a um provedor de chat é o próprio texto recuperado, que chega como tokens de entrada comuns dentro do próximo prompt. Implementação de RAG explica como o tamanho dos chunks e o top-k se transformam nessa contagem de entrada.
# The chat connection. This is the only slot the setup guides cover.
OPENAI_API_BASE_URL=https://api.kunavo.com/v1
OPENAI_API_KEY=sk-kn-...
# Titles, tags and retrieval queries run on the CHAT model unless you say
# otherwise. TASK_MODEL_EXTERNAL defaults to empty (config.py L2195).
TASK_MODEL_EXTERNAL=claude-haiku-4-5
# Leave the document-embedding step alone: empty means local, and local
# means no API spend at all (config.py L996 and L1002).
RAG_EMBEDDING_ENGINE=
RAG_EMBEDDING_MODEL=sentence-transformers/all-MiniLM-L6-v2Uma estimativa calculada para um dia de chat
Isto é uma aritmética ilustrativa de tokens, não um custo medido nem um teto de cobrança. Suponha o dia de trabalho de uma pessoa na janela de chat: 40 turnos do assistente, cada um enviando 6.000 tokens de entrada não armazenados em cache (o histórico visível mais quaisquer chunks recuperados) e retornando 700 tokens de saída — 240.000 tokens de entrada e 28.000 de saída no total. Suponha 8 novos chats nesse dia e que os geradores padrão de título, tag e consulta de recuperação do Open WebUI façam três chamadas adicionais por chat, com 2.000 tokens de entrada e 40 de saída cada. Esse tamanho por chamada é uma suposição; não foi medido. As tarifas são os preços atuais do catálogo da Kunavo por milhão de tokens.
| Modelo | Entrada / saída por 1M | 40 turnos de chat | Tarefas em segundo plano | Total do dia |
|---|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.266 | $0.037 | $0.303 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.286 | $0.038 | $0.323 |
| Claude Sonnet 4.6 | $2.10 / $10.50 | $0.798 | $0.111 | $0.909 |
| Claude Sonnet 5 | $1.40 / $7.00 | $0.532 | $0.074 | $0.606 |
Leia a última coluna, não a coluna de chat. Sob essas suposições, o tráfego em segundo plano representa cerca de 12% de um dia de Claude Sonnet 5 — $0.074 de $0.606 — gastos na nomeação e classificação dos chats. Definir TASK_MODEL_EXTERNAL como Claude Haiku 4.5 reduz essa parcela para $0.037 e o total do dia para $0.569, sem alterar o que alguém realmente lê. Essa única configuração altera mais essa conta do que trocar de provedor dentro do mesmo nível.
Escale pela sua própria quantidade de pessoas e dias antes de tratar isso como um orçamento, e observe o que a aritmética exclui: cache de prompts, geração de imagens ou vídeos e qualquer ferramenta chamada pelo interpretador de código. O valor do catálogo da Kunavo é um piso de cobrança, não um teto — quando o upstream informa sua cobrança, a conta é o maior valor entre o custo do catálogo e o custo do upstream multiplicado pelo markup aplicável. O recarregamento mínimo da Kunavo é $10 em crédito pré-pago, o que é um mínimo de financiamento, não uma assinatura nem uma tarifa por assento. Consulte detalhes de cobrança e uso para o registro por solicitação. O Open WebUI também informa sua própria visão: o README da v0.11.3 descreve painéis administrativos que “acompanham o volume de mensagens, o consumo de tokens e o custo entre usuários e modelos”. Esse recurso não foi utilizado para esta página, e dois medidores que contam o mesmo tráfego não vão concordar token a token; portanto, faça a conciliação com o lado que você está efetivamente financiando.
Qual rota vence e quando
| Opção | Vantagens | O que você abre mão |
|---|---|---|
| API direta do fornecedor | Os modelos de um fornecedor cobrem tudo o que seus usuários fazem | Uma segunda família significa uma segunda conexão, uma segunda chave e um segundo saldo para acompanhar |
| Gateway (Kunavo e suas alternativas) | Você quer várias famílias em um único seletor por trás de uma única chave, com os preços por modelo visíveis em um só lugar | Uma camada entre você e o fornecedor; extras específicos do fornecedor, como o cache nativo de prompts, comportam-se de forma diferente em cada gateway e vale a pena testá-los antes de depender deles |
| Modelo local via Ollama ou llama.cpp | Trabalho privado ou de baixo risco, sem cobrança por solicitação, e o Open WebUI documenta ambos nativamente | Hardware e uma lacuna de capacidade em comparação com modelos de fronteira hospedados; recuperação e históricos longos ficam caros em RAM, não em dólares |
| Uma assinatura de chat para consumidores | Você quer principalmente o produto próprio de um fornecedor | Não conecta: o Open WebUI precisa de um endpoint de API, e uma assinatura de chat não é um |
| Hospedagem gerenciada do Open WebUI | Você não quer executar o contêiner | Uma cobrança de servidor além da cobrança de tokens, e nenhum preço é citado nesta página porque não foi possível verificar nenhum |
Um detalhe de protocolo determina a configuração mais do que a escolha do fornecedor. O Open WebUI é explicitamente orientado a protocolos — implementa o protocolo OpenAI Chat Completions e se recusa a adicionar APIs específicas de provedores ao núcleo — portanto, o que você deve fornecer é uma raiz /v1 no formato da OpenAI, mesmo para modelos Claude. A própria página do Anthropic configura https://api.anthropic.com/v1 como uma conexão OpenAI e repassa o alerta do Anthropic de que a camada de compatibilidade destina-se a testes, não à produção. Há também um seletor de API Type por conexão para Open Responses, que a documentação identifica como experimental e alerta que “pode não funcionar conforme o esperado com todos os provedores”. A Kunavo oferece uma rota no formato Responses, mas essa combinação não foi testada em runtime para esta página; portanto, trate o caminho de chat completions como o conhecido por funcionar e o seletor como algo a experimentar em uma conexão separada.
Comparando a própria interface, e não o provedor? LibreChat vs Open WebUI e AnythingLLM vs Open WebUI abordam essa escolha, e melhor gateway de LLM compara a camada de gateway com base em tarifas e condições de financiamento, não na profundidade da integração.
Configure e depois verifique a cobrança do primeiro dia
A conexão fica em Settings → Admin → Connections → “Manage OpenAI API Connections” → “Add Connection”, com uma URL e um campo API Key; a mesma coisa pode ser feita com as duas variáveis de ambiente acima na inicialização do contêiner. Mantenha o /v1 na URL — o Open WebUI acrescenta a rota por conta própria, e o código-fonte remove uma barra final.
Vale a pena conhecer antecipadamente um modo de falha, porque ele parece uma integração inativa, mas não é. A própria documentação do Open WebUI afirma que salvar uma conexão não a testa, que o botão Verify chama o endpoint /models do provedor e que, se essa chamada falhar, “isso não significa que o provedor seja incompatível: as conclusões de chat ainda funcionarão” — você deve digitar os ids dos modelos na lista de permissões Model IDs por conexão. Preencher essa lista vale a pena de qualquer forma: em um catálogo com modelos de imagem, vídeo e música, um filtro vazio coloca no seletor modelos que uma janela de chat não consegue chamar.
A Kunavo publica um guia de configuração para este cliente. Trata-se de uma referência de configuração publicada, não de um teste de compatibilidade — o Open WebUI não foi testado em runtime aqui contra o endpoint da Kunavo, e tudo acima foi lido no código-fonte lançado do Open WebUI e em sua própria documentação. Mantenha uma rota funcional disponível enquanto experimenta, execute um dia limitado e depois leia o que sua conta realmente registrou. Comece pelo guia de integração do Open WebUI e crie uma conta Kunavo quando estiver pronto para financiar uma chave.
Perguntas frequentes
Quanto custa o Open WebUI?
O software é gratuito e não há uma lista de preços para consultar: openwebui.com/pricing e openwebui.com/enterprise retornam 404, e a própria linha de instalação da página inicial é "pip install open-webui / Um comando. 60 segundos. Nenhuma conta necessária." (verificado em 19 de setembro de 2026). Não há limite de assentos nem de solicitações ao executá-lo. O que você realmente paga é a máquina em que ele roda, os tokens de modelo que envia e — se quiser remover a marca do Open WebUI ou desejar um complemento exclusivo da edição empresarial, como Terminals — uma licença empresarial, cujo valor não é publicado e é cotado pelo projeto depois que você envia a quantidade de assentos.
O Open WebUI tem uma página de preços ou um preço empresarial publicado?
Não. A documentação empresarial pede que você envie a quantidade de usuários finais (assentos) e afirma que as licenças empresariais estão disponíveis exclusivamente para entidades e organizações registradas, não para usuários individuais. Nenhum valor em dólares aparece em qualquer página oficial do Open WebUI. Provedores de hospedagem terceirizados e sites de conteúdo publicam tabelas de planos e valores anuais para "preços do Open WebUI" que o próprio projeto não publica; trate-os como conteúdo dos fornecedores. Um domínio separado de aparência semelhante, openwebui.net, vende um plano "Pro" de $19 por mês para um aplicativo que chama de "NextChat"; ele não é openwebui.com e não é operado pelo projeto.
Preciso de uma licença empresarial para executar o Open WebUI para mais de 50 usuários?
Não de acordo com a própria tabela empresarial do projeto, que lista Standard Use — uso interno com a marca original intacta — como gratuito e exige uma licença empresarial apenas para white-label, rebranding ou ofertas exclusivas para empresas. O limite de cinquenta usuários está na cláusula 4 da LICENSE e controla uma única coisa: se você pode alterar, remover, ocultar ou substituir a marca do Open WebUI sem permissão, em qualquer período móvel de trinta dias. Leia o texto da licença antes de uma implantação de grande porte; isto é um resumo, não aconselhamento jurídico.
Qual é a melhor API para o Open WebUI?
Depende de quantos fornecedores você quer no seletor. O Open WebUI não oferece nenhum modelo próprio e não impõe uma lista de fornecedores permitidos, portanto todas as rotas estão abertas: uma API direta de fornecedor é a melhor opção quando os modelos de um fornecedor cobrem tudo o que você faz e você quer o cache e os termos de processamento em lote desse fornecedor; um gateway é melhor quando uma conexão deve expor várias famílias ao seletor de modelos usando uma única chave e um único saldo; um servidor local por meio do Ollama ou do llama.cpp é melhor para trabalho privado ou de baixo risco, sem cobrança por solicitação. Uma API direta de fornecedor e um gateway exigem a mesma quantidade de configuração — o formulário de conexão compatível com OpenAI do Open WebUI recebe uma URL e uma chave de API em ambos os casos. Um servidor local é diferente: você também precisa instalá-lo e executá-lo, e o Open WebUI documenta o Ollama e o llama.cpp em suas próprias páginas de conexão.
Qual é a API mais barata para o Open WebUI?
A tarifa mais baixa anunciada e a forma mais barata de obter a resposta são questões diferentes. Uma interface de chat cobra todo o histórico visível a cada turno, portanto uma conversa longa em um modelo de tarifa baixa pode custar mais do que uma curta em um modelo de tarifa alta, e um modelo que exige uma segunda tentativa custa o dobro. Três configurações afetam a conta do chat mais do que a tabela de tarifas: qual modelo executa a geração padrão de título, tag e consulta de recuperação, quanto texto dos documentos recuperados é inserido em cada prompt e por quanto tempo você permite que um histórico cresça antes de iniciar um novo. Corrija isso primeiro e depois compare as tarifas.
Qual é o melhor modelo para o Open WebUI?
Escolha com base no que a janela realmente está fazendo, e não na posição em benchmarks. Documentos longos colados e históricos com RAG precisam de uma janela de contexto grande e de uma tarifa de entrada baixa, porque a entrada é a classe de tokens que uma interface de chat mais consome. O uso de ferramentas e o interpretador de código integrado exigem um modelo cuja chamada de funções seja confiável no endpoint exato que você está usando — a documentação do próprio Open WebUI sobre provedores alerta que o endpoint compatível com OpenAI do Google descarta chamadas de ferramentas transmitidas em streaming, o que é uma propriedade desse endpoint, não do modelo. A visão é importante se as pessoas colarem capturas de tela. Uma configuração sensata é usar duas conexões: um modelo barato como padrão e um modelo potente para o qual as pessoas possam alternar.
O Open WebUI é a mesma coisa que o text-generation-webui?
Não. Open WebUI é open-webui/open-webui, mantido pela Open WebUI Inc., com v0.11.3 como sua versão mais recente. O text-generation-webui da oobabooga é outro projeto, de outro mantenedor, agora renomeado como TextGen e transferido para github.com/oobabooga/textgen. Ambos expõem APIs compatíveis com OpenAI, portanto um trecho de configuração de um parece plausível no outro, mas não é intercambiável.
As páginas do Open WebUI, o repositório, o histórico de commits e o pacote foram verificados em 19 de setembro e novamente em 21 de setembro de 2026; os 404 em openwebui.com/pricing e openwebui.com/enterprise foram obtidos diretamente, e todos os padrões de configuração citados foram lidos na tag lançada v0.11.3, e não em main. Não verificado: preços de hospedagem gerenciada, qualquer valor empresarial em dólares, o overhead de tokens das tarefas padrão em segundo plano, os próprios painéis de uso do Open WebUI e qualquer execução de ponta a ponta do Open WebUI contra a Kunavo. As tarifas de tokens da Kunavo vêm do catálogo atual, e todo exemplo em dólares aqui é uma aritmética ilustrativa de tokens.