Voltar aos guias
Preços·21 de setembro de 2026·Atualizado em 24 de setembro de 2026·9 min de leitura

Preços do Open WebUI: quanto o software custa e quanto custam os tokens

O Open WebUI não tem lista de preços. Separe o software auto-hospedado gratuito da cláusula de licença que restringe o rebranding, e ambos dos custos da máquina e dos tokens do modelo que você realmente paga.

Última revisão em .

O Open WebUI não publica nenhuma lista de preços: openwebui.com/pricing e openwebui.com/enterprise retornam 404, e a interface de chat é gratuita para auto-hospedagem, sem limite de assentos e sem limite de solicitações. O que uma licença empresarial controla é a remoção da marca do Open WebUI e de complementos exclusivos para empresas, como Terminals, não o número de pessoas que o utilizam. Os números de que um comprador realmente precisa são os três pelos quais o projeto não cobra — a máquina, os tokens do modelo e as configurações dentro do Open WebUI que enviam silenciosamente tokens que você não digitou. Os três aparecem abaixo, com fontes e datas de verificação.

Três preços incorretos circulam para esta consulta, então vamos esclarecê-los primeiro. $60 por assento por ano é real e oficial, mas corresponde ao nível Supporter do Open WebUI Computer — o pacote cptr, um produto separado da mesma equipe, sob uma licença diferente, cujo próprio nível gratuito informa “$0 para sempre”. Um valor empresarial anual atribuído ao Open WebUI nos resultados de busca vem de um fornecedor de hospedagem terceirizado e não aparece em nenhuma página oficial, portanto não é repetido aqui. E um plano “Pro” de $19 por mês pertence ao openwebui.net — um domínio parecido que não é openwebui.com e cujo aplicativo é identificado como “NextChat” em seu próprio texto (verificado em 21 de setembro de 2026). Ele é mencionado aqui para que você o reconheça e deliberadamente não é vinculado.

Quanto o software custa e o que a licença realmente controla

A página inicial do projeto vende a instalação, não um plano: “pip install open-webui / Um comando. 60 segundos. Nenhuma conta necessária.” O repositório está ativo e não arquivado, e seu commit mais recente em main é datado de 4 de setembro de 2026. A versão atual é v0.11.3, cujos arquivos foram publicados no PyPI em 31 de agosto de 2026. Observe uma divergência oficial: o cartão do blog na página inicial ainda destaca a v0.11.1 de 25 de agosto. Essa é uma publicação de blog, não um banner de versão; GitHub Releases é a fonte definitiva da versão.

A licença exige o mesmo cuidado. O GitHub a informa como NOASSERTION / “Other”, enquanto textos de terceiros frequentemente ainda a chamam de BSD-3. Ambos estão parcialmente certos. O arquivo LICENSE contém o texto BSD-3 mais uma quarta cláusula, introduzida na v0.6.6, que proíbe alterar, remover, ocultar ou substituir a marca do Open WebUI, exceto quando “o número total de usuários finais … não exceder cinquenta (50) em qualquer período móvel de 30 dias”, quando você tiver permissão por escrito ou quando possuir uma licença empresarial. A página de licença do projeto afirma claramente: “Os requisitos de marca aplicam-se apenas a implantações maiores (50+ usuários, no total)” e “qualquer pessoa ainda pode fazer um fork da v0.6.5 sem restrições”. Portanto: atualmente não é uma licença aprovada pela OSI, mas também não é um limite de uso — o limite controla o rebranding, não a execução.

ItemQuanto custaFonte, verificada em 21 de setembro de 2026
Open WebUI, auto-hospedado, com a marca intacta$0 — listado como “Standard Use … Free”Open WebUI for Enterprise
Aplicar white-label ou rebranding à interfaceLicença empresarial obrigatória; nenhum valor publicadoMesma página, mesma tabela
A própria licença empresarialCotado em particular com base na quantidade de assentos“Informe a quantidade de usuários finais (assentos) da sua implantação”
Licença empresarial para uma pessoa físicaNão vendido“exclusivamente para entidades e organizações registradas … incapazes de atender usuários individuais”
Open WebUI Computer (cptr), um produto diferente$0 para sempre; $60 / assento / ano Supporter; Enterprise personalizadoopenwebui.com/computer
Tokens do modeloTarifa por token do seu provedorCobrança do próprio provedor

O que a licença empresarial concede, nas próprias palavras do projeto, é “White-labeling, rebranding, modifications to original branding, or enterprise-exclusive offerings like Terminals”. Terminals é documentado como a camada de orquestração do Open Terminal: ele provisiona um workspace separado — arquivos, processos, ambiente de pacotes, limites de recursos e limite de rede — por usuário, e é o exemplo nomeado de um recurso que a licença controla, além da marca. A “hospedagem do Open WebUI” gerenciada por fornecedores terceirizados é outra questão: trata-se de uma cobrança de servidor na infraestrutura de outra pessoa. Nenhum valor verificado para qualquer host gerenciado foi obtido para esta página — a única página de plano de fornecedor verificada exibe placeholders de preço em vez de números em uma busca simples — portanto nenhum é citado.

Duas perguntas diferentes estão ocultas em “custo da API do Open WebUI”

A consulta é genuinamente ambígua, e as duas partes têm respostas diferentes.

As chamadas de saída são as que custam dinheiro. O Open WebUI não oferece nenhum modelo próprio, portanto cada token é cobrado pelo endpoint que você configurou. A própria API do Open WebUI não custa nada: na tag lançada v0.11.3, backend/open_webui/main.py serve GET /api/models (L874), POST /api/chat/completions (L1085) e — mais recente e fácil de não perceber — um POST /api/v1/messages no formato do Anthropic (L1976), com POST /api/v1/messages/count_tokens ao lado (L1907). Você se autentica nesses endpoints com uma chave própria do Open WebUI, e não com a chave do seu provedor. O Open WebUI não cobra por eles porque são uma porta de entrada: cada solicitação ainda chega ao upstream que você configurou e é cobrada lá. Apontar seus próprios scripts para o Open WebUI em vez de para o provedor muda o roteamento, não a conta.

As chamadas faturáveis que você não digitou

Esta é a parte que uma comparação de tarifas não mostra. Lido na tag v0.11.3 em backend/open_webui/config.py, quatro geradores em segundo plano estão ativados por padrão e um está desativado.

ConfiguraçãoPadrão na v0.11.3No que gasta
ENABLE_TITLE_GENERATION (L2312)VerdadeiroUma conclusão adicional por novo chat, para nomeá-lo
ENABLE_TAGS_GENERATION (L2310)VerdadeiroUma conclusão adicional por novo chat, para classificá-lo com uma tag
ENABLE_RETRIEVAL_QUERY_GENERATION (L2317)VerdadeiroUma conclusão adicional sempre que a recuperação é executada
ENABLE_SEARCH_QUERY_GENERATION (L2315)VerdadeiroUma conclusão adicional quando a busca na web é usada
ENABLE_AUTOCOMPLETE_GENERATION (L2346)FalsoNada, a menos que você o ative
TASK_MODEL / TASK_MODEL_EXTERNAL (L2193, L2195)VazioVazio significa que essas tarefas são executadas no seu modelo de chat

Não foi medido para esta página quantos tokens adicionais isso representa na prática, e qualquer porcentagem que afirmasse o contrário seria inventada. O que pode ser verificado é o formato: as flags estão ativadas, o modelo de tarefas não está definido, portanto o tráfego de nomeação e classificação por tags é cobrado no modelo de chat que a conversa já estiver usando até que você informe um id barato em TASK_MODEL_EXTERNAL. O FAQ do próprio Open WebUI diz a mesma coisa — “Por padrão, essas tarefas usam o mesmo modelo com o qual você está conversando” — e recomenda a mesma correção. Duas configurações padrão funcionam no sentido oposto e vale a pena conhecê-las antes de fazer o orçamento: a busca na web está desativada (ENABLE_WEB_SEARCH, L1155) e a geração de imagens está desativada (ENABLE_IMAGE_GENERATION, L1336), enquanto o interpretador de código está ativado (L422).

Quatro subsistemas, quatro slots de endpoint — e um padrão que vale a pena ler duas vezes

A compatibilidade de chat não se estende ao restante do produto. Embeddings de recuperação, fala para texto, texto para fala e geração de imagens têm, cada um, seu próprio par de URL base e chave, e o fallback de cada um é o singular OPENAI_API_BASE_URL. Aqui está a parte que surpreende as pessoas: na tag v0.11.3, depois que a lista de conexões foi criada, a linha 365 de config.py reatribui OPENAI_API_BASE_URL = 'https://api.openai.com/v1' incondicionalmente. Portanto, todo padrão de subsistema avaliado posteriormente — RAG_OPENAI_API_BASE_URL (L1092), IMAGES_OPENAI_API_BASE_URL (L1490), AUDIO_STT_OPENAI_API_BASE_URL (L1565), AUDIO_TTS_OPENAI_API_BASE_URL (L1606) — resolve para o endpoint da OpenAI, independentemente da variável definida para o chat. Este é o padrão em nível de módulo lido no código-fonte; esses valores inicializam uma configuração persistida que a interface administrativa pode substituir, e o comportamento não foi reproduzido em uma instância em execução para esta página. A Issue #22084 descreve o mesmo sintoma; ela foi aberta em 1º de março de 2026 e agora está encerrada como concluída, portanto trate a leitura do código acima como o padrão em nível de módulo da v0.11.3, não como um bug aberto.

A boa notícia é que nenhum desses quatro slots gera gasto de API nas configurações padrão.

SubsistemaPadrão na v0.11.3Custo padrão
Recuperação de documentosRAG_EMBEDDING_ENGINE vazio (L996); modelo sentence-transformers/all-MiniLM-L6-v2 (L1002)Nada em gasto de API — a etapa de embedding é executada localmente, na sua própria CPU e RAM
Fala para textoAUDIO_STT_ENGINE vazio (L1571), Whisper localNada em gasto de API; computação local em vez disso
Texto para falaAUDIO_TTS_ENGINE vazio (L1620)Nada em gasto de API — com o mecanismo não definido, a própria rota /audio/speech do servidor responde 404 em vez de fazer uma chamada externa (routers/audio.py L559)
Geração de imagensDesativado (L1336)Nada até que você o ative e escolha um endpoint

Kunavo não oferece embeddings, não oferece fala para texto e não oferece texto para fala.

Esse limite determina para quais desses slots você pode apontar um gateway: RAG_OPENAI_API_BASE_URL, AUDIO_STT_OPENAI_API_BASE_URL e AUDIO_TTS_OPENAI_API_BASE_URL não são slots para apontar para cá. Deixe a etapa de recuperação em seu padrão local — essa é tanto a configuração fornecida quanto a gratuita — ou envie-a para um provedor que ofereça essa etapa mediante cobrança. A única linha da sua conta de recuperação que chega a um provedor de chat é o próprio texto recuperado, que chega como tokens de entrada comuns dentro do próximo prompt. Implementação de RAG explica como o tamanho dos chunks e o top-k se transformam nessa contagem de entrada.

Ambiente do Open WebUI
# The chat connection. This is the only slot the setup guides cover.
OPENAI_API_BASE_URL=https://api.kunavo.com/v1
OPENAI_API_KEY=sk-kn-...

# Titles, tags and retrieval queries run on the CHAT model unless you say
# otherwise. TASK_MODEL_EXTERNAL defaults to empty (config.py L2195).
TASK_MODEL_EXTERNAL=claude-haiku-4-5

# Leave the document-embedding step alone: empty means local, and local
# means no API spend at all (config.py L996 and L1002).
RAG_EMBEDDING_ENGINE=
RAG_EMBEDDING_MODEL=sentence-transformers/all-MiniLM-L6-v2

Uma estimativa calculada para um dia de chat

Isto é uma aritmética ilustrativa de tokens, não um custo medido nem um teto de cobrança. Suponha o dia de trabalho de uma pessoa na janela de chat: 40 turnos do assistente, cada um enviando 6.000 tokens de entrada não armazenados em cache (o histórico visível mais quaisquer chunks recuperados) e retornando 700 tokens de saída — 240.000 tokens de entrada e 28.000 de saída no total. Suponha 8 novos chats nesse dia e que os geradores padrão de título, tag e consulta de recuperação do Open WebUI façam três chamadas adicionais por chat, com 2.000 tokens de entrada e 40 de saída cada. Esse tamanho por chamada é uma suposição; não foi medido. As tarifas são os preços atuais do catálogo da Kunavo por milhão de tokens.

ModeloEntrada / saída por 1M40 turnos de chatTarefas em segundo planoTotal do dia
Claude Haiku 4.5$0.70 / $3.50$0.266$0.037$0.303
GPT-5.6 Terra$0.70 / $4.20$0.286$0.038$0.323
Claude Sonnet 4.6$2.10 / $10.50$0.798$0.111$0.909
Claude Sonnet 5$1.40 / $7.00$0.532$0.074$0.606

Leia a última coluna, não a coluna de chat. Sob essas suposições, o tráfego em segundo plano representa cerca de 12% de um dia de Claude Sonnet 5 — $0.074 de $0.606 — gastos na nomeação e classificação dos chats. Definir TASK_MODEL_EXTERNAL como Claude Haiku 4.5 reduz essa parcela para $0.037 e o total do dia para $0.569, sem alterar o que alguém realmente lê. Essa única configuração altera mais essa conta do que trocar de provedor dentro do mesmo nível.

Escale pela sua própria quantidade de pessoas e dias antes de tratar isso como um orçamento, e observe o que a aritmética exclui: cache de prompts, geração de imagens ou vídeos e qualquer ferramenta chamada pelo interpretador de código. O valor do catálogo da Kunavo é um piso de cobrança, não um teto — quando o upstream informa sua cobrança, a conta é o maior valor entre o custo do catálogo e o custo do upstream multiplicado pelo markup aplicável. O recarregamento mínimo da Kunavo é $10 em crédito pré-pago, o que é um mínimo de financiamento, não uma assinatura nem uma tarifa por assento. Consulte detalhes de cobrança e uso para o registro por solicitação. O Open WebUI também informa sua própria visão: o README da v0.11.3 descreve painéis administrativos que “acompanham o volume de mensagens, o consumo de tokens e o custo entre usuários e modelos”. Esse recurso não foi utilizado para esta página, e dois medidores que contam o mesmo tráfego não vão concordar token a token; portanto, faça a conciliação com o lado que você está efetivamente financiando.

Qual rota vence e quando

OpçãoVantagensO que você abre mão
API direta do fornecedorOs modelos de um fornecedor cobrem tudo o que seus usuários fazemUma segunda família significa uma segunda conexão, uma segunda chave e um segundo saldo para acompanhar
Gateway (Kunavo e suas alternativas)Você quer várias famílias em um único seletor por trás de uma única chave, com os preços por modelo visíveis em um só lugarUma camada entre você e o fornecedor; extras específicos do fornecedor, como o cache nativo de prompts, comportam-se de forma diferente em cada gateway e vale a pena testá-los antes de depender deles
Modelo local via Ollama ou llama.cppTrabalho privado ou de baixo risco, sem cobrança por solicitação, e o Open WebUI documenta ambos nativamenteHardware e uma lacuna de capacidade em comparação com modelos de fronteira hospedados; recuperação e históricos longos ficam caros em RAM, não em dólares
Uma assinatura de chat para consumidoresVocê quer principalmente o produto próprio de um fornecedorNão conecta: o Open WebUI precisa de um endpoint de API, e uma assinatura de chat não é um
Hospedagem gerenciada do Open WebUIVocê não quer executar o contêinerUma cobrança de servidor além da cobrança de tokens, e nenhum preço é citado nesta página porque não foi possível verificar nenhum

Um detalhe de protocolo determina a configuração mais do que a escolha do fornecedor. O Open WebUI é explicitamente orientado a protocolos — implementa o protocolo OpenAI Chat Completions e se recusa a adicionar APIs específicas de provedores ao núcleo — portanto, o que você deve fornecer é uma raiz /v1 no formato da OpenAI, mesmo para modelos Claude. A própria página do Anthropic configura https://api.anthropic.com/v1 como uma conexão OpenAI e repassa o alerta do Anthropic de que a camada de compatibilidade destina-se a testes, não à produção. Há também um seletor de API Type por conexão para Open Responses, que a documentação identifica como experimental e alerta que “pode não funcionar conforme o esperado com todos os provedores”. A Kunavo oferece uma rota no formato Responses, mas essa combinação não foi testada em runtime para esta página; portanto, trate o caminho de chat completions como o conhecido por funcionar e o seletor como algo a experimentar em uma conexão separada.

Comparando a própria interface, e não o provedor? LibreChat vs Open WebUI e AnythingLLM vs Open WebUI abordam essa escolha, e melhor gateway de LLM compara a camada de gateway com base em tarifas e condições de financiamento, não na profundidade da integração.

Configure e depois verifique a cobrança do primeiro dia

A conexão fica em Settings → Admin → Connections → “Manage OpenAI API Connections” → “Add Connection”, com uma URL e um campo API Key; a mesma coisa pode ser feita com as duas variáveis de ambiente acima na inicialização do contêiner. Mantenha o /v1 na URL — o Open WebUI acrescenta a rota por conta própria, e o código-fonte remove uma barra final.

Vale a pena conhecer antecipadamente um modo de falha, porque ele parece uma integração inativa, mas não é. A própria documentação do Open WebUI afirma que salvar uma conexão não a testa, que o botão Verify chama o endpoint /models do provedor e que, se essa chamada falhar, “isso não significa que o provedor seja incompatível: as conclusões de chat ainda funcionarão” — você deve digitar os ids dos modelos na lista de permissões Model IDs por conexão. Preencher essa lista vale a pena de qualquer forma: em um catálogo com modelos de imagem, vídeo e música, um filtro vazio coloca no seletor modelos que uma janela de chat não consegue chamar.

A Kunavo publica um guia de configuração para este cliente. Trata-se de uma referência de configuração publicada, não de um teste de compatibilidade — o Open WebUI não foi testado em runtime aqui contra o endpoint da Kunavo, e tudo acima foi lido no código-fonte lançado do Open WebUI e em sua própria documentação. Mantenha uma rota funcional disponível enquanto experimenta, execute um dia limitado e depois leia o que sua conta realmente registrou. Comece pelo guia de integração do Open WebUI e crie uma conta Kunavo quando estiver pronto para financiar uma chave.

Perguntas frequentes

Quanto custa o Open WebUI?

O software é gratuito e não há uma lista de preços para consultar: openwebui.com/pricing e openwebui.com/enterprise retornam 404, e a própria linha de instalação da página inicial é "pip install open-webui / Um comando. 60 segundos. Nenhuma conta necessária." (verificado em 19 de setembro de 2026). Não há limite de assentos nem de solicitações ao executá-lo. O que você realmente paga é a máquina em que ele roda, os tokens de modelo que envia e — se quiser remover a marca do Open WebUI ou desejar um complemento exclusivo da edição empresarial, como Terminals — uma licença empresarial, cujo valor não é publicado e é cotado pelo projeto depois que você envia a quantidade de assentos.

O Open WebUI tem uma página de preços ou um preço empresarial publicado?

Não. A documentação empresarial pede que você envie a quantidade de usuários finais (assentos) e afirma que as licenças empresariais estão disponíveis exclusivamente para entidades e organizações registradas, não para usuários individuais. Nenhum valor em dólares aparece em qualquer página oficial do Open WebUI. Provedores de hospedagem terceirizados e sites de conteúdo publicam tabelas de planos e valores anuais para "preços do Open WebUI" que o próprio projeto não publica; trate-os como conteúdo dos fornecedores. Um domínio separado de aparência semelhante, openwebui.net, vende um plano "Pro" de $19 por mês para um aplicativo que chama de "NextChat"; ele não é openwebui.com e não é operado pelo projeto.

Preciso de uma licença empresarial para executar o Open WebUI para mais de 50 usuários?

Não de acordo com a própria tabela empresarial do projeto, que lista Standard Use — uso interno com a marca original intacta — como gratuito e exige uma licença empresarial apenas para white-label, rebranding ou ofertas exclusivas para empresas. O limite de cinquenta usuários está na cláusula 4 da LICENSE e controla uma única coisa: se você pode alterar, remover, ocultar ou substituir a marca do Open WebUI sem permissão, em qualquer período móvel de trinta dias. Leia o texto da licença antes de uma implantação de grande porte; isto é um resumo, não aconselhamento jurídico.

Qual é a melhor API para o Open WebUI?

Depende de quantos fornecedores você quer no seletor. O Open WebUI não oferece nenhum modelo próprio e não impõe uma lista de fornecedores permitidos, portanto todas as rotas estão abertas: uma API direta de fornecedor é a melhor opção quando os modelos de um fornecedor cobrem tudo o que você faz e você quer o cache e os termos de processamento em lote desse fornecedor; um gateway é melhor quando uma conexão deve expor várias famílias ao seletor de modelos usando uma única chave e um único saldo; um servidor local por meio do Ollama ou do llama.cpp é melhor para trabalho privado ou de baixo risco, sem cobrança por solicitação. Uma API direta de fornecedor e um gateway exigem a mesma quantidade de configuração — o formulário de conexão compatível com OpenAI do Open WebUI recebe uma URL e uma chave de API em ambos os casos. Um servidor local é diferente: você também precisa instalá-lo e executá-lo, e o Open WebUI documenta o Ollama e o llama.cpp em suas próprias páginas de conexão.

Qual é a API mais barata para o Open WebUI?

A tarifa mais baixa anunciada e a forma mais barata de obter a resposta são questões diferentes. Uma interface de chat cobra todo o histórico visível a cada turno, portanto uma conversa longa em um modelo de tarifa baixa pode custar mais do que uma curta em um modelo de tarifa alta, e um modelo que exige uma segunda tentativa custa o dobro. Três configurações afetam a conta do chat mais do que a tabela de tarifas: qual modelo executa a geração padrão de título, tag e consulta de recuperação, quanto texto dos documentos recuperados é inserido em cada prompt e por quanto tempo você permite que um histórico cresça antes de iniciar um novo. Corrija isso primeiro e depois compare as tarifas.

Qual é o melhor modelo para o Open WebUI?

Escolha com base no que a janela realmente está fazendo, e não na posição em benchmarks. Documentos longos colados e históricos com RAG precisam de uma janela de contexto grande e de uma tarifa de entrada baixa, porque a entrada é a classe de tokens que uma interface de chat mais consome. O uso de ferramentas e o interpretador de código integrado exigem um modelo cuja chamada de funções seja confiável no endpoint exato que você está usando — a documentação do próprio Open WebUI sobre provedores alerta que o endpoint compatível com OpenAI do Google descarta chamadas de ferramentas transmitidas em streaming, o que é uma propriedade desse endpoint, não do modelo. A visão é importante se as pessoas colarem capturas de tela. Uma configuração sensata é usar duas conexões: um modelo barato como padrão e um modelo potente para o qual as pessoas possam alternar.

O Open WebUI é a mesma coisa que o text-generation-webui?

Não. Open WebUI é open-webui/open-webui, mantido pela Open WebUI Inc., com v0.11.3 como sua versão mais recente. O text-generation-webui da oobabooga é outro projeto, de outro mantenedor, agora renomeado como TextGen e transferido para github.com/oobabooga/textgen. Ambos expõem APIs compatíveis com OpenAI, portanto um trecho de configuração de um parece plausível no outro, mas não é intercambiável.

As páginas do Open WebUI, o repositório, o histórico de commits e o pacote foram verificados em 19 de setembro e novamente em 21 de setembro de 2026; os 404 em openwebui.com/pricing e openwebui.com/enterprise foram obtidos diretamente, e todos os padrões de configuração citados foram lidos na tag lançada v0.11.3, e não em main. Não verificado: preços de hospedagem gerenciada, qualquer valor empresarial em dólares, o overhead de tokens das tarefas padrão em segundo plano, os próprios painéis de uso do Open WebUI e qualquer execução de ponta a ponta do Open WebUI contra a Kunavo. As tarifas de tokens da Kunavo vêm do catálogo atual, e todo exemplo em dólares aqui é uma aritmética ilustrativa de tokens.