Zurück zu den Leitfäden
Preise·21. September 2026·Aktualisiert am 24. September 2026·9 Min. Lesezeit

Open-WebUI-Preise: Was die Software kostet und was die Tokens kosten

Open WebUI hat keine Preisliste. Trennen Sie die kostenlose selbst gehostete Software von der Lizenzklausel, die Rebranding beschränkt, und beide wiederum von den Kosten für den Rechner und die Modelltokens, die Sie tatsächlich bezahlen.

Zuletzt überprüft am .

Open WebUI veröffentlicht überhaupt keine Preisliste: openwebui.com/pricing und openwebui.com/enterprise liefern beide 404, und die Chatoberfläche kann ohne Sitzplatz- oder Anfragegrenze kostenlos selbst gehostet werden. Eine Unternehmenslizenz regelt das Entfernen des Open-WebUI-Brandings und ausschließlich für Unternehmen verfügbare Add-ons wie Terminals, nicht die Anzahl der Personen, die es nutzen. Die Zahlen, die ein Käufer tatsächlich benötigt, sind die drei, die das Projekt Ihnen nicht in Rechnung stellt — die Maschine, die Modell-Tokens und die Einstellungen in Open WebUI, die unbemerkt Tokens senden, die Sie nicht eingegeben haben. Alle drei werden im Folgenden mit Quellen und Prüfzeitpunkten erläutert.

Für diese Abfrage kursieren drei falsche Preise; klären wir sie daher zuerst. $60 pro Sitzplatz und Jahr ist real und offiziell, betrifft aber die Supporter-Stufe von Open WebUI Computer – das cptr-Paket, ein separates Produkt desselben Teams unter einer anderen Lizenz, dessen eigene kostenlose Stufe „$0 für immer“ lautet. Eine jährliche Enterprise-Angabe, die in Suchergebnissen Open WebUI zugeschrieben wird, stammt von einem Hosting-Anbieter eines Drittanbieters und erscheint auf keiner offiziellen Seite; sie wird daher hier nicht wiederholt. Und ein „Pro“-Tarif für 19 $ pro Monat gehört zu openwebui.net – einer ähnlich aussehenden Domain, die nicht openwebui.com ist und deren App in ihren eigenen Texten als „NextChat“ bezeichnet wird (geprüft am 21. September 2026). Sie wird hier genannt, damit Sie sie erkennen, aber bewusst nicht verlinkt.

Was die Software kostet und welche Einschränkungen die Lizenz tatsächlich festlegt

Die Projekt-Homepage verkauft die Installation, keinen Tarif: „pip install open-webui / Ein Befehl. 60 Sekunden. Kein Konto erforderlich.“ Das Repository ist aktiv und nicht archiviert; sein jüngster Commit auf main ist vom 4. September 2026. Die aktuelle Version ist v0.11.3; ihre Dateien wurden am 31. August 2026 auf PyPI veröffentlicht. Beachten Sie eine offizielle Abweichung: Die Blog-Karte auf der Homepage trägt weiterhin die Überschrift v0.11.1 vom 25. August. Das ist ein Blogbeitrag, kein Versionsbanner; GitHub Releases ist maßgeblich für die Version.

Auch bei der Lizenz ist dieselbe Sorgfalt erforderlich. GitHub führt sie als NOASSERTION / „Other“, während Texte von Drittanbietern sie häufig weiterhin als BSD-3 bezeichnen. Beides ist nur halb richtig. Die LICENSE-Datei enthält BSD-3-Text plus eine vierte Klausel, die mit v0.6.6 eingeführt wurde und das Ändern, Entfernen, Verschleiern oder Ersetzen des Brandings von Open WebUI untersagt – außer wenn „die Gesamtzahl der Endnutzer … innerhalb eines beliebigen rollierenden Zeitraums von 30 Tagen fünfzig (50) nicht überschreitet“, eine schriftliche Genehmigung vorliegt oder eine Enterprise-Lizenz gehalten wird. Die Lizenzseite des Projekts formuliert es klar: „Branding-Anforderungen gelten nur für größere Bereitstellungen (insgesamt 50+ Nutzer)“ und „jeder kann weiterhin ab v0.6.5 ohne Einschränkungen forken“. Also: heute keine OSI-anerkannte Lizenz, aber auch keine Nutzungsobergrenze – der Schwellenwert regelt das Rebranding, nicht den Betrieb.

PositionWas es kostetQuelle, geprüft am 21. September 2026
Open WebUI, selbst gehostet, Branding unverändert$0 – aufgeführt als „Standard Use … Free“Open WebUI for Enterprise
White-Labeling oder Umbenennung der BenutzeroberflächeEnterprise-Lizenz erforderlich; keine Angabe veröffentlichtDieselbe Seite, dieselbe Tabelle
Die Enterprise-Lizenz selbstPrivat nach Sitzplatzanzahl genannt„Teilen Sie uns die Anzahl der Endnutzer (Sitze) Ihrer Bereitstellung mit“
Enterprise-Lizenz für eine EinzelpersonNicht erhältlich„ausschließlich an registrierte Unternehmen und Organisationen … wir können einzelne Nutzer nicht berücksichtigen“
Open WebUI Computer (cptr), ein anderes Produkt$0 für immer; $60 / Sitzplatz / Jahr Supporter; Enterprise individuellopenwebui.com/computer
Modell-TokensDer Token-Tarif Ihres AnbietersDie eigene Abrechnung Ihres Anbieters

Was die Enterprise-Lizenz nach den eigenen Worten des Projekts gewährt, ist „White-Labeling, Umbenennung, Änderungen am ursprünglichen Branding oder exklusive Enterprise-Angebote wie Terminals“. Terminals ist als Orchestrierungsschicht für Open Terminal dokumentiert: Sie stellt pro Nutzer einen separaten Arbeitsbereich bereit – Dateien, Prozesse, Paketumgebung, Ressourcenlimits und Netzwerkgrenze – und ist das genannte Beispiel einer Funktion, die die Lizenz regelt, nicht nur das Branding. Verwaltetes „Open-WebUI-Hosting“ von Drittanbietern ist wiederum eine separate Angelegenheit: Es handelt sich um eine Serverrechnung auf der Infrastruktur eines anderen. Für diese Seite wurde keine verifizierte Angabe für einen verwalteten Host ermittelt – die geprüfte Anbieter-Tarifseite zeigt bei einem einfachen Abruf Preisplatzhalter statt Zahlen –, daher wird keine solche Angabe genannt.

Zwei verschiedene Fragen verbergen sich in „Open WebUI API cost“

Die Abfrage ist tatsächlich mehrdeutig, und die beiden Hälften haben unterschiedliche Antworten.

Ausgehende Aufrufe kosten Geld. Open WebUI liefert kein eigenes Modell aus, daher wird jedes Token von dem von Ihnen konfigurierten Endpunkt abgerechnet. Die eigene API von Open WebUI kostet nichts: Beim veröffentlichten Tag v0.11.3 stellt backend/open_webui/main.py GET /api/models (L874), POST /api/chat/completions (L1085) und – neuer und leicht zu übersehen – einen Anthropic-ähnlichen POST /api/v1/messages (L1976) mit dem danebenliegenden POST /api/v1/messages/count_tokens (L1907) bereit. Sie authentifizieren sich dort mit einem eigenen Open-WebUI-Schlüssel und nicht mit dem Schlüssel Ihres Anbieters. Open WebUI berechnet dafür nichts, weil diese Endpunkte nur eine Eingangstür sind: Jede Anfrage landet weiterhin bei dem von Ihnen konfigurierten Upstream und wird dort abgerechnet. Wenn Sie Ihre eigenen Skripte statt direkt beim Anbieter an Open WebUI richten, ändert sich das Routing, nicht die Rechnung.

Die abrechenbaren Aufrufe, die Sie nicht eingegeben haben

Das ist der Teil, den ein Ratenvergleich übersieht. Im Tag v0.11.3 sind in backend/open_webui/config.py vier Hintergrundgeneratoren standardmäßig aktiviert, einer ist deaktiviert.

EinstellungStandard bei v0.11.3Wofür Kosten entstehen
ENABLE_TITLE_GENERATION (L2312)TrueEine zusätzliche Completion pro neuem Chat, um ihn zu benennen
ENABLE_TAGS_GENERATION (L2310)TrueEine zusätzliche Completion pro neuem Chat, um ihn zu taggen
ENABLE_RETRIEVAL_QUERY_GENERATION (L2317)TrueEine zusätzliche Completion bei jeder Ausführung von Retrieval
ENABLE_SEARCH_QUERY_GENERATION (L2315)TrueEine zusätzliche Completion bei Verwendung der Websuche
ENABLE_AUTOCOMPLETE_GENERATION (L2346)FalseNichts, solange Sie es nicht aktivieren
TASK_MODEL / TASK_MODEL_EXTERNAL (L2193, L2195)LeerLeer bedeutet, dass diese Aufgaben Ihr Chat-Modell verwenden

Wie viele zusätzliche Tokens das in der Praxis sind, wurde für diese Seite nicht gemessen; jede gegenteilige Prozentangabe wäre erfunden. Überprüfbar ist die Struktur: Die Flags sind aktiviert, das Aufgabenmodell ist nicht gesetzt, daher werden Namens- und Tagging-Aufrufe so lange mit dem jeweils verwendeten Chatmodell abgerechnet, bis Sie in TASK_MODEL_EXTERNAL eine günstige ID festlegen. Die eigene FAQ von Open WebUI sagt dasselbe – „Standardmäßig verwenden diese Aufgaben dasselbe Modell, mit dem Sie chatten“ – und empfiehlt dieselbe Lösung. Zwei Standardwerte gehen in die andere Richtung und sind vor der Budgetplanung wichtig: Die Websuche ist deaktiviert (ENABLE_WEB_SEARCH, L1155) und die Bildgenerierung ist deaktiviert (ENABLE_IMAGE_GENERATION, L1336), während der Code-Interpreter aktiviert ist (L422).

Vier Subsysteme, vier Endpunktfelder – und ein Standardwert, den man zweimal lesen sollte

Die Chat-Kompatibilität erstreckt sich nicht auf den restlichen Teil des Produkts. Retrieval-Embeddings, Sprache-zu-Text, Text-zu-Sprache und Bildgenerierung haben jeweils ihr eigenes Basis-URL-/Schlüsselpaar, und der Fallback jedes einzelnen ist das singuläre OPENAI_API_BASE_URL. Hier liegt der überraschende Teil: Beim Tag v0.11.3 weist Zeile 365 von config.py nach dem Aufbau der Verbindungsliste OPENAI_API_BASE_URL = 'https://api.openai.com/v1' bedingungslos neu zu. Jeder später ausgewertete Subsystem-Standard – RAG_OPENAI_API_BASE_URL (L1092), IMAGES_OPENAI_API_BASE_URL (L1490), AUDIO_STT_OPENAI_API_BASE_URL (L1565), AUDIO_TTS_OPENAI_API_BASE_URL (L1606) – wird daher unabhängig davon, welche Variable Sie für den Chat setzen, auf den OpenAI-Endpunkt aufgelöst. Dies ist der auf Quelltextebene gelesene Modulstandard; diese Werte speisen eine persistierte Konfiguration, die die Admin-Oberfläche anschließend überschreiben kann, und das Verhalten wurde für diese Seite nicht in einer laufenden Instanz reproduziert. Issue #22084 beschreibt dasselbe Symptom; es wurde am 1. März 2026 eröffnet und inzwischen als erledigt geschlossen. Behandeln Sie die obige Quelltextanalyse daher als Modulstandard von v0.11.3 und nicht als offenen Fehler.

Die gute Nachricht ist, dass alle vier dieser Slots bei den Standardeinstellungen keine API-Kosten verursachen.

SubsystemStandard bei v0.11.3Standardmäßige Kosten
DokumentabrufRAG_EMBEDDING_ENGINE leer (L996); Modell sentence-transformers/all-MiniLM-L6-v2 (L1002)Keine API-Kosten – der Embedding-Schritt läuft lokal auf Ihrer eigenen CPU und in Ihrem eigenen RAM
Sprache zu TextAUDIO_STT_ENGINE leer (L1571), lokales WhisperKeine API-Kosten; stattdessen lokale Berechnung
Text zu SpracheAUDIO_TTS_ENGINE leer (L1620)Keine API-Kosten – wenn die Engine nicht gesetzt ist, antwortet die eigene /audio/speech-Route des Servers mit 404, statt einen externen Aufruf durchzuführen (routers/audio.py L559)
BildgenerierungDeaktiviert (L1336)Nichts, bis Sie es aktivieren und einen Endpunkt auswählen

Kunavo stellt keine Embeddings, keine Sprache-zu-Text- und keine Text-zu-Sprache-Funktionen bereit.

Diese Grenze entscheidet, welche dieser Slots Sie überhaupt auf ein Gateway richten können: RAG_OPENAI_API_BASE_URL, AUDIO_STT_OPENAI_API_BASE_URL und AUDIO_TTS_OPENAI_API_BASE_URL sind keine Slots, die Sie hierher richten sollten. Lassen Sie den Retrieval-Schritt bei seinem lokalen Standard – das ist sowohl die ausgelieferte als auch die kostenlose Einstellung – oder senden Sie ihn an einen Anbieter, der diesen Schritt anbietet. Der einzige Teil Ihrer Retrieval-Rechnung, der einen Chat-Anbieter erreicht, ist der abgerufene Text selbst, der als gewöhnliche Eingabetokens im nächsten Prompt eintrifft. Die RAG-Implementierung erläutert, wie Chunk-Größe und Top-k in diese Eingabeanzahl einfließen.

Open-WebUI-Umgebung
# The chat connection. This is the only slot the setup guides cover.
OPENAI_API_BASE_URL=https://api.kunavo.com/v1
OPENAI_API_KEY=sk-kn-...

# Titles, tags and retrieval queries run on the CHAT model unless you say
# otherwise. TASK_MODEL_EXTERNAL defaults to empty (config.py L2195).
TASK_MODEL_EXTERNAL=claude-haiku-4-5

# Leave the document-embedding step alone: empty means local, and local
# means no API spend at all (config.py L996 and L1002).
RAG_EMBEDDING_ENGINE=
RAG_EMBEDDING_MODEL=sentence-transformers/all-MiniLM-L6-v2

Eine Beispielrechnung für einen Chat-Tag

Dies ist eine beispielhafte Tokenrechnung, keine gemessenen Kosten und keine Rechnungsobergrenze. Nehmen wir den Arbeitstag einer Person im Chatfenster an: 40 Assistenteninteraktionen, bei denen jeweils 6.000 nicht zwischengespeicherte Eingabetokens gesendet werden (der sichtbare Verlauf plus abgerufene Chunks) und 700 Ausgabetokens zurückkommen – insgesamt 240.000 Eingabe- und 28.000 Ausgabetokens. Nehmen wir außerdem 8 neue Chats an diesem Tag an und dass Open WebUIs standardmäßige Generatoren für Titel, Tags und Retrieval-Abfragen pro Chat drei zusätzliche Aufrufe mit jeweils 2.000 Eingabe- und 40 Ausgabetokens ausführen. Diese Größe pro Aufruf ist eine Annahme; sie wurde nicht gemessen. Die Preise sind aktuelle Preise aus dem Kunavo-Katalog pro einer Million Tokens.

ModellEingabe / Ausgabe pro 1 Mio.40 Chat-InteraktionenHintergrundaufgabenTagessumme
Claude Haiku 4.5$0.70 / $3.50$0.266$0.037$0.303
GPT-5.6 Terra$0.70 / $4.20$0.286$0.038$0.323
Claude Sonnet 4.6$2.10 / $10.50$0.798$0.111$0.909
Claude Sonnet 5$1.40 / $7.00$0.532$0.074$0.606

Lesen Sie die letzte Spalte statt der Chat-Spalte. Unter diesen Annahmen macht der Hintergrundverkehr etwa 12 % eines Claude Sonnet 5-Tages aus – $0.074 von $0.606 – und wird für die Benennung und das Tagging von Chats ausgegeben. Wenn Sie TASK_MODEL_EXTERNAL stattdessen auf Claude Haiku 4.5 setzen, sinkt dieser Anteil auf $0.037 und der Tag auf $0.569, ohne dass sich ändert, was jemand tatsächlich liest. Diese eine Einstellung verändert einen größeren Teil dieser Rechnung, als ein Anbieterwechsel innerhalb derselben Stufe bewirken würde.

Skalieren Sie die Werte anhand Ihrer eigenen Nutzerzahl und der Anzahl der Tage, bevor Sie sie als Budget behandeln, und beachten Sie, was die Rechnung ausschließt: Prompt-Caching, Bild- oder Videogenerierung sowie alle vom Code-Interpreter aufgerufenen Tools. Der Katalogbetrag von Kunavo ist ein Abrechnungsboden und keine Obergrenze – wenn der Upstream seine Kosten meldet, ist die Rechnung der höhere Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem geltenden Aufschlag. Die minimale Kunavo-Aufladung beträgt $10 als vorausbezahltes Guthaben; das ist ein Finanzierungsminimum, kein Abonnement und keine Gebühr pro Sitzplatz. Siehe Abrechnungsdetails sowie Nutzung für das Pro-Anfrage-Journal. Auch Open WebUI bietet eine eigene Ansicht: Die README von v0.11.3 beschreibt Admin-Dashboards, die „Nachrichtenvolumen, Tokenverbrauch und Kosten über Nutzer und Modelle hinweg verfolgen“. Diese Funktion wurde für diese Seite nicht ausprobiert, und zwei Zähler desselben Verkehrs werden nicht Token für Token übereinstimmen. Stimmen Sie daher mit der Seite ab, die Sie tatsächlich finanzieren.

Welche Route gewinnt und wann

WegVorteile, wennWorauf Sie verzichten
Direkte Anbieter-APIDie Modelle eines Anbieters decken alles ab, was Ihre Nutzer tunEine zweite Familie bedeutet eine zweite Verbindung, einen zweiten Schlüssel und ein zweites Guthaben, das überwacht werden muss
Gateway (Kunavo und seine Alternativen)Sie möchten mehrere Familien in einer Auswahl hinter einem Schlüssel und die Preise pro Modell an einer Stelle sehenEine Schicht zwischen Ihnen und dem Anbieter; anbieterabhängige Extras wie natives Prompt-Caching verhalten sich je nach Gateway unterschiedlich und sollten getestet werden, bevor Sie sich darauf verlassen
Lokales Modell über Ollama oder llama.cppPrivate oder unkritische Aufgaben, keine Gebühr pro Anfrage, und Open WebUI dokumentiert beide nativHardware und eine Fähigkeitslücke gegenüber gehosteten Frontier-Modellen; Retrieval und lange Verläufe werden in RAM statt in Dollar teuer
Ein Chat-Abonnement für EndkundenSie möchten überwiegend das eigene Produkt eines AnbietersEs stellt keine Verbindung her: Open WebUI benötigt einen API-Endpunkt, ein Chat-Abonnement ist keiner
Verwaltetes Open-WebUI-HostingSie möchten den Container nicht selbst betreibenEine Serverrechnung zusätzlich zur Tokenrechnung; auf dieser Seite wird kein Preis genannt, weil keiner verifiziert werden konnte

Ein Protokolldetail entscheidet stärker über die Einrichtung als die Wahl des Anbieters. Open WebUI ist ausdrücklich protokollorientiert – es implementiert das OpenAI-Chat-Completions-Protokoll und verzichtet darauf, anbieterspezifische APIs in den Kern aufzunehmen –, daher müssen Sie ihm einen OpenAI-kompatiblen /v1-Stamm übergeben, auch für Claude-Modelle. Die eigene Anthropic-Seite konfiguriert https://api.anthropic.com/v1 als OpenAI-Verbindung und gibt Anthropics Warnung weiter, dass die Kompatibilitätsschicht eher zum Testen als für den Produktiveinsatz gedacht ist. Außerdem gibt es pro Verbindung einen Umschalter für den API-Typ Open Responses; die Dokumentation bezeichnet ihn als experimentell und warnt, er „funktioniert möglicherweise nicht wie erwartet mit allen Anbietern“. Kunavo stellt eine Responses-kompatible Route bereit, aber diese Kombination wurde für diese Seite nicht zur Laufzeit getestet. Behandeln Sie daher den Chat-Completions-Pfad als den bekannten zuverlässigen Pfad und den Umschalter als etwas, das Sie mit einer ungenutzten Verbindung ausprobieren sollten.

Vergleichen Sie das Frontend selbst statt des Anbieters? LibreChat vs Open WebUI und AnythingLLM vs Open WebUI behandeln diese Wahl, während best LLM gateway die Gateway-Schicht anhand von Raten und Finanzierungsbedingungen statt anhand der Integrationstiefe vergleicht.

Richten Sie es ein und prüfen Sie anschließend die Rechnung des ersten Tages

Die Verbindung befindet sich unter Settings → Admin → Connections → „Manage OpenAI API Connections“ → „Add Connection“ und enthält ein URL- sowie ein API-Key-Feld; dasselbe lässt sich beim Containerstart mit den beiden obigen Umgebungsvariablen erledigen. Lassen Sie /v1 in der URL stehen – Open WebUI hängt die Route selbst an, und der Quelltext entfernt einen abschließenden Schrägstrich.

Ein Fehlermodus sollte im Voraus bekannt sein, weil er wie eine defekte Integration aussieht, es aber nicht ist. Die eigene Dokumentation von Open WebUI erklärt, dass das Speichern einer Verbindung sie nicht testet, dass die Schaltfläche „Verify“ den /models-Endpunkt des Anbieters aufruft und dass ein Fehlschlag dieses Aufrufs „nicht bedeutet, dass der Anbieter inkompatibel ist: Chat-Completions funktionieren weiterhin“ – stattdessen tragen Sie die Modell-IDs in die Allowlist „Model IDs“ pro Verbindung ein. Diese Allowlist auszufüllen lohnt sich unabhängig davon: Bei einem Katalog mit Bild-, Video- und Musikmodellen führt ein leerer Filter Modelle in die Auswahl, die ein Chatfenster nicht aufrufen kann.

Kunavo veröffentlicht eine Einrichtungsanleitung für diesen Client. Das ist eine veröffentlichte Konfigurationsreferenz, kein Kompatibilitätstest – Open WebUI wurde hier nicht zur Laufzeit gegen den Kunavo-Endpunkt getestet, und alles Obige wurde aus dem veröffentlichten Quelltext von Open WebUI und der eigenen Dokumentation gelesen. Halten Sie beim Ausprobieren eine funktionierende Route bereit, führen Sie zunächst einen begrenzten Tag aus und lesen Sie anschließend, was Ihr Konto tatsächlich aufgezeichnet hat. Beginnen Sie mit der Open-WebUI-Integrationsanleitung und erstellen Sie ein Kunavo-Konto, sobald Sie bereit sind, einen Schlüssel zu finanzieren.

Häufig gestellte Fragen

Wie viel kostet Open WebUI?

Die Software ist kostenlos, und es gibt keine Preisliste, die man lesen könnte: openwebui.com/pricing und openwebui.com/enterprise liefern beide 404, und die eigene Installationszeile der Startseite lautet „pip install open-webui / One command. 60 seconds. No account required.“ (geprüft am 19. September 2026). Für den Betrieb gibt es weder eine Sitzplatzgrenze noch eine Anfragegrenze. Tatsächlich zahlen Sie für die Maschine, auf der es läuft, für die von ihm gesendeten Modell-Tokens und — wenn Sie das Open-WebUI-Branding entfernen möchten oder ein ausschließlich für Unternehmen verfügbares Add-on wie Terminals benötigen — für eine Unternehmenslizenz; dafür ist kein Betrag veröffentlicht, und das Projekt erstellt ein Angebot, nachdem Sie Ihre Sitzplatzanzahl übermittelt haben.

Hat Open WebUI eine Preisseite oder einen veröffentlichten Unternehmenspreis?

Nein. Die Unternehmensdokumentation bittet Sie, die Anzahl Ihrer Endnutzer (Sitzplätze) zu übermitteln, und erklärt, dass Unternehmenslizenzen ausschließlich registrierten Rechtsträgern und Organisationen, nicht einzelnen Nutzern, zur Verfügung stehen. Auf keiner offiziellen Open-WebUI-Seite erscheint ein Dollarbetrag. Drittanbieter für Hosting und Content-Seiten veröffentlichen Plantabellen und Jahresbeträge für „Open WebUI pricing“, die das Projekt selbst nicht veröffentlicht; behandeln Sie diese als Anbieterinhalte. Eine separate, ähnlich aussehende Domain, openwebui.net, verkauft einen „Pro“-Tarif für $19 pro Monat für eine Anwendung mit der Markenbezeichnung „NextChat“; sie ist nicht openwebui.com und wird nicht vom Projekt betrieben.

Benötige ich eine Unternehmenslizenz, um Open WebUI für mehr als 50 Nutzer zu betreiben?

Laut der eigenen Unternehmenstabelle des Projekts nicht. Dort wird Standard Use — interne Nutzung mit unverändertem ursprünglichem Branding — als Free aufgeführt; eine Unternehmenslizenz ist nur für White-Labeling, Rebranding oder ausschließlich für Unternehmen verfügbare Angebote erforderlich. Die Schwelle von fünfzig Nutzern steht in Klausel 4 der LICENSE und regelt nur, ob Sie das Open-WebUI-Branding ohne Genehmigung in einem beliebigen rollierenden Zeitraum von dreißig Tagen ändern, entfernen, unkenntlich machen oder ersetzen dürfen. Lesen Sie den Lizenztext vor einer großen Bereitstellung selbst; dies ist eine Zusammenfassung und keine Rechtsberatung.

Was ist die beste API für Open WebUI?

Das hängt davon ab, wie viele Anbieter Sie im Picker haben möchten. Open WebUI enthält kein eigenes Modell und schreibt keine Positivliste von Anbietern vor, daher stehen alle Wege offen: Eine direkte Anbieter-API ist sinnvoll, wenn die Modelle eines Anbieters alles abdecken, was Sie tun, und Sie dessen eigene Caching- und Batch-Konditionen nutzen möchten; ein Gateway ist sinnvoll, wenn eine Verbindung mehrere Modellfamilien unter einem Schlüssel und einem Guthaben für den Modell-Picker bereitstellen soll; ein lokaler Server über Ollama oder llama.cpp eignet sich für private oder weniger kritische Aufgaben ohne Gebühr pro Anfrage. Eine direkte Anbieter-API und ein Gateway erfordern gleich viel Einrichtung — Open WebUIs OpenAI-kompatibles Verbindungsformular nimmt in beiden Fällen eine URL und einen API-Schlüssel entgegen. Bei einem lokalen Server ist das anders: Sie müssen ihn zusätzlich installieren und ausführen, und Open WebUI dokumentiert Ollama und llama.cpp auf eigenen Verbindungsseiten.

Was ist die günstigste API für Open WebUI?

Der günstigste angegebene Tarif und die günstigste Möglichkeit, eine Antwort zu erhalten, sind unterschiedliche Fragen. Eine Chatoberfläche berechnet in jeder Runde den gesamten sichtbaren Verlauf, daher kann eine lange Unterhaltung mit einem Modell mit niedrigem Tarif mehr kosten als eine kurze mit einem Modell mit hohem Tarif, und ein Modell, das einen zweiten Versuch benötigt, kostet das Doppelte. Drei Einstellungen beeinflussen die Chatrechnung stärker als die Preistabelle: auf welchem Modell die Generierung des standardmäßigen Titels, Tags und der Retrieval-Abfrage läuft, wie viel abgerufener Dokumenttext in jeden Prompt eingefügt wird und wie lange Sie einen Thread wachsen lassen, bevor Sie einen neuen beginnen. Legen Sie diese zuerst fest und vergleichen Sie anschließend die Tarife.

Was ist das beste Modell für Open WebUI?

Wählen Sie nach dem, was das Fenster tatsächlich tut, und nicht nach dem Benchmark-Rang. Lange eingefügte Dokumente und RAG-Threads benötigen ein großes Kontextfenster und einen niedrigen Eingabetarif, weil Eingaben die Tokenklasse sind, für die eine Chatoberfläche am meisten ausgibt. Tool-Calling und der integrierte Code-Interpreter benötigen ein Modell, dessen Function-Calling auf dem von Ihnen verwendeten exakten Endpunkt zuverlässig funktioniert — die eigene Anbieter-Dokumentation von Open WebUI warnt, dass der OpenAI-kompatible Endpunkt von Google gestreamte Tool-Aufrufe verwirft; dies ist eine Eigenschaft dieses Endpunkts und nicht des Modells. Vision ist relevant, wenn Nutzer Screenshots einfügen. Eine sinnvolle Konfiguration umfasst zwei Verbindungen: ein günstiges Modell als Standard und ein leistungsstarkes Modell, zu dem Nutzer wechseln können.

Ist Open WebUI dasselbe wie text-generation-webui?

Nein. Open WebUI ist open-webui/open-webui, wird von Open WebUI Inc. gepflegt und hat v0.11.3 als jüngste Veröffentlichung. oobaboogas text-generation-webui ist ein anderes Projekt eines anderen Maintainers, heißt inzwischen TextGen und ist zu github.com/oobabooga/textgen umgezogen. Beide stellen OpenAI-kompatible APIs bereit, daher wirkt ein Konfigurationsausschnitt des einen im anderen plausibel, ist jedoch nicht austauschbar.

Open-WebUI-Seiten, Repository, Commit-Historie und Paket wurden am 19. September geprüft und am 21. September 2026 erneut geprüft; die 404-Antworten auf openwebui.com/pricing und openwebui.com/enterprise wurden direkt abgerufen, und jeder zitierte Konfigurationsstandard wurde am veröffentlichten Tag v0.11.3 statt auf main gelesen. Nicht geprüft: Preise für verwaltetes Hosting, eine Dollarangabe für Enterprise, der Token-Overhead der standardmäßigen Hintergrundaufgaben, die eigenen Nutzungs-Dashboards von Open WebUI sowie ein End-to-End-Lauf von Open WebUI gegen Kunavo. Die Kunavo-Tokenpreise stammen aus dem aktuellen Katalog, und jedes Dollarbeispiel hier ist eine beispielhafte Tokenrechnung.