Oh My Pi kostet nichts. Der omp-Client ist MIT-lizenzierte Open-Source-Software, und omp.sh veröffentlicht überhaupt keine Preis-, Abrechnungs-, Checkout- oder Registrierungsseite – „Oh My Pi pricing“ ist also eine Frage der Modell-Token, die Sie darüber verbrauchen, und nicht des Tools. Der Teil, den Sie vor der Budgetplanung lesen sollten, ist ungewöhnlicher als eine Preisliste: Lassen Sie omp die Modelle eines Gateways entdecken, zeigt die eigene Kostenanzeige absichtlich für jedes davon $0 an.
Am 21. September 2026 anhand der GitHub- und npm-APIs geprüft: can1357/oh-my-pi ist auf GitHub aktiv, nicht archiviert und kein Fork-Eintrag, MIT-lizenziert und hat 32.293 Sterne. Das neueste nicht als Entwurf markierte Release ist v18.2.8, veröffentlicht an diesem Tag um 17:31 UTC. Geben Sie bei jeder zitierten Version das Datum an – v18.2.6 wurde am 18. September veröffentlicht und v18.2.7 traf am 21. September um 02:13 UTC ein, sodass sich diese Zahl innerhalb von vier Tagen dreimal änderte. Das Paket, das die Binärdatei installiert, ist @oh-my-pi/pi-coding-agent und ebenfalls 18.2.8, MIT-lizenziert und nicht als veraltet gekennzeichnet, mit bin: omp.
Zunächst eine Abgrenzung, denn sie entscheidet, welche Dokumentation gilt. Oh My Pi ist ein Fork. In der README heißt es ausdrücklich: „omp ist ein Fork von Pi von Mario Zechner, der als vorrangig auf Programmieraufgaben ausgerichtete Oberfläche neu geschrieben wurde“. Pi ist ein separater, eigenständig gepflegter Client mit einer eigenen Release-Linie – am 21. September 2026 war dessen neuestes GitHub-Release v0.87.0, gegenüber v18.2.8 bei omp. Die Hauptversionsnummer von omp bedeutet daher nicht, dass es Pi um 18 Reife-Generationen voraus ist. Pis Pläne und Anbieteroberfläche lassen sich nicht übertragen. Informationen dazu finden Sie unter Pi-Preise und die Unterschiede unter Oh My Pi im Vergleich zu Pi.
Was Oh My Pi berechnet und was Ihnen tatsächlich in Rechnung gestellt wird
| Position | Was es kostet | Quelle |
|---|---|---|
Der omp-Client | $0, MIT | Repository-Lizenz und README: Installation per Skript, Homebrew, Bun, Nix oder PowerShell |
| Ein Oh-My-Pi-Konto, ein Plan oder ein Gateway | Existiert nicht | Sitemap von omp.sh: 36 URLs, kein Preis-, Abrechnungs-, Checkout-, Abonnement-, Registrierungs-, Konto- oder Anmeldepfad |
/collab-Relais (my.omp.sh) | Kein veröffentlichter Preis; optional; auf einen anderen Ort verweisbar | Die Collab-Dokumentation von omp. Wer es finanziert oder nach Nutzung abrechnet, ist nicht verifiziert – gehen Sie nicht davon aus, dass es kostenlos bleibt |
| Modell-Tokens | Der Token-Tarif Ihres Anbieters | Unabhängig davon, welchen Anbieter, welches Gateway oder welchen Coding-Plan Sie verknüpfen |
web_search-Backend | Ein separates Zugangsmittel, manchmal 0 $ | Die Kette mit 23 Anbietern aus der README; in der Tabelle stehen duckduckgo, startpage, google, ecosia und mojeek als Anbieter, die keinen Schlüssel benötigen, drei davon mit der Kennzeichnung „kein Schlüssel (Browser)“ |
| Ein lokal bereitgestelltes Modell | Keine Gebühr pro Token; stattdessen Hardware und Strom | Ollama: Das Ausführen von Modellen auf eigener Hardware ist „immer unbegrenzt“ |
Zwei dieser Punkte werden häufig verwechselt. Der Schlüssel für die Websuche ist eine separate Achse: Wenn Sie die Modelle von omp auf ein Gateway verweisen, erhalten Sie keine Suche, und der Kauf eines Suchschlüssels verschafft Ihnen keine Modelle. Das Relais ist außerdem die einzige gehostete Komponente des Projekts – es führt keine Inferenz aus, und laut Dokumentation wird jede Sitzungsnutzlast mit AES-256-GCM versiegelt, bevor sie den Socket berührt. Für das Relais bleiben nur Raum-IDs, Verbindungsanzahlen und undurchsichtige Chiffretext-Frames sichtbar. Es ist jedoch kein Preis veröffentlicht, und nichts klärt, wer den Standardhost bezahlt.
Die omp-spezifische Falle: Gateway-Modelle werden auf dem Bildschirm mit 0 $ abgerechnet
omp schätzt die Ausgaben lokal. In der Modelldokumentation steht, dass es „Tokenkosten anhand der Katalogpreise des ausgewählten Anbieters/Modells schätzt und, sofern verfügbar, vom Server gemeldete Geldkosten bevorzugt“ und dass abgeschlossene Nachrichten ihre aufgezeichneten Kosten behalten. Ein Modellwechsel oder das erneute Öffnen einer Sitzung berechnet bereits ausgegebene Beträge nicht neu.
Dieser Katalog ist das Problem für alle, die ein Gateway verwenden. Auf derselben Seite steht, dass entdeckte Proxy- und Gateway-Modelle „der umgekehrte Fall sind: Ihre Preise sind anbieterspezifisch und stimmen selten mit dem gebündelten Katalog überein, daher setzt die Erkennung sie auf lokal unbekannte Kosten von null und es wird kein Tarif auf sie angewendet“. Wenn Sie einen discovery-Block konfigurieren und omp die Modellliste eines Gateways lesen lassen, trifft jedes gefundene Modell ohne Preis ein, und das cost-Segment in der Statuszeile hat nichts zu summieren. Ihr Anbieter stellt Ihnen weiterhin normal Kosten in Rechnung. Nur die Anzeige bleibt leer.
Die dokumentierte Lösung besteht darin, die relevanten Modelle manuell mit einem expliziten cost-Block zu deklarieren. Die Einheit ist pro Million Token – die Katalogquelle von omp dokumentiert den Typ als Tarife pro Million Token für eine Modellpreisstufe –, aber das Schema nennt keine Währung. Übernehmen Sie daher die Währung der kopierten Preiskarte. Die folgenden Tarife stammen aus dem Live-Kunavo-Katalog:
# Derived from omp's documented schema in docs/models.md and
# docs/providers.md, read 2026-09-21. Not runtime-tested by Kunavo.
providers:
kunavo:
baseUrl: https://api.kunavo.com/v1
api: openai-completions
apiKey: KUNAVO_API_KEY # an env var NAME, a literal, or !shell-command
authHeader: true
# No discovery block here, deliberately: discovered models arrive with no
# price, so every model you want costed is listed by hand below.
models:
- id: claude-sonnet-5
name: Claude Sonnet 5
contextWindow: 1000000
maxTokens: 128000
cost: # per MILLION tokens; the schema states no currency
input: 1.40
output: 7.00
cacheRead: 0.14
cacheWrite: 1.75Drei Konsequenzen sollten Sie bei der Planung berücksichtigen. Erstens models.yml „akzeptiert keinen timeBased-Zeitplan“, und ein explizites cost „ist eine Pauschalpreisüberschreibung und deaktiviert die geerbte zeitbasierte Preisgestaltung für dieses Modell“ – ein Anbieter mit Spitzen- und Nebenzeitpreisen kann hier also nicht exakt modelliert werden, und der Tarifpfeil ↑/↓, den omp bei zeitgesteuerten Preisen anzeigt, erscheint nie. Zweitens hat ein in models.yml festgelegter Schlüssel bewusst Vorrang vor einer gespeicherten OAuth-Anmeldedaten, „sodass ein für ein benutzerdefiniertes baseUrl oder Gateway bereitgestellter Schlüssel verwendet wird, statt ein Upstream-OAuth-Token weiterzuleiten, das der Proxy ablehnen würde“ – dadurch wird der häufigste Gateway-Authentifizierungsfehler verhindert, bevor er auftritt. Drittens verlaufen Fehler hier still: Ein models.yml, das die Validierung nicht besteht, lässt die Registry „mit integrierten Modellen weiterarbeiten“, sodass eine fehlerhafte Konfiguration wie ein fehlender Anbieter und nicht wie ein Absturz aussieht. Ein apiKey-Wert, der keine vorhandene Umgebungsvariable bezeichnet, wird als literaler Schlüssel verwendet.
Wenn die Schätzung von omp und die Preiskarte des Anbieters nicht übereinstimmen
Das lässt sich heute überprüfen und ist kein Rundungsunterschied. Der gebündelte Katalog von omp enthält die zeitgesteuerte Preiskarte von DeepSeek. In der Dokumentation steht, dass deepseek-v4-pro „zunächst Spitzenpreise von 1,32 $ für nicht zwischengespeicherte Eingaben, 0,044 $ für zwischengespeicherte Eingaben und 3,96 $ für Ausgaben pro Million Token verwendet“, aber „ab 2026-09-14 04:00 UTC die Flash-Preiskarte für seine Schätzungen verwendet“ – also 0,30 $ für nicht zwischengespeicherte Eingaben und 1,20 $ für Ausgaben während der Spitzenzeit.
| Pro 1 Mio. Token, Spitzenzeit | Lokale Schätzung von omp | Veröffentlichter Preis von DeepSeek |
|---|---|---|
| Nicht zwischengespeicherte Eingabe | $0.30 | $1.32 |
| Zwischengespeicherte Eingabe | $0.006 | $0.044 |
| Output | $1.20 | $3.96 |
Beide Spalten wurden am 21. September 2026 gelesen – die linke aus der Modelldokumentation von omp, die rechte aus DeepSeeks eigener Preiskarte, auf der weiterhin 1,32 $ / 3,96 $ ohne Hinweis auf eine Änderung im September stehen. Lesen Sie dies eng gefasst: Es handelt sich um eine Abweichung zwischen der lokalen Schätzung von omp und einem veröffentlichten Anbieterpreis, nicht um einen Beleg dafür, dass DeepSeek seine Preise geändert hat. Wenn beide Angaben aktuell sind, unterschätzt die Anzeige von omp die Ausgaben für deepseek-v4-pro-Eingaben um ungefähr das Vierfache. Die allgemeine Lehre gilt für jede Route: Der Dollarbetrag von omp ist die eigene Berechnung des Clients, und das Hauptbuch Ihres Anbieters ist die maßgebliche Zahl.
DeepSeeks Zeitplan ist separat wissenswert, weil er eine Rechnung halbiert, ohne das Modell zu ändern. Auf der Preisseite steht, dass „Spitzenzeiten montags bis freitags von 01:00–04:00 und 06:00–10:00 UTC liegen, chinesische Feiertage ausgenommen“, und dass alle übrigen Zeiten zum halben Tarif als Nebenzeit gelten. Keine hier gelesene Quelle führt den Feiertagskalender auf. Betrachten Sie jede angegebene Woche daher als Näherung.
Günstigste API für Oh My Pi
Ehrlich beantwortet: Kein gemessener Tokenpreis ist günstiger als das Ausführen des Modells auf dem eigenen Rechner, wo überhaupt keine Gebühr pro Anfrage anfällt. Kunavos Textkatalog umfasst die Claude- und GPT-Familien; er enthält kein DeepSeek-Modell und führt nichts lokal aus. Daher steht keine dieser beiden Routen auf der Preisliste. Veröffentlichten Anbieterpreise für die Routen, die omp erreichen kann, alle am 21. September 2026 gelesen:
| Weg | Veröffentlichte Eingabe-/Ausgabegebühr pro 1 Mio. | Quelle |
|---|---|---|
| Ein Modell auf eigener Hardware | Keine Gebühr pro Token; Hardware und Strom gehören Ihnen | Ollama – lokale Nutzung „immer unbegrenzt“ |
| gemini-2.5-flash-lite | 0,10 $ / 0,40 $ (zwischengespeicherte Eingabe 0,01 $) | Google, Standardtarif, Texteingabe |
| deepseek-flash, Nebenzeit | 0,15 $ / 0,60 $ (Cache-Treffer 0,003 $) | DeepSeek |
| gpt-5.6-luna | 0,20 $ / 1,20 $ (zwischengespeicherte Eingabe 0,02 $) | OpenAI, Standardtarif mit kurzem Kontext |
| deepseek-flash, Spitzenzeit | 0,30 $ / 1,20 $ (Cache-Treffer 0,006 $) | DeepSeek, dieselbe Preiskarte |
| gemini-3.5-flash-lite | 0,30 $ / 2,50 $ (zwischengespeicherte Eingabe 0,03 $) | Google, dieselbe Seite, Standardtarif |
Zwei dieser Anbieter sind omp bereits entgegengekommen. DeepSeek veröffentlicht eine eigene Oh-My-Pi-Seite, auf der Sie aufgefordert werden, unter ~/.omp/agent/models.yml einen vollständigen benutzerdefinierten Anbieterblock mit baseUrl: https://api.deepseek.com zu schreiben – beachten Sie: ohne /v1 – und es wird gewarnt: „Verlassen Sie sich nicht auf die integrierten Modelleinträge“, da neuere Builds ihre IDs ohne drei benötigte Kompatibilitätsfelder auflisten. Auch Ollama veröffentlicht eine solche Seite, auf der die gesamte Einrichtung aus ollama launch omp besteht. Dort heißt es, dies „konfiguriert Ollama als Anbieter, richtet Websuchwerkzeuge ein und startet OMP“. Keine der beiden Seiten nennt Kosten. Wenn ein Anbieter Ihre Arbeit abdeckt, sind dies die kürzesten Wege auf dieser Liste.
Der günstigste aufgelistete Tarif und die niedrigsten Kosten für den Abschluss der Aufgabe sind unterschiedliche Aussagen; in der Tabelle oben steht nur die erste. Ein günstiges Modell, das drei Versuche und einen Prüfdurchlauf benötigt, kann mehr kosten als ein teureres Modell, das die Aufgabe in einem einzigen Durchlauf erledigt. omp enthält omp bench, das in der CLI-Referenz als Benchmarking von Modellen anhand des „TTFT/Prefill- gegenüber Decode-Durchsatzes mit p50/p95 über Chat-, Prefill-, Generierungs- und Prompt-Cache-Workloads“ beschrieben wird – nützlich, aber es misst die Geschwindigkeit und nicht die Kosten und erzeugt daher allein keine Zahl für die Kosten bis zum Abschluss. KI-Kostenoptimierung behandelt die Messmethode; der Kostenrechner übernimmt die Berechnung anhand Ihrer eigenen Tokenzahlen.
Eine Beispielschätzung zu Kunavos Live-Tarifen
Dies ist eine beispielhafte Tokenberechnung, keine gemessene Aufgabenkostenangabe und keine Abrechnungsobergrenze. omp verteilt Arbeit auf neun Rollen, die jeweils ein anderes Modell benennen können. Daher wird hier von zwei Rollen ausgegangen: einem default-Durchlauf mit 200.000 nicht zwischengespeicherten Eingabe- und 15.000 Ausgabetoken sowie einem smol-Subagenten-Fan-out mit 120.000 Eingabe- und 8.000 Ausgabetoken. Beide Annahmen gehen von keinen Cache-Treffern aus. Die Tarife sind aktuelle Katalogpreise pro Million Token.
| Modell | Eingabe / Ausgabe pro 1 Mio. | Schätzung, default Turn | Schätzung, smol Fan-out |
|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.192 | $0.112 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.203 | $0.118 |
| Claude Sonnet 5 | $1.40 / $7.00 | $0.385 | $0.224 |
| Claude Opus 5 | $3.50 / $17.50 | $0.963 | $0.560 |
Die Aufteilung der Rollen ist der Hebel, den diese Zahlen veranschaulichen sollen. Wenn Claude Sonnet 5 im Haupt-Turn und Claude Haiku 4.5 im Fan-out ausgeführt werden, beläuft sich die Schätzung für diese Sitzung auf $0.497, gegenüber $0.609, wenn beide Rollen auf Claude Sonnet 5 liegen — dieselbe Arbeit, anders geroutet. Beachten Sie außerdem, dass Claude Sonnet 5 und Claude Opus 5 heute denselben Kunavo-Tarif und daher dieselbe Schätzung haben; das ist eine Tatsache über einen Katalog an einem bestimmten Datum, keine allgemeine Beziehung.
Speziell für Claude lässt sich ein Listenvergleich belegen, da Anthropic auf seiner eigenen Seite am 21. September 2026 Sonnet 5 mit 2 $ / 10 $, Opus 5 mit 5 $ / 25 $ und Haiku 4.5 mit 1 $ / 5 $ pro Million ausweist. Im Vergleich dazu verkauft Kunavo Claude Sonnet 5 about 30% below it; Claude Opus 5 about 30% below it; Claude Haiku 4.5 about 30% below it. Dieser Vergleich gilt nur für die Claude-Zeilen, weil bei diesen drei der Katalogbezug für diesen Leitfaden Zeile für Zeile anhand der aktuellen Anbieterseite geprüft wurde; die GPT-Zeile wird als Kunavo-Tarif ohne angehängten „gegenüber offiziell“-Wert ausgegeben. Modell-IDs unterscheiden sich auf den verschiedenen Oberflächen außerdem in der Schreibweise — OpenAI verwendet Punkte, Kunavos Slugs Bindestriche — kopieren Sie die ID daher von der Oberfläche, die Sie konfigurieren.
Der Katalogbetrag von Kunavo ist eine Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Gebühr meldet, entspricht die Rechnung dem höheren Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem jeweils geltenden Aufschlag. Cache-Gebühren und externe Tools liegen außerhalb dieses Beispiels, und ob Prompt-Cache-Markierungen ein Gateway in omp überstehen, wurde hier nicht getestet — da Caching der größte einzelne Hebel bei einer Rechnung für einen Coding-Agenten ist, behandeln Sie jedes Beispiel, das Cache-Treffer voraussetzt, als Annahme. Die minimale Aufladung beträgt $10 Prepaid-Guthaben, eine Finanzierungsuntergrenze und weder eine monatliche Gebühr noch ein Aufgabenpreis; siehe Abrechnungsdetails und Caching.
Beste API für Oh My Pi: Welche Route gewinnt, wenn
| Weg | Vorteile, wenn | Worauf Sie verzichten |
|---|---|---|
| Direkte Anbieter-API | Ein Anbieter deckt Ihre Arbeit ab und Sie möchten genau dessen Preisliste, Cache-Tarife und jeden geplanten Rabatt anwenden | Eine zweite Familie bedeutet ein zweites Konto und einen zweiten Schlüssel. DeepSeek und Ollama veröffentlichen eigene omp-Seiten; bei dieser Prüfung wurde keine Seite eines anderen Anbieters gefunden |
| Ein OpenAI-kompatibles Gateway | omps Rollen führen Sie in einer Sitzung über mehrere Modellfamilien hinweg, und Sie möchten einen Schlüssel und ein Guthaben für alle dahinter | Entdeckte Modelle werden ohne Preis geliefert, daher werden Tarife für eine Anzeige im Client manuell festgelegt; omps Blöcke openRouterRouting und vercelGatewayRouting sind ausdrücklich als Anbieter-Routing auf openrouter.ai beziehungsweise ai-gateway.vercel.sh dokumentiert, nicht als allgemeine Gateway-Steuerungen |
| Ein Abonnement für einen Coding-Plan | Ein pauschaler monatlicher Betrag passt besser zu Ihnen als nach Token abgerechnete Kosten | omp bindet diese über integrierte Anbieter-IDs und /login ein; ein benutzerdefinierter Anbieter kann keiner davon werden, weil auth: oauth bei einem benutzerdefinierten Modell „vom Schema akzeptiert wird, aber die Anforderung apiKey nicht außer Kraft setzt“. Bring-Your-Own-Key und Abonnement sind hier getrennte Routen, keine Ebenen |
| Ein lokal bereitgestelltes Modell | Kleine, private oder umfangreiche Aufgaben ohne Gebühr pro Anfrage | Hardware, Strom und die Fähigkeitslücke gegenüber einem Frontier-Modell — nichts davon wird von einer Quelle auf dieser Seite bepreist |
Eine Abgrenzung sollte klar ausgesprochen werden, statt sie einer Tabellenzelle zu überlassen. omp bietet /login anthropic, und Anthropic erklärt auf seiner Rechts- und Compliance-Seite, dass die OAuth-Authentifizierung „ausschließlich für Käufer der Claude-Free-, Pro-, Max-, Team- und Enterprise-Abonnements vorgesehen ist und die gewöhnliche Nutzung von Claude Code und anderen nativen Anthropic-Anwendungen unterstützen soll“ und dass „Anthropic es Drittentwicklern nicht gestattet, den Claude.ai-Login in ihren eigenen Anwendungen anzubieten oder Anfragen im Namen ihrer Nutzer über Zugangsdaten von Free-, Pro- oder Max-Tarifen zu routen“. Dieselbe Seite behält sich das Recht vor, dies ohne vorherige Ankündigung durchzusetzen. Diese beiden Tatsachen lassen sich nicht in einem Satz miteinander in Einklang bringen, und es wurde keine Anthropic-Erklärung gefunden, in der Oh My Pi genannt wird. Daher berichtet diese Seite beide Fakten und empfiehlt keine der beiden Lesarten. Außerdem gibt es ein Guthabenmodell für Apps, die sich über Anthropic’s Agent SDK authentifizieren, aber der Help-Center-Artikel beginnt mit „Update 15. Juni: Wir pausieren die unten beschriebenen Änderungen an der Nutzung des Claude Agent SDK“ und wurde zuletzt am 16. Juni 2026 aktualisiert — drei Monate vor dieser Prüfung — und omp führt eigenes OAuth aus, statt dieses SDK zu verwenden. Ob es anwendbar ist, bleibt daher doppelt ungeklärt. Eindeutige Zahlungsmöglichkeiten sind ein auf Sie abgerechneter API-Schlüssel oder ein Gateway-Schlüssel.
Einrichten und die erste Belastung prüfen
Kunavo veröffentlicht eine Konfigurationsreferenz für diesen Client, und eine veröffentlichte Referenz ist kein Kompatibilitätstest: Kunavo hat omp nicht gegen seinen Endpunkt ausgeführt — weder eine Sitzung noch einen gestreamten Turn, einen Tool-Roundtrip oder eine Routing-Prüfung. Alles oben leitet sich aus omps dokumentiertem Schema und den veröffentlichten Seiten der jeweiligen Anbieter ab. Ein Detail, das diese Seite für Sie klärt: Kunavos Route /v1/models gibt das Feld nicht aus, das omps Modus discovery.type: proxy liest, weshalb die dokumentierte Einrichtung stattdessen openai-models-list verwendet; diese Route listet außerdem Medienmodelle auf. Deklarieren Sie die gewünschten Chatmodelle daher manuell, wenn die übrigen Modelle nicht im Auswahlmenü erscheinen sollen.
Halten Sie eine funktionierende Route verfügbar, während Sie es ausprobieren, führen Sie anschließend eine begrenzte Aufgabe aus und vergleichen Sie dann die tatsächliche Belastung Ihres Kontos mit omps Anzeige-Schätzung — bei einem manuell deklarierten cost-Block sollten die Werte nahe beieinanderliegen, ohne einen solchen Block ist die Schätzung null. Beginnen Sie mit dem Integrationsleitfaden für Oh My Pi und erstellen Sie ein Kunavo-Konto, sobald Sie einen Schlüssel aufladen möchten. Wenn Sie noch zwischen Clients statt zwischen Anbietern wählen, vergleicht Oh My Pi vs. OpenCode die beiden hinsichtlich Arbeitsablauf und der Frage, wer Ihnen die Modelle verkauft; Wie ein LLM-Gateway funktioniert erläutert das Konzept, falls dieser Teil neu für Sie ist.
Häufig gestellte Fragen
Wie viel kostet Oh My Pi?
Der Client ist kostenlos. Oh My Pi ist MIT-lizenzierte Open-Source-Software, die per Skript, Homebrew, Bun, Nix oder PowerShell installiert werden kann. Die Website omp.sh veröffentlicht 36 URLs – die Startseite plus 35 Dokumentationsseiten –, ohne Preis-, Abrechnungs-, Checkout-, Abonnement-, Registrierungs-, Konto- oder Anmelderoute darunter (geprüft am 21. September 2026). Es gibt kein Oh-My-Pi-Konto und beim Projekt nichts zu kaufen. Sie bezahlen die Rechnung des Modellanbieters: einen Anbieter-API-Schlüssel, einen Gateway-Schlüssel, ein Coding-Plan-Abonnement oder Hardware und Strom, wenn Sie ein Modell lokal ausführen. Optional bezahlen Sie außerdem für ein Backend zur Websuche; dafür benötigen Sie ein separates Zugangsmittel vom Modellanbieter.
Bietet Oh My Pi einen kostenpflichtigen Plan, ein Abonnement oder einen gehosteten Dienst?
Kein Plan und kein Abonnement. Das einzige gehostete Angebot des Projekts ist das optionale /collab-Sitzungsrelais. Es verwendet standardmäßig my.omp.sh, kann auf einen anderen Host einschließlich ws://localhost:7475 verwiesen werden und hat keinen veröffentlichten Preis. In der Dokumentation steht, dass jede Sitzungsnutzlast mit AES-256-GCM versiegelt wird, bevor sie den Socket berührt, und dass das Relais nur Raum-IDs, Verbindungsanzahlen, undurchsichtige Chiffretext-Frames und deren Größen sieht. Wer dieses Standardrelais finanziert, ob es nach Nutzung abgerechnet wird und ob es kostenlos bleibt, wurde von keiner für diese Seite gelesenen Quelle geklärt. Planen Sie daher nicht damit, dass es auf unbestimmte Zeit kostenlos bleibt.
Warum zeigt Oh My Pi für meine Gateway-Modelle Kosten von 0 $ an?
Weil omp sie absichtlich so eingetragen hat. In der Modelldokumentation steht, dass entdeckte Proxy- und Gateway-Modelle anbieterspezifische Preise haben, die selten mit dem gebündelten Katalog übereinstimmen. Daher setzt die Erkennung sie auf lokal unbekannte Kosten von null, und es wird kein Tarif auf sie angewendet. Alles, was omp durch das Lesen der Modellliste eines Gateways findet, hat folglich keinen Preis, und im Kostensegment der Statuszeile gibt es nichts zu summieren. Die Lösung besteht darin, sich für die Modelle, deren Kosten erfasst werden sollen, nicht auf die Erkennung zu verlassen, sondern jedes Modell manuell in ~/.omp/agent/models.yml mit einem Kostenblock aus input, output, cacheRead und cacheWrite zu deklarieren. Dabei handelt es sich um Tarife pro Million Token; das Schema von omp nennt keine Währung, daher müssen Sie die Einheiten der kopierten Preiskarte übernehmen. Beachten Sie außerdem, dass models.yml keinen zeitbasierten Zeitplan akzeptiert. Ein Anbieter mit Spitzen- und Nebenzeitpreisen kann daher in der Schätzung von omp nicht korrekt modelliert werden.
Welche API ist für Oh My Pi am günstigsten?
Bei veröffentlichten Tokenpreisen sind das lokale Ausführen eines Modells und die günstigen gehosteten Tarife die billigsten Routen. Ollama sagt, dass das Ausführen von Modellen auf eigener Hardware „immer unbegrenzt“ ist, ohne Gebühr pro Token; DeepSeek veröffentlicht deepseek-flash mit 0,15 $ für Eingaben und 0,60 $ für Ausgaben pro Million Token außerhalb der Spitzenzeiten; und Google veröffentlicht gemini-2.5-flash-lite für Text in seinem Standardtarif mit 0,10 $ für Eingaben und 0,40 $ für Ausgaben pro Million (alles geprüft am 21. September 2026). Kunavo verkauft kein DeepSeek und führt keine lokalen Modelle aus. Daher steht keine dieser beiden Routen überhaupt auf der Preisliste, und diese Seite erhebt keinen Anspruch darauf, die günstigste zu sein. Der günstigste veröffentlichte Tarif und die niedrigsten Kosten für den Abschluss der Aufgabe sind unterschiedliche Fragen: Ein günstiges Modell, das drei Versuche und eine menschliche Prüfung benötigt, kann mehr kosten als ein teureres Modell, das die Aufgabe in einem einzigen Durchlauf erledigt. Auch lokale Ausführung verursacht Kosten, für die hier keine Quelle einen Preis nennt – Hardware, Strom und die Fähigkeitslücke gegenüber einem Frontier-Modell.
Welche API ist für Oh My Pi am besten?
Das hängt davon ab, wie viele Modellfamilien Ihre Arbeit umfasst. Eine direkte Anbieter-API ist ideal, wenn Sie innerhalb eines Anbieters bleiben und dessen eigene Preiskarte, Caching-Tarife und zeitlich geplante Rabatte exakt anwenden möchten. DeepSeek und Ollama veröffentlichen jeweils eine eigene Einrichtungsseite für Oh My Pi, daher sind diese beiden Routen vom Anbieter offiziell dokumentiert. Ein Gateway ist ideal, wenn die neun Rollen von omp Sie innerhalb einer Sitzung über mehrere Familien hinweg führen: default, smol, slow, plan, commit, vision, task, advisor und tiny können jeweils ein anderes Modell benennen, und ein Schlüssel für alle vermeidet ein separates Konto pro Anbieter. Der Nachteil besteht darin, dass entdeckte Gateway-Modelle ohne Preis eintreffen. Für eine Kostenanzeige im Client müssen Sie die Tarife daher manuell deklarieren. Außerdem sind die beiden Gateway-Routing-Blöcke von omp ausdrücklich als Provider-Routing auf openrouter.ai und ai-gateway.vercel.sh dokumentiert, nicht als allgemeine Steuerungen, die jedes Gateway versteht. Das lokale Ausführen eines Modells ist ideal für kleine oder private Aufgaben ohne Gebühr pro Anfrage.
Kann ich ein Claude-Pro- oder Max-Abonnement mit Oh My Pi verwenden?
omp stellt die Anmeldeschaltfläche bereit, und die veröffentlichte Richtlinie von Anthropic weist in die andere Richtung. Daher empfiehlt diese Seite diese Route nicht. Auf der Rechts- und Compliance-Seite von Claude Code von Anthropic steht, dass die OAuth-Authentifizierung ausschließlich für Käufer der Abonnementpläne Claude Free, Pro, Max, Team und Enterprise vorgesehen ist und die gewöhnliche Nutzung von Claude Code und anderen nativen Anthropic-Anwendungen unterstützen soll. Außerdem erlaubt Anthropic Drittanbietern nicht, eine Claude.ai-Anmeldung in ihren eigenen Anwendungen anzubieten oder Anfragen im Namen ihrer Nutzer über Zugangsdaten von Free-, Pro- oder Max-Plänen weiterzuleiten. Auf derselben Seite steht, dass Anthropic sich das Recht vorbehält, diese Einschränkungen ohne vorherige Ankündigung durchzusetzen. Ob Anthropic dies ausdrücklich auf Oh My Pi anwendet, wird in keiner von dieser Seite auffindbaren Quelle angegeben. Eindeutig mögliche Routen sind ein Ihnen in Rechnung gestellter Anthropic-API-Schlüssel oder ein Gateway-Schlüssel.
Führt eine fehlerhafte models.yml dazu, dass Oh My Pi nicht mehr funktioniert?
Nein. Das ist wichtig zu wissen, weil es die Auswirkungen eines Fehlers verändert. In der Dokumentation von omp steht, dass die Registry bei fehlgeschlagenen Schema- oder Validierungsprüfungen von models.yml oder models.yaml mit den integrierten Modellen weiterarbeitet und der Fehler über ModelRegistry.getError() offengelegt und in der Oberfläche angezeigt wird. Ein Tippfehler bringt den Client also nicht zum Absturz – Ihr benutzerdefinierter Anbieter ist einfach nicht vorhanden. Dasselbe stille Fehlerverhalten gilt für Zugangsdaten: apiKey eines benutzerdefinierten Anbieters wird zuerst als Name einer Umgebungsvariablen und andernfalls als literaler String aufgelöst. Ein falsch geschriebener Variablenname wird daher ohne Meldung geladen und der Variablenname selbst als Schlüssel gesendet, sodass der Fehler bei der ersten Anfrage und nicht beim Start auftritt.
Jede hier verlinkte Quelle wurde am 21. September 2026 gelesen: die GitHub- und npm-APIs für oh-my-pi und pi-mono, die Sitemap von omp.sh, omps README sowie die Dokumentation zu Modellen, Anbietern, Zusammenarbeit und CLI-Referenz, die Preisliste von DeepSeek und dessen Oh-My-Pi-Seite, die Preis- und Oh-My-Pi-Seiten von Ollama, die Preisseiten von Google und OpenAI sowie die Preis- und Authentifizierungsrichtlinien von Anthropic. Oh My Pi wurde nicht zur Laufzeit gegen Kunavo getestet, und keine Aussage hier beruht auf einer beobachteten Ausführung. Kunavos Token-Tarife stammen aus dem aktuellen Katalog; jeder Dollarbetrag ist eine illustrative Tokenberechnung und keine gemessenen Aufgabenkosten. Versionsnummern, die Anzahl der Sterne und die Anzahl der Sitemap-Einträge ändern sich — prüfen Sie sie erneut, statt ihnen zu vertrauen.