Zurück zu den Leitfäden
Coding-Agenten·1. Oktober 2026·9 Min. Lesezeit

Warp-AI-Preise: Guthaben, Pläne und was eigene Inferenz entfernt

Warps Terminal ist kostenlos, seine KI wird jedoch über drei Guthabentypen verbrauchsabhängig abgerechnet. Ihr eigener Schlüssel oder Endpunkt entfernt KI-Guthaben für die von ihm übertragenen Aufrufe – aber nicht Auto, nicht Cloud-Agenten und im Business-Plan nicht die Plattformgebühr pro Stunde.

Zuletzt überprüft am .

Warps Terminal kostet nichts; seine KI wird in Credits abgerechnet, und genau diese Credits gilt es zu verstehen. Am 1. Oktober 2026 nennt Warps Preisseite für Build 1.500 Credits pro Monat für 20 $, für Max 18.000 für 200 $ und für Business 1.500 pro Sitz für 50 $; weitere Credits werden in Reload-Paketen ab 400 Credits für 10 $ verkauft. Plan-Credits werden alle 30 Tage zurückgesetzt; gekaufte Credits sind 12 Monate gültig. Ein Modellaufruf, den Sie über Ihren eigenen Schlüssel oder Endpunkt leiten, verbraucht überhaupt keine KI-Credits — Auto, Cloud-Agenten und bei Business eine stundenweise Plattformgebühr verbrauchen jedoch weiterhin Credits.

Auf dieser Seite geht es um genau diese Abrechnung: was jeder Topf misst, was ein Credit je Kanal kostet und welche Nutzung durch Ihre eigene Inferenz tatsächlich entfällt. Informationen zu Warp als Produkt im Vergleich zu Claude Code — Lizenzierung, Protokolle und der Ort, an dem das Agenten-Harness läuft — finden Sie unter Warp vs Claude Code. Alles Folgende wurde am 1. Oktober 2026 aus Warps Preisseite und Dokumentation gelesen; niemand hier besitzt ein Warp-Abonnement, daher ist keine Zahl eine gemessene Rechnung.

Welches Warp hier gemeint ist

Warp bezeichnet hier das agentische Terminal von warp.dev — die Desktop-App und die Warp Agent CLI. Gemeint ist weder Cloudflares WARP, der 1.1.1.1-VPN-Client mit einem eigenen kostenpflichtigen Tarif, noch das Rust-Webframework namens warp. Keine der folgenden Preise gilt für diese beiden Produkte.

Die Tarife und ihre Leistungen

TarifMonatlichJährlich abgerechnetEnthaltene CreditsIhre eigene Inferenz
Kostenlos$0$0Keine für den Warp AgentEigene API-Schlüssel, SuperGrok oder ein benutzerdefinierter Endpunkt — für Einzelpersonen und Organisationen mit höchstens 10 Mitarbeitenden
Build$2018 $ pro Monat1.500 pro Monat — auf der Karte steht „20 $ enthaltene Agentennutzung zu API-Tarifen“Wie bei Free
Max$200180 $ pro Monat18.000 pro Monat — von Warp mit 240 $ bewertetWie bei Free
Business50 $ pro Sitz45 $ pro Sitz1.500 pro Sitz; bis zu 25 SitzeFür Organisationen mit mehr als 10 Mitarbeitenden freigeschaltet
EnterpriseIndividuellIndividuellBenutzerdefinierte gemeinsame PoolsFügt BYOLLM (Inferenz in Ihrer eigenen Cloud) sowie vom Team verwaltete Schlüssel und Endpunkte hinzu

„Pay as you go, starting at“ ist Warps eigene Formulierung auf jeder kostenpflichtigen Karte: Das Abonnement ist eine Untergrenze, und alles über den enthaltenen Credits wird als Reload-Credits gekauft.

Drei Töpfe, ein Guthaben

Warps Dokumentation rechnet Agentenarbeit in drei Arten von Credits ab, die alle aus demselben Guthaben schöpfen — zuerst Plan-Credits, danach Reload-Credits.

TopfWofür er bezahltWann er verbraucht wird
AI-CreditsDer ModellaufrufWenn Warp den Anbieter bezahlt — von Warp verwaltete Modelle und immer bei Auto
Compute-CreditsDie Sandbox, in der ein Agent läuftCloud-Agentenläufe auf von Warp gehosteten Workern; lokale Läufe verwenden Ihren Rechner und verbrauchen keine
Platform-CreditsLebenszyklus des Laufs, Integrationen, Dashboard, APIs, Observability — abgerechnet nach AgentenstundeJeder Cloud-Agentenlauf in jedem Tarif sowie lokale Läufe bei Business oder Enterprise, die Ihren eigenen Schlüssel, Endpunkt oder BYOLLM verwenden

Zwei Details bestimmen die tatsächlichen Rechnungen. Platform-Credits fallen pro Agentenstunde an, bei Teilstunden anteilig, und beim Warp Agent nur während der Generierung — bei Claude Code und Codex, die als Cloud-Harnesses laufen, zählt dagegen der gesamte Lauf einschließlich der Wartezeit auf den Modellanbieter. Der Stundensatz ist dort, wohin die Dokumentation verweist, nicht angegeben: Die Seite zu Platform-Credits verweist für aktuelle Tarife auf die Preisseite, und am 1. Oktober 2026 war dort kein Satz aufgeführt.

Was ein Credit je Kanal kostet

Wie Sie den Credit erhaltenGuthabenPreisPro Credit
Build-Tarif1,500$20$0.0133
Max-Tarif18,000$200$0.0111
Reload-Paket, kostenpflichtiger Tarif400$10$0.0250
Reload-Paket, kostenpflichtiger Tarif1,000$20$0.0200
Reload-Paket, kostenpflichtiger Tarif3,000$50$0.0167
Reload-Paket, kostenpflichtiger Tarif6,500$100$0.0154
Reload-Paket, Free-Tarif400Laut Warp 20 % über dem Tarif für kostenpflichtige Pläneetwa $0.030

Die Spalte pro Credit ist eine Division der Listenpreise von Warp; die Zeile für den Free-Tarif wendet Warps genannte 20 % auf den kostenpflichtigen Tarif an, statt einen gedruckten Preis zu zitieren. Warps eigener Tooltip nennt Max „etwa 17 % günstiger pro Credit als der Kauf von Reload-Credits“; eine einfache Division gegenüber der besten Reload-Stufe ergibt eine größere Differenz. Betrachten Sie die 17 % daher als Warps Darstellung, nicht als eine von dieser Seite abgeleitete Zahl. Keine dieser Zeilen sagt Ihnen, wie viele Credits Ihre Arbeit verbraucht: Warp erklärt, dass zwei ähnliche Prompts unterschiedliche Mengen verwenden können, dass größere Modelle, mehr Tool-Aufrufe und mehr Kontext den Verbrauch erhöhen und dass es keine Formel gibt.

Zurücksetzung, Übertragung und Teampool

  • Plan-Credits werden alle 30 Tage zurückgesetzt — gerechnet ab Ihrem Abonnement- oder Verlängerungsdatum, nicht nach dem Kalendermonat — und nicht übertragen.
  • Reload-Credits werden übertragen und bleiben ab dem Kauf 12 Monate gültig, auch nach einem Downgrade zu Free. Sie sind nur erstattungsfähig, wenn kein Credit verwendet wurde.
  • In einem Team bilden Reload-Credits einen gemeinsamen Pool. Jedes Mitglied kann sie kaufen; jedes Mitglied verbraucht zuerst seine eigenen Plan-Credits und danach den gemeinsamen Pool — ein intensiver Nutzer kann also Credits ausgeben, die jemand anderes gekauft hat. Guthaben in persönlichen Pools aus dem Zeitraum Mai bis August 2026 wird erst verwendet, wenn der gemeinsame Pool leer ist.
  • Auto-reload ist für neue Abonnenten standardmäßig deaktiviert; wird es aktiviert, kauft es das ausgewählte Paket, sobald das Guthaben unter 100 Credits fällt, unter einem monatlichen Ausgabenlimit, das bei 200 $ beginnt und im Kalendermonat statt im Abrechnungszyklus zurückgesetzt wird.
  • Wenn die Credits ausgehen, deaktiviert ein kostenpflichtiger Tarif ohne Reload die Premium-Modelle bis zur nächsten Zurücksetzung; Warp dokumentiert außerdem ein separates Tokenlimit, das als QuotaLimit gemeldet wird und alle Modelle stoppen kann, selbst wenn noch Credits vorhanden sind.

Wann Ihre eigene Inferenz Credits ersetzt — und wann nicht

Warp dokumentiert drei Möglichkeiten, eigenen Modellzugriff einzubringen: einen API-Schlüssel für OpenAI, Anthropic oder Google (BYOK), ein SuperGrok- oder X-Premium-Abonnement für Grok sowie einen benutzerdefinierten Inferenz-Endpunkt — jeden Dienst, der OpenAI Chat Completions implementiert. Für darüber geleitete Anfragen verbraucht Warp keine AI-Credits, und der Anbieter stellt Ihnen die Kosten direkt in Rechnung. Die Ausnahmen machen ein Budget verlässlich:

  • Auto verwendet immer Warp-Credits. Um Ihren Endpunkt zu verwenden, müssen Sie im Auswahlfeld das über den Endpunkt geleitete Modell wählen; auch benutzerdefinierte Router können kein solches Modell auflösen.
  • Cloud-Agenten verwenden immer Warp-Credits. Ein benutzerdefinierter Self-Service-Endpunkt wird auf Ihrem Gerät gespeichert und erreicht Cloud-Läufe nie; in Enterprise können Administratoren vom Team verwaltete Endpunkte konfigurieren, die dies können.
  • Business und Enterprise zahlen Platform-Credits bei lokalen Agentenläufen, die Ihren eigenen Schlüssel oder Endpunkt verwenden. Bei Free, Build und Max verbrauchen lokale Läufe mit eigener Inferenz keine.
  • Die Grenze von 10 Mitarbeitenden. Self-Service-BYOK und benutzerdefinierte Endpunkte sind gemäß Warps Bedingungen für Einzelpersonen und Organisationen mit höchstens 10 Mitarbeitenden vorgesehen; darüber ist Business oder Enterprise erforderlich.
  • Die App, nicht die CLI. Warps Preis-FAQ sagt, dass benutzerdefinierte Inferenz-Endpunkte nur in der Warp-App verfügbar sind; die Warp Agent CLI nimmt API-Schlüssel und SuperGrok über /api-keys entgegen.
  • Eine öffentliche URL über Warps Server. Das Agenten-Harness läuft auf Warps Backend und ruft Ihren Endpunkt von dort aus auf; daher werden localhost und private Adressen abgelehnt, und Warp erklärt, dass Zero Data Retention für diesen Datenverkehr nicht erzwungen werden kann.

Drei Budgets, durchgerechnet

Diese Beispiele sind illustrativ, nicht gemessen. Die Token-Seite nimmt einen Entwicklermonat mit 20 Mio. nicht gecachten Eingabetokens und 0.8 Mio. Ausgabetokens über einen benutzerdefinierten Endpunkt zu Kunavos aktuellen Katalogtarifen pro Million Tokens an; Cache-Rabatte, Wiederholungen und alles, was weiterhin Warp-Credits verbraucht, sind ausgeschlossen.

Modell über den EndpunktEingabe / Ausgabe pro 1 Mio.Angenommener Tokenmonat
Claude Haiku 4.5$0.70 / $3.50$16.80
GPT-5.6 Terra$0.70 / $4.20$17.36
Claude Sonnet 5$1.40 / $7.00$33.60
  • Ein einzelner Entwickler im Free-Tarif mit einem Endpunkt. Warp berechnet 0 $; die Modellrechnung stammt vom Endpunkt. Auto und jeder Cloud-Agentenlauf benötigen Credits, was bei Free Reload-Credits zum höheren Tarif bedeutet.
  • Derselbe Entwickler im Build-Tarif. Für 20 $ monatlich erhalten Sie 1.500 Credits für Auto, Cloud-Läufe und Modelle, die Sie nicht über Ihren Endpunkt leiten; die Endpunktrechnung bleibt unverändert. Build lohnt sich für das, was die Credits und der Tarif hinzufügen, nicht für den Endpunkt, den Free bereits erlaubt.
  • Ein Unternehmen mit 12 Personen. Oberhalb der Grenze von 10 Mitarbeitenden erfordert eigene Inferenz Business: 50 $ pro Sitz zuzüglich Platform-Credits für jede lokale Agentenstunde, die den Endpunkt verwendet, zu einem Satz, den Warp auf seiner Preisseite nicht angibt — fragen Sie nach, bevor Sie ein Team darauf festlegen.

Den Endpunkt einrichten, falls Sie diesen Weg wählen

Warps Dokumentation zu benutzerdefinierten Endpunkten nennt die Schritte: Öffnen Sie Settings, suchen Sie nach inference endpoint, fügen Sie die Basis-URL mit /v1/chat/completions und einen Schlüssel hinzu, tragen Sie die Modellkennungen ein und speichern Sie. Das eigene Beispiel für ein lokales Modell verwendet eine URL mit der Endung /v1.

Benutzerdefinierter Inferenz-Endpunkt von Warp — Felder aus der Warp-Dokumentation, hier nicht getestet
Warp app  →  Settings  →  search "inference endpoint"

Endpoint URL   https://api.kunavo.com/v1     (the base that exposes /v1/chat/completions)
API key        sk-kn-...                     (stored in your OS keychain, sent per request)
Model IDs      claude-sonnet-5, claude-haiku-4-5  (one per model you want in the picker)

Then pick the endpoint-routed model in the model picker — not Auto.

Kunavos Endpunkt ist öffentlich und OpenAI-kompatibel, also das, was Warp verlangt — doch dies ist eine Übereinstimmung zwischen zwei Dokumentationssätzen. Niemand bei Kunavo hat Warp damit ausgeführt. Senden Sie daher eine begrenzte Aufgabe, bestätigen Sie, dass sie streamt und ein Tool-Aufruf zurückgegeben wird, und vergleichen Sie Warps Credit-Symbol (das für diese Runde null AI-Credits anzeigen sollte) mit der Belastung in Ihrem Kunavo-Nutzungsprotokoll. Kunavo rechnet pro Token aus einem Prepaid-Guthaben mit einer Mindestaufladung von $10 und ohne Abonnement ab — siehe Abrechnung.

Ihre eigenen Credits pro Aufgabe messen

Da Warp kein Verhältnis von Credits zu Tokens veröffentlicht, ist die einzige verlässliche Zahl Ihre eigene. Bewegen Sie in der App den Mauszeiger über das Credit-Symbol unter einer Agentenantwort, um die Credits dieser Runde zu sehen; in der Warp Agent CLI gibt /cost die Credits pro Antwort aus; Settings > Billing and usage enthält die laufende Summe, wobei Platform-, AI- und Compute-Credits getrennt angezeigt werden. Führen Sie dieselbe kleine Aufgabe einmal mit einem von Warp verwalteten Modell und einmal über Ihren Endpunkt aus — damit haben Sie den einen Vergleich, den keine Preisseite liefern kann.

Weiterführende Lektüre: Warp vs Claude Code für die Produktentscheidung, OpenAI-kompatible API für die Anforderungen an einen Endpunkt und das Verzeichnis für KI-Agenten-APIs für andere Agenten, die einen benutzerdefinierten Endpunkt ohne Tarifbeschränkung akzeptieren.

Häufig gestellte Fragen

Wie viel kostet Warps KI?

Warps Terminal ist kostenlos, seine KI wird jedoch in Credits abgerechnet. Am 1. Oktober 2026 nennt die Preisseite von Warp Free mit 0 $ ohne enthaltene Agentennutzung, Build mit 20 $ monatlich und 1.500 Credits, Max mit 200 $ monatlich und 18.000 Credits, Business mit 50 $ pro Sitz und Monat sowie 1.500 Credits pro Sitz für bis zu 25 Sitze und Enterprise zu individuellen Konditionen; bei jährlicher Zahlung gibt es 10 % Rabatt. Zusätzliche Credits sind in Reload-Paketen erhältlich, von 400 Credits für 10 $ bis 6.500 für 100 $ bei kostenpflichtigen Tarifen; Warp sagt, dass die Reload-Tarife im Free-Tarif 20 % höher sind. Wenn Sie Ihren eigenen API-Schlüssel oder einen benutzerdefinierten Inferenz-Endpunkt für ein Modell verwenden, verbrauchen die Aufrufe dieses Modells keine Warp-AI-Credits.

Was ist ein Warp-Credit, und wie viele Tokens entspricht er?

Ein Credit ist Warps Einheit für Agentenarbeit; Warp veröffentlicht keine Umrechnung in Tokens. Laut Dokumentation skaliert der Credit-Verbrauch mit den verarbeiteten Tokens und folgt im Allgemeinen der API-Preisgestaltung des Modells, doch es gibt keine exakte Formel und zwei ähnliche Prompts können unterschiedlich viele Credits verbrauchen. Außerdem werden drei getrennte Töpfe aus einem Guthaben abgerechnet: AI-Credits für den Modellaufruf, Compute-Credits für von Warp gehostete Sandboxes bei Cloud-Ausführungen und Platform-Credits, die nach Agentenstunde abgerechnet werden. Um Ihr eigenes Verhältnis zu ermitteln, führen Sie eine Aufgabe aus und lesen Sie das Credit-Symbol unter der Antwort in der App ab oder verwenden Sie /cost in der Warp Agent CLI.

Wird Warps KI kostenlos, wenn ich meinen eigenen API-Schlüssel oder Endpunkt verwende?

Dadurch entfallen AI-Credits für die darüber geleiteten Anfragen, aber nicht alle anderen Gebühren. Warps Auto-Modelle verwenden immer Warp-Credits, benutzerdefinierte Router können kein über einen Endpunkt geleitetes Modell auflösen, Cloud-Agentenläufe verbrauchen immer Credits, und Funktionen wie Codebase Context nutzen Warps Infrastruktur. Bei Business und Enterprise verbrauchen lokale Agentenläufe mit Ihrem eigenen Schlüssel oder Endpunkt weiterhin Platform-Credits, abgerechnet nach Agentenstunde. Warps Bedingungen beschränken Self-Service-BYOK und benutzerdefinierte Endpunkte außerdem auf Einzelpersonen und Organisationen mit höchstens 10 Mitarbeitenden; größere Organisationen benötigen Business oder Enterprise.

Werden ungenutzte Warp-Credits übertragen?

Plan-Credits werden nicht übertragen, Reload-Credits schon. Laut Warps Preis-FAQ werden enthaltene monatliche Credits alle 30 Tage ab dem Abonnement- oder Verlängerungsdatum zurückgesetzt; die Dokumentation zu Add-on-Credits besagt, dass gekaufte Credits über Abrechnungszyklen hinweg übertragen werden und 12 Monate ab dem Kauf gültig bleiben, auch nach einem Wechsel in den Free-Tarif. In einem Team fließen gekaufte Credits in einen gemeinsamen Pool, aus dem jedes Mitglied schöpft, sobald seine eigenen Plan-Credits aufgebraucht sind. Ein intensiver Nutzer kann daher Credits ausgeben, die ein anderes Mitglied gekauft hat; Administratoren können ein teamweites monatliches Ausgabenlimit festlegen.

Kann Warp einen OpenAI-kompatiblen Endpunkt wie Kunavo verwenden?

Warp dokumentiert einen benutzerdefinierten Inferenz-Endpunkt für jeden Dienst, der die OpenAI Chat Completions API implementiert. Er wird in der Warp-App unter Settings konfiguriert, indem Sie nach inference endpoint suchen und Basis-URL, API-Schlüssel sowie Modellkennungen eingeben. Der Endpunkt muss unter einer öffentlichen URL erreichbar sein, da die Anfrage auf Warps Servern zusammengestellt wird; Warp erklärt, dass Zero Data Retention für diesen Datenverkehr nicht erzwungen werden kann. Benutzerdefinierte Endpunkte sind nur in der Warp-App verfügbar, nicht in der Warp Agent CLI. Kunavos Endpunkt ist öffentlich und OpenAI-kompatibel, aber niemand bei Kunavo hat Warp damit ausgeführt; betrachten Sie die erste Anfrage daher als eigenen Test.

Gelesen am 1. Oktober 2026: warp.dev/pricing (Tarifkarten und FAQ in den strukturierten Daten) sowie Warps Dokumentation zu Plänen und Abrechnung, Credits, Add-on-Credits, Platform-Credits, benutzerdefiniertem Inferenz-Endpunkt und Bring Your Own API Key. Nicht veröffentlicht: ein Platform-Credit-Satz pro Agentenstunde sowie eine Umrechnung von Credits in Tokens. Nicht getestet: Warp wurde weder installiert noch abonniert, und keine Anfrage wurde von Warp an Kunavo gesendet. Kunavos Tokenpreise stammen aus dem Live-Katalog; jeder Dollarbetrag in der Tokentabelle ist illustrative Arithmetik.