Warps Terminal kostet nichts; seine KI wird in Credits abgerechnet, und genau diese Credits gilt es zu verstehen. Am 1. Oktober 2026 nennt Warps Preisseite für Build 1.500 Credits pro Monat für 20 $, für Max 18.000 für 200 $ und für Business 1.500 pro Sitz für 50 $; weitere Credits werden in Reload-Paketen ab 400 Credits für 10 $ verkauft. Plan-Credits werden alle 30 Tage zurückgesetzt; gekaufte Credits sind 12 Monate gültig. Ein Modellaufruf, den Sie über Ihren eigenen Schlüssel oder Endpunkt leiten, verbraucht überhaupt keine KI-Credits — Auto, Cloud-Agenten und bei Business eine stundenweise Plattformgebühr verbrauchen jedoch weiterhin Credits.
Auf dieser Seite geht es um genau diese Abrechnung: was jeder Topf misst, was ein Credit je Kanal kostet und welche Nutzung durch Ihre eigene Inferenz tatsächlich entfällt. Informationen zu Warp als Produkt im Vergleich zu Claude Code — Lizenzierung, Protokolle und der Ort, an dem das Agenten-Harness läuft — finden Sie unter Warp vs Claude Code. Alles Folgende wurde am 1. Oktober 2026 aus Warps Preisseite und Dokumentation gelesen; niemand hier besitzt ein Warp-Abonnement, daher ist keine Zahl eine gemessene Rechnung.
Welches Warp hier gemeint ist
Warp bezeichnet hier das agentische Terminal von warp.dev — die Desktop-App und die Warp Agent CLI. Gemeint ist weder Cloudflares WARP, der 1.1.1.1-VPN-Client mit einem eigenen kostenpflichtigen Tarif, noch das Rust-Webframework namens warp. Keine der folgenden Preise gilt für diese beiden Produkte.
Die Tarife und ihre Leistungen
| Tarif | Monatlich | Jährlich abgerechnet | Enthaltene Credits | Ihre eigene Inferenz |
|---|---|---|---|---|
| Kostenlos | $0 | $0 | Keine für den Warp Agent | Eigene API-Schlüssel, SuperGrok oder ein benutzerdefinierter Endpunkt — für Einzelpersonen und Organisationen mit höchstens 10 Mitarbeitenden |
| Build | $20 | 18 $ pro Monat | 1.500 pro Monat — auf der Karte steht „20 $ enthaltene Agentennutzung zu API-Tarifen“ | Wie bei Free |
| Max | $200 | 180 $ pro Monat | 18.000 pro Monat — von Warp mit 240 $ bewertet | Wie bei Free |
| Business | 50 $ pro Sitz | 45 $ pro Sitz | 1.500 pro Sitz; bis zu 25 Sitze | Für Organisationen mit mehr als 10 Mitarbeitenden freigeschaltet |
| Enterprise | Individuell | Individuell | Benutzerdefinierte gemeinsame Pools | Fügt BYOLLM (Inferenz in Ihrer eigenen Cloud) sowie vom Team verwaltete Schlüssel und Endpunkte hinzu |
„Pay as you go, starting at“ ist Warps eigene Formulierung auf jeder kostenpflichtigen Karte: Das Abonnement ist eine Untergrenze, und alles über den enthaltenen Credits wird als Reload-Credits gekauft.
Drei Töpfe, ein Guthaben
Warps Dokumentation rechnet Agentenarbeit in drei Arten von Credits ab, die alle aus demselben Guthaben schöpfen — zuerst Plan-Credits, danach Reload-Credits.
| Topf | Wofür er bezahlt | Wann er verbraucht wird |
|---|---|---|
| AI-Credits | Der Modellaufruf | Wenn Warp den Anbieter bezahlt — von Warp verwaltete Modelle und immer bei Auto |
| Compute-Credits | Die Sandbox, in der ein Agent läuft | Cloud-Agentenläufe auf von Warp gehosteten Workern; lokale Läufe verwenden Ihren Rechner und verbrauchen keine |
| Platform-Credits | Lebenszyklus des Laufs, Integrationen, Dashboard, APIs, Observability — abgerechnet nach Agentenstunde | Jeder Cloud-Agentenlauf in jedem Tarif sowie lokale Läufe bei Business oder Enterprise, die Ihren eigenen Schlüssel, Endpunkt oder BYOLLM verwenden |
Zwei Details bestimmen die tatsächlichen Rechnungen. Platform-Credits fallen pro Agentenstunde an, bei Teilstunden anteilig, und beim Warp Agent nur während der Generierung — bei Claude Code und Codex, die als Cloud-Harnesses laufen, zählt dagegen der gesamte Lauf einschließlich der Wartezeit auf den Modellanbieter. Der Stundensatz ist dort, wohin die Dokumentation verweist, nicht angegeben: Die Seite zu Platform-Credits verweist für aktuelle Tarife auf die Preisseite, und am 1. Oktober 2026 war dort kein Satz aufgeführt.
Was ein Credit je Kanal kostet
| Wie Sie den Credit erhalten | Guthaben | Preis | Pro Credit |
|---|---|---|---|
| Build-Tarif | 1,500 | $20 | $0.0133 |
| Max-Tarif | 18,000 | $200 | $0.0111 |
| Reload-Paket, kostenpflichtiger Tarif | 400 | $10 | $0.0250 |
| Reload-Paket, kostenpflichtiger Tarif | 1,000 | $20 | $0.0200 |
| Reload-Paket, kostenpflichtiger Tarif | 3,000 | $50 | $0.0167 |
| Reload-Paket, kostenpflichtiger Tarif | 6,500 | $100 | $0.0154 |
| Reload-Paket, Free-Tarif | 400 | Laut Warp 20 % über dem Tarif für kostenpflichtige Pläne | etwa $0.030 |
Die Spalte pro Credit ist eine Division der Listenpreise von Warp; die Zeile für den Free-Tarif wendet Warps genannte 20 % auf den kostenpflichtigen Tarif an, statt einen gedruckten Preis zu zitieren. Warps eigener Tooltip nennt Max „etwa 17 % günstiger pro Credit als der Kauf von Reload-Credits“; eine einfache Division gegenüber der besten Reload-Stufe ergibt eine größere Differenz. Betrachten Sie die 17 % daher als Warps Darstellung, nicht als eine von dieser Seite abgeleitete Zahl. Keine dieser Zeilen sagt Ihnen, wie viele Credits Ihre Arbeit verbraucht: Warp erklärt, dass zwei ähnliche Prompts unterschiedliche Mengen verwenden können, dass größere Modelle, mehr Tool-Aufrufe und mehr Kontext den Verbrauch erhöhen und dass es keine Formel gibt.
Zurücksetzung, Übertragung und Teampool
- Plan-Credits werden alle 30 Tage zurückgesetzt — gerechnet ab Ihrem Abonnement- oder Verlängerungsdatum, nicht nach dem Kalendermonat — und nicht übertragen.
- Reload-Credits werden übertragen und bleiben ab dem Kauf 12 Monate gültig, auch nach einem Downgrade zu Free. Sie sind nur erstattungsfähig, wenn kein Credit verwendet wurde.
- In einem Team bilden Reload-Credits einen gemeinsamen Pool. Jedes Mitglied kann sie kaufen; jedes Mitglied verbraucht zuerst seine eigenen Plan-Credits und danach den gemeinsamen Pool — ein intensiver Nutzer kann also Credits ausgeben, die jemand anderes gekauft hat. Guthaben in persönlichen Pools aus dem Zeitraum Mai bis August 2026 wird erst verwendet, wenn der gemeinsame Pool leer ist.
- Auto-reload ist für neue Abonnenten standardmäßig deaktiviert; wird es aktiviert, kauft es das ausgewählte Paket, sobald das Guthaben unter 100 Credits fällt, unter einem monatlichen Ausgabenlimit, das bei 200 $ beginnt und im Kalendermonat statt im Abrechnungszyklus zurückgesetzt wird.
- Wenn die Credits ausgehen, deaktiviert ein kostenpflichtiger Tarif ohne Reload die Premium-Modelle bis zur nächsten Zurücksetzung; Warp dokumentiert außerdem ein separates Tokenlimit, das als
QuotaLimitgemeldet wird und alle Modelle stoppen kann, selbst wenn noch Credits vorhanden sind.
Wann Ihre eigene Inferenz Credits ersetzt — und wann nicht
Warp dokumentiert drei Möglichkeiten, eigenen Modellzugriff einzubringen: einen API-Schlüssel für OpenAI, Anthropic oder Google (BYOK), ein SuperGrok- oder X-Premium-Abonnement für Grok sowie einen benutzerdefinierten Inferenz-Endpunkt — jeden Dienst, der OpenAI Chat Completions implementiert. Für darüber geleitete Anfragen verbraucht Warp keine AI-Credits, und der Anbieter stellt Ihnen die Kosten direkt in Rechnung. Die Ausnahmen machen ein Budget verlässlich:
- Auto verwendet immer Warp-Credits. Um Ihren Endpunkt zu verwenden, müssen Sie im Auswahlfeld das über den Endpunkt geleitete Modell wählen; auch benutzerdefinierte Router können kein solches Modell auflösen.
- Cloud-Agenten verwenden immer Warp-Credits. Ein benutzerdefinierter Self-Service-Endpunkt wird auf Ihrem Gerät gespeichert und erreicht Cloud-Läufe nie; in Enterprise können Administratoren vom Team verwaltete Endpunkte konfigurieren, die dies können.
- Business und Enterprise zahlen Platform-Credits bei lokalen Agentenläufen, die Ihren eigenen Schlüssel oder Endpunkt verwenden. Bei Free, Build und Max verbrauchen lokale Läufe mit eigener Inferenz keine.
- Die Grenze von 10 Mitarbeitenden. Self-Service-BYOK und benutzerdefinierte Endpunkte sind gemäß Warps Bedingungen für Einzelpersonen und Organisationen mit höchstens 10 Mitarbeitenden vorgesehen; darüber ist Business oder Enterprise erforderlich.
- Die App, nicht die CLI. Warps Preis-FAQ sagt, dass benutzerdefinierte Inferenz-Endpunkte nur in der Warp-App verfügbar sind; die Warp Agent CLI nimmt API-Schlüssel und SuperGrok über
/api-keysentgegen. - Eine öffentliche URL über Warps Server. Das Agenten-Harness läuft auf Warps Backend und ruft Ihren Endpunkt von dort aus auf; daher werden localhost und private Adressen abgelehnt, und Warp erklärt, dass Zero Data Retention für diesen Datenverkehr nicht erzwungen werden kann.
Drei Budgets, durchgerechnet
Diese Beispiele sind illustrativ, nicht gemessen. Die Token-Seite nimmt einen Entwicklermonat mit 20 Mio. nicht gecachten Eingabetokens und 0.8 Mio. Ausgabetokens über einen benutzerdefinierten Endpunkt zu Kunavos aktuellen Katalogtarifen pro Million Tokens an; Cache-Rabatte, Wiederholungen und alles, was weiterhin Warp-Credits verbraucht, sind ausgeschlossen.
| Modell über den Endpunkt | Eingabe / Ausgabe pro 1 Mio. | Angenommener Tokenmonat |
|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $16.80 |
| GPT-5.6 Terra | $0.70 / $4.20 | $17.36 |
| Claude Sonnet 5 | $1.40 / $7.00 | $33.60 |
- Ein einzelner Entwickler im Free-Tarif mit einem Endpunkt. Warp berechnet 0 $; die Modellrechnung stammt vom Endpunkt. Auto und jeder Cloud-Agentenlauf benötigen Credits, was bei Free Reload-Credits zum höheren Tarif bedeutet.
- Derselbe Entwickler im Build-Tarif. Für 20 $ monatlich erhalten Sie 1.500 Credits für Auto, Cloud-Läufe und Modelle, die Sie nicht über Ihren Endpunkt leiten; die Endpunktrechnung bleibt unverändert. Build lohnt sich für das, was die Credits und der Tarif hinzufügen, nicht für den Endpunkt, den Free bereits erlaubt.
- Ein Unternehmen mit 12 Personen. Oberhalb der Grenze von 10 Mitarbeitenden erfordert eigene Inferenz Business: 50 $ pro Sitz zuzüglich Platform-Credits für jede lokale Agentenstunde, die den Endpunkt verwendet, zu einem Satz, den Warp auf seiner Preisseite nicht angibt — fragen Sie nach, bevor Sie ein Team darauf festlegen.
Den Endpunkt einrichten, falls Sie diesen Weg wählen
Warps Dokumentation zu benutzerdefinierten Endpunkten nennt die Schritte: Öffnen Sie Settings, suchen Sie nach inference endpoint, fügen Sie die Basis-URL mit /v1/chat/completions und einen Schlüssel hinzu, tragen Sie die Modellkennungen ein und speichern Sie. Das eigene Beispiel für ein lokales Modell verwendet eine URL mit der Endung /v1.
Warp app → Settings → search "inference endpoint"
Endpoint URL https://api.kunavo.com/v1 (the base that exposes /v1/chat/completions)
API key sk-kn-... (stored in your OS keychain, sent per request)
Model IDs claude-sonnet-5, claude-haiku-4-5 (one per model you want in the picker)
Then pick the endpoint-routed model in the model picker — not Auto.Kunavos Endpunkt ist öffentlich und OpenAI-kompatibel, also das, was Warp verlangt — doch dies ist eine Übereinstimmung zwischen zwei Dokumentationssätzen. Niemand bei Kunavo hat Warp damit ausgeführt. Senden Sie daher eine begrenzte Aufgabe, bestätigen Sie, dass sie streamt und ein Tool-Aufruf zurückgegeben wird, und vergleichen Sie Warps Credit-Symbol (das für diese Runde null AI-Credits anzeigen sollte) mit der Belastung in Ihrem Kunavo-Nutzungsprotokoll. Kunavo rechnet pro Token aus einem Prepaid-Guthaben mit einer Mindestaufladung von $10 und ohne Abonnement ab — siehe Abrechnung.
Ihre eigenen Credits pro Aufgabe messen
Da Warp kein Verhältnis von Credits zu Tokens veröffentlicht, ist die einzige verlässliche Zahl Ihre eigene. Bewegen Sie in der App den Mauszeiger über das Credit-Symbol unter einer Agentenantwort, um die Credits dieser Runde zu sehen; in der Warp Agent CLI gibt /cost die Credits pro Antwort aus; Settings > Billing and usage enthält die laufende Summe, wobei Platform-, AI- und Compute-Credits getrennt angezeigt werden. Führen Sie dieselbe kleine Aufgabe einmal mit einem von Warp verwalteten Modell und einmal über Ihren Endpunkt aus — damit haben Sie den einen Vergleich, den keine Preisseite liefern kann.
Weiterführende Lektüre: Warp vs Claude Code für die Produktentscheidung, OpenAI-kompatible API für die Anforderungen an einen Endpunkt und das Verzeichnis für KI-Agenten-APIs für andere Agenten, die einen benutzerdefinierten Endpunkt ohne Tarifbeschränkung akzeptieren.
Häufig gestellte Fragen
Wie viel kostet Warps KI?
Warps Terminal ist kostenlos, seine KI wird jedoch in Credits abgerechnet. Am 1. Oktober 2026 nennt die Preisseite von Warp Free mit 0 $ ohne enthaltene Agentennutzung, Build mit 20 $ monatlich und 1.500 Credits, Max mit 200 $ monatlich und 18.000 Credits, Business mit 50 $ pro Sitz und Monat sowie 1.500 Credits pro Sitz für bis zu 25 Sitze und Enterprise zu individuellen Konditionen; bei jährlicher Zahlung gibt es 10 % Rabatt. Zusätzliche Credits sind in Reload-Paketen erhältlich, von 400 Credits für 10 $ bis 6.500 für 100 $ bei kostenpflichtigen Tarifen; Warp sagt, dass die Reload-Tarife im Free-Tarif 20 % höher sind. Wenn Sie Ihren eigenen API-Schlüssel oder einen benutzerdefinierten Inferenz-Endpunkt für ein Modell verwenden, verbrauchen die Aufrufe dieses Modells keine Warp-AI-Credits.
Was ist ein Warp-Credit, und wie viele Tokens entspricht er?
Ein Credit ist Warps Einheit für Agentenarbeit; Warp veröffentlicht keine Umrechnung in Tokens. Laut Dokumentation skaliert der Credit-Verbrauch mit den verarbeiteten Tokens und folgt im Allgemeinen der API-Preisgestaltung des Modells, doch es gibt keine exakte Formel und zwei ähnliche Prompts können unterschiedlich viele Credits verbrauchen. Außerdem werden drei getrennte Töpfe aus einem Guthaben abgerechnet: AI-Credits für den Modellaufruf, Compute-Credits für von Warp gehostete Sandboxes bei Cloud-Ausführungen und Platform-Credits, die nach Agentenstunde abgerechnet werden. Um Ihr eigenes Verhältnis zu ermitteln, führen Sie eine Aufgabe aus und lesen Sie das Credit-Symbol unter der Antwort in der App ab oder verwenden Sie /cost in der Warp Agent CLI.
Wird Warps KI kostenlos, wenn ich meinen eigenen API-Schlüssel oder Endpunkt verwende?
Dadurch entfallen AI-Credits für die darüber geleiteten Anfragen, aber nicht alle anderen Gebühren. Warps Auto-Modelle verwenden immer Warp-Credits, benutzerdefinierte Router können kein über einen Endpunkt geleitetes Modell auflösen, Cloud-Agentenläufe verbrauchen immer Credits, und Funktionen wie Codebase Context nutzen Warps Infrastruktur. Bei Business und Enterprise verbrauchen lokale Agentenläufe mit Ihrem eigenen Schlüssel oder Endpunkt weiterhin Platform-Credits, abgerechnet nach Agentenstunde. Warps Bedingungen beschränken Self-Service-BYOK und benutzerdefinierte Endpunkte außerdem auf Einzelpersonen und Organisationen mit höchstens 10 Mitarbeitenden; größere Organisationen benötigen Business oder Enterprise.
Werden ungenutzte Warp-Credits übertragen?
Plan-Credits werden nicht übertragen, Reload-Credits schon. Laut Warps Preis-FAQ werden enthaltene monatliche Credits alle 30 Tage ab dem Abonnement- oder Verlängerungsdatum zurückgesetzt; die Dokumentation zu Add-on-Credits besagt, dass gekaufte Credits über Abrechnungszyklen hinweg übertragen werden und 12 Monate ab dem Kauf gültig bleiben, auch nach einem Wechsel in den Free-Tarif. In einem Team fließen gekaufte Credits in einen gemeinsamen Pool, aus dem jedes Mitglied schöpft, sobald seine eigenen Plan-Credits aufgebraucht sind. Ein intensiver Nutzer kann daher Credits ausgeben, die ein anderes Mitglied gekauft hat; Administratoren können ein teamweites monatliches Ausgabenlimit festlegen.
Kann Warp einen OpenAI-kompatiblen Endpunkt wie Kunavo verwenden?
Warp dokumentiert einen benutzerdefinierten Inferenz-Endpunkt für jeden Dienst, der die OpenAI Chat Completions API implementiert. Er wird in der Warp-App unter Settings konfiguriert, indem Sie nach inference endpoint suchen und Basis-URL, API-Schlüssel sowie Modellkennungen eingeben. Der Endpunkt muss unter einer öffentlichen URL erreichbar sein, da die Anfrage auf Warps Servern zusammengestellt wird; Warp erklärt, dass Zero Data Retention für diesen Datenverkehr nicht erzwungen werden kann. Benutzerdefinierte Endpunkte sind nur in der Warp-App verfügbar, nicht in der Warp Agent CLI. Kunavos Endpunkt ist öffentlich und OpenAI-kompatibel, aber niemand bei Kunavo hat Warp damit ausgeführt; betrachten Sie die erste Anfrage daher als eigenen Test.
Gelesen am 1. Oktober 2026: warp.dev/pricing (Tarifkarten und FAQ in den strukturierten Daten) sowie Warps Dokumentation zu Plänen und Abrechnung, Credits, Add-on-Credits, Platform-Credits, benutzerdefiniertem Inferenz-Endpunkt und Bring Your Own API Key. Nicht veröffentlicht: ein Platform-Credit-Satz pro Agentenstunde sowie eine Umrechnung von Credits in Tokens. Nicht getestet: Warp wurde weder installiert noch abonniert, und keine Anfrage wurde von Warp an Kunavo gesendet. Kunavos Tokenpreise stammen aus dem Live-Katalog; jeder Dollarbetrag in der Tokentabelle ist illustrative Arithmetik.