Zurück zu den Leitfäden
Integration·10. Juli 2026·Aktualisiert am 1. Oktober 2026·8 Min. Lesezeit

Kilo Code mit der Claude API – Einrichtung der OpenAI-kompatiblen Basis-URL und Routing pro Modus

Kilo Code akzeptiert einen benutzerdefinierten OpenAI-kompatiblen Endpunkt – drei Einstellungsfelder bringen Claude für 30% unter dem Listenpreis von Anthropic in deinen Editor. Hier erfährst du die Einrichtung, welches Modell du pro Modus wählen solltest und was eine agentische Codingsitzung tatsächlich kostet.

Zuletzt überprüft am .

Kilo Code ist einer der meistgenutzten quelloffenen KI-Programmieragenten für VS Code. Wie seine Geschwister aus der Cline-Familie ermöglicht es Ihnen, einen eigenen OpenAI-kompatiblen API-Endpunkt zu verwenden. Damit können Sie Claude in Ihrem Editor mit einem einzigen sk-kn--Schlüssel ausführen, bei den wichtigsten Modellen zu etwa 30 % unter dem Listenpreis von Anthropic. Dieser Leitfaden behandelt die Einrichtung mit drei Feldern, die Auswahl des passenden Claude-Modells pro Aufgabe und die tatsächlichen Kosten einer agentischen Programmiersitzung.

Warum Kilo Code einen API-Schlüssel benötigt

Kilo Code bündelt kein Modell – jede Aktion (eine Datei lesen, eine Änderung vorschlagen, einen Befehl ausführen, das Ergebnis prüfen) ist ein API-Aufruf, der pro Token abgerechnet wird. Ein Chat-Abonnement wie Claude Pro deckt dies nicht ab; die Erweiterung benötigt direkten API-Zugriff. Genau dafür ist Kunavo ausgelegt: Pay-as-you-go ab einer Aufladung von 10 $, ein Schlüssel für Claude und GPT und ein Guthaben, das nie verfällt. Da agentische Schleifen den wachsenden Aufgabenkontext bei jedem Schritt erneut senden, ist der Preis pro Token der größte einzelne Einflussfaktor auf die Kosten einer Sitzung – deshalb wirkt sich der Rabatt von etwa 30 % auf claude-sonnet-5 so schnell aus.

Die drei Felder

Kilo Code stellt den Anbieter über drei Einstellungsfelder bereit:

provider-settings
API Provider   OpenAI Compatible
Base URL       https://api.kunavo.com/v1
API Key        sk-kn-...          # create at kunavo.com/app/keys
Model ID       claude-sonnet-5        # or claude-opus-5 / claude-haiku-4-5

Holen Sie den Schlüssel aus dem Dashboard, nachdem Sie sich registriert und 10 $ aufgeladen haben – er wird nur einmal angezeigt, speichern Sie ihn daher sofort. Die vollständige Schlüsselverwaltung wird in der Dokumentation zum Claude-API-Schlüssel behandelt.

Kilo-Code-Einrichtung

  1. Installieren Sie Kilo Code über den VS-Code-Marktplatz und öffnen Sie es über die Seitenleiste.
  2. Öffnen Sie die Einstellungen der Erweiterung (Zahnradsymbol) und gehen Sie zum Abschnitt Providers.
  3. Setzen Sie API Provider auf OpenAI Compatible.
  4. Basis-URL: https://api.kunavo.com/v1 · API-Schlüssel: Ihr sk-kn-…-Schlüssel · Modell: claude-sonnet-5.
  5. Speichern Sie die Einstellungen und stellen Sie anschließend eine kleine Anfrage („Erkläre diese Datei“), um die Verbindung zu bestätigen, bevor Sie dem Tool erlauben, Code zu bearbeiten.

Kilo Code unterstützt modusspezifische Modellüberschreibungen (Architect / Code / Debug) – ein guter Ort, um die Planung an ein stärkeres Modell (claude-opus-5) und die Ausführung an ein günstigeres Modell (claude-sonnet-5) weiterzuleiten.

Cline und Roo Code

Kilo Code und Roo Code sind beide Forks innerhalb der Cline-Familie, daher sind die drei oben genannten Felder in allen drei Tools identisch – Anbieter OpenAI Compatible, Basis-URL https://api.kunavo.com/v1, Schlüssel, Modell-ID. Der Unterschied besteht darin, welche Funktion Ihnen das jeweilige Tool zum Weiterleiten von Modellen bietet; dort liegen die Kosteneinsparungen. Deshalb gibt es für jedes Tool eine eigene Anleitung: Cline mit der Claude API behandelt die Aufteilung in Plan/Act, und Roo Code mit der Claude API behandelt die benannten Konfigurationsprofile und die modusspezifische Modellbindung.

Alle drei Tools bieten zusätzlich einen nativen Anthropic-Anbieter mit einer Option für eine benutzerdefinierte Basis-URL. Wenn Sie diese auf https://api.kunavo.com setzen, wird stattdessen die native Messages API (/v1/messages) verwendet – nützlich, weil cache_control unverändert durchgereicht wird und gecachte Eingaben mit 10 % des Eingabepreises berechnet werden (siehe die Dokumentation zum Prompt-Caching). Beide Wege funktionieren; der OpenAI-kompatible Weg ist der einfachste Einstieg.

Welches Claude-Modell Sie auswählen sollten

AufgabeModellKunavo-Eingabe / Ausgabe (pro 1 Mio.)
Alltägliches agentisches Programmieren (Standard)claude-sonnet-5$1.40 / $7.00
Sonnet der vorherigen Generation für Prompts, die bereits darauf abgestimmt sindclaude-sonnet-4-6$2.10 / $10.50
Anspruchsvollste Refactorings und Debuggingclaude-opus-5$3.50 / $17.50
Schnelle Änderungen, Commit-Nachrichten, Fragen und Antwortenclaude-haiku-4-5$0.70 / $3.50

claude-opus-5 ist hier die Wahl für starkes logisches Schlussfolgern: Es ist Anthropics neuestes Opus und wird zum gleichen Preis von $3.50 / $17.50 abgerechnet wie das Opus der vorherigen Generation claude-opus-4-7 ($3.50 / $17.50), das weiterhin verfügbar ist, wenn Sie darauf festgelegt sind. Da das Modellfeld lediglich ein Slug am selben Endpunkt ist, genügt zum Wechsel eine Änderung an einem Wort – kein neuer Schlüssel und keine neue Anbieterkonfiguration. Die vollständigen Preise für jedes Modell finden Sie im Leitfaden zu den Claude-API-Preisen und auf der Preisseite.

Was eine Sitzung tatsächlich kostet

Agentische Tools verbrauchen konstruktionsbedingt viele Token: Bei jedem Schritt werden System-Prompt, Aufgabenverlauf und neuer Dateikontext erneut gesendet. Realistische Zahlen zu Kunavo-Preisen:

EinheitTokens (Eingabe / Ausgabe)claude-sonnet-5Zum Listenpreis von Anthropic
Ein agentischer Schritt25,000 / 1,200$0.043$0.062
Eine Aufgabe mit 20 Schritten~500k / ~24k~$0.87~$1.24
Ein intensiver Tag (5 solcher Aufgaben)—~$4.34~$6.20

Die ausführbare Rechnung:

session_cost.py
# Kunavo Claude rates (USD per 1M tokens): (input, output)
RATES = {
    "claude-haiku-4-5":  (0.70, 3.50),
    "claude-sonnet-5":   (1.40, 7.00),
}

def step_cost(model, in_tokens, out_tokens):
    i, o = RATES[model]
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

# One agentic step: the tool resends the task context + file reads.
print(step_cost("claude-sonnet-5", 25_000, 1_200))         # -> $0.0434
# A realistic 20-step task (edit, run, fix, repeat):
print(20 * step_cost("claude-sonnet-5", 25_000, 1_200))    # -> ~$0.87

Die Rechnung niedrig halten

  1. Starten Sie neue Aufgaben, statt eine Aufgabe endlos zu verlängern. Das Tool sendet bei jedem Schritt die gesamte Unterhaltung erneut, daher ist eine lang laufende Aufgabe quadratisch teuer. Neue Aufgabe = neuer, kleiner Kontext.
  2. Leiten Sie nach Modus weiter. Kilo Code unterstützt ein Modell pro Modus – Architect auf claude-opus-5, Code auf claude-sonnet-5, schnelle Fragen auf claude-haiku-4-5. Die Planung macht nur einen kleinen Anteil der Token aus, daher kostet das stärkere Modell dort wenig.
  3. Verwenden Sie für Caching den nativen Anthropic-Weg. Gecachte Eingaben werden mit 10 % des Eingabepreises berechnet – bei einer Schleife, die in jedem Schritt einen stabilen Präfix erneut sendet, ist dies die größte verfügbare Einsparung (so funktioniert es).
  4. Behalten Sie die Ausgaben pro Schlüssel im Blick. Geben Sie dem Editor einen eigenen Schlüssel mit einem Ausgabenlimit im Dashboard und prüfen Sie die Nutzung, um zu sehen, was eine Woche agentisches Programmieren tatsächlich kostet.

Häufig gestellte Fragen

Welche Base-URL verwende ich für Kilo Code mit der Claude API?

Setzen Sie den API-Anbieter auf 'OpenAI Compatible' und die Base-URL auf https://api.kunavo.com/v1, mit einem Kunavo-API-Schlüssel (sk-kn-...) und einem Claude-Modell-Slug wie claude-sonnet-5. Wenn Sie stattdessen den nativen Anthropic-Anbieter verwenden, setzen Sie die Base-URL nur auf den Ursprung (https://api.kunavo.com) — diese Client-App hängt /v1/messages selbst an.

Kann ich mein Claude-Pro- oder Max-Abonnement mit Kilo Code verwenden?

Nein – Chat-Abonnements beinhalten keinen API-Zugriff. Kilo Code ruft die API direkt auf und rechnet pro Token ab. Ein Pay-as-you-go-Schlüssel ist dafür die richtige Wahl: Auf Kunavo laden Sie ab 10 $ Guthaben auf, Claude wird 30 % unter dem Listenpreis von Anthropic angeboten, und das Guthaben verfällt nie.

Welches Claude-Modell eignet sich am besten für Kilo Code?

claude-sonnet-5 ($1.40/$7.00 pro 1 Mio. Token auf Kunavo) ist der Standard für alltägliches agentisches Programmieren: nahezu Opus-Qualität beim Programmieren und hier geringere Kosten pro Token als claude-sonnet-4-6 ($2.10/$10.50). Für die anspruchsvollsten Refactorings und das schwierigste Debugging können Sie auf claude-opus-5 ($3.50/$17.50) wechseln – es ist das neuere Opus zum gleichen Preis wie claude-opus-4-7, der Wechsel kostet also nichts zusätzlich. Leiten Sie schnelle, einfache Anfragen an claude-haiku-4-5 weiter, um die Kosten noch weiter zu senken. Preise und Spezifikationen für claude-opus-5 finden Sie auf der Modellseite; der Vergleich ist unter Claude vs GPT vs Gemini verfügbar.

Wie viel kostet die Nutzung von Claude mit Kilo Code?

Agentische Tools senden den Kontext bei jedem Schritt erneut, daher summieren sich die Token: Ein typischer Schritt umfasst etwa 25.000 Eingabe- und 1.200 Ausgabetoken, also ungefähr 0.043 $ für claude-sonnet-5 zu Kunavo-Preisen – etwa 0.87 $ für eine Aufgabe mit 20 Schritten gegenüber ungefähr 1.24 $ zum Listenpreis von Anthropic. Fehlgeschlagene Anfragen werden nicht berechnet.

Funktioniert dieselbe Einrichtung auch mit Cline und Roo Code?

Ja. Kilo Code und Roo Code sind Forks innerhalb der Cline-Familie und verwenden dasselbe Anbietermodell: Wählen Sie „OpenAI Compatible“, setzen Sie die Basis-URL https://api.kunavo.com/v1, fügen Sie den Schlüssel ein und legen Sie die Modell-ID fest. Der Unterschied liegt darin, wie die einzelnen Tools Modelle weiterleiten – Cline trennt zwischen dem Plan- und dem Act-Modus, Roo Code bindet benannte Konfigurationsprofile an Modi. Hier liegen die Kosteneinsparungen, daher gibt es für jedes Tool eine eigene Anleitung. Alle drei verfügen außerdem über einen nativen Anthropic-Anbieter mit einer Option für eine benutzerdefinierte Basis-URL; verweisen Sie diese auf den Ursprung https://api.kunavo.com, damit cache_control durchgereicht wird.

Unterscheidet sich das von der Nutzung des OpenAI SDK?

Derselbe Mechanismus: Jeder OpenAI-kompatible Client funktioniert, indem Sie base_url ändern – die Editor-Erweiterungen stellen dies einfach als Einstellungsfeld bereit. Das allgemeine Muster wird im Leitfaden zur OpenAI-kompatiblen API beschrieben.

Wie sieht es mit Claude Code, dem Terminal-Agenten, aus?

Claude Code wird anders konfiguriert – es liest ANTHROPIC_BASE_URL und ANTHROPIC_AUTH_TOKEN aus der Umgebung statt aus einem Einstellungsfeld und verwendet die native Messages API anstelle der OpenAI-kompatiblen API. Im Einrichtungsleitfaden für Claude Code finden Sie die Variablen, die Zugangsdaten-Falle hinter den meisten 401-Fehlern und eine Erklärung dazu, was sich durch ein Gateway ändert.