Roo Code ist ein Open-Source-autonomer Coding-Agent für VS Code – ein Fork aus der Cline-Familie, der sich durch sein Modussystem und das Routing von Modellen pro Modus auszeichnet. Es enthält kein eigenes Modell und benötigt daher einen API-Schlüssel. Dieser Leitfaden beschreibt die genaue Einrichtung, um Claude in Roo Code mit einem sk-kn--Schlüssel zu einem Preis von etwa 30% unter dem Listenpreis von Anthropic für die wichtigsten Modelle auszuführen, Konfigurationsprofile zu verwenden, um Geld für leistungsstarke Modelle nur dort auszugeben, wo es sich lohnt, die Kosten einer Sitzung und eine ehrliche Darstellung des Kompromisses gegenüber direkten Aufrufen an Anthropic.
Warum Roo Code einen API-Schlüssel benötigt
Jeder Schritt, den Roo Code ausführt – eine Datei lesen, ein Diff schreiben, einen Befehl ausführen, das Ergebnis lesen – ist ein pro Token berechneter Modellaufruf. Ein claude.ai-Pro- oder Max-Abonnement deckt dies nicht ab: Chat-Tarife und API-Zugriff sind getrennte Produkte, und Roo Code kommuniziert mit der API. Da eine agentische Schleife den wachsenden Aufgabenkontext bei jedem Schritt erneut sendet, ist der Preis pro Token der größte Hebel für die Sitzungskosten – und genau hier liegt der Vorteil eines Gateways: Pay-as-you-go ab einer Aufladung von 10 $, ein Schlüssel, der auch GPT erreicht, und ein Guthaben, das niemals verfällt.
Einrichtung – die drei Felder
Öffnen Sie Settings → Providers und setzen Sie den API-Provider auf OpenAI Compatible. Drei Werte:
API Provider OpenAI Compatible
Base URL https://api.kunavo.com/v1
API Key sk-kn-... # create at kunavo.com/app/keys
Model ID claude-sonnet-5 # or claude-opus-5 / claude-haiku-4-5Erstellen Sie den Schlüssel im Dashboard, nachdem Sie sich registriert und Guthaben aufgeladen haben – er wird nur einmal angezeigt, speichern Sie ihn daher sofort; die Claude-API-Schlüsseldokumentation behandelt Rotation und Ausgabenlimits. Wenn Roo Code nach Modellmetadaten wie Kontextfenster oder Output-Limit fragt, übernehmen Sie die Werte von der Modellseite – ein zu klein angegebenes Kontextfenster führt dazu, dass früher als nötig gekürzt wird.
Testen Sie zunächst etwas Kleines, bevor Sie den Code bearbeiten lassen. Ein 401 ist hier fast immer auf den Schlüssel zurückzuführen; ein 404 fast immer auf die Base URL oder einen nicht existierenden Modell-Slug – Kunavo gleicht Slugs exakt ab und verwendet keine Aliase für Namen mit Datumszusatz. Daher liefert claude-sonnet-4-5-20250929 404, während claude-sonnet-4-6 aufgelöst wird.
Modi und Konfigurationsprofile – der Kostenhebel
Roo Code enthält mehrere integrierte Modi – Code, Architect, Ask und Debug – sowie benutzerdefinierte Modi, die Sie selbst definieren. Für die Kosten entscheidend ist, dass Roo Code benannte API-Konfigurationsprofile speichert und sich merkt, welches Profil Sie zuletzt in jedem Modus verwendet haben. Das Modell wird somit zu einer Eigenschaft des Modus und nicht zu etwas, an dessen Änderung Sie denken müssen:
# One API configuration profile per job, all on the same sk-kn- key.
# Roo Code remembers the profile you last used in each mode.
Profile "strong" model claude-opus-5 -> bind to Architect and Debug
Profile "code-default" model claude-sonnet-5 -> bind to Code mode
Profile "ask-cheap" model claude-haiku-4-5 -> bind to Ask modeDer Grund, warum dies funktioniert, liegt darin, dass die Modi sehr unterschiedliche Tokenprofile haben. Architect umfasst einige reasoning-intensive Durchläufe, bei denen die Modellqualität entscheidet, ob die nächsten zwanzig Schritte produktiv sind – ein kleiner Anteil der Gesamt-Tokens, sodass ein leistungsstarkes Modell absolut wenig kostet. Code umfasst viele mechanische Schritte, die jeweils den Kontext erneut senden; hier summiert sich der Preis pro Token. Ask ist normalerweise ein einmaliger Aufruf und benötigt überhaupt kein Frontier-Modell.
Die konkreten Zahlen finden Sie unten: Drei Architect-Schritte mit Opus 5 plus siebzehn Code-Schritte mit Sonnet 5 ergeben etwa 1.06 $ gegenüber 0.87 $ für den vollständig mit Sonnet ausgeführten Ablauf – ungefähr 23% mehr für eine deutlich bessere Planung und deutlich günstiger, als alles mit Opus auszuführen.
Die native Anthropic-Route (und warum Sie sie verwenden könnten)
Roo Code bietet außerdem einen nativen Anthropic-Provider mit einem benutzerdefinierten Base-URL-Feld. Wenn Sie ihn auf https://api.kunavo.com verweisen – nur den Origin, ohne /v1, da dieser Client selbst /v1/messages anhängt –, läuft die Verbindung über die native Messages API. Das Einfügen der /v1-Form hier erzeugt einen 404, der wie ein fehlendes Modell aussieht.
Dieser Weg bietet Prompt-Caching: cache_control wird unverändert durchgereicht und gecachter Input mit 10 % des Input-Tarifs berechnet (so funktioniert es). Bei einer Schleife, die in jedem Schritt ein stabiles Präfix erneut sendet, ist dies die größte verfügbare einzelne Ersparnis – größer als jeder Modellwechsel. Beide Wege funktionieren; OpenAI Compatible ist für den Einstieg einfacher, und der Wechsel zwischen ihnen ist eine Einstellungssache.
Welches Claude-Modell welchem Modus zugeordnet werden sollte
| Modus | Modell | Kunavo-Eingabe / Ausgabe (pro 1 Mio.) |
|---|---|---|
| Code (Standard, höchstes Volumen) | claude-sonnet-5 | $1.40 / $7.00 |
| Architect und Debug – Planung, Design, schwierige Fehler | claude-opus-5 | $3.50 / $17.50 |
| Ask – einmalige Fragen | claude-haiku-4-5 | $0.70 / $3.50 |
Alle verwenden denselben Schlüssel und denselben Endpunkt – nur der Modell-Slug unterscheidet sich, sodass ein Profilwechsel eine Änderung an einem Wort ist. Die vollständigen Preise pro Modell im Vergleich zum offiziellen Listenpreis von Anthropic finden Sie in der Preisliste der Anthropic Claude API; der aktuelle Katalog befindet sich auf der Preisseite.
Roo Code auf Kunavo vs. direkter Aufruf von Anthropic
Der ehrliche Vergleich, einschließlich der Fälle, in denen der direkte Weg die bessere Wahl ist:
| Roo Code → Kunavo | Roo Code → Anthropic direkt | |
|---|---|---|
| Sonnet 5 pro 1 Mio. (Input / Output) | $1.40 / $7.00 | $2.00 / $10.00 |
| Erste Schritte | Registrieren, $10 aufladen, einen Schlüssel erstellen | Anthropic-Console-Konto mit eingerichteter Abrechnung |
| Modelle mit einem einzigen Schlüssel | Claude und GPT sowie Bild, Video und Audio | Nur Claude |
| Modellrouting pro Modus | Ja — Profile sind eine Roo-Code-Funktion und vom Anbieter unabhängig | Ja |
| Prompt-Caching | Ja, über die native Anthropic-Anbieterroute (cache_control wird durchgereicht) | Ja, nativ |
| Fehlgeschlagene Anfragen | Werden nicht berechnet | Werden nicht berechnet |
| Kapazität und SLA | Gemeinsam genutzte Upstream-Kapazität, kein vertragliches SLA und kein garantiertes Kontingent | Das Rate-Limit-Kontingent Ihrer eigenen Organisation und die Supportbedingungen von Anthropic |
| Zugriff am selben Tag auf brandneue Modelle | Wenn der Upstream-Kanal sie führt | Bei Veröffentlichung |
Diese Kapazitätszeile ist der eigentliche Zielkonflikt, klar ausgesprochen. Wenn Sie ein garantiertes Kontingent, ein vertragliches SLA oder eine Beschaffungsbeziehung mit dem Modellanbieter benötigen, gehen Sie direkt — dafür bezahlen Sie den Preisunterschied. Für einzelne Entwickler oder kleine Teams, die Roo Code ausführen, fällt der Kompromiss üblicherweise umgekehrt aus.
Was eine Roo-Code-Sitzung tatsächlich kostet
Agentische Tools verbrauchen konstruktionsbedingt viele Token: Bei jedem Schritt werden System-Prompt, Aufgabenverlauf und neuer Dateikontext erneut gesendet. Realistische Zahlen zu Kunavo-Preisen:
| Einheit | Tokens (Eingabe / Ausgabe) | claude-sonnet-5 | Zum Listenpreis von Anthropic |
|---|---|---|---|
| Ein Schritt im Code-Modus | 25,000 / 1,200 | $0.043 | $0.062 |
| Eine Aufgabe mit 20 Schritten | ~500k / ~24k | ~$0.87 | ~$1.24 |
| Dieselbe Aufgabe, Architect auf Opus 5 | ~500k / ~24k | ~$1.06 | ~$1.52 |
| Ein intensiver Tag (5 solcher Aufgaben) | — | ~$4.34 | ~$6.20 |
Die ausführbare Rechnung:
# Kunavo Claude rates (USD per 1M tokens): (input, output)
RATES = {
"claude-haiku-4-5": (0.70, 3.50),
"claude-sonnet-5": (1.40, 7.00),
"claude-opus-5": (3.50, 17.50),
}
def step_cost(model, in_tokens, out_tokens):
i, o = RATES[model]
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
# One Code-mode step: Roo resends the task context plus the files it read.
print(step_cost("claude-sonnet-5", 25_000, 1_200)) # -> $0.0434
# A realistic 20-step task on the Code-mode default:
print(20 * step_cost("claude-sonnet-5", 25_000, 1_200)) # -> ~$0.87
# Architect mode on Opus 5 for 3 steps, Code mode on Sonnet 5 for 17:
print(3 * step_cost("claude-opus-5", 25_000, 1_200)
+ 17 * step_cost("claude-sonnet-5", 25_000, 1_200)) # -> ~$1.06Die Rechnung niedrig halten
- Starten Sie neue Aufgaben, statt eine Aufgabe endlos zu verlängern. Roo Code sendet bei jedem Schritt die gesamte Konversation erneut, sodass die Kosten einer einzigen lang laufenden Aufgabe quadratisch steigen. Eine neue Aufgabe bedeutet einen neuen, kleinen Kontext — die Gewohnheit mit dem größten Hebel.
- Binden Sie pro Modus ein Profil. Wie oben beschrieben: Dadurch wird das Modellrouting zu einer Konfiguration, an die Sie sich während der Aufgabe nicht erinnern müssen.
- Verwenden Sie zum Caching die native Anthropic-Route. Gecachter Input zu 10 % des Input-Tarifs ist die größte strukturelle Einsparung bei einer Schleife, die ein stabiles Präfix erneut sendet.
- Geben Sie dem Editor einen eigenen, ausgabenbegrenzten Schlüssel. Erstellen Sie im Dashboard einen separaten Schlüssel und prüfen Sie nach einer tatsächlichen Woche die Nutzung — nur so lässt sich ehrlich einschätzen, was Sie das kostet.
Häufig gestellte Fragen
Welche Base URL verwende ich für Roo Code mit der Claude API?
Gehen Sie in Roo Code zu Settings → Providers, setzen Sie API Provider auf „OpenAI Compatible“, Base URL auf https://api.kunavo.com/v1, fügen Sie einen Kunavo-Schlüssel (sk-kn-...) ein und setzen Sie die Model ID auf einen Claude-Slug wie claude-sonnet-5. Wenn Sie stattdessen Roo Codes nativen Anbieter „Anthropic“ verwenden, setzen Sie die Base URL nur auf den Origin – https://api.kunavo.com –, da dieser Client selbst /v1/messages anhängt. Das Hinzufügen von /v1 ist die häufigste Ursache für einen 404 bei dieser Konfiguration. Für die schwierigsten Aufgaben setzen Sie die Model ID auf claude-opus-5.
Kann ich ein Claude-Pro- oder Max-Abonnement mit Roo Code verwenden?
Nein. Mit Stand September 2026 nennen die Provider-Dokumente von Roo Code keine Claude-Abonnementoption – der Anthropic-Provider verwendet einen API-Schlüssel aus der Anthropic Console –, und ein claude.ai-Chat-Abonnement umfasst keinen API-Zugriff. Roo Code ruft die API direkt auf, daher ist jeder Dateiabruf, jedes Diff und jeder Befehl ein kostenpflichtiger Modellaufruf und Sie benötigen einen Pay-as-you-go-API-Schlüssel. Bei Kunavo gelten folgende Konditionen: eine Mindestaufladung von 10 $, die meisten Claude-Modelle 30% unter dem Listenpreis von Anthropic und ein Guthaben, das niemals verfällt.
Kann Roo Code je Modus ein anderes Claude-Modell verwenden?
Ja, und dies ist der wichtigste Kostenhebel bei diesem Tool. Roo Code speichert benannte API-Konfigurationsprofile und merkt sich, welches Profil Sie zuletzt in jedem Modus verwendet haben. So können Sie ein leistungsstarkes Modell an Architect und Debug binden und ein günstigeres an Code und Ask. Eine praktische Aufteilung: claude-opus-5 ($3.50/$17.50 pro 1 Mio.) für Architect und Debug, claude-sonnet-5 ($1.40/$7.00) für Code – neuer als claude-sonnet-4-6 ($2.10/$10.50) und bei Kunavo pro Token günstiger – und claude-haiku-4-5 ($0.70/$3.50) für Ask. Alle drei Profile verwenden denselben Schlüssel – nur der Modell-Slug ändert sich.
Wie viel kostet es, Claude in Roo Code auszuführen?
Roo Code sendet den Aufgabenkontext bei jedem Schritt erneut, daher richten sich die Kosten eher nach der Anzahl der Schritte als nach der aufgewendeten Zeit. Ein typischer Schritt umfasst etwa 25.000 Input- und 1.200 Output-Tokens – bei Kunavo-Tarifen etwa 0.043 $ auf claude-sonnet-5, sodass eine Aufgabe mit 20 Schritten ungefähr 0.87 $ kostet, gegenüber etwa 1.24 $ beim Listenpreis von Anthropic. Fehlgeschlagene Anfragen werden niemals berechnet. Prompt-Caching, das über die native Anthropic-Provider-Route verfügbar ist, berechnet gecachten Input mit 10 % des Input-Tarifs und ist die größte strukturelle Ersparnis.
Funktioniert dieselbe Konfiguration für Cline und Kilo Code?
Ja – alle drei verwenden dasselbe Provider-Modell, da Roo Code und Kilo Code Forks aus der Cline-Familie sind. Die tool-spezifischen Details unterscheiden sich: Cline mit der Claude API behandelt die Aufteilung in Plan/Act, und Kilo Code mit der Claude API beschreibt die eigene Einrichtung. Für den Terminal-Agenten statt der Editor-Erweiterung enthält der Einrichtungsleitfaden für Claude Code den Vertrag für Umgebungsvariablen, und Claude-Code-Preise behandelt den Break-even zwischen Abonnement und API.