Claude Opus 5.5 ist Anthropics neuestes Opus, veröffentlicht am 22. September 2026, und das Modell, auf das Anthropic inzwischen bei „den meisten Workloads“ verweist. Sein API-Preis beträgt bei Anthropic $4.00 Eingabe / $20.00 Ausgabe pro 1 Mio. Token — unter Opus 5 mit $5.00 / $25.00 — und bei Kunavo $2.80 / $14.00, 30% unter diesem Listenpreis. Die Modell-ID lautet claude-opus-5-5, das Modell verfügt über ein Kontextfenster von 1 Mio. Token und bis zu 128K Ausgabe-Token und denkt bei jeder Anfrage.
Claude-Opus-5.5-API-Preise
Anthropics veröffentlichte Tarife neben denen von Kunavo, jeweils pro 1 Mio. Token. Anthropic berechnet Cache-Lesevorgänge bei Opus 5.5 mit 5% des Eingabepreises statt mit den 10%, die es für die meisten Claude-Modelle verlangt, und Kunavo gibt dasselbe Verhältnis weiter:
| Tokenklasse | Anthropic-Listenpreis | Kunavo |
|---|---|---|
| Eingabe | $4.00 | $2.80 |
| Ausgabe (einschließlich Denken) | $20.00 | $14.00 |
| Cache-Schreibzugriff | $5.00 (5 Min.) · $8.00 (1 Stunde) | $3.50, beliebige TTL |
| Cache-Lesezugriff | $0.20 | $0.14 |
Neben der übrigen Claude-Modellreihe bei Kunavo ist Opus 5.5 die günstigste Möglichkeit für Opus-Klasse-Reasoning — günstiger als Claude Opus 5 ($3.50 / $17.50). Claude Sonnet 5 ist noch günstiger ($1.40 / $7.00), während Claude Fable 5.1 mit $7.00 / $35.00 am oberen Ende und Claude Haiku 4.5 mit $0.70 / $3.50 am unteren Ende der Reihe liegen. Alle Claude-Tarife mit ausgearbeiteten Beispielen stehen im Leitfaden zu den Claude-API-Preisen; die eigene Modellseite ist /models/claude-opus-5-5.
Claude Opus 5.5 aufrufen
Ein Kunavo-Schlüssel erreicht Opus 5.5 sowohl über den OpenAI-kompatiblen Endpunkt als auch über die native Anthropic Messages API. Ändere mit dem OpenAI-SDK base_url und den Modell-String:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
)
# Opus 5.5 always thinks, and thinking bills as output — leave max_tokens
# generous or the budget is spent before the answer starts.
resp = client.chat.completions.create(
model="claude-opus-5-5",
max_tokens=4096,
messages=[{"role": "user", "content": "Review this migration plan for failure modes."}],
)
print(resp.choices[0].message.content)Übergebe mit dem Anthropic-SDK den Ursprung als base_url; das SDK hängt /v1/messages selbst an:
from anthropic import Anthropic
# Native Messages API: pass the origin — the SDK appends /v1/messages.
client = Anthropic(base_url="https://api.kunavo.com", auth_token="sk-kn-...")
msg = client.messages.create(
model="claude-opus-5-5",
max_tokens=8192, # thinking plus the answer
messages=[{"role": "user", "content": "Find the race condition in this diff."}],
)
for block in msg.content:
if block.type == "text":
print(block.text)Schlüssel werden unter /app/keys erstellt; der Leitfaden zu Claude-API-Schlüsseln führt dich durch den Vorgang.
Was sich gegenüber Opus 5 geändert hat – und was das für deine Anfragen bedeutet
Anthropic nennt vier grundlegende Änderungen für Code, der mit Opus 5 lief, sowie eine Änderung an der Antwortstruktur. Schreibe nach Anthropics Regeln — beachte aber, dass zwei davon bei unseren Tests am 24. September 2026 über Kunavo nicht fehlschlugen:
- Das Denken kann nicht deaktiviert werden. Bei Anthropic führen
thinking: {type: "disabled"}undbudget_tokensbei jedem Aufwandsniveau zu einem 400-Fehler, und effort (Standardwertmedium) ist die einzige Steuerung. Bei Kunavo kam die Deaktivierungsanfrage mit 200 zurück und das Modell dachte trotzdem weiter;output_config.effortzeigte keinen messbaren Unterschied — der Opus 5.5 bereitstellende Kanal wendet keine der beiden Einstellungen an. Denken wird als Ausgabe abgerechnet: Eine Ein-Wort-Antwort verbrauchte 15 ihrer 16 Ausgabe-Token für das Denken. Lassmax_tokensgroßzügig bemessen. - Erzwungene Tool-Nutzung wird nicht unterstützt. Bei Anthropic führt
tool_choicevonanyodertoolzu einem 400-Fehler (das OpenAI-kompatible"required"wird aufanyabgebildet). Bei Kunavo gab eine Anfrage mit erzwungenem Tool stattdessen 200 zurück — auf die Erzwingung ist daher kein Verlass. Verwendeautound nenne das Tool im Prompt. - Denkblöcke sind an das Modell und die Unterhaltung gebunden. Gib sie bei Opus 5.5 unverändert wieder; das Bearbeiten des System-Prompts, der Tools oder vorheriger Nachrichten macht sie ungültig. Siehe den Leitfaden zu Fehlern bei Denksignaturen.
- Das ältere Computer-Use-Tool wurde entfernt.
computer_20251124wird von der Claude API nicht akzeptiert. - Text zwischen Tool-Aufrufen wird als Denkblöcke empfangen, die bei der standardmäßigen Einstellung
displayleer sind — eine Anwendung, die Fortschrittstext streamt, bleibt zwischen Tool-Aufrufen stumm.
Sampling-Parameter waren bei Opus 5 bereits entfernt; bei Opus 5.5 entfernt Kunavo temperature, top_p und top_k, bevor die Anfrage das Gateway verlässt, ebenso wie bei den übrigen Modellen der Claude-5-Familie.
Opus 5.5 vs. Opus 5 nach Anthropics Zahlen
Anthropics Ankündigung besagt, dass Opus 5.5 „bei den meisten Aufgaben auf dem Niveau von Claude Fable 5.1 arbeitet und 40 % weniger Betriebskosten als Opus 5 verursacht“ und dass es Ausgaben um mehr als 30 % schneller erzeugt. Die veröffentlichten Werte im Vergleich zu Opus 5 (Anthropics Angaben, nicht die von Kunavo):
| Benchmark | Opus 5.5 | Opus 5 |
|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 52.3% |
| CursorBench 4.0 | 57.8% | 46.6% |
| FrontierCode v1.1 (Main) | 54.4% | 48.0% |
| OSWorld 2.0 | 81.8% | 74.0% |
| GDPval-AA v2.1 (Elo) | 1846 | 1708 |
Für neue Arbeiten gibt es wenig Grund, bei Opus 5 zu bleiben: Opus 5.5 ist schneller, erzielt höhere Werte und kostet weniger, und der Modell-String ist die einzige Änderung, sofern dein Code nicht vom Deaktivieren des Denkens oder vom Erzwingen eines Tools abhängt. Bleibe nur so lange bei claude-opus-5, bis diese beiden Pfade umgeschrieben sind.
Claude Code bei Kunavo mit Opus 5.5
Ab Claude Code v2.1.280 werden das Standardmodell und der Alias opus zu Opus 5.5 aufgelöst, das Kunavo bereitstellt. Kunavos Einrichtungsanleitung setzt den Alias opus auf claude-opus-5-5, sodass /model opus und die Planungsphase von opusplan mit $2.80 / $14.00 pro 1M Token berechnet werden. Verwenden Sie bei einer älteren Claude-Code-Version zuerst claude update. Die Anleitung setzt außerdem den Alias sonnet auf claude-sonnet-5: Der Alias fordert Sonnet 5.5 an, das Kunavo nicht bereitstellt. Andernfalls würden /model sonnet, die Ausführungsphase von opusplan und auf sonnet gesetzte Subagents einen 404 zurückgeben. Um die gesamte Sitzung mit Opus 5.5 auszuführen, setzen Sie zusätzlich ANTHROPIC_MODEL:
export ANTHROPIC_BASE_URL=https://api.kunavo.com # origin, no /v1
export ANTHROPIC_AUTH_TOKEN=sk-kn-...
# Run the session on Opus 5.5 (Claude Code v2.1.280 or later).
export ANTHROPIC_MODEL=claude-opus-5-5
# Pin the aliases to models Kunavo serves. The sonnet alias asks for
# Sonnet 5.5, which Kunavo does not serve: without the SONNET line,
# /model sonnet, opusplan's execution phase and sonnet subagents get a 404.
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5
claudeDie übrige Einrichtung — die ursprungsbeschränkte Basis-URL, warum ANTHROPIC_AUTH_TOKEN statt ANTHROPIC_API_KEY und die Form von settings.json — steht auf der Claude-Code-Seite.
Häufig gestellte Fragen
Wie viel kostet die Claude-Opus-5.5-API?
Anthropic gibt Claude Opus 5.5 mit $4.00 pro 1 Mio. Eingabe-Token und $20.00 pro 1 Mio. Ausgabe-Token an, mit Cache-Lesevorgängen zu $0.20 und 5-minütigen Cache-Schreibvorgängen zu $5.00. Bei Kunavo kostet es $2.80 Eingabe / $14.00 Ausgabe pro 1 Mio. Token — 30% unter dem Anthropic-Listenpreis —, mit Cache-Lesevorgängen zu $0.14 und Cache-Schreibvorgängen zu $3.50. Die Abrechnung erfolgt nutzungsbasiert aus einem Prepaid-Guthaben ohne Abonnement.
Wie lautet die Modell-ID von Claude Opus 5.5?
Die API-Modell-ID lautet claude-opus-5-5 — derselbe String in der Claude API, bei Google Cloud, Microsoft Foundry und Kunavo; Amazon Bedrock stellt anthropic.claude-opus-5-5 voran. Es gibt kein Suffix für einen datierten Snapshot: Ab der Generation 4.6 sind Anthropics zeitlose IDs selbst festgelegte Snapshots. Schreibweisen wie claude-opus-5.5 sind ungültig.
Ist Claude Opus 5.5 besser als Opus 5?
Nach Anthropics eigenen Zahlen: ja, und es ist günstiger. Anthropic gibt für Opus 5.5 bei Terminal-Bench 4.0 66,4 % gegenüber 52,3 % für Opus 5 an, sagt, es „erbringt bei den meisten Aufgaben Leistungen auf dem Niveau von Claude Fable 5.1“, erzeugt Ausgaben mehr als 30 % schneller als Opus 5 und kostet im Betrieb 40 % weniger. Der Listenpreis beträgt $4.00 / $20.00 gegenüber $5.00 / $25.00 für Opus 5; bei Kunavo sind es $2.80 / $14.00 gegenüber $3.50 / $17.50, bei der Ausgabe 20% weniger.
Kann ich das Denken bei Claude Opus 5.5 deaktivieren?
Nein. Adaptives Denken ist immer aktiviert: Bei Anthropic führen thinking: {type: "disabled"} und eine Einstellung budget_tokens bei jedem Aufwandsniveau zu einem 400-Fehler; die einzige Steuerung ist der Parameter effort, dessen Standardwert bei Opus 5.5 medium lautet. Bei Kunavo führte die am 24. September 2026 getestete Deaktivierungsanfrage nicht zu einem Fehler — sie wurde ignoriert und das Modell dachte weiterhin —, und die effort-Werte zeigten keinen messbaren Unterschied. Denk-Token werden zum Ausgabetarif abgerechnet; bemiss max_tokens daher für das Denken plus die Antwort ausreichend groß.
Verwendet Claude Code standardmäßig Opus 5.5?
Ja, ab Claude Code v2.1.280: Bei Anthropic-API-Konten werden sowohl das Standardmodell als auch der Alias opus zu Opus 5.5 aufgelöst (code.claude.com model-config), und Kunavo stellt claude-opus-5-5 bereit. Kunavos Claude-Code-Konfiguration legt den Alias opus auf claude-opus-5-5 fest, wofür v2.1.280 oder höher erforderlich ist (führen Sie bei einer älteren Installation claude update aus), und verwendet für die Sitzung weiterhin claude-sonnet-5. Setzen Sie ANTHROPIC_MODEL=claude-opus-5-5, um die gesamte Sitzung mit Opus 5.5 auszuführen. Setzen Sie außerdem ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5: Der Alias sonnet fordert Sonnet 5.5 an, das Kunavo nicht bereitstellt. Ohne diese Einstellung führen /model sonnet, die Ausführungsphase von opusplan und auf sonnet gesetzte Subagents zu einem 404.
Wie groß ist das Kontextfenster von Claude Opus 5.5?
Laut Anthropics Modellseite 1 Mio. Kontext-Token und bis zu 128K Ausgabe-Token pro Anfrage über die Messages API. Das 1-Mio.-Fenster ist der Standard — ohne Beta-Header —, und lange Anfragen werden zum gleichen Token-Tarif wie kurze abgerechnet. Anthropics Batch API erhöht die Ausgabe mit einem Beta-Header auf 300K; Kunavo bietet die Batch API nicht an.
Funktioniert erzwungenes tool_choice bei Claude Opus 5.5?
Nicht zuverlässig. Anthropic unterstützt die erzwungene Tool-Nutzung bei Opus 5.5 nicht: tool_choice {type: "any"} oder {type: "tool"} führt dort zu einem 400-Fehler, und Kunavos OpenAI-kompatibler Endpunkt übersetzt tool_choice "required" in "any". Bei Kunavo gab eine am 24. September 2026 getestete Anfrage mit erzwungenem Tool 200 statt 400 zurück; auf die Erzwingung ist daher ebenfalls kein Verlass. Sende tool_choice "auto" und nenne das Tool in den Anweisungen, oder verwende ein Antwortformat mit JSON-Schema, wenn der erzwungene Aufruf nur dazu diente, eine strukturierte Ausgabe zu erhalten.