Retour aux guides
Modèles·24 septembre 2026·Mis à jour le 4 octobre 2026·6 min de lecture

API Claude Opus 5.5 — tarifs, identifiant du modèle et nouveautés par rapport à Opus 5

Anthropic a lancé Claude Opus 5.5 le 22 septembre 2026 — moins cher qu’Opus 5 et, selon les chiffres d’Anthropic, meilleur. Voici son prix API chez Anthropic et sur Kunavo, son identifiant de modèle, l’impact des changements incompatibles sur les requêtes écrites pour Opus 5 et du code fonctionnel pour le SDK OpenAI, le SDK Anthropic et Claude Code.

Dernière vérification le .

Claude Opus 5.5 est le nouvel Opus d’Anthropic, sorti le 22 septembre 2026, et le modèle vers lequel Anthropic oriente désormais « la plupart des charges de travail ». Son prix API est de $4.00 en entrée / $20.00 en sortie par 1M de tokens chez Anthropic — inférieur aux $5.00 / $25.00 d’Opus 5 — et de $2.80 / $14.00 sur Kunavo, soit 30 % sous ce tarif catalogue. L’identifiant du modèle est claude-opus-5-5 ; il dispose d’une fenêtre de contexte de 1M de tokens et de jusqu’à 128K tokens de sortie, et raisonne à chaque requête.

Tarification de l’API Claude Opus 5.5

Tarifs publiés par Anthropic à côté de ceux de Kunavo, par 1M de tokens. Anthropic facture les lectures du cache d’Opus 5.5 à 5% de l’entrée, au lieu des 10% facturés sur la plupart des modèles Claude, et Kunavo applique le même ratio :

Classe de tokensTarif catalogue AnthropicKunavo
Entrée$4.00$2.80
Sortie (raisonnement inclus)$20.00$14.00
Écriture dans le cache$5.00 (5 min) · $8.00 (1 heure)$3.50, quelle que soit la TTL
Lecture du cache$0.20$0.14

À côté du reste de la gamme Claude sur Kunavo, Opus 5.5 est le moyen le moins cher d’obtenir un raisonnement de niveau Opus — moins cher que Claude Opus 5 ($3.50 / $17.50). Claude Sonnet 5 coûte encore moins cher ($1.40 / $7.00), tandis que Claude Fable 5.1 est en tête de gamme à $7.00 / $35.00 et que Claude Haiku 4.5 ferme la gamme à $0.70 / $3.50. Tous les tarifs Claude, avec des exemples détaillés, figurent dans le guide de tarification de l’API Claude ; la page du modèle est /models/claude-opus-5-5.

Appeler Claude Opus 5.5

Une seule clé Kunavo permet d’accéder à Opus 5.5 via le point de terminaison compatible OpenAI et via l’API native Anthropic Messages. Avec le SDK OpenAI, modifiez base_url et la chaîne du modèle :

opus55_openai.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Opus 5.5 always thinks, and thinking bills as output — leave max_tokens
# generous or the budget is spent before the answer starts.
resp = client.chat.completions.create(
    model="claude-opus-5-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "Review this migration plan for failure modes."}],
)
print(resp.choices[0].message.content)

Avec le SDK Anthropic, transmettez l’origine sous la forme base_url ; le SDK ajoute lui-même /v1/messages :

opus55_messages.py
from anthropic import Anthropic

# Native Messages API: pass the origin — the SDK appends /v1/messages.
client = Anthropic(base_url="https://api.kunavo.com", auth_token="sk-kn-...")

msg = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=8192,   # thinking plus the answer
    messages=[{"role": "user", "content": "Find the race condition in this diff."}],
)
for block in msg.content:
    if block.type == "text":
        print(block.text)

Les clés sont créées à l’adresse /app/keys ; le guide des clés API Claude explique la procédure.

Ce qui change par rapport à Opus 5 — et l’impact sur vos requêtes

Anthropic répertorie quatre changements incompatibles pour le code exécuté sur Opus 5, ainsi qu’un changement dans la structure des réponses. Écrivez en respectant les règles d’Anthropic — mais sachez que deux d’entre eux n’ont pas échoué via Kunavo lors de notre test du 24 septembre 2026 :

  • Le raisonnement ne peut pas être désactivé. Chez Anthropic, thinking: {type: "disabled"} et budget_tokens renvoient une erreur 400 quel que soit le niveau d’effort, et effort (par défaut medium) est le seul contrôle. Via Kunavo, la demande de désactivation a renvoyé 200 et le modèle a tout de même raisonné, tandis que output_config.effort n’a produit aucune différence mesurable — le canal qui fournit Opus 5.5 n’applique aucun de ces deux paramètres. Le raisonnement est facturé comme une sortie : une réponse d’un mot a consommé 15 de ses 16 tokens de sortie en raisonnement. Laissez max_tokens suffisamment élevé.
  • L’utilisation forcée d’outils n’est pas prise en charge. Chez Anthropic, tool_choice de any ou tool renvoie une erreur 400 (le "required" compatible OpenAI est converti en any). Via Kunavo, une requête avec outil forcé a renvoyé 200 ; il ne faut donc pas compter sur ce forçage. Utilisez auto et nommez l’outil dans le prompt.
  • Les blocs de raisonnement sont liés au modèle et à la conversation. Rejouez-les sans modification sur Opus 5.5 ; la modification du prompt système, des outils ou des tours précédents les invalide. Consultez le guide des erreurs de signature du raisonnement.
  • L’ancien outil d’utilisation de l’ordinateur a disparu. computer_20251124 n’est pas accepté par l’API Claude.
  • Le texte entre les appels d’outils arrive sous forme de blocs de raisonnement, vides avec le paramètre display par défaut — une application qui diffuse du texte de progression reste silencieuse entre les appels d’outils.

Les paramètres d’échantillonnage avaient déjà disparu sur Opus 5 ; sur Opus 5.5, Kunavo supprime temperature, top_p et top_k avant que la requête ne quitte la passerelle, comme pour le reste de la famille Claude 5.

Opus 5.5 contre Opus 5, selon les chiffres d’Anthropic

L’annonce d’Anthropic indique qu’Opus 5.5 « atteint le niveau de Claude Fable 5.1 pour la plupart des tâches et coûte 40 % moins cher à exécuter qu’Opus 5 », et qu’il génère les sorties plus de 30 % plus rapidement. Ses scores publiés par rapport à Opus 5 (chiffres d’Anthropic, pas ceux de Kunavo) :

Test de performanceOpus 5.5Opus 5
Terminal-Bench 4.066.4%52.3%
CursorBench 4.057.8%46.6%
FrontierCode v1.1 (Main)54.4%48.0%
OSWorld 2.081.8%74.0%
GDPval-AA v2.1 (Elo)18461708

Pour les nouveaux projets, il y a peu de raisons de rester sur Opus 5 : Opus 5.5 est plus rapide, obtient de meilleurs scores et coûte moins cher, et la chaîne du modèle est le seul changement, sauf si votre code dépend de la désactivation du raisonnement ou du forçage d’un outil. Restez sur claude-opus-5 uniquement jusqu’à la réécriture de ces deux chemins.

Claude Code sur Kunavo avec Opus 5.5

Depuis Claude Code v2.1.280, son modèle par défaut et son alias opus pointent vers Opus 5.5, que Kunavo sert. Le guide de configuration Kunavo fixe l’alias opus sur claude-opus-5-5 ; ainsi, /model opus et la phase de planification de opusplan sont facturés à $2.80 / $14.00 par million de tokens. Sur une ancienne version de Claude Code, exécutez d’abord claude update. Le guide fixe également l’alias sonnet sur claude-sonnet-5 : l’alias demande Sonnet 5.5, que Kunavo ne sert pas ; sans cela, /model sonnet, la phase d’exécution de opusplan et les sous-agents configurés sur sonnet renverraient 404. Pour exécuter toute la session sur Opus 5.5, définissez également ANTHROPIC_MODEL :

claude-code.sh
export ANTHROPIC_BASE_URL=https://api.kunavo.com   # origin, no /v1
export ANTHROPIC_AUTH_TOKEN=sk-kn-...

# Run the session on Opus 5.5 (Claude Code v2.1.280 or later).
export ANTHROPIC_MODEL=claude-opus-5-5
# Pin the aliases to models Kunavo serves. The sonnet alias asks for
# Sonnet 5.5, which Kunavo does not serve: without the SONNET line,
# /model sonnet, opusplan's execution phase and sonnet subagents get a 404.
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5

claude

Le reste de la configuration — l’URL de base limitée à l’origine, pourquoi utiliser ANTHROPIC_AUTH_TOKEN plutôt que ANTHROPIC_API_KEY, et la forme settings.json — se trouve sur la page Claude Code.

Questions fréquentes

Combien coûte l’API Claude Opus 5.5 ?

Anthropic affiche Claude Opus 5.5 à $4.00 par 1M de tokens d’entrée et $20.00 par 1M de tokens de sortie, avec les lectures du cache à $0.20 et les écritures du cache de 5 minutes à $5.00. Sur Kunavo, il coûte $2.80 en entrée / $14.00 en sortie par 1M — soit 30 % sous le tarif catalogue d’Anthropic — avec les lectures du cache à $0.14 et les écritures du cache à $3.50, selon un paiement à l’usage prélevé sur un solde prépayé sans abonnement.

Quel est l’identifiant du modèle Claude Opus 5.5 ?

L’identifiant du modèle API est claude-opus-5-5 — la même chaîne sur l’API Claude, Google Cloud, Microsoft Foundry et Kunavo ; Amazon Bedrock la préfixe par anthropic.claude-opus-5-5. Il n’existe aucun suffixe d’instantané daté : depuis la génération 4.6, les identifiants sans date d’Anthropic sont eux-mêmes des instantanés figés. Les écritures telles que claude-opus-5.5 ne sont pas valides.

Claude Opus 5.5 est-il meilleur qu’Opus 5 ?

D’après les propres chiffres d’Anthropic, oui, et il est moins cher. Anthropic indique qu’Opus 5.5 atteint 66,4 % sur Terminal-Bench 4.0, contre 52,3 % pour Opus 5, affirme qu’il « offre des performances du niveau de Claude Fable 5.1 sur la plupart des tâches », génère les sorties plus de 30 % plus vite qu’Opus 5 et coûte 40 % moins cher à exécuter. Son prix catalogue est de $4.00 / $20.00, contre $5.00 / $25.00 pour Opus 5 ; sur Kunavo, il est de $2.80 / $14.00, contre $3.50 / $17.50, soit 20 % de moins pour la sortie.

Puis-je désactiver le raisonnement sur Claude Opus 5.5 ?

Non. Le raisonnement adaptatif est toujours activé : chez Anthropic, thinking: {type: "disabled"} et le paramètre budget_tokens renvoient tous deux une erreur 400 quel que soit le niveau d’effort, et le seul contrôle est le paramètre effort, dont la valeur par défaut sur Opus 5.5 est medium. Via Kunavo, lors d’un test le 24 septembre 2026, la demande de désactivation n’a pas généré d’erreur — elle a été ignorée et le modèle a tout de même raisonné — et les valeurs d’effort n’ont produit aucune différence mesurable. Les tokens de raisonnement sont facturés au tarif de sortie ; dimensionnez donc max_tokens pour le raisonnement et la réponse.

Claude Code utilise-t-il Opus 5.5 par défaut ?

Oui, depuis Claude Code v2.1.280 : pour les comptes Anthropic API, le modèle par défaut et l’alias opus pointent tous deux vers Opus 5.5 (configuration des modèles de code.claude.com), et Kunavo sert claude-opus-5-5. Le réglage Claude Code de Kunavo fixe l’alias opus sur claude-opus-5-5, qui nécessite v2.1.280 ou une version ultérieure (exécutez claude update sur une ancienne installation), et conserve la session sur claude-sonnet-5 ; définissez ANTHROPIC_MODEL=claude-opus-5-5 pour exécuter toute la session sur Opus 5.5. Fixez également ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5 : l’alias sonnet demande Sonnet 5.5, que Kunavo ne sert pas ; sans ce réglage, /model sonnet, la phase d’exécution d’opusplan et les sous-agents configurés sur sonnet renvoient 404.

Quelle est la fenêtre de contexte de Claude Opus 5.5 ?

1M tokens de contexte et jusqu’à 128K tokens de sortie par requête sur l’API Messages, selon la page de modèle d’Anthropic. La fenêtre de 1M est la valeur par défaut — aucun en-tête bêta n’est nécessaire — et les requêtes longues sont facturées au même tarif par token que les requêtes courtes. L’API Batch d’Anthropic porte la sortie à 300K avec un en-tête bêta ; Kunavo ne propose pas l’API Batch.

Le paramètre tool_choice forcé fonctionne-t-il sur Claude Opus 5.5 ?

Pas de manière fiable. Anthropic ne prend pas en charge l’utilisation forcée d’outils sur Opus 5.5 : tool_choice {type: "any"} ou {type: "tool"} renvoie une erreur 400, et le point de terminaison compatible OpenAI de Kunavo convertit tool_choice "required" en "any". Via Kunavo, lors d’un test le 24 septembre 2026, une requête avec outil forcé a renvoyé 200 plutôt que 400 ; on ne peut donc compter sur le forçage dans aucun des deux cas. Envoyez tool_choice "auto" et nommez l’outil dans les instructions, ou utilisez un format de réponse à schéma JSON lorsque l’appel forcé ne servait qu’à obtenir une sortie structurée.