Retour aux guides
Agents de programmation·1 octobre 2026·9 min de lecture

Tarification de Warp AI : crédits, forfaits et ce que votre propre inférence supprime

Le terminal de Warp est gratuit et son IA est facturée en crédits répartis dans trois catégories. Votre propre clé ou point de terminaison supprime les crédits IA pour les appels qu’il prend en charge — mais pas Auto, ni les agents cloud, ni, avec Business, les frais de plateforme à l’heure.

Dernière vérification le .

Le terminal de Warp ne coûte rien ; son IA est mesurée en crédits, et ce sont ces crédits qu’il vaut la peine de comprendre. Au 1er octobre 2026, la page tarifaire de Warp fournit 1 500 crédits par mois avec Build pour 20 $, 18 000 avec Max pour 200 $ et 1 500 par siège avec Business pour 50 $, et vend des crédits supplémentaires dans des packs Reload à partir de 400 crédits pour 10 $. Les crédits de formule sont réinitialisés tous les 30 jours ; les crédits achetés restent valables 12 mois. Et un appel de modèle acheminé avec votre propre clé ou votre propre endpoint n’utilise aucun crédit IA — mais Auto, les agents cloud et, avec Business, les frais de plateforme à l’heure continuent de consommer des crédits.

Cette page explique cette comptabilisation : ce que mesure chaque compartiment, ce que coûte un crédit selon le canal, et précisément quelle utilisation votre propre inférence supprime. Pour Warp en tant que produit comparé à Claude Code — licences, protocoles, emplacement d’exécution du harnais d’agent — consultez Warp vs Claude Code. Tout ce qui suit provient de la page de tarification et de la documentation de Warp consultées le 1er octobre 2026 ; personne ici ne possède d’abonnement Warp, donc aucun chiffre ne correspond à une facture mesurée.

De quel Warp s’agit-il ?

Warp désigne ici le terminal agentique de warp.dev — l’application de bureau et la Warp Agent CLI. Il ne s’agit ni de WARP de Cloudflare, le client VPN 1.1.1.1 avec son propre niveau payant, ni du framework web Rust appelé warp. Aucun des prix ci-dessous ne s’applique à ces deux produits.

Les forfaits et leur contenu

FormuleMensuelFacturé annuellementCrédits inclusVotre propre inférence
Gratuit$0$0Aucun pour Warp AgentVos propres clés API, SuperGrok ou un point de terminaison personnalisé — pour les particuliers et les organisations de 10 employés ou moins
Build$2018 $ par mois1 500 par mois — la carte indique « 20 $ d’utilisation d’agent incluse aux tarifs API »Identique à Free
Max$200180 $ par mois18 000 par mois — valorisés par Warp à 240 $Identique à Free
Business50 $ par siège45 $ par siège1 500 par siège ; jusqu’à 25 siègesDébloqué pour les organisations de plus de 10 employés
EnterprisePersonnaliséPersonnaliséPools partagés personnalisésAjoute BYOLLM (inférence dans votre propre cloud), ainsi que des clés et points de terminaison gérés par l’équipe

« Payez à l’usage, à partir de » est la formulation utilisée par Warp sur chaque carte payante : l’abonnement constitue un minimum, et tout ce qui dépasse les crédits inclus est acheté sous forme de crédits Reload.

Trois compartiments, un seul solde

La documentation de Warp mesure le travail des agents en trois types de crédits qui puisent tous dans le même solde — d’abord les crédits du forfait, puis les crédits Reload.

CompartimentCe qu’il paieQuand il est consommé
Crédits AIL’appel au modèleLorsque Warp paie le fournisseur — pour les modèles gérés par Warp, et toujours pour Auto
Crédits de calculLe bac à sable dans lequel s’exécute un agentLes exécutions d’agents cloud se déroulent sur des workers hébergés par Warp ; les exécutions locales utilisent votre machine et n’en consomment aucun
Crédits de plateformeCycle de vie de l’exécution, intégrations, tableau de bord, API, observabilité — facturés à l’heure d’agentChaque exécution d’agent cloud sur tout forfait, ainsi que les exécutions locales sur Business ou Enterprise qui utilisent votre propre clé, point de terminaison ou BYOLLM

Deux détails déterminent les factures réelles. Les crédits de plateforme s’accumulent par heure d’agent, les heures partielles étant calculées proportionnellement, et pour Warp Agent uniquement pendant sa génération — mais pour Claude Code et Codex exécutés comme harnais cloud, la totalité de l’exécution est comptabilisée, y compris le temps d’attente du fournisseur de modèle. De plus, le tarif horaire n’est pas indiqué là où la documentation renvoie : la page des crédits de plateforme demande de consulter la page de tarification pour connaître les tarifs actuels, et au 1er octobre 2026 la page de tarification n’en indiquait aucun.

Coût d’un crédit selon le canal

Comment obtenir le créditCréditsPrixPar crédit
Forfait Build1,500$20$0.0133
Forfait Max18,000$200$0.0111
Pack Reload, forfait payant400$10$0.0250
Pack Reload, forfait payant1,000$20$0.0200
Pack Reload, forfait payant3,000$50$0.0167
Pack Reload, forfait payant6,500$100$0.0154
Pack Reload, forfait Free40020 % au-dessus du tarif du forfait payant, selon Warpenviron $0.030

La colonne du coût par crédit résulte de la division des prix catalogue de Warp, et la ligne du forfait Free applique les 20 % indiqués par Warp au tarif payant au lieu de citer un prix publié. L’infobulle de Warp indique que Max est « environ 17 % moins cher par crédit que l’achat de crédits Reload » ; une simple division comparée au meilleur niveau Reload donne un écart plus large. Considérez donc les 17 % comme la présentation de Warp, et non comme un chiffre calculé par cette page. Aucune de ces lignes ne vous indique combien de crédits votre travail consomme : Warp précise que deux requêtes similaires peuvent utiliser des quantités différentes, que les modèles plus grands, les appels d’outils plus nombreux et un contexte plus vaste augmentent cette consommation, et qu’il n’existe aucune formule.

Réinitialisation, report et pool d’équipe

  • Les crédits du forfait sont réinitialisés tous les 30 jours à compter de la date de votre abonnement ou de son renouvellement — et non au début du mois civil — et ne sont pas reportés.
  • Les crédits Reload sont reportés et restent valides pendant 12 mois à compter de leur achat, y compris après un passage au forfait Free. Ils ne sont remboursables que si aucun n’a été utilisé.
  • Dans une équipe, les crédits Reload constituent un pool partagé unique. Tout membre peut en acheter ; chaque membre dépense d’abord ses propres crédits de forfait, puis le pool partagé — un utilisateur intensif peut donc dépenser des crédits achetés par quelqu’un d’autre. Les soldes restants dans les pools personnels de la période de mai à août 2026 ne sont utilisés qu’une fois le pool partagé épuisé.
  • Le rechargement automatique est désactivé par défaut pour les nouveaux abonnés ; lorsqu’il est activé, il achète le pack choisi dès que le solde passe sous 100 crédits, dans la limite d’un plafond mensuel de dépenses qui commence à 200 $ et se réinitialise au début du mois civil, et non selon le cycle de facturation.
  • À court de crédits sur un forfait payant sans Reload désactive les modèles premium jusqu’à votre prochaine réinitialisation ; Warp documente également une limite distincte de tokens, indiquée comme QuotaLimit, qui peut arrêter tous les modèles même s’il reste des crédits.

Quand votre propre inférence remplace les crédits — et quand ce n’est pas le cas

Warp documente trois façons d’apporter votre propre accès aux modèles : une clé API pour OpenAI, Anthropic ou Google (BYOK), un abonnement SuperGrok ou X Premium pour Grok, et un point de terminaison d’inférence personnalisé — tout service qui implémente OpenAI Chat Completions. Pour les requêtes acheminées par l’un de ces moyens, Warp ne consomme aucun crédit AI et le fournisseur vous facture directement. Les exceptions sont ce qui rend un budget fiable :

  • Auto utilise toujours les crédits Warp. Pour utiliser votre point de terminaison, vous devez sélectionner dans le sélecteur le modèle acheminé vers ce point de terminaison ; les routeurs personnalisés ne peuvent pas non plus être résolus vers l’un d’eux.
  • Les agents cloud utilisent toujours les crédits Warp. Un point de terminaison personnalisé en libre-service est enregistré sur votre appareil et n’atteint jamais les exécutions cloud ; dans Enterprise, les administrateurs peuvent configurer des points de terminaison gérés par l’équipe qui, eux, les atteignent.
  • Business et Enterprise paient des crédits de plateforme pour les exécutions locales d’agents qui utilisent votre propre clé ou point de terminaison. Dans Free, Build et Max, les exécutions locales utilisant votre propre inférence n’en consomment aucun.
  • Le seuil de 10 employés. Selon les conditions de Warp, le BYOK en libre-service et les points de terminaison personnalisés sont destinés aux particuliers et aux organisations de 10 employés ou moins ; au-delà, Business ou Enterprise est requis.
  • L’application, pas la CLI. La FAQ de tarification de Warp indique que les points de terminaison d’inférence personnalisés sont disponibles uniquement dans l’application Warp ; la Warp Agent CLI accepte les clés API et SuperGrok via /api-keys.
  • Une URL publique, via les serveurs de Warp. Le harnais d’agent s’exécute sur le backend de Warp et appelle votre point de terminaison depuis celui-ci ; localhost et les adresses privées sont donc rejetés, et Warp indique ne pas pouvoir appliquer la conservation nulle des données à ce trafic.

Trois budgets, avec exemples

Ces exemples sont illustratifs et non mesurés. Le volet tokens suppose un mois de travail d’un développeur avec 20M tokens d’entrée non mis en cache et 0.8M tokens de sortie via un point de terminaison personnalisé, aux tarifs actuels de Kunavo par million de tokens ; il exclut les remises de mise en cache, les nouvelles tentatives et tout ce qui continue de fonctionner avec les crédits Warp.

Modèle via le point de terminaisonEntrée / sortie par millionVolume mensuel de tokens supposé
Claude Haiku 4.5$0.70 / $3.50$16.80
GPT-5.6 Terra$0.70 / $4.20$17.36
Claude Sonnet 5$1.40 / $7.00$33.60
  • Un développeur indépendant avec Free et un point de terminaison. Warp facture 0 $ ; la facture du modèle est celle du point de terminaison. Auto et toute exécution d’agent cloud nécessitent des crédits, ce qui signifie Reload au tarif plus élevé dans Free.
  • Le même développeur avec Build. 20 $ par mois achètent 1 500 crédits pour Auto, les exécutions cloud et les modèles que vous n’acheminez pas vers votre point de terminaison ; la facture du point de terminaison reste inchangée. Build vaut la peine pour les crédits et les ajouts du forfait, pas pour le point de terminaison, déjà autorisé par Free.
  • Une entreprise de 12 personnes. Au-delà du seuil de 10 employés, sa propre inférence nécessite Business : 50 $ par siège, plus des crédits de plateforme pour chaque heure d’agent local utilisant le point de terminaison, selon un tarif que Warp n’imprime pas sur sa page de tarification — demandez-le avant d’y engager une équipe.

Configurer le point de terminaison, si vous choisissez cette option

La documentation des points de terminaison personnalisés de Warp donne les étapes : ouvrez Settings, recherchez inference endpoint, ajoutez l’URL de base qui expose /v1/chat/completions ainsi qu’une clé, répertoriez les identifiants de modèles, puis enregistrez. Son propre exemple de modèle local utilise une URL se terminant par /v1.

Endpoint d’inférence personnalisé Warp — champs issus de la documentation de Warp, non testés ici
Warp app  →  Settings  →  search "inference endpoint"

Endpoint URL   https://api.kunavo.com/v1     (the base that exposes /v1/chat/completions)
API key        sk-kn-...                     (stored in your OS keychain, sent per request)
Model IDs      claude-sonnet-5, claude-haiku-4-5  (one per model you want in the picker)

Then pick the endpoint-routed model in the model picker — not Auto.

Le point de terminaison de Kunavo est public et compatible avec OpenAI, ce qui correspond aux exigences de Warp — mais il s’agit d’une concordance entre deux ensembles de documentation. Personne chez Kunavo n’a exécuté Warp avec celui-ci ; envoyez donc une tâche limitée, vérifiez qu’elle est diffusée en continu et qu’un appel d’outil aboutit, puis comparez le compteur de crédits de Warp (qui devrait indiquer zéro crédit AI pour ce tour) avec le débit de votre journal d’utilisation Kunavo. Kunavo facture par token à partir d’un solde prépayé, avec un rechargement minimal de $10 et sans abonnement — consultez la facturation.

Mesurer vos propres crédits par tâche

Comme Warp ne publie aucun ratio crédits-tokens, le seul chiffre fiable est le vôtre. Dans l’application, survolez le compteur de crédits sous la réponse de l’agent pour voir les crédits de ce tour ; dans la Warp Agent CLI, /cost affiche les crédits par réponse ; Settings > Billing and usage contient le total cumulé, avec les crédits de plateforme, AI et de calcul affichés séparément. Exécutez une même petite tâche une fois avec un modèle géré par Warp et une fois via votre point de terminaison : vous obtenez ainsi la seule comparaison qu’aucune page de tarification ne peut fournir.

À lire également : Warp vs Claude Code pour le choix du produit, API compatible avec OpenAI pour ce qu’un point de terminaison doit implémenter, et l’annuaire des API d’agents AI pour d’autres agents qui acceptent un point de terminaison personnalisé sans blocage par forfait.

Questions fréquentes

Combien coûte l’IA de Warp ?

Le terminal de Warp est gratuit, et son IA est mesurée en crédits. Au 1er octobre 2026, la page tarifaire de Warp indique Free à 0 $ sans utilisation d’agent incluse, Build à 20 $ par mois avec 1 500 crédits, Max à 200 $ par mois avec 18 000 crédits, Business à 50 $ par siège et par mois avec 1 500 crédits par siège pour un maximum de 25 sièges, et Enterprise selon des conditions personnalisées ; le paiement annuel permet d’économiser 10 %. Les crédits supplémentaires sont proposés dans des packs Reload allant de 400 crédits pour 10 $ à 6 500 pour 100 $ sur les formules payantes, et Warp indique que les tarifs Reload du forfait Free sont 20 % plus élevés. Utiliser votre propre clé API ou un endpoint d’inférence personnalisé pour un modèle signifie que les appels de ce modèle ne consomment aucun crédit IA Warp.

Qu’est-ce qu’un crédit Warp, et combien de tokens représente-t-il ?

Un crédit est l’unité de travail d’agent de Warp, et Warp ne publie pas de conversion en tokens. Sa documentation indique que l’utilisation des crédits évolue avec le nombre de tokens traités et suit généralement la tarification de l’API du modèle, mais qu’il n’existe aucune formule exacte et que deux prompts similaires peuvent utiliser des nombres différents de crédits. Warp mesure également trois compartiments distincts à partir d’un même solde : les crédits IA pour l’appel du modèle, les crédits de calcul pour les sandbox hébergées par Warp lors des exécutions cloud, et les crédits de plateforme facturés à l’heure d’agent. Pour connaître votre propre ratio, exécutez une tâche et consultez l’indicateur de crédits sous la réponse dans l’application, ou utilisez /cost dans le CLI Warp Agent.

Le fait d’utiliser ma propre clé API ou mon propre endpoint rend-il l’IA de Warp gratuite ?

Cela supprime les crédits IA pour les requêtes que vous y acheminez, mais pas tous les autres frais. Les modèles Auto utilisent toujours des crédits Warp, les routeurs personnalisés ne peuvent pas résoudre vers un modèle acheminé par endpoint, les exécutions d’agents cloud consomment toujours des crédits, et des fonctionnalités telles que Codebase Context dépendent de l’infrastructure Warp. Avec Business et Enterprise, les exécutions d’agents locaux utilisant votre propre clé ou votre propre endpoint consomment toujours des crédits de plateforme, facturés à l’heure d’agent. Les conditions de Warp limitent également le BYOK et les endpoints personnalisés en libre-service aux personnes et organisations comptant 10 employés ou moins ; les organisations plus grandes doivent utiliser Business ou Enterprise.

Les crédits Warp inutilisés sont-ils reportés ?

Les crédits de formule ne le sont pas ; les crédits Reload le sont. La FAQ tarifaire de Warp indique que les crédits mensuels inclus sont réinitialisés tous les 30 jours à compter de la date d’abonnement ou de renouvellement, et sa documentation sur les crédits complémentaires indique que les crédits achetés sont reportés d’un cycle de facturation à l’autre et restent valables pendant 12 mois à compter de l’achat, y compris après un passage au forfait Free. Dans une équipe, les crédits achetés sont versés dans un seul pool partagé auquel chaque membre puise une fois ses propres crédits de formule épuisés ; un utilisateur intensif peut donc dépenser des crédits achetés par un autre membre. Les administrateurs peuvent définir un plafond mensuel de dépenses pour toute l’équipe.

Warp peut-il utiliser un endpoint compatible avec OpenAI comme Kunavo ?

Warp documente un endpoint d’inférence personnalisé pour tout service qui implémente l’API OpenAI Chat Completions, configuré dans l’application Warp sous Settings en recherchant inference endpoint, avec l’URL de base, une clé API et les identifiants des modèles. L’endpoint doit être accessible à une URL publique, car la requête est assemblée sur les serveurs de Warp, et Warp indique ne pas pouvoir appliquer la conservation zéro des données à ce trafic. Les endpoints personnalisés sont disponibles uniquement dans l’application Warp, et non dans le CLI Warp Agent. L’endpoint de Kunavo est public et compatible avec OpenAI, mais personne chez Kunavo n’a exécuté Warp contre lui ; considérez donc la première requête comme votre propre test.

Consulté le 1er octobre 2026 : warp.dev/pricing (cartes des forfaits et FAQ dans ses données structurées) et la documentation de Warp consacrée aux forfaits et à la facturation, aux crédits, aux crédits complémentaires, aux crédits de plateforme, au point de terminaison d’inférence personnalisé et à l’utilisation de votre propre clé API. Non publié dans les sources consultées : un tarif de crédit de plateforme par heure d’agent et toute conversion des crédits en tokens. Non testé : Warp n’a pas été installé et aucun abonnement à Warp n’a été souscrit ; aucune requête n’a été envoyée de Warp à Kunavo. Les tarifs de tokens de Kunavo proviennent du catalogue actuel ; chaque montant en dollars du tableau des tokens est un calcul illustratif.