Retour aux guides
Configuration·21 septembre 2026·Mis à jour le 24 septembre 2026·9 min de lecture

Modèles Jan AI et coûts API : local, cloud et endpoints personnalisés

Jan n’héberge aucun service d’inférence et ne vend rien ; le seul montant à prévoir correspond donc aux tokens au tarif de votre fournisseur — ou à rien par requête si le modèle s’exécute sur votre propre machine.

Dernière vérification le .

Les modèles cloud de Jan AI ne sont pas les modèles de Jan. Jan n’héberge aucun service d’inférence et ne vend rien ; dans Jan Desktop, « modèles cloud » désigne donc onze passerelles intégrées utilisant votre propre clé vers des fournisseurs tiers, ainsi que tout point de terminaison au format OpenAI ou Anthropic que vous ajoutez vous-même — chacun étant facturé par l’entité située à l’autre extrémité. L’application elle-même est gratuite : jan.ai/pricing renvoyait HTTP 404 lors de la vérification du 19 septembre 2026, et ni Jan Desktop ni Jan Agent ne documente de forfait, de siège, de crédit ou de quota. Le seul chiffre à prévoir est donc celui des tokens au tarif de votre fournisseur — ou zéro par requête si le modèle s’exécute sur votre propre machine.

Une première clarification s’impose, car les recherches les mélangent. Janitor AI (janitorai.com) est un site grand public de discussion avec des personnages et un produit totalement différent ; une grande partie des recherches « jan ai api key » désigne sa clé proxy. Si c’est ce que vous configurez, commencez plutôt par la page de configuration de Janitor AI — aucune information de prix ou de limite pour ce produit n’apparaît sur cette page.

Trois produits partagent la marque Jan, et deux partagent le nom du binaire

C’est cette confusion qui explique pourquoi les acheteurs ne savent plus si Jan est gratuit à exécuter. jan.ai répertorie exactement trois produits (page d’accueil consultée le 18 septembre 2026) :

  • Jan Desktop — l’application stable privilégiant l’usage local. Dernière version étiquetée v0.8.4, publiée le 23 juillet 2026 ; le dépôt n’est pas archivé et a reçu son dernier push le 18 septembre 2026, avec 44 551 étoiles (API GitHub, 19 septembre 2026). Il intègre les moteurs llama.cpp et MLX et peut accéder facultativement à des fournisseurs cloud. Le dépôt se décrit comme fonctionnant à 100 % hors ligne.
  • Jan Agent — un agent de terminal distinct, distribué séparément. Son démarrage rapide comporte un avertissement de préversion : l’installateur de dev extrait la version depuis le canal agent-nightly. Il n’a aucune version marquée dans le dépôt, et le démarrage rapide n’en affiche une qu’avec jan --version ; toute information que vous écrivez sur ses options dépend donc de la version que vous avez installée.
  • Tokamak — un backend auto-hébergé au niveau de l’organisation, avec son propre domaine documentaire. Sa page ne publie ni prix, ni forfait, ni nombre de sièges, ni crédit, ni liste d’attente ; cette page n’en cite donc aucun — et l’absence de conditions publiées ne signifie pas que le service est gratuit. Il s’agit d’un backend auto-hébergé distinct plutôt que d’un forfait payant ajouté à Jan Desktop, et jan login est la procédure documentée pour y accéder.

La documentation de Jan semble contradictoire sur ce point, et c’est la page des fournisseurs qui permet de la concilier. Le texte de présentation de la documentation décrit Jan Agent comme lançant des agents sur un modèle local ; le démarrage rapide affirme catégoriquement que Jan Agent ne possède aucun moteur d’inférence local — il appelle un fournisseur distant. Les deux affirmations sont exactes, mais concernent des aspects différents. L’Agent n’exécute lui-même aucun modèle, qui s’exécute donc toujours ailleurs — mais cet « ailleurs » peut être votre propre machine : la page des fournisseurs comporte une section « Your own hardware » qui dirige l’Agent vers le serveur d’API local de Jan Desktop (http://localhost:6767/v1) et précise que rien ne quitte votre machine dans cette configuration. L’Agent a donc toujours besoin d’un point de terminaison ; il n’a pas toujours besoin d’un point de terminaison payant.

La collision des noms aggrave encore la situation. La propre CLI de Jan Desktop (disponible depuis 0.7.8) et le binaire Jan Agent sont tous deux invoqués avec jan, mais proposent des ensembles de commandes différents. Il existe donc trois « points de terminaison Jan » distincts : 127.0.0.1:1337 pour le serveur d’API local de l’interface graphique Desktop, localhost:6767/v1 pour jan serve depuis la CLI Desktop, et toute URL de base distante vers laquelle un fournisseur est dirigé.

Tarification de Jan AI : coût du logiciel et services qui vous facturent

PosteCe que cela coûteSource
Application Jan Desktop$0, Apache 2.0Le fichier LICENSE de janhq/jan
Un service d’inférence Jan hébergéN’existe pasAucun fournisseur de ce type dans les constantes de fournisseurs livrées
Jan Agent (CLI en préversion)$0 à l’installation ; il n’exécute lui-même aucun modèle et appelle donc toujours un point de terminaison configuré — distant et facturé, ou serveur localDémarrage rapide de l’Agent et documentation des fournisseurs
CLI Jan Desktop, jan serve$0, aucun compte cloud et aucuns frais d’utilisationRéférence de la CLI
Modèles propriétaires de première partie de Jan$0 — poids ouvertsTéléchargements GGUF sur Hugging Face sous les propres organisations de Jan, janhq et Menlo ; le coût est celui du disque et de la RAM
TokamakAucune condition commerciale publiéePage de Tokamak — aucun prix, forfait ni siège n’y apparaît
Tokens de modèles distantsLe tarif par jeton de votre fournisseurLa facturation propre à votre fournisseur, et non celle de Jan

Une note sur la licence, car la lecture automatique est incorrecte : l’API de GitHub renvoie NOASSERTION pour ce dépôt, car le fichier LICENSE est constitué d’un préambule personnalisé de Menlo Research suivi de la mention standard Apache 2.0 et d’une demande d’attribution, plutôt que du texte Apache 2.0 reproduit mot pour mot qu’un analyseur recherche. Le fichier lui-même indique « Licensed under the Apache License, Version 2.0 » ; c’est donc la licence, et non le champ de l’API.

Les onze fournisseurs cloud intégrés, et ce qu’ils sont réellement

Jan Desktop initialise chaque fournisseur intégré avec une URL de base dans web-app/src/constants/providers.ts. Chacune pointe vers un tiers. Il n’existe aucune entrée jan ou menlo.

Fournisseur intégréURL de base fournie par Jan
OpenAIhttps://api.openai.com/v1
Azure OpenAIhttps://YOUR-RESOURCE-NAME.openai.azure.com/openai/v1
Anthropichttps://api.anthropic.com/v1 — la seule entrée marquée api_type: 'anthropic'
OpenRouterhttps://openrouter.ai/api/v1
Mistralhttps://api.mistral.ai/v1
Groqhttps://api.groq.com/openai/v1
xAIhttps://api.x.ai/v1
Google Geminihttps://generativelanguage.googleapis.com/v1beta/openai
MiniMaxhttps://api.minimax.io/v1
Hugging Facehttps://router.huggingface.co/v1
NVIDIAhttps://integrate.api.nvidia.com/v1

Lu dans ce fichier le 18 septembre 2026. Remarquez le schéma que chacun suit : le chemin de version fait partie de l’URL de base. Cette convention unique est la cause d’échec de configuration la plus fréquente dans Jan, et elle est couverte ci-dessous.

Trois choses différentes appelées « clé API Jan AI »

Quelle cléQui la créeDestination
Clé du serveur d’API local de JanVous l’inventez. La page du serveur d’API indique de définir n’importe quelle chaîne ; elle peut être laissée vide pour désactiver l’authentificationEnvoyée par votre propre client sous la forme Authorization: Bearer à 127.0.0.1:1337, préfixe d’API par défaut /v1
Clé d’un fournisseur amont ou d’une passerelleLe fournisseur ou la passerelle auprès duquel vous avez un compteCollée dans un fournisseur de modèles au sein de Jan afin que l’application puisse effectuer des appels sortants
Clé de proxy Janitor AIUn produit différent sur janitorai.comPas Jan du tout — consultez la configuration de Janitor AI

Les deux significations se confondent réellement dans Jan, car son serveur local reproduit les deux formats réseau. La documentation des préférences d’API de Jan montre que le serveur local expose GET /v1/models, POST /v1/chat/completions et un POST /v1/messages compatible Anthropic, authentifié avec x-api-key. C’est la même structure qu’expose une passerelle distante — la même commande curl peut donc être dirigée vers votre ordinateur portable ou vers un point de terminaison payant ; seul l’hôte indique lequel.

Local ou cloud : décidez selon la mémoire, le contexte et le besoin de travailler hors ligne

La base la plus objective pour cette décision est publiée par Jan lui-même sur la page d’installation Mac (macOS 13.6 ou version ultérieure, Apple Silicon uniquement — les Mac Intel ne sont pas pris en charge — et au moins 10GB d’espace libre) :

RAM systèmeRecommandations publiées par JanCe que cela implique pour la décision
8GBGénéralement jusqu’aux modèles 3B sans difficulté ; certains modèles 7B peuvent ne tenir qu’avec des quantifications agressives à faible nombre de bitsLe local convient au travail court et simple ; toute tâche exigeante passe par le distant
16GBGénéralement jusqu’aux modèles 7B sans difficulté ; certains modèles 13B avec des quantifications plus faiblesLe local gère les échanges quotidiens ; le distant convient aux longs contextes ou aux raisonnements complexes
32GBGénéralement jusqu'à 13B confortablement, avec une marge pour des quantifications plus élevées, des fenêtres de contexte plus larges ou le multitâcheLe local couvre la plupart des besoins ; le distant devient un choix de qualité, et non de capacité

Les minima Windows sont indiqués séparément sur la page d'installation de Windows et incluent un seuil de VRAM : Windows 10 ou version ultérieure, 8GB de RAM minimum avec 16GB recommandés, 6GB de VRAM minimum pour les GPU NVIDIA, AMD ou Intel Arc, 10GB d'espace libre et la prise en charge d'AVX2. Cette page ne publie aucun tableau de RAM par taille de modèle. Les exigences Linux n'ont pas été vérifiées pour cette page. Dans l'application, le Hub remplace les chiffres par un verdict — une pastille colorée indiquant S'adapte, Peut être lent ou Ne s'adaptera pas pour chaque niveau de quantification — et précise qu'aucune donnée n'est téléchargée pour déterminer l'état d'adéquation.

Concernant le choix du modèle : Jan documente sept modèles propriétaires — Jan-v3-4B, Jan-Code-4B, Jan-v1, Jan-v2-VL-med, Jan-Nano-32, Jan-Nano-128 et Lucy — avec des poids ouverts sur Hugging Face dans les propres organisations de Jan, janhq et Menlo. Ils ne sont pas tous de la même taille : la documentation des modèles indique 4B paramètres pour Jan-v3-4B et Jan-v1, 8B pour Jan-v2-VL-med et 1.7B pour Lucy. Jan-v3-4B possède également un contexte natif de 262,144 tokens, et sa page énonce clairement sa propre limite : les 4B paramètres limitent les raisonnements complexes en plusieurs étapes par rapport aux modèles plus grands. Cette phrase résume à elle seule l'argument local contre cloud. Utilisez le local pour les tâches délimitées et la confidentialité ; passez au distant lorsque la tâche dépasse le nombre de paramètres ou votre mémoire.

API personnalisée de Jan Desktop : ajouter un endpoint au format OpenAI ou Anthropic

Le chemin documenté est Settings → Model Providers → Add Provider. La page des endpoints personnalisés de Jan (vérifiée le 19 septembre 2026) propose exactement deux formats filaires — compatible OpenAI, présenté comme destiné à vLLM, Ollama, LocalAI, TGI, llama.cpp server et LiteLLM en mode OpenAI, et compatible Anthropic, pour les endpoints qui exposent l'API Anthropic Messages — puis demande un nom de fournisseur, une URL de base et une clé API. Le champ de clé est obligatoire même pour les serveurs locaux sans clé, pour lesquels n'importe quel espace réservé convient.

Deux détails déterminent si cela fonctionne du premier coup.

Le chemin de version doit figurer dans l'URL de base. La documentation de Jan présente cela comme l'erreur courante, avec ces mots : saisir http://localhost:8000 au lieu de http://localhost:8000/v1, ce qui produit une 404 à chaque requête. Pour un fournisseur au format OpenAI destiné à Kunavo, cela signifie https://api.kunavo.com/v1.

Pour le format Anthropic, la documentation de Jan ne donne pas de règle — elle indique d'utiliser la base documentée par votre passerelle, et son seul exemple est une instance locale de LiteLLM. Le code source de Jan permet de résoudre la question : le chemin Anthropic repose sur le fournisseur Anthropic du SDK Vercel AI, dont l'URL de requête est construite comme {baseURL}/messages avec un en-tête x-api-key, et dont la base par défaut comporte le préfixe de version. Ainsi, la même https://api.kunavo.com/v1 est la valeur à saisir, ce qui envoie la requête vers /v1/messages. Il s'agit d'une lecture de deux bases de code plutôt que d'un test ; considérez donc cette valeur comme celle à essayer en premier — consultez la note non testée à la fin de cette page.

Cette distinction piège les utilisateurs, car les instructions de Kunavo concernant ANTHROPIC_BASE_URL indiquent l'inverse pour une autre famille de clients : les SDK Anthropic officiels et Claude Code ajoutent eux-mêmes /v1/messages, donc ils prennent l'origine nue et l'ajout de /v1 produit /v1/v1/messages et une 404. Le fournisseur au format Anthropic de Jan ne fait pas partie de ces clients. Si vous voyez une 404, le chemin doublé dans l'erreur indique la convention utilisée. L'endpoint Messages de Kunavo accepte également l'en-tête Anthropic x-api-key ainsi que Authorization: Bearer, et l'endpoint chat completions couvre la route au format OpenAI.

Découverte des modèles et capacités. Lors de l'enregistrement, Jan tente de récupérer les modèles disponibles depuis {base_url}/models ; si cela échoue, vous saisissez exactement l'identifiant du modèle attendu par votre serveur. Kunavo fournit une liste de modèles au même préfixe, donc la découverte devrait fonctionner sur la route au format OpenAI — mais la question de savoir si Jan l'interroge pour un fournisseur au format Anthropic n'est pas documentée ni testée ; soyez donc prêt à ajouter l'identifiant manuellement. Plus important encore : les capacités des fournisseurs personnalisés ne sont pas détectées. Jan indique qu'il ne peut pas déduire si un modèle prend en charge les outils, la vision ou l'audio, et vous demande d'ajouter chaque modèle manuellement et de configurer ses capacités modèle par modèle. Sa documentation MCP montre l'autre cas : pour un fournisseur intégré comme Anthropic, Jan lit automatiquement les capacités des modèles du fournisseur une fois la clé ajoutée, et l'entrée de dépannage de la page concernant « le modèle n'utilise pas les MCP que j'ai activés » consiste à vérifier que le modèle dispose des outils activés. Aucune des deux pages n'indique les valeurs par défaut d'un modèle personnalisé nouvellement ajouté ; vérifiez donc Model Capabilities avant de supposer que MCP est actif. C'est la principale différence pratique entre coller une clé dans le fournisseur Anthropic intégré et ajouter une passerelle comme fournisseur personnalisé.

L'application expose également un champ Base URL pour certains fournisseurs intégrés, ce qui permettrait de rediriger l'entrée Anthropic ou OpenAI intégrée vers une passerelle. Aucune page de documentation de Jan ne couvre ce point, et cette page n'a pas exécuté l'application pour le confirmer — considérez le flux Add Provider comme la voie prise en charge.

Jan Agent prend en charge les mêmes deux formats sous forme d'options

La documentation des fournisseurs Agent configure l'endpoint avec --provider, --api-key, --base-url, --model (répétable) et --api-type, ce dernier étant le protocole filaire, soit openai soit anthropic, avec OpenAI-compatible par défaut.

Jan Agent : diriger l’agent vers un point de terminaison au format Anthropic
# Jan Agent is a preview build from a nightly channel.
# Re-check these flags against your own `jan config --help` before relying on them.
jan config set \
  --provider kunavo \
  --api-type anthropic \
  --base-url https://api.kunavo.com/v1 \
  --api-key sk-kn-... \
  --model claude-sonnet-4-6

Les paramètres sont enregistrés dans ~/.jan/config.toml, avec une surcharge par projet dans agent.toml sous [provider] et une surcharge éphémère via JAN_API_KEY. La priorité est documentée dans le code source lui-même, dans providers.rs : la configuration globale constitue la base, les paramètres de Desktop sont ajoutés comme source uniquement héritée qui ne l'écrase jamais, le fichier de projet remplace les deux, et les options CLI ainsi que les variables d'environnement ont priorité sur tout le reste. Les deux interfaces de Jan acceptent également plusieurs clés par fournisseur et réessaient avec la suivante, avec la même portée dans les deux cas : la page des endpoints personnalisés de Jan Desktop documente un repli uniquement pour les codes HTTP 401, 403 ou 429, les autres erreurs n'étant pas réessayées, et le code source d'Agent applique les mêmes trois statuts. Le message key rotation exhausted vient de Jan Desktop, et sa page de dépannage l'interprète comme l'échec de toutes les clés configurées avec 401 ou 403, et non d'une seule.

Si vous auditez vous-même le dépôt, vous rencontrerez ici un piège : un commentaire sur stream_openai_chat_completions dans core/agent/upstream.rs indique que api_type « is None for every caller today » et que l'agent a toujours utilisé OpenAI /chat/completions quelle que soit sa valeur. Ce commentaire décrit un seul utilitaire et est obsolète pour le reste : core/agent/loop.rs appelle resolve_api_type_for_model et construit un convertisseur à partir de celui-ci, et ce convertisseur réécrit la requête vers /messages avec x-api-key et un en-tête anthropic-version fixe (converters.rs). Ainsi, --api-type anthropic est bien pris en compte — et le propre commentaire du convertisseur indique que le base_url enregistré doit inclure le préfixe de version, raison pour laquelle l'extrait ci-dessus se termine par /v1.

En cas d'échec

SymptômeCause documentée par JanModification à effectuer
Erreur 404 sur chaque requêteBase URL sans /v1, ou chemin incorrectAjoutez le chemin de version attendu par votre serveur ; un /v1/v1 doublé signifie que l'autre convention est utilisée
401 ou 403Clé absente, incorrecte ou révoquée ; ou la clé n'a pas accès à ce modèleVérifiez la clé ; pour les serveurs locaux sans clé, saisissez un espace réservé quelconque non vide
429Trop de requêtes, ou quota ou crédits épuisésVérifiez le solde du compte associé à la clé
Aucun modèle répertoriéL'endpoint n'expose pas /modelsAjoutez manuellement l'identifiant du modèle, exactement comme l'attend le serveur
Les outils ou MCP ne font rienLes capacités des fournisseurs personnalisés ne sont pas détectéesActivez manuellement l'appel d'outils dans Model Capabilities

Les trois premières lignes proviennent de la page de dépannage de Jan ; les deux dernières de la page des endpoints personnalisés. Les journaux de l'application se trouvent dans ~/Library/Application Support/Jan/data/logs/app.log sur macOS, %APPDATA%\Jan\data\logs\app.log sur Windows et ~/.local/share/Jan/data/logs/app.log sur Linux. La référence des erreurs de Kunavo couvre les mêmes codes d'état côté passerelle.

Budget cloud détaillé pour Jan

Ces chiffres sont une arithmétique illustrative des tokens, et non des coûts de tâches mesurés ni un plafond de facturation. La colonne chat suppose une journée dans Jan Desktop d'environ 40 tours, durant laquelle le fil grandissant est renvoyé à chaque fois — 240,000 tokens d'entrée et 20,000 tokens de sortie. La colonne agent suppose une session plus longue utilisant des outils avec 400,000 tokens d'entrée et 30,000 tokens de sortie. Ces deux décomptes sont les propres estimations de cette page, et non des chiffres publiés par Jan. Les deux supposent aucune lecture de cache, car la persistance de la mise en cache des prompts via un fournisseur personnalisé dans l'une ou l'autre interface de Jan n'a pas été vérifiée. Les tarifs sont les prix actuels du catalogue Kunavo par million de tokens.

ModèleEntrée / sortie par millionEstimation, une journée de chatEstimation, une session d'agent
Claude Haiku 4.5$0.70 / $3.50$0.238$0.385
GPT-5.6 Terra$0.70 / $4.20$0.252$0.406
Claude Sonnet 4.6$2.10 / $10.50$0.714$1.155
Claude Opus 5$3.50 / $17.50$1.190$1.925

Deux interprétations. Premièrement, l'écart entre le modèle le moins cher et le plus cher de ce tableau est d'environ 5.0x pour la même session supposée — une amplitude suffisante pour que le choix du modèle soit le levier à actionner en premier, et un argument en faveur d'une route permettant de changer de modèle sans ouvrir un nouveau compte. Deuxièmement, comparez honnêtement ces totaux à l'option locale : un modèle qui tient dans le tableau de RAM ci-dessus coûte $0 par requête, et Jan fournit le moteur nécessaire. Pour un utilisateur de Jan Desktop, la facture distante est un choix de capacité, et non un coût d'utilisation de l'application.

Projetez ces chiffres sur vos propres journées avant de considérer quoi que ce soit comme un budget. Le montant du catalogue Kunavo constitue un seuil de facturation plutôt qu'un plafond : lorsque le fournisseur amont communique son coût, la facture correspond au montant le plus élevé entre le coût du catalogue et le coût amont multiplié par la majoration applicable. Le rechargement minimum est de $10 en crédit prépayé — un minimum de financement, et non des frais de tâche ni un abonnement. Consultez les détails de facturation et l'optimisation des coûts d'IA pour appliquer la méthode mesurer puis choisir.

Quelle route l'emporte selon le cas

FormuleÀ privilégier lorsqueCe à quoi vous renoncez
Modèle local dans Jan DesktopTravail privé ou hors ligne compatible avec votre RAM ; aucun coût par requêtePlafond de capacité — les propres modèles 4B de Jan en documentent la limite — ainsi que contraintes de disque et de mémoire ; Jan Agent ne peut y accéder que par le serveur local de Desktop, jamais de manière autonome
Fournisseur intégré, clé du fournisseurVous utilisez les modèles d'un seul fournisseur et voulez que la détection des capacités fonctionne automatiquementUn compte par fournisseur ; chaque nouveau fournisseur implique une autre clé et un autre solde
Endpoint personnalisé vers une passerelleVous changez de modèle selon la tâche et voulez une clé et un solde uniques derrière les deux formats filairesAucune détection des capacités : les outils, la vision et MCP doivent être activés manuellement ; les identifiants de modèles peuvent devoir être saisis à la main
Jan Agent sur un fournisseur distantVous voulez un agent de terminal et acceptez des versions de qualité nocturneL'Agent n'exécute rien lui-même, donc une route distante facture chaque requête ; l'alternative gratuite documentée consiste à le diriger vers le serveur local de Desktop. Les options peuvent changer d'une version à l'autre
Tokamak, auto-hébergéUne organisation veut son propre backend avec routage et auditVous l'exécutez vous-même, et Jan ne publie aucune condition commerciale à comparer

Si vous évaluez la ligne de la passerelle, l'annuaire des clients indique comment chaque client desktop et agent gère les URL de base et les formats filaires, et l'API compatible OpenAI couvre la convention suivie par le premier format de Jan.

Configuration et vérification de la première facture

Tout ce qui précède provient de la documentation et du code source publiés par Jan, ainsi que de la propre documentation de Kunavo. Kunavo n'a pas testé Jan Desktop ni Jan Agent en conditions réelles : aucune requête n'a été envoyée via l'une ou l'autre application pour cette page, donc rien ici ne signifie que l'appel d'outils, le streaming ou la découverte des modèles a réussi de bout en bout. Considérez les URL de base comme celles déduites des deux ensembles de documentation et confirmez-les vous-même sur une tâche limitée. Conservez une route fonctionnelle pendant vos essais, envoyez une petite requête, puis consultez le montant réellement enregistré par votre compte plutôt qu'une estimation figurant sur cette page. Créez un compte Kunavo lorsque vous serez prêt à approvisionner une clé.

Questions fréquentes

Combien coûte Jan AI ?

L’application Jan Desktop ne coûte rien. Elle est open source sous Apache 2.0 selon le fichier LICENSE du dépôt janhq/jan, et il n’existe aucune page de tarification — jan.ai/pricing renvoyait HTTP 404 le 19 septembre 2026. Jan Desktop n’a ni compte, ni crédits, ni quota ; rien dans l’application n’est donc déverrouillé en payant Jan. Ce que vous payez réellement, c’est le matériel et l’électricité lorsqu’un modèle s’exécute localement, ainsi que la facture d’un fournisseur tiers ou d’une passerelle lorsque vous dirigez Jan vers un fournisseur distant. Jan Agent, l’interface CLI distincte en préversion, est également gratuit à installer mais n’exécute lui-même aucun modèle ; il appelle donc toujours un point de terminaison que vous configurez : un fournisseur distant facture chaque requête, tandis que sa documentation indique également comment le diriger vers le serveur d’API local de Jan Desktop, qui ne facture rien. Tokamak, le backend auto-hébergé accessible avec jan login, ne publie aucune condition commerciale ; cette page ne peut donc pas indiquer combien il coûte.

Que sont les modèles cloud de Jan AI ?

Ce ne sont pas les modèles de Jan. Jan n’héberge aucun service d’inférence. Jan Desktop intègre onze fournisseurs distants — OpenAI, Azure OpenAI, Anthropic, OpenRouter, Mistral, Groq, xAI, Google Gemini, MiniMax, Hugging Face et NVIDIA — et chacun constitue une passerelle utilisant votre propre clé vers ce tiers, facturée par ce tiers. Il n’existe aucune entrée de fournisseur hébergé par Jan ou Menlo dans les constantes de fournisseurs livrées. Vous pouvez également ajouter tout point de terminaison personnalisé parlant le format réseau OpenAI ou Anthropic. Les modèles propriétaires de première partie de Jan, tels que Jan-v3-4B et Jan-Code-4B, sont des poids ouverts publiés sur Hugging Face sous les propres organisations de Jan, janhq et Menlo — des téléchargements que vous exécutez localement, et non une API hébergée.

Qu’est-ce qu’une clé API Jan AI ?

Cette expression recouvre trois choses sans rapport. Premièrement, la clé du propre serveur d’API local de Jan Desktop : une chaîne que vous inventez vous-même, documentée comme « set any string (e.g., a-secure-password) », qui peut même être laissée vide pour désactiver l’authentification, et que les clients envoient comme Authorization: Bearer à 127.0.0.1:1337. Deuxièmement, un identifiant en amont — une clé de fournisseur ou de passerelle que vous collez dans un fournisseur de modèles afin que Jan puisse effectuer des appels sortants. Troisièmement, une clé de proxy Janitor AI, qui appartient à un produit entièrement différent sur janitorai.com. Jan Desktop lui-même n’émet rien : il n’a pas de compte, donc aucune clé à générer ni rien à acheter. L’unique exception est Tokamak, le backend auto-hébergé distinct, où jan login enregistre une clé dans ~/.jan/config.toml — il s’agit d’une connexion à votre propre déploiement, et non d’un forfait API Jan.

Quelle est la meilleure API pour Jan Desktop ?

Il n’existe pas de gagnant unique, car la bonne voie dépend de votre utilisation de l’application. Une API fournisseur directe est préférable lorsque vous utilisez toute la journée le modèle phare d’un seul fournisseur et souhaitez bénéficier de ses propres conditions de mise en cache et de traitement par lots. Une passerelle derrière un point de terminaison personnalisé est préférable lorsque vous changez de modèle selon la tâche et souhaitez une seule clé et un seul solde ; le coût est réel et spécifique à Jan — la page de Jan sur les points de terminaison personnalisés indique que les fournisseurs personnalisés ne font pas l’objet d’une détection de capacités, de sorte que vous configurez manuellement les outils, la vision et l’audio pour chaque modèle, tandis que la page MCP de Jan indique qu’un fournisseur intégré comme Anthropic voit automatiquement ses capacités lues une fois la clé ajoutée. Un modèle local via le moteur llama.cpp ou MLX intégré à Jan est préférable pour le travail privé ou hors ligne, sans frais par requête. Jan Agent n’exécute lui-même aucun modèle ; il pointe donc toujours vers un point de terminaison — un fournisseur distant ou, selon sa documentation fournisseur, le serveur d’API local de Jan Desktop.

Quelle est l’API la moins chère pour Jan Desktop ?

Pour Jan Desktop en particulier, l’option la moins chère n’est généralement pas une API. Un modèle local compatible avec votre RAM ne coûte rien par requête, et Jan fournit le moteur nécessaire pour l’exécuter ; commencez donc par cette option et ne vous tournez vers un fournisseur distant que lorsque le modèle local n’est pas assez performant ou ne tient pas. Lorsque vous passez au distant, le tarif affiché le plus bas et le coût le plus faible pour terminer la tâche sont deux questions différentes : un modèle moins cher qui nécessite trois tentatives peut coûter plus cher qu’un modèle qui réussit en une seule passe. Comparez les tarifs par million pour établir une présélection, puis exécutez une tâche limitée sur chaque candidat et consultez le montant effectivement enregistré par le compte de votre fournisseur.

Quel est le meilleur modèle pour Jan Desktop ?

Pour une utilisation locale, la contrainte honnête est la mémoire plutôt que les préférences. La page d’installation Mac de Jan publie directement ses recommandations, tout en les nuançant : la compatibilité dépend de la quantification, de la longueur du contexte et de ce que macOS utilise déjà ; ainsi, 8GB prennent généralement en charge confortablement les modèles jusqu’à 3B, 16GB ceux jusqu’à 7B et 32GB ceux jusqu’à 13B, avec de la marge pour des fenêtres de contexte plus grandes. Le Hub affiche pour chaque modèle une pastille indiquant Fits, May be slow ou Won't fit pour votre machine. Les modèles propriétaires de première partie de Jan vont de 1.7B (Lucy) à 8B (Jan-v2-VL-med), et la documentation des modèles 4B indique clairement que leurs 4B paramètres limitent le raisonnement complexe en plusieurs étapes par rapport aux modèles plus grands ; un fournisseur distant est donc la solution lorsqu’une tâche exige davantage. Sous Windows, le minimum publié est encore différent : 8GB de RAM, 6GB de VRAM et la prise en charge d’AVX2.

Revérifié le 21 septembre 2026 : l'URL de tarification (toujours en 404), le dépôt GitHub et sa dernière version (v0.8.4), la page d'accueil, la page Tokamak, les documentations des endpoints personnalisés, du serveur API, de la référence API, de MCP, de l'installation Mac, de l'installation Windows, du Hub et du dépannage, le guide de démarrage rapide et la documentation des fournisseurs d'Agent, la documentation des modèles propriétaires, les organisations Hugging Face, ainsi que les fichiers source des constantes des fournisseurs, du convertisseur, de l'amont de l'agent et de la boucle de l'agent. Les chiffres d'étoiles et de dernier push proviennent de l'API GitHub au 19 septembre 2026 et évoluent quotidiennement. Non vérifiés : les exigences système Linux, les conditions commerciales de Tokamak et le comportement de la mise en cache via un fournisseur personnalisé. Les tarifs des tokens Kunavo proviennent du catalogue actuel, et chaque montant en dollars ici est une arithmétique illustrative des tokens plutôt qu'un coût de tâche mesuré.