Les questions que les développeurs de Chine continentale posent le plus souvent : peut-on appeler directement Claude / GPT ? Quand faut-il passer par un proxy ? Comment payer ? Cet article répond à chacune d’elles ; pour la latence, il vous donne une méthode de mesure, plutôt qu’un chiffre dont nous ne pouvons pas répondre vis-à-vis de votre réseau.
La conclusion d’abord
La passerelle de Kunavo fonctionne dans une seule région de la côte Est des États-Unis (Ashburn, Virginie), avec un réseau périphérique anycast en entrée. Depuis les principaux fournisseurs cloud de Chine continentale (Alibaba Cloud, Tencent Cloud, Huawei Cloud), aucun proxy n’est nécessaire pour se connecter directement ; le temps aller-retour dépend du chemin réel entre la Chine continentale et la côte Est des États-Unis, et nous ne garantissons pas de latence précise — un appel direct à Anthropic ou Google emprunte le même trajet transocéanique.
Appelez directement, sans proxy
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1",
)
# 直接调用,不需要任何代理配置
resp = client.chat.completions.create(
model="claude-sonnet-4-6",
messages=[{"role": "user", "content": "你好,中国大陆能稳定调用吗?"}],
)
print(resp.choices[0].message.content)C’est tout. La requête arrive par le point d’entrée anycast et est traitée sur la côte Est des États-Unis ; le temps aller-retour que vous mesurez dépend donc principalement de la sortie internationale de votre réseau — un appel direct à Anthropic ou OpenAI emprunte également le même lien transocéanique.
Mesurez vous-même la latence
Exécutez cette commande une fois sur le serveur qui recevra votre trafic de production afin de voir combien de temps prennent la connexion et le premier octet :
curl -o /dev/null -s \
-w "dns=%{time_namelookup}s connect=%{time_connect}s tls=%{time_appconnect}s ttfb=%{time_starttransfer}s\n" \
https://api.kunavo.com/v1/models \
-H "Authorization: Bearer $KUNAVO_API_KEY"Les erreurs momentanées de l’amont (429, 502, 503, 504, 529 et interruptions de connexion) font automatiquement l’objet d’une nouvelle tentative une fois, avant le début du renvoi du contenu et dans la même requête ; lorsque le modèle est configuré avec plusieurs canaux, le canal suivant est également essayé. Les requêtes qui échouent toujours ne sont pas facturées ; consultez le status page pour connaître le taux de réussite réel.
Une écriture robuste face aux fluctuations occasionnelles
Le réseau international de la Chine continentale peut parfois subir des fluctuations de 5 à 30 secondes ; il est recommandé d’ajouter un délai d’expiration et des tentatives avec temporisation progressive côté client. Kunavo ne facture pas les requêtes échouées, donc les nouvelles tentatives ne coûtent rien.
# 中国大陆网络偶尔抖动,建议给客户端加 timeout + 退避重试。
# 不要用大重试值打爆配额。
import time, random
from openai import OpenAI, APIConnectionError, APITimeoutError, RateLimitError
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
timeout=60, # 总超时
max_retries=0, # 关掉 SDK 自带重试,自己控制
)
def call_with_backoff(**kwargs):
last = None
for attempt in range(5):
try:
return client.chat.completions.create(**kwargs)
except (APIConnectionError, APITimeoutError, RateLimitError) as e:
last = e
time.sleep(min(30, (2 ** attempt) + random.random()))
raise lastModes de paiement — disponibles en Chine continentale
- Alipay (支付宝) : via Stripe, la plupart des cartes bancaires courantes en Chine continentale sont prises en charge
- WeChat Pay (微信支付) : même fonctionnement
- Cartes chinoises Visa/Mastercard à double devise (la plupart des cartes à double devise de China Merchants Bank, CITIC, etc. sont acceptées)
- Carte bancaire américaine en dollars (si vous en avez une)
Recharge minimale de 10 $, paiement à l’usage, solde sans date d’expiration. Consultez la page des tarifs pour connaître le prix de chaque modèle.
Quand un proxy est réellement nécessaire
Dans la plupart des cas, ce n’est pas nécessaire. L’exception concerne les réseaux où se trouve le serveur, lorsque leur sortie internationale est instable (connexion haut débit résidentielle, certains réseaux métropolitains). Recommandations :
- Exécuter le trafic de production sur un serveur cloud Alibaba Cloud/Tencent Cloud, etc. (et non sur une connexion haut débit résidentielle)
- Si la connexion reste instable, mettre en place un relais sur une instance cloud située à l’étranger (par exemple à Hong Kong). La passerelle ne dispose que d’une seule région, sur la côte Est des États-Unis ; nous n’avons pas de route que nous puissions changer pour vous
Questions fréquentes
- Y a-t-il une limitation de débit ? La passerelle ne limite actuellement pas la fréquence des appels. Vous pouvez définir pour chaque clé un plafond mensuel de dépenses et une liste blanche d’adresses IP ; l’accès se trouve à /app/keys.
- Peut-on l’utiliser en production ? Oui, mais nous ne publions pas de pourcentage de SLA. Les erreurs momentanées de l’amont font automatiquement l’objet d’une nouvelle tentative dans la même requête, et les requêtes échouées ne sont pas facturées ; le taux de réussite mesuré est publié sur le status page.
- Pouvez-vous émettre des factures ? Non. Nous n’émettons pas de factures et ne pouvons pas non plus fournir de facture de TVA chinoise ; les seuls justificatifs disponibles sont le débit visible sur votre relevé de carte bancaire / WeChat Pay / Alipay, ainsi que l’historique des recharges et des consommations détaillées dans /app/billing. Pour une procédure d’achat d’entreprise, écrivez à sales@kunavo.com ; nous vous indiquerons directement dans quelle mesure nous pouvons vous accompagner.
- Existe-t-il des modèles vidéo et audio ? Oui. Veo 3 (vidéo) et Suno (musique) peuvent être appelés, avec une seule facture. /models.
Prêt à commencer ? Après vous être inscrit, rechargez à partir de 10 $, payez à l’usage et conservez un solde sans date d’expiration. Consultez la documentation complète : /docs/quickstart.