Volver al blog
Práctica·25 de mayo de 2026·5 min de lectura

Llamar a Claude / GPT API desde China — conexión directa, pagos y patrones de reintento

Llamar a Kunavo desde China: la puerta de enlace está en una única región del este de EE. UU.; la latencia depende de tu salida internacional, con comandos de autodiagnóstico incluidos. Se aceptan Alipay, WeChat Pay y tarjetas de doble divisa. Código de reintento robusto + cuándo realmente necesitas un reenviador.

Las preguntas que más hacen los desarrolladores de China continental: ¿se puede llamar directamente a Claude / GPT? ¿Cuándo hay que usar un proxy? ¿Cómo se paga? Este artículo responde una por una; para la latencia te damos un método para medirla tú mismo, no una cifra de la que no podemos responsabilizarnos respecto a tu red.

La conclusión primero

El gateway de Kunavo funciona en una única región del este de EE. UU. (Ashburn, Virginia), con una red de borde anycast como entrada. Desde los principales proveedores de nube de China continental (Alibaba Cloud, Tencent Cloud y Huawei Cloud) se puede conectar directamente sin proxy; el tiempo de ida y vuelta depende de la ruta real entre tu ubicación y el este de EE. UU., y no garantizamos una latencia concreta: la conexión directa con Anthropic o Google recorre la misma ruta transoceánica.

Llamar directamente, sin proxy

first_call.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",
)

# 直接调用,不需要任何代理配置
resp = client.chat.completions.create(
    model="claude-sonnet-4-6",
    messages=[{"role": "user", "content": "你好,中国大陆能稳定调用吗?"}],
)
print(resp.choices[0].message.content)

Eso es todo. La solicitud entra por una puerta anycast y se procesa en el este de EE. UU., así que el tiempo de ida y vuelta que midas depende principalmente de la salida internacional de tu red; la conexión directa con Anthropic u OpenAI también recorre la misma ruta transoceánica.

Mide la latencia tú mismo

Ejecuta una vez la prueba en el servidor donde vayas a ejecutar el tráfico de producción para comprobar cuánto tardan la conexión y el primer byte:

latency.sh
curl -o /dev/null -s \
  -w "dns=%{time_namelookup}s connect=%{time_connect}s tls=%{time_appconnect}s ttfb=%{time_starttransfer}s\n" \
  https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer $KUNAVO_API_KEY"

Los errores transitorios del upstream (429, 502, 503, 504, 529 y desconexiones) se reintentan automáticamente una vez antes de empezar a devolver contenido, dentro de la misma solicitud; cuando un modelo tiene varios canales configurados, también se cambia al siguiente. Las solicitudes que siguen fallando no se cobran; consulta la tasa de éxito real en la página de estado.

Implementación robusta frente a fluctuaciones ocasionales

La red internacional de China continental puede sufrir ocasionalmente fluctuaciones de 5-30 segundos; recomendamos que el cliente añada tiempo de espera y reintentos con backoff. Kunavo no cobra las solicitudes fallidas, por lo que reintentar no tiene coste.

robust_call.py
# 中国大陆网络偶尔抖动,建议给客户端加 timeout + 退避重试。
# 不要用大重试值打爆配额。
import time, random
from openai import OpenAI, APIConnectionError, APITimeoutError, RateLimitError

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
    timeout=60,        # 总超时
    max_retries=0,     # 关掉 SDK 自带重试,自己控制
)

def call_with_backoff(**kwargs):
    last = None
    for attempt in range(5):
        try:
            return client.chat.completions.create(**kwargs)
        except (APIConnectionError, APITimeoutError, RateLimitError) as e:
            last = e
            time.sleep(min(30, (2 ** attempt) + random.random()))
    raise last

Métodos de pago disponibles en China continental

  • Alipay: canal de Stripe; admite las tarjetas bancarias habituales de China continental
  • WeChat Pay: igual que el anterior
  • Tarjetas nacionales Visa/Mastercard de doble divisa (la mayoría de las tarjetas de doble divisa de China Merchants Bank, CITIC y otros bancos funcionan)
  • Tarjeta estadounidense en dólares (si tienes una)

Recarga mínima de $10, pago por uso y saldo que nunca caduca. Consulta el precio unitario de cada modelo en la página de precios.

Cuándo necesitas realmente un proxy

En la mayoría de los casos, no. La excepción es que la salida internacional de la red donde está el servidor sea inestable (banda ancha doméstica o determinadas redes metropolitanas). Recomendamos:

  • Ejecutar el tráfico de producción en un servidor de nube como Alibaba Cloud o Tencent Cloud (no en una conexión doméstica)
  • Si la conexión sigue siendo inestable, configura una capa de reenvío en un servidor en la nube en el extranjero (por ejemplo, en Hong Kong). La puerta de enlace solo tiene una región, en el este de EE. UU.; no disponemos de otra ruta a la que podamos cambiarte.

Preguntas frecuentes

  • ¿Hay limitación de velocidad? Actualmente el gateway no limita la frecuencia de las llamadas. Puedes establecer un límite de gasto mensual y una lista blanca de IP para cada clave; la entrada está en /app/keys.
  • ¿Se puede usar en producción? Sí, pero no publicamos un porcentaje de SLA. Los errores transitorios del upstream se reintentan automáticamente dentro de la misma solicitud y las solicitudes fallidas no se cobran; la tasa de éxito medida se publica en la página de estado.
  • ¿Se pueden emitir facturas? No. No emitimos facturas, tampoco facturas de IVA dentro de China; los únicos comprobantes disponibles son el cargo que aparece en el extracto de tu tarjeta bancaria / WeChat / Alipay y los registros de recarga y consumo detallado de /app/billing. Si sigues un proceso de compras corporativas, escribe a sales@kunavo.com y te indicaremos directamente hasta qué punto podemos colaborar.
  • ¿Hay modelos de vídeo y audio? Sí. Se pueden usar Veo 3 (vídeo) y Suno (música), con una sola factura. /models.

¿Listo para empezar? Tras registrarte, recarga desde $10, paga por uso y conserva un saldo que nunca caduca. Consulta la documentación completa: /docs/quickstart.