Voltar ao blog
Prático·25 de maio de 2026·5 min de leitura

Chamando Claude / GPT API na China — conexão direta, pagamento e padrões de nova tentativa

Chamando a Kunavo da China: o gateway fica em uma única região no leste dos EUA, e a latência é determinada pela sua saída internacional, com um comando de autoteste incluído. Alipay / WeChat Pay / cartões de dupla moeda são aceitos. Código robusto de novas tentativas + quando realmente é necessário um proxy.

As principais perguntas dos desenvolvedores na China continental: é possível chamar Claude / GPT diretamente? Quando é preciso usar um proxy? Como pagar? Este artigo responde a cada uma delas; para a latência, ele mostra como fazer sua própria medição, em vez de fornecer um número pelo qual não podemos nos responsabilizar em relação à sua rede.

Conclusão primeiro

O gateway da Kunavo opera em uma única região no leste dos EUA (Ashburn, Virgínia), com uma rede de borda anycast na entrada. Dos principais provedores de nuvem da China continental (Alibaba Cloud, Tencent Cloud e Huawei Cloud), é possível conectar-se diretamente sem proxy; o tempo de ida e volta depende do caminho real entre sua rede doméstica e o leste dos EUA, e não garantimos uma latência específica — uma conexão direta com Anthropic ou Google percorre o mesmo trecho transoceânico.

Sem proxy, faça chamadas diretamente

first_call.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",
)

# 直接调用,不需要任何代理配置
resp = client.chat.completions.create(
    model="claude-sonnet-4-6",
    messages=[{"role": "user", "content": "你好,中国大陆能稳定调用吗?"}],
)
print(resp.choices[0].message.content)

É isso. A solicitação entra pelo ponto de entrada anycast e é processada no leste dos EUA, portanto o tempo de ida e volta que você mede depende principalmente da saída internacional da sua rede — uma conexão direta com Anthropic ou OpenAI também percorre o mesmo enlace transoceânico.

Meça a latência você mesmo

Execute uma vez no servidor em que você pretende executar o tráfego de produção e veja quanto tempo a conexão e o primeiro byte levam:

latency.sh
curl -o /dev/null -s \
  -w "dns=%{time_namelookup}s connect=%{time_connect}s tls=%{time_appconnect}s ttfb=%{time_starttransfer}s\n" \
  https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer $KUNAVO_API_KEY"

Erros transitórios do upstream (429, 502, 503, 504, 529 e interrupções de conexão) são repetidos automaticamente uma vez na mesma solicitação, antes do início do retorno do conteúdo; quando o modelo tem vários canais configurados, o sistema também muda para o próximo. Solicitações que continuam falhando não são cobradas; a taxa de sucesso real está disponível na página de status.

Uma implementação robusta contra instabilidades ocasionais

A rede internacional da China continental pode apresentar instabilidades ocasionais de 5 a 30 segundos; recomendamos que o cliente adicione timeout e novas tentativas com backoff. A Kunavo não cobra por solicitações que falham, portanto as novas tentativas não têm custo.

robust_call.py
# 中国大陆网络偶尔抖动,建议给客户端加 timeout + 退避重试。
# 不要用大重试值打爆配额。
import time, random
from openai import OpenAI, APIConnectionError, APITimeoutError, RateLimitError

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
    timeout=60,        # 总超时
    max_retries=0,     # 关掉 SDK 自带重试,自己控制
)

def call_with_backoff(**kwargs):
    last = None
    for attempt in range(5):
        try:
            return client.chat.completions.create(**kwargs)
        except (APIConnectionError, APITimeoutError, RateLimitError) as e:
            last = e
            time.sleep(min(30, (2 ** attempt) + random.random()))
    raise last

Formas de pagamento — disponíveis na China continental

  • Alipay: canal Stripe; os cartões bancários comuns na China continental são aceitos
  • WeChat Pay: igual ao anterior
  • Cartões nacionais Visa/Mastercard de duas moedas da China continental (a maioria dos cartões de duas moedas, como os do CMB e CITIC, é aceita)
  • Cartão americano em dólares (se você tiver um)

Recarga mínima de $10, pagamento conforme o uso e saldo sem prazo de validade. Os preços individuais dos modelos estão na página de preços.

Quando você realmente precisa de um proxy

Na maioria dos casos, não é necessário. A exceção é quando a saída internacional da rede onde o servidor está localizado é instável (banda larga residencial ou determinadas redes metropolitanas). Recomendamos:

  • Executar o tráfego de produção em um servidor de nuvem da Alibaba Cloud, Tencent Cloud ou similar (não em banda larga residencial)
  • Se ainda estiver instável, configurar um encaminhamento intermediário em um servidor de nuvem no exterior (por exemplo, em Hong Kong). O gateway tem apenas uma região no leste dos EUA; não temos outra rota para a qual possamos transferir você

Dúvidas frequentes

  • Há limitação de velocidade? Atualmente, o gateway não limita a frequência das chamadas. Você pode definir um limite mensal de gastos e uma lista de permissões de IP para cada chave; o acesso fica em /app/keys.
  • Posso usar em produção? Sim, mas não publicamos um percentual de SLA. Erros transitórios do upstream são repetidos automaticamente na mesma solicitação, e solicitações que falham não são cobradas; a taxa de sucesso medida é publicada na página de status.
  • Vocês emitem nota fiscal? Não. Não emitimos notas fiscais, nem notas fiscais de IVA dentro da China; os únicos comprovantes disponíveis são a cobrança exibida na fatura do seu cartão bancário, WeChat ou Alipay e os registros de recarga e consumo individual em /app/billing. Para compras corporativas, escreva para sales@kunavo.com e informaremos diretamente até que ponto podemos colaborar.
  • Há modelos de vídeo e áudio? Sim. Veo 3 (vídeo) e Suno (música) estão disponíveis, com uma única fatura. /models.

Pronto para começar? Depois de se cadastrar, faça uma recarga a partir de $10, pague conforme o uso e mantenha um saldo sem prazo de validade. Veja a documentação completa: /docs/quickstart.