Die häufigsten Fragen von Entwicklern auf dem chinesischen Festland: Kann man Claude / GPT direkt aufrufen? Wann braucht man einen Proxy? Wie bezahlt man? Dieser Artikel beantwortet sie einzeln; für die Latenz erhalten Sie eine Methode zum Selbstmessen statt einer Zahl, für deren Zuverlässigkeit in Ihrem Netzwerk wir nicht einstehen können.
Das Fazit zuerst
Das Gateway von Kunavo läuft in einer einzigen Region im Osten der USA (Ashburn, Virginia); der Eingang ist ein Anycast-Edge-Netzwerk. Von den großen Cloud-Anbietern auf dem chinesischen Festland (Alibaba Cloud, Tencent Cloud, Huawei Cloud) können Sie ohne Proxy eine direkte Verbindung herstellen; die Round-Trip-Zeit hängt von der tatsächlichen Verbindung vom chinesischen Festland in den Osten der USA ab. Wir machen keine Zusage zu einer bestimmten Latenz – eine direkte Verbindung zu Anthropic oder Google nutzt denselben transozeanischen Abschnitt.
Ohne Proxy direkt aufrufen
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1",
)
# 直接调用,不需要任何代理配置
resp = client.chat.completions.create(
model="claude-sonnet-4-6",
messages=[{"role": "user", "content": "你好,中国大陆能稳定调用吗?"}],
)
print(resp.choices[0].message.content)Das ist alles. Die Anfrage kommt über den Anycast-Eingang herein und wird im Osten der USA verarbeitet. Die gemessene Round-Trip-Zeit wird daher hauptsächlich vom internationalen Ausgang Ihres Netzwerks bestimmt – auch eine direkte Verbindung zu Anthropic oder OpenAI muss denselben transozeanischen Abschnitt durchlaufen.
Latenz selbst messen
Führen Sie auf dem Server, auf dem Sie den Produktionsverkehr ausführen möchten, einmal Folgendes aus, um zu sehen, wie lange Verbindung und erstes Byte jeweils dauern:
curl -o /dev/null -s \
-w "dns=%{time_namelookup}s connect=%{time_connect}s tls=%{time_appconnect}s ttfb=%{time_starttransfer}s\n" \
https://api.kunavo.com/v1/models \
-H "Authorization: Bearer $KUNAVO_API_KEY"Vorübergehende Upstream-Fehler (429, 502, 503, 504, 529 und Verbindungsabbrüche) werden vor Beginn der Inhaltsausgabe innerhalb derselben Anfrage automatisch einmal wiederholt; wenn für das Modell mehrere Kanäle konfiguriert sind, wird außerdem zum nächsten gewechselt. Weiterhin fehlgeschlagene Anfragen werden nicht berechnet; die tatsächliche Erfolgsrate finden Sie auf der Statusseite.
Robuste Implementierung gegen gelegentliche Schwankungen
Das internationale Netzwerk auf dem chinesischen Festland kann gelegentlich 5–30 Sekunden schwanken. Es wird empfohlen, clientseitig Timeouts und Wiederholungen mit Backoff einzubauen. Fehlgeschlagene Anfragen berechnet Kunavo nicht, daher sind Wiederholungen kostenlos.
# 中国大陆网络偶尔抖动,建议给客户端加 timeout + 退避重试。
# 不要用大重试值打爆配额。
import time, random
from openai import OpenAI, APIConnectionError, APITimeoutError, RateLimitError
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
timeout=60, # 总超时
max_retries=0, # 关掉 SDK 自带重试,自己控制
)
def call_with_backoff(**kwargs):
last = None
for attempt in range(5):
try:
return client.chat.completions.create(**kwargs)
except (APIConnectionError, APITimeoutError, RateLimitError) as e:
last = e
time.sleep(min(30, (2 ** attempt) + random.random()))
raise lastZahlungsarten – auf dem chinesischen Festland verfügbar
- Alipay: über Stripe; gängige Bankkarten im Inland werden unterstützt
- WeChat Pay: wie oben
- Visa-/Mastercard-Karten mit zwei Währungen aus dem chinesischen Festland (die meisten Dual-Currency-Karten, etwa von CMB und CITIC, funktionieren)
- US-Dollar-Karte aus den USA (falls vorhanden)
Mindestaufladung $10, nutzungsabhängige Zahlung, Guthaben verfällt nie. Die Preise der einzelnen Modelle finden Sie auf der Preisseite.
Wann Sie wirklich einen Proxy benötigen
In den meisten Fällen nicht. Eine Ausnahme ist ein instabiler internationaler Ausgang des Netzwerks, in dem der Server steht (Privatanschlüsse, einzelne Stadtnetze). Empfehlung:
- Produktionsverkehr auf einem Cloud-Server von Alibaba Cloud, Tencent Cloud o. Ä. ausführen (nicht über einen Privatanschluss)
- Wenn es weiterhin instabil ist, einen Weiterleitungsserver auf einer Cloud-Instanz im Ausland (zum Beispiel Hongkong) einrichten. Das Gateway hat nur eine Region im Osten der USA; wir können keine alternative Route für Sie auswählen.
Häufige Fragen
- Gibt es eine Ratenbegrenzung? Das Gateway begrenzt derzeit die Aufruffrequenz nicht. Sie können für jeden Schlüssel ein monatliches Ausgabenlimit und eine IP-Allowlist festlegen; der Einstieg befindet sich unter /app/keys.
- Kann man es produktiv einsetzen? Ja, aber wir veröffentlichen keinen SLA-Prozentsatz. Vorübergehende Upstream-Fehler werden innerhalb derselben Anfrage automatisch wiederholt, fehlgeschlagene Anfragen werden nicht berechnet; die gemessene Erfolgsrate ist auf der Statusseite öffentlich einsehbar.
- Kann ich eine Rechnung erhalten? Nein. Wir stellen keine Rechnungen aus, auch keine chinesischen Mehrwertsteuerrechnungen. Als Beleg dienen nur die Abbuchung in Ihrer Bankkarten-, WeChat- oder Alipay-Abrechnung sowie die Auflade- und Einzelverbrauchsdaten unter /app/billing. Wenn Sie über einen Unternehmenseinkauf beschaffen, schreiben Sie an sales@kunavo.com; wir teilen Ihnen direkt mit, in welchem Umfang wir Sie unterstützen können.
- Gibt es Video- und Audiomodelle? Ja. Veo 3 (Video) und Suno (Musik) können verwendet werden, mit einer gemeinsamen Rechnung. /models.
Bereit zum Start? Nach der Registrierung können Sie ab $10 aufladen und nutzungsabhängig bezahlen; das Guthaben verfällt nie. Die vollständige Dokumentation finden Sie unter /docs/quickstart.