„Alternative zur OpenAI API“ bezeichnet zwei verschiedene Wechsel, und die meisten Zusammenfassungen zu diesem Suchbegriff beantworten nur einen davon. Der Wechsel des Modells — zu Claude, Gemini oder Open Weights — ändert Anbieter, Konten, SDKs und Abrechnung. Der Wechsel des Endpunkts ändert eine base_url und einen API-Schlüssel, während Ihr Code unverändert bleibt, weil das OpenAI-Wire-Format kopiert wird. Entscheiden Sie zuerst, welchen Wechsel Sie vornehmen; eine Modellliste kann Ihnen nicht sagen, welche Migrationskosten entstehen.
Die Frage, die diese Listen auslassen, ist die entscheidende: Welche OpenAI-Schnittstellen überstehen den Wechsel tatsächlich? Diese Seite beantwortet das speziell für Kunavo, einschließlich der drei Zeilen, bei denen die Antwort „nein“ lautet. Offenlegung: Kunavo ist unser Produkt — ein unabhängiges OpenAI-kompatibles Gateway, weder OpenAI noch Anthropic. Preise und Verfügbarkeit zuletzt am 1. Oktober 2026 überprüft.
Die drei Routen und was jede davon an Codeänderungen kostet
| Weg | Was sich in Ihrem Code ändert | Wähle es, wenn |
|---|---|---|
| Die eigene API eines anderen Anbieters | Neues SDK, neue Authentifizierung, neue Anfrageformate | Sie möchten die vollständige Oberfläche eines Anbieters nutzen, einschließlich der Funktionen, die nur dieser Anbieter besitzt |
| Ein OpenAI-kompatibles Gateway | base_url und der Schlüssel | Sie möchten Modelle mehrerer Anbieter ohne mehrere Konten nutzen |
| Ein selbst gehosteter OpenAI-kompatibler Server | base_url und der Schlüssel sowie der Betrieb des Servers | Prompt-Text darf Ihre Infrastruktur nicht verlassen |
Der eigene Kompatibilitätsendpunkt eines Anbieters ist eine vierte, enger gefasste Option: Google veröffentlicht eine OpenAI-Kompatibilitätsschicht für die Gemini API; dabei handelt es sich um denselben base_url-Wechsel, beschränkt auf die Modelle eines Anbieters.
Den Endpunkt vollständig wechseln
# The whole migration, when you swap the endpoint rather than the model.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...", # was sk-proj-...
base_url="https://api.kunavo.com/v1", # the only other line that moves
)
# Same SDK, same call shape, same streaming, same tool-call format.
resp = client.chat.completions.create(
model="claude-sonnet-5", # now reachable on the same key
messages=[{"role": "user", "content": "Summarise this changelog."}],
stream=True,
)Welche OpenAI-Schnittstellen den Wechsel überstehen
Lesen Sie vor der Migration die mittlere Spalte. „Nur Route“ bedeutet, dass das Wire-Format implementiert ist, dahinter aber kein Modell aktiviert wurde, sodass der Aufruf fehlschlägt — das ist eine unangenehmere Überraschung als eine nicht implementierte Route und der Grund, warum die Zeile vorhanden ist, statt stillschweigend ausgelassen zu werden.
| OpenAI-Schnittstelle | Auf Kunavo | Was sie ist / Hinweis |
|---|---|---|
/v1/chat/completions | ja | Chat, streaming, tool calls — The one almost every migration is about. |
/v1/responses | ja | The Responses API — Implemented — this is what Codex CLI speaks. |
/v1/models | ja | List what you can call — Always the authority on availability. |
/v1/images/generations | ja | Text zu Bild |
/v1/images/edits | ja | Image editing — Prompt-directed; no mask inpainting. |
/v1/embeddings | nur Route | Embeddings — Route exists, no model enabled — embed against OpenAI, Voyage or Cohere directly. |
/v1/audio/speech | nur Route | Text to speech — Route exists, no model enabled. |
/v1/audio/transcriptions | nur Route | Speech to text — Route exists, no model enabled. |
/v1/files | ja | Upload a source image — For image edits and image-to-video. |
Assistants, Threads, Vector Stores | nein | OpenAI's hosted agent state — Not implemented. Keep that state in your own app. |
Realtime | nein | Realtime voice sessions — Not implemented. |
Batch, Fine-tuning, Moderations | nein | Nicht implementiert. |
Die 3-Zeilen mit „nur Route“ müssen Sie bei der Planung berücksichtigen. Eine RAG-Pipeline ist der häufigste Fall: Erzeugen Sie Embeddings direkt bei einem Embedding-Anbieter und generieren Sie über das Gateway. Die beiden Vorgänge sind ohnehin separate HTTP-Aufrufe; der Preis ist daher ein zweiter Schlüssel und keine zweite Architektur. GET /v1/models ist immer maßgeblich dafür, was heute aufgerufen werden kann.
Was der Wechsel pro Token kostet
Im direkten Vergleich auf Kunavo mit Stand September 2026: Claude Sonnet 4.6 kostet $2.10 Input / $10.50 Output pro 1 Mio. Token gegenüber $3.00 / $15.00 von Anthropic, GPT-5.6 Sol $2.00 / $12.00 gegenüber dem derzeit von OpenAI berechneten Aktionspreis von $4.00 / $20.00 (Liste $5.00 / $30.00; die Aktion läuft mindestens bis 21. November 2026). Prüfen Sie die OpenAI-Seite unter deren Preisseite, statt unsere Angaben ungeprüft zu übernehmen. Der Hebel, der eine Rechnung meist stärker beeinflusst als die Wahl des Anbieters, ist Prompt-Caching: Ein Agent sendet in jedem Turn einen großen System-Prompt erneut, sodass ungecachter Input dominiert.
Was Kunavo nicht ist
Nicht OpenAI und keine Möglichkeit, OpenAIs gehostete Agenteninfrastruktur anderswo günstiger zu erhalten — Assistants, Threads, Vector Stores, Realtime, Batch, Fine-Tuning und Moderation sind nicht implementiert, und eine darauf basierende App lässt sich nicht einfach durch Ändern der base_url verschieben. Auch kein Hosting von Open Weights: Wenn Sie Llama oder Qwen auf Ihrer eigenen Hardware möchten, ist ein selbst gehosteter OpenAI-kompatibler Server der richtige Weg, und Kunavo ist das nicht. Ebenso kein Embeddings-Anbieter, wie die obige Tabelle zeigt.
Für angrenzende Vergleiche: OpenRouter-Alternativen, die vier Arten von LLM-Gateways und die Referenz zum Chat-Endpunkt für die genauen Anfrage- und Antwortformate.
Häufig gestellte Fragen
Was sind die besten Alternativen zur OpenAI API?
Das hängt davon ab, welchen Austausch Sie vornehmen; die Zusammenfassungen zu diesem Suchbegriff beantworten meist eine von zwei Fragen. Wenn Sie ein anderes Modell möchten, stehen Anthropic Claude, Google Gemini und die von Inferenzanbietern bereitgestellten Open-Weight-Modellfamilien auf der engeren Auswahlliste. Wenn Sie Ihren OpenAI-Code behalten und nur ändern möchten, wohin er zeigt, sieht die Auswahl anders aus: ein OpenAI-kompatibles Gateway wie Kunavo oder OpenRouter, ein eigener Kompatibilitätsendpunkt eines Anbieters wie der von Google oder ein selbst gehosteter OpenAI-kompatibler Server wie Ollama oder vLLM. Der zweite Wechsel erfordert eine base_url und einen Schlüssel; der erste kann eine SDK-Migration erfordern.
Gibt es eine kostenlose Alternative zur OpenAI API?
Nicht für Produktionsverkehr bei einem gehosteten Anbieter — Inferenz bedeutet echte GPU-Zeit, und niemand stellt sie unbegrenzt kostenlos bereit. Wirklich kostenlose Wege sind das Selbsthosting von Open Weights auf Hardware, für die Sie bereits bezahlen (Ollama und vLLM stellen beide einen OpenAI-kompatiblen Endpunkt bereit, daher ist die Codeänderung dieselbe base_url-Änderung), sowie kostenlose Kontingente einiger Anbieter mit strengen Tageslimits. Betrachten Sie eine beworbene unbegrenzt kostenlose OpenAI-kompatible API als Frage danach, was sie tatsächlich proxied und was sie mit Ihren Prompts macht.
Welche API ist günstiger, OpenAI oder Anthropic?
Keine von beiden ist pauschal günstiger — es hängt von der verwendeten Stufe und davon ab, wie viel Ihres Inputs sich wiederholt. Im direkten Vergleich auf Kunavo mit Stand September 2026 kostet Claude Sonnet 4.6 $2.10 Input / $10.50 Output pro 1 Mio. Token und GPT-5.6 Sol $2.00 / $12.00. Der Hebel, der eine Rechnung meist stärker beeinflusst als die Wahl des Anbieters, ist Prompt-Caching, weil ein Agent in jedem Turn einen großen System-Prompt erneut sendet und gecachter Input bei beiden Familien nur mit einem Bruchteil des Preises für frischen Input berechnet wird.
Kann ich von der OpenAI API wechseln, ohne meinen Code zu ändern?
Größtenteils, und genau dafür ist die Kompatibilitätstabelle dieser Seite gedacht. Wenn Ihre App Chat Completions, Streaming, Tool-Aufrufe und die Responses API verwendet, benötigen Sie bei einem OpenAI-kompatiblen Gateway lediglich eine base_url und einen API-Schlüssel — SDK, Anfrageformate und Antwortformate bleiben unverändert. Nicht übertragbar sind OpenAIs gehosteter Agentenstatus (Assistants, Threads, Vector Stores), die Realtime API, Batch, Fine-Tuning und Moderation; nichts davon implementiert Kunavo. Prüfen Sie die konkreten Schnittstellen, die Ihr Code aufruft, bevor Sie einen nahtlosen Wechsel annehmen.
Unterstützt ein OpenAI-kompatibles Gateway Embeddings?
Nicht automatisch; dies ist die Schnittstelle, die am ehesten fehlt — prüfen Sie es vor der Migration, nicht danach. Bei Kunavo ist /v1/embeddings zwar als Wire-Format implementiert, dahinter jedoch kein Modell aktiviert, sodass der Aufruf fehlschlägt und der Embedding-Schritt einer RAG-Pipeline direkt an OpenAI, Voyage oder Cohere gehen muss. Das kostet einen zweiten API-Schlüssel und sonst nichts, da Embedding- und Generierungsaufruf ohnehin getrennte Anfragen sind. GET /v1/models ist immer maßgeblich dafür, was tatsächlich aufgerufen werden kann.
Ist eine OpenAI-kompatible API dasselbe wie OpenAI?
Nein. Eine OpenAI-kompatible API übernimmt das Wire-Format — URL-Strukturen, Anfragekörper und Antwortkörper — sodass Ihr bestehender Client mit ihr kommunizieren kann. Sie wird nicht von OpenAI betrieben, stellt nicht zwingend OpenAI-Modelle bereit und entscheidet selbst über Datenaufbewahrung, Ratenlimits und die implementierten Schnittstellen. Kunavo ist ein unabhängiges Gateway, weder OpenAI noch Anthropic; genau deshalb führt die obige Tabelle sowohl nicht funktionierende als auch funktionierende Bereiche auf.