Die günstigste API zur Bildgenerierung ist nicht bei jeder Auflösung dieselbe. Im September 2026 berechnet GPT-Image-2 bei 1K, 2K und 4K pauschal $0.0633 pro Bild, während jedes Google-Modell mit demselben Key nach Auflösung berechnet wird — GPT-Image-2 ist daher bei 1K der teuerste Generator und bei 4K der günstigste, wo es Nano Banana 2 mit $0.1057 und Nano Banana Pro mit $0.1200 unterbietet. Über den Bereich hinweg, für den die meisten Vergleichsseiten eine einzige Zahl nennen, kehrt sich die Rangfolge um. Legen Sie die Auflösung fest, die Sie tatsächlich ausliefern, bevor Sie Modelle überhaupt vergleichen.
Vorab die Befangenheit: Kunavo ist unser Produkt — ein Gateway für weiterverkauften Zugang, kein unabhängiger Benchmark. Die folgenden Zahlen werden live aus dem Katalog gelesen, der die Anfragen abrechnet. Sie entsprechen daher dem Betrag, der Ihnen berechnet würde, und nicht einem aus einem Launch-Post kopierten Tarif. Kunavo führt 6 Bildgenerierungsmodelle und 3 Bearbeitungsmodelle; der Abschnitt zu den nicht angebotenen Modellen nennt die Familien, die auf diesem Key nicht verfügbar sind — also den größten Teil dessen, was Menschen in die engere Auswahl nehmen.
Preis pro Bild nach Modell und Auflösung
Ein Bild, ein Preis — die Einheit ist die Ausgabe, nicht die Länge des Prompts. Die Kunavo-Tarife wurden zuletzt am 1. Oktober 2026 verifiziert. „Provider-Liste“ bezeichnet den vom Anbieter selbst veröffentlichten Tarif für dasselbe Bild: bei Google aus der Dokumentation zur Bildgenerierung der Gemini API und der Preisseite, bei OpenAI aus der API-Preisseite. Ein Gedankenstrich bedeutet, dass das Modell diese Auflösung nicht als separate Stufe anbietet.
| Modell | Anbieter | 1K | 2K | 4K | Provider-Liste (Basis) |
|---|---|---|---|---|---|
| Nano Banana 2 Lite | $0.0255 | — | — | $0.0340 | |
| Nano Banana | $0.0273 | — | — | $0.0390 | |
| Nano Banana 2 | $0.0469 | $0.0707 | $0.1057 | $0.0670 | |
| GPT-Image-2 | OpenAI | $0.0633 | $0.0633 | $0.0633 | $0.1266 |
| Nano Banana Pro | $0.0670 | — | $0.1200 | $0.1340 |
Modelle ohne separate Auflösungsstufen berechnen ihren einzigen Tarif unabhängig von der angeforderten Größe. Jeder Tarif in der Tabelle liegt unter dem vom Anbieter selbst veröffentlichten Listenpreis für dasselbe Bild.
Die Familie, die nach Rendergeschwindigkeit berechnet
Ideogram v3 hat überhaupt keine Auflösungsstufen. Es berechnet nach der Rendergeschwindigkeit — also danach, wie viel Rechenleistung es für die Erstellung des Bildes aufwendet. Das ist ein anderer Stellhebel mit derselben Struktur: Die günstige Einstellung ist für Entwürfe gedacht, die teure für den Frame, den Sie ausliefern. Das sollten Sie wissen, bevor Sie den veröffentlichten Tarif mit etwas in der obigen Tabelle vergleichen, denn die beiden Zahlen messen nicht dasselbe.
| Modell | Rendergeschwindigkeit | Pro Bild | Anbieter-Listenpreis |
|---|---|---|---|
| Ideogram v3 | Turbo | $0.02625 | $0.0300 |
| Ideogram v3 | Balanced | $0.0525 | $0.0600 |
| Ideogram v3 | Quality | $0.0750 | $0.0900 |
Jede Stufe liegt unter dem von Ideogram selbst veröffentlichten Tarif für dieselbe Einstellung. Ideogram v3 Edit wird nach derselben Skala mit drei Geschwindigkeiten berechnet und erscheint weiter unten im Abschnitt zur Bearbeitung — es ist das einzige Modell auf diesem Key, das eine Maske akzeptiert.
Die Umkehrung der Auflösungsrangfolge, klar formuliert
Bei 1K entspricht die Rangfolge dem, was jeder Überblick abdruckt: Die kleinen Google-Modelle sind am günstigsten, GPT-Image-2 ist das teure Modell. Bei 4K kehrt sich die Reihenfolge um, weil OpenAI für die größere Ausgabe nicht mehr berechnet, Google jedoch schon. Konkret bei Kunavo im September 2026:
- Bei 1K — Nano Banana 2 Lite $0.0255, GPT-Image-2 $0.0633. GPT-Image-2 kostet etwa 2.5× so viel wie die günstigste Option.
- Bei 4K — GPT-Image-2 $0.0633, Nano Banana 2 $0.1057, Nano Banana Pro $0.1200. GPT-Image-2 ist nun das günstigste der drei Modelle.
Wenn Ihr Produkt Vorschaubilder rendert, gewinnen die Google-Modelle bei den Kosten mit großem Abstand. Wenn es Assets in Druckauflösung rendert, gewinnt das Modell mit Pauschaltarif. Eine Seite, die Ihnen einen einzigen Gewinner nennt, hat eine dieser beiden Auslastungen angenommen, ohne zu sagen, welche.
Bearbeitung eines vorhandenen Bildes
Drei Modelle nehmen neben der Ausgabe auch ein Bild als Eingabe entgegen, mit demselben Key und Guthaben wie bei der Generierung — und sie bearbeiten nicht alle auf dieselbe Weise:
| Modell | Pro Bild | Mehrere Quellbilder | Maskenbasiertes Inpainting |
|---|---|---|---|
| Nano Banana Edit | $0.0273 | ja | nein |
| GPT-Image-2 Edit | $0.0633 | ja | nein |
| Ideogram v3 Edit | $0.02625+ | nein | ja |
Die beiden Editoren von Google und OpenAI nehmen mehr als ein Quellbild in einer einzelnen Anfrage entgegen, was für Compositing erforderlich ist, und steuern die Bearbeitung vollständig per Prompt. Ideogram v3 Edit ist das einzige Modell hier, das eine Maske akzeptiert — eine gemalte Region, die die Änderung begrenzt — und genau dieser Unterschied entscheidet über einen Retusche-Workflow. Wenn Sie Masken benötigen, ist das die richtige Zeile; wenn Sie mehrere Quellbilder zu einem Compositing zusammenfügen müssen, ist es eines der beiden anderen Modelle.
Was Kunavo nicht anbietet
Fünf Modellfamilien, die bei dieser Suche auf den meisten Auswahllisten stehen, sind mit Stand September 2026 nicht auf Kunavo verfügbar: Flux, Seedream, Recraft, Stable Diffusion und Midjourney. Wenn Ihre Auswahlliste auf einer dieser Modellfamilien basiert, ist ein anderer Anbieter die richtige Wahl, und diese Seite versucht nicht, Sie davon abzubringen. Ideogram stand bis zum 14. September 2026 auf dieser Liste und ist jetzt über den API-Schlüssel verfügbar — siehe den Abschnitt zur Rendergeschwindigkeit oben.
Aufrufen
Generierung und Bearbeitung sind zwei Endpunkte, beide in ihrer Form OpenAI-kompatibel, und nur die Modell-ID ändert sich zwischen den Modellen. Anders als bei Video liefert die Bildgenerierung das Ergebnis inline und nicht als abgefragte Aufgabe zurück.
# One endpoint for every image model; the model id is the only change.
curl https://api.kunavo.com/v1/images/generations \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nano-banana-2-lite",
"prompt": "a brass compass on a folded paper map, overhead, soft window light",
"size": "1024x1024"
}'
# Editing an existing image is a different endpoint, same key and balance.
curl https://api.kunavo.com/v1/images/edits \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-F model=nano-banana-edit \
-F 'prompt=replace the background with a plain studio grey' \
-F image=@photo.pngDetails pro Modell finden Sie in den einzelnen Anleitungen: Nano Banana, Nano Banana Pro, GPT-Image-2 und der Referenz für den images-Endpunkt. Für die Videohälfte desselben Keys siehe den Vergleich der APIs zur Videogenerierung.
Bereits bei fal, Replicate oder WaveSpeed? fal.ai-Alternativen berechnet dieselben Modelle mit denselben Spezifikationen auf jedem Host.
Häufig gestellte Fragen
Welche AI-API ist am besten für die Bildgenerierung?
Es hängt von der Auflösung ab, die Sie tatsächlich ausliefern, da sich dadurch die Preisrangfolge ändert. Im September 2026 ist bei Kunavo Nano Banana 2 Lite mit $0.0255 pro Bild die günstigste Möglichkeit zur Generierung in 1K; in 4K ist GPT-Image-2 mit $0.0633 günstiger als jedes Google-Modell mit demselben Schlüssel, da OpenAI bei jeder Auflösung einen einheitlichen Tarif berechnet, während Google nach Auflösung abrechnet. Wählen Sie zuerst die Auflösung und dann das Modell — die umgekehrte Reihenfolge führt dazu, dass Teams am Ende die teurere Option wählen.
Welche AI ist derzeit am besten für die Bildgenerierung geeignet?
Googles Nano Banana Pro und OpenAIs GPT-Image-2 sind im September 2026 die beiden stärksten universell einsetzbaren Bildmodelle, die per API erreichbar sind. Welches gewinnt, hängt von der Aufgabe ab: GPT-Image-2 folgt Anweisungen für Text in Bildern und bei präzisen Bearbeitungen besser, während die Nano-Banana-Familie schneller und pro Bild bei 1K und 2K deutlich günstiger ist. Keines ist in allen Bereichen am besten; der ehrliche Test besteht darin, dieselben zwanzig Prompts mit beiden zu generieren — bei diesen Preisen kostet das Experiment ein paar Dollar.
Wie viel kostet eine API zur Bildgenerierung?
Bei Kunavo kostet ein einzelnes generiertes Bild im September 2026 je nach Modell und Auflösung zwischen $0.0255 und $0.1200. Die Einheit ist ein Bild, nicht eine Tokenanzahl; deshalb kann ein Token-Rechner diese Auslastung nicht bepreisen. Die Abrechnung erfolgt nutzungsabhängig über ein Prepaid-Guthaben, fehlgeschlagene Generierungen werden nicht berechnet, und es gibt keinen monatlichen Mindestumsatz.
Gibt es eine kostenlose API zur AI-Bildgenerierung?
Nicht für den Produktionseinsatz. Mehrere Anbieter bieten Testguthaben an, und einige Verbraucher-Apps haben einen kostenlosen Tarif mit einem täglichen Limit, aber kein Anbieter stellt eine kostenlose Bild-API ohne Limit bereit, da jede Generierung echte GPU-Zeit benötigt. Die realistische Untergrenze liegt bei einigen Cent pro Bild, und der günstigste Produktionstarif bei Kunavo liegt unter drei Cent. Betrachten Sie jedes Angebot einer unbegrenzt kostenlosen Bild-API als Frage danach, was sie weiterleitet und welche Teile Ihrer Prompts sie speichert.
Hat Kunavo Flux, Midjourney, Stable Diffusion oder Seedream?
Ideogram ja, die anderen nein. Im September 2026 umfasst Kunavos Bildkatalog Googles Nano-Banana-Familie, OpenAIs GPT-Image-2 und Ideogram v3 — sechs Generierungsmodelle und drei Bearbeitungsmodelle. Flux, Seedream, Recraft, Stable Diffusion und Midjourney sind bei Kunavo nicht verfügbar. Ideogram kam am 14. September 2026 hinzu und berechnet nach Rendergeschwindigkeit statt nach Auflösung. Vergleichen Sie daher den Tarif mit den anderen bei der Geschwindigkeit, die Sie tatsächlich verwenden würden.
Welche Bildmodelle unterstützen die Bearbeitung eines vorhandenen Bildes?
Drei bei Kunavo im September 2026: Nano Banana Edit für $0.0273 pro Bild, GPT-Image-2 Edit für $0.0633 pro Bild und Ideogram v3 Edit, das abhängig von der Rendergeschwindigkeit ab $0.02625 berechnet. Sie bearbeiten nicht auf dieselbe Weise. Die Editoren von Google und OpenAI akzeptieren mehrere Quellbilder in einer Anfrage und steuern die Bearbeitung vollständig per Prompt — genau das, was das Einfügen eines Produkts in eine Szene erfordert. Ideogram v3 Edit ist das einzige Modell auf diesem Key, das eine Maske akzeptiert — eine gemalte Region, die die Änderung begrenzt —, was für einen Retusche-Workflow erforderlich ist. Entscheiden Sie danach, welcher dieser beiden Ansätze zu Ihrer Pipeline passt.
Warum berechnen Bild-APIs pro Bild statt pro Token?
Weil der Kostentreiber eine feste Menge an GPU-Arbeit pro Ausgabe ist und nicht die Länge der Eingabe. Ein Prompt mit fünf Wörtern und ein Prompt mit zweihundert Wörtern erzeugen jeweils ein Bild und benötigen ungefähr dieselbe Renderzeit; eine Abrechnung pro Token würde also das Falsche berechnen. Praktisch bedeutet das, dass Bild- und Textkosten keine gemeinsame Einheit haben und nicht in einem Rechner zusammengerechnet werden können. Deshalb liefert ein Token-Rechner für diese Auslastung kein nützliches Ergebnis.