Zurück zu den Leitfäden
Preise·21. September 2026·Aktualisiert am 24. September 2026·11 Min. Lesezeit

bolt.diy: Preise, Modelle und die beste API dafür

Die Software kostet $0. Die Rechnung entsteht durch die drei Modellaufrufe, die eine Nachricht sendet, sobald Ihr Projekt Dateien enthält.

Zuletzt überprüft am .

bolt.diy kostet 0 $ — es handelt sich um Software unter MIT-Lizenz ohne Pläne, Konten oder gehosteten Tarif, daher ist die einzige Rechnung die von Ihnen ausgewählte Modell-API. Die Zahl, die diese Rechnung tatsächlich bestimmt, ist nicht der von Ihnen gewählte Preis pro Million: Die Kontextoptimierung ist standardmäßig aktiviert. Sobald Ihr Projekt Dateien enthält, sendet eine Chatnachricht drei Modellaufrufe, und bolt.diy sendet selbst keine Cache-Direktive, sodass der Client keinen Anbieter auffordert, den großen System-Prompt wiederzuverwenden.

Zunächst eine Abgrenzung, da die Suchergebnisse beides vermischen. bolt.new ist das gehostete, tokenbasierte Produkt, von dem dieses Projekt geforkt wurde, und daher stammt die Angabe von 25 $ pro Monat. BoltAI ist ein unabhängiger macOS-Client mit eigenen Lizenzpreisen. Keines von beiden gehört in ein bolt.diy-Budget. Und coleam00/bolt.new-any-llm ist kein separates Projekt — es ist der ursprüngliche Name von bolt.diy und leitet jetzt zu stackblitz-labs/bolt.diy weiter.

bolt.diy-Preise: Die Software kostet 0 $, die Anfragen nicht

PositionWas es kostetQuelle
bolt.diy selbst, jeder Installationsweg$0, MITRepository-API: MIT, nicht archiviert, nicht deaktiviert
Ein gehostetes, kostenpflichtiges bolt.diyExistiert nichtDie Domain bolt.diy leitet auf das GitHub-Repository weiter
Modell-API-TokensDer Token-Tarif Ihres AnbietersDie eigene Abrechnung Ihres Anbieters
Hosting, falls Sie es nicht lokal ausführenIhre eigene RechnungDas Repository enthält eine Docker-Compose-Datei und ein Container-Image
bolt.new Free / Pro / Teams (anderes Produkt)0 $ mit 1M Tokens pro Monat und einem Tageslimit von 300K · ab 25 $/Monat mit 10M Tokens · 30 $/Monat pro Mitgliedbolt.new-Preise

Alle Zeilen wurden am 19. September 2026 überprüft. Die Zeile zu bolt.new ist enthalten, damit Sie sie erkennen, wenn ein Suchergebnis sie Ihnen anzeigt — sie ist kein Preis von bolt.diy, und bolt.diy hat keinerlei Token-Kontingent.

Prüfen Sie die Entwicklungsgeschwindigkeit, bevor Sie ein Team darauf standardisieren. Das Repository ist nicht archiviert und hat rund 20.000 Stars, aber der letzte Commit auf main datiert vom 7. Februar 2026, und seitdem ist nichts hinzugekommen; die einzige 1.x-Version ist v1.0.0 vom 12. Mai 2025. Gleichzeitig sind 56 Pull Requests offen und nicht zusammengeführt. Es gibt keinen Archivhinweis und keine Stellungnahme der Maintainer zur Ausrichtung; betrachten Sie dies daher als datierten Beleg und nicht als Ankündigung.

Welche bolt.diy-Version führen Sie aus? Drei Builds, drei Verhaltensweisen

Das ist der Teil, der die Setup-Anleitungen anderer widersprüchlich macht. Das Projekt liefert derzeit drei Artefakte aus Code unterschiedlichen Alters aus, und sie konfigurieren einen benutzerdefinierten Endpunkt nicht auf dieselbe Weise.

InstallationswegErhaltener CodeWo der API-Schlüssel eingetragen wirdWenn die Modellliste fehlschlägt
Desktop-Binärdateien von v1.0.0v1.0.0, 12. Mai 2025Im Chat-UI erscheint ein SchlüsselfeldKein Fallback und kein Timeout
git clone -b stable, wie die README anweistDerselbe v1.0.0-Release-CommitDasselbe SchlüsselfeldDasselbe: kein Fallback
git clone main oder das ghcr.io-ImageCommit 2e254ac, 7. Februar 2026Nur Serverumgebung — kein UI-Feld5-Sekunden-Timeout, danach OPENAI_LIKE_API_MODELS

Der Unterschied beim Schlüsselfeld ist eine tatsächliche, an einen datierten Commit gebundene Verhaltensänderung, kein Gerücht. Bei dem Commit, auf den stable zeigt, lautet die Bedingung zum Schutz des Schlüsselfelds (!LOCAL_PROVIDERS.includes(provider.name) || 'OpenAILike') — ein bloßes Stringliteral ist immer wahr, daher wird das Feld gerendert. Auf main ist || 'OpenAILike' verschwunden, und OpenAI-Like befindet sich in LOCAL_PROVIDERS, daher wird nirgendwo ein Schlüsselfeld gezeichnet. Eine Anleitung mit der Aussage „Fügen Sie Ihren Schlüssel in das UI ein“ ist für den Desktop-Build richtig und für den Docker-Build falsch.

Zwei weitere wichtige Daten. Die Konfiguration des veröffentlichten ghcr.io/stackblitz-labs/bolt.diy:latest-Images ist mit 7. Februar 2026 datiert und mit der Revision 2e254ac… gekennzeichnet, daher entspricht sie main und ist ebenfalls sieben Monate alt. Der v1.0.0-Release enthält außerdem nur Binärdateien für Windows x64, macOS arm64 und Linux arm64 — es gibt kein macOS-Intel- und kein Linux-x64-Asset. Node >=18.18.0 und pnpm 9.14.4 sind in package.json angegeben; der Dev-Server verwendet standardmäßig Port 5173.

Benutzerdefinierte bolt.diy-API: Einen OpenAI-kompatiblen Endpunkt verbinden

Der gewünschte Provider heißt OpenAI-Like und ist in den Einstellungen unter Local Providers statt unter Cloud Providers eingeordnet — der Cloud-Tab filtert ihn zusammen mit Ollama und LM Studio ausdrücklich heraus. Er ist außerdem standardmäßig deaktiviert, da der Code einen Provider nur aktiviert, wenn er nicht in dieser lokalen Liste enthalten ist. Aktivieren Sie den Umschalter, sonst werden niemals Modelle angezeigt.

Es gibt drei Einstellungen, aber nur zwei davon stehen in der eigenen .env.example des Repositorys:

.env.local
# bolt.diy reads these from the SERVER environment on main and on the
# ghcr.io image. Edit, then restart the server — there is no key field in
# the UI on those builds.
OPENAI_LIKE_API_BASE_URL=https://api.kunavo.com/v1
OPENAI_LIKE_API_KEY=your_kunavo_key

# main only. Used only if GET {baseUrl}/models fails or times out.
# Format: model:contextLimit, separated by semicolons.
OPENAI_LIKE_API_MODELS=claude-sonnet-5:1000000;claude-haiku-4-5:200000

Vier Dinge zu dieser Basis-URL. Sie muss das Präfix sein, unter dem sowohl /models als auch /chat/completions erreichbar sind, da das festgelegte Vercel AI SDK den Pfad einfach daran anhängt — für Kunavo ist das https://api.kunavo.com/v1. bolt.diy entfernt für Sie einen abschließenden Schrägstrich. Ein Wert, der im einzigen UI-Feld „API Endpoint“ gesetzt wird, hat Vorrang vor der Umgebung. Außerdem gibt es kein Textfeld für die Modell-ID: bolt.diy führt GET {baseUrl}/models mit einem Bearer-Token aus, listet nur dann etwas auf, wenn sowohl die Basis-URL als auch der Schlüssel vorhanden sind, und verwendet jedes zurückgegebene id unverändert als OpenAI-model-Wert.

Eine Besonderheit bei einem multimodalen Katalog: Kunavos /v1/models gibt Bild-, Video- und Musikmodelle in derselben Liste wie Chatmodelle zurück, und der Parser von bolt.diy filtert nicht nach Art — jede Zeile wird in das Auswahlfeld übernommen. Wählen Sie ein Chatmodell; die anderen können keine Chatvervollständigung bereitstellen. Dies wurde aus beiden Codebasen abgelesen und nicht in einer laufenden Installation beobachtet.

Was der OpenAI-Like-Provider nicht erreichen kann

Was Sie vielleicht erwartenWas der Code tutFolge
Den Anthropic-Provider auf ein Gateway umleitenSeine Konfiguration enthält nur apiTokenKey ohne Basis-URL-Schlüssel, und die Modellliste wird von api.anthropic.com abgerufenEin Claude-kompatibler Endpunkt muss über OpenAI-Like auf der Chat-Completions-Leitung verwendet werden
Den OpenRouter-Provider auf einen anderen Endpunkt verweisenopenrouter.ai/api/v1 ist fest codiert; sein einziger Schlüssel ist OPEN_ROUTER_API_KEYOpenRouter ist ein separater Provider, kein Trick mit der Basis-URL
Das tatsächliche Kontextfenster Ihres ModellsJedes aus Ihrer /models-Antwort gelesene Modell erhält maxTokenAllowed: 8000; das zurückgegebene Kontextfeld wird nie gelesen. Modelle, die in OPENAI_LIKE_API_MODELS deklariert sind, behalten das dort eingetragene LimitDas Auswahlfeld zeigt selbst bei einem Modell mit einer Million Tokens ungefähr 8K an. Die Zahl fließt in die Bezeichnung des Auswahlfelds und ein serverseitiges Warnprotokoll ein; im Streaming-Pfad wird die Anfrage weder begrenzt noch der Chat gekürzt
Lange AusgabenPROVIDER_COMPLETION_LIMITS.OpenAILike = 8192, als Ausgabelimit der Anfrage gesendet8.192 Ausgabe-Tokens pro Anfrage, unabhängig davon, was das Modell zulässt — außer bei den IDs in der folgenden Zeile
Ein grünes GesundheitsabzeichenDas Abzeichen führt browserseitig ein GET an {baseUrl}/models ohne Authorization-Header aus und hängt /v1 an, falls es fehltEin Endpunkt, der einen Schlüssel verlangt — Kunavos /v1/models tut dies — weist diese nicht authentifizierte Prüfung zurück, sodass das Abzeichen einen nicht funktionsfähigen Zustand anzeigt, während die Generierung funktioniert
IDs, die mit o1, o3 oder gpt-5 beginnen, werden wie alle anderen behandeltDer reguläre Ausdruck /^(o1|o3|gpt-5)/i erzwingt temperature: 1, entfernt Sampling-Parameter und übergibt maxCompletionTokens — einen Schlüssel, den die Typen des festgelegten ai@4.3.16 nicht definierenDiese IDs werden stillschweigend ohne angewendetes Ausgabelimit gesendet. Der reguläre Ausdruck ist am Anfang der ID verankert, daher passt gpt-5-6-terra, während claude-haiku-4-5 und claude-sonnet-5 nicht passen

Aus dem Quellcode von main am 19. September 2026 gelesen. Die Protokolluntergrenze für eine Standardinstallation ist bescheiden: Streaming-Chat-Completions, kein Function Calling — bolt.diy übergibt ein leeres Toolset, sofern Sie keinen MCP-Server konfigurieren, und das festgelegte SDK entfernt ein leeres Toolset zusammen mit der Toolauswahl. Kunavo stellt kein Embedding-Modell bereit, und der Chat-Ablauf von bolt.diy fordert keines an. Konfigurieren Sie einen MCP-Server, steigt die Untergrenze auf Tools mit mehrstufiger Ausführung. Bildanhänge werden als Base64-Data-URL-Teile gesendet, daher benötigt Vision diese Form.

Eine Nachricht, drei Modellaufrufe: Eine Beispielrechnung zu den bolt.diy-API-Kosten

Die Kontextoptimierung ist standardmäßig aktiviert, und wenn Ihr Projekt Dateien enthält, führt die Chat-Route vor dem Generierungsaufruf einen Zusammenfassungsaufruf und einen Dateiauswahlaufruf aus. Eine einzelne fortgesetzte Antwort kann bis zu zwei weitere Segmente hinzufügen. Nichts in der Codebasis setzt eine Cache-Direktive — kein cache_control-Marker, keine Provider-Cache-Option — daher wird ein Cache, den ein Client anfordern müsste, nie aktiviert, und die folgenden Zahlen gehen überhaupt nicht von einem Cache-Rabatt aus. Ob ein erneut gesendetes Präfix trotzdem rabattiert wird, hängt vom von Ihnen ausgewählten Provider ab, nicht von bolt.diy. Der Prompt ist außerdem nicht klein: Die drei enthaltenen Prompt-Quelldateien sind 15,4 KB, 32,8 KB und 23,8 KB groß, wobei die Datei „fine tuned“ standardmäßig verwendet wird. Das sind Zeichen, keine Tokens; die Tokenanzahl wurde nicht gemessen.

Die folgenden Zahlen sind veranschaulichende Tokenarithmetik, keine gemessenen Aufgabenkosten und keine Rechnungsobergrenze. Nehmen wir eine Nachricht in einem kleinen Projekt an: einen Generierungsaufruf mit 30k Eingabe- und 4k Ausgabe-Tokens sowie einen Zusammenfassungsaufruf mit 20k Eingabe- und 800 Ausgabe-Tokens und einen Dateiauswahlaufruf mit 20k Eingabe- und 600 Ausgabe-Tokens — insgesamt 70k Eingabe- und 5.400 Ausgabe-Tokens. Die Aufteilung dient nur der Veranschaulichung. Die Preise sind die aktuellen Kunavo-Katalogpreise pro Million Tokens.

ModellEingabe / Ausgabe pro 1 Mio.Nur der GenerierungsaufrufEine Nachricht, Standardeinstellungen40 Nachrichten
Claude Haiku 4.5$0,70 / $3,50$0,0350$0,0679$2,72
GPT-5.6 Terra$0,70 / $4,20$0,0378$0,0717$2,87
Claude Sonnet 5$1,40 / $7,00$0,0700$0,1358$5,43

Unter diesen Annahmen verursachen die Standardeinstellungen bei jeder Nachricht in einem Projekt mit Dateien ungefähr das Doppelte der Kosten des Generierungsaufrufs — Claude Sonnet 5 steigt für dieselbe sichtbare Ausgabe von $0,0700 auf $0,1358. Das ist der ehrliche Inhalt der Aussage „Die Software ist kostenlos“. Wenn Ihr Projekt groß genug ist, dass die Zusammenfassungs- und Dateiauswahlaufrufe mehr Kontext enthalten als der Generierungsaufruf, wird das Verhältnis schlechter, nicht besser; das Deaktivieren der Kontextoptimierung tauscht diese Kosten dagegen ein, dass das Modell weniger Ihrer Dateien sieht.

Rechnen Sie diese Angaben auf Ihre eigene Nachrichtenanzahl hoch, bevor Sie sie als Budget betrachten. Der Katalogbetrag von Kunavo ist eine Abrechnungsuntergrenze und keine Obergrenze: Sobald der vorgelagerte Anbieter seine Kosten meldet, wird der höhere der beiden Beträge abgerechnet – die Katalogkosten oder die Kosten des vorgelagerten Anbieters multipliziert mit dem geltenden Aufschlagsfaktor. Die Mindestaufladung beträgt $10 als Prepaid-Guthaben – ein Mindestbetrag zur Guthabenaufladung, keine Gebühr pro Aufgabe und kein Abonnement. Weitere Informationen finden Sie in den Abrechnungsdetails, oder berechnen Sie andere Nutzungsszenarien mit dem LLM-Kostenrechner.

Beste API für bolt.diy: Welcher Weg wann gewinnt

WegVorteile, wennWorauf Sie verzichten
Direkte Anbieter-APISie bleiben bei einem Anbieter, und bolt.diy liefert dafür einen erstklassigen ProviderEin zweiter Anbieter bedeutet einen zweiten Schlüssel; die statische integrierte Anthropic-Liste ist veraltet genug, dass die dynamische Liste vorzuziehen ist
OpenRouterSie möchten Preise pro Modell und echte Kontextfenster im Auswahlfeld sehenDie Guthabenkaufgebühr und ein Provider, auf den Sie nichts anderes verweisen können
OpenAI-kompatibles Gateway (OpenAI-Like)Sie möchten einen Schlüssel und ein Guthaben über mehrere Modellfamilien hinwegDie Kontextbezeichnung mit 8.000 Tokens, das Ausgabelimit von 8.192 Tokens, eine rote Statusanzeige und der Schlüssel in der Serverumgebung bei aktuellen Builds
Kostenloser Tarif von Google GeminiSie zahlen nichts, und bolt.diy unterstützt ihn nativGoogles Preisseite kennzeichnet Inhalte des kostenlosen Tarifs als „zur Verbesserung unserer Produkte verwendet“, Inhalte des kostenpflichtigen Tarifs jedoch nicht — berücksichtigen Sie dies, bevor Sie eine Kundencodebasis einfügen
Lokales Modell über Ollama oder LM StudioPrivate oder einmalige Aufgaben ohne Gebühr pro AnfrageDie eigene FAQ von bolt.diy sagt, dass Modelle mit weniger als 7B Parametern typischerweise nicht richtig damit interagieren können; Hardware und Strom statt Tokens

Bei der Frage nach dem „besten Modell für bolt.diy“ widersprechen sich die beiden offiziellen Antworten des Projekts, und beide sind veraltet. Die veröffentlichte Dokumentations-FAQ, zuletzt am 4. September 2025 bearbeitet, nennt unter anderem Claude 3.5 Sonnet, GPT-4o, Claude 4 Opus, Gemini 2.0 Flash, DeepSeek Coder und Qwen 2.5 Coder; die FAQ.md im Repository-Stamm, zuletzt am 28. Januar 2025 bearbeitet, nennt eine ältere Auswahl und ergänzt, dass Modelle mit weniger als ungefähr 7 Milliarden Parametern bolt.diy nicht richtig steuern können. Orientieren Sie sich an der Untergrenze, nicht an den Namen. Beachten Sie außerdem, dass der OpenAI-Like-Pfad kaum dokumentiert ist: Nichts im docs/-Baum des Repositorys — der Quelle der veröffentlichten Dokumentationsseite — erwähnt ihn, und die README beschreibt ihn in einer einzigen Zeile: „Mit jedem OpenAI-kompatiblen API-Endpunkt verbinden“. Die Namen der Umgebungsvariablen erscheinen nur in .env.example. Die README wirbt außerdem mit „19+“ Providern, obwohl das Repository 22 Providerdateien enthält, und beschreibt API-Schlüssel als „sicher in Browser-Cookies gespeichert“, während der Code sie als reines JSON in ein Cookie schreibt.

bolt.diy mit OpenRouter und die Obergrenze des kostenlosen Kontingents

OpenRouter ist hier ein erstklassiger Anbieter und kein Trick mit einer Basis-URL. Außerdem ist es der einzige Weg, bei dem der Auswahlbereich von bolt.diy echte Zahlen anzeigt: Für jedes Label werden die eigenen Prompt- und Completion-Preise sowie die tatsächliche Kontextlänge aus der Live-Modellliste verwendet. Wenn Sie das 8k-Label bei einem benutzerdefinierten Endpunkt stört, ist dieser Kontrast der Grund dafür.

Das kostenlose Kontingent hat eine feste Obergrenze, bei der sich eine Berechnung lohnt. OpenRouter dokumentiert 20 Anfragen pro Minute für seine :free-Modelle, 50 pro Tag bei weniger als 10 lebenslangen Credits und 1.000 pro Tag bei 10 oder mehr (Werte von der Seite zu den Limits vom 19. September 2026). Da bolt.diy nach dem Hinzufügen von Dateien für eine Nachricht drei Aufrufe tätigt, entsprechen 50 Anfragen pro Tag ungefähr 16 solchen Nachrichten – weniger, wenn eine Antwort in ein zweites Segment übergeht. In den FAQ wird kein Aufschlag auf die Inferenz genannt; beim Credit-Kauf über Stripe fällt eine Gebühr von 5,5 % und über Krypto von 5 % an. Vergleichen Sie diese Finanzierungsstruktur mit einem vorausbezahlten Guthaben in Kunavo vs. OpenRouter und OpenRouter-Alternativen.

Einrichten und die erste Belastung prüfen

bolt.diy wurde nicht zur Laufzeit gegen Kunavos Endpunkt getestet, und Kunavo bietet keine bolt.diy-spezifische Integration. Alle obigen Angaben stammen aus den Quellen und der Dokumentation beider Seiten. Die allgemeinen Einstellungen finden Sie im Schnellstart und bei den Chat-Completions; der Leitfaden zur OpenAI-kompatiblen API beschreibt dasselbe Basis-URL-Muster für andere Clients, und das Verzeichnis für KI-Agenten-APIs listet Clients auf, die über eine solche Integration verfügen. Halten Sie während des Ausprobierens eine funktionierende Route verfügbar, senden Sie eine begrenzte Nachricht und lesen Sie anschließend die tatsächlich von Ihrem Konto verbuchte Abrechnung aus, statt einer Schätzung in der App zu vertrauen.

Ein Protokolldetail entscheidet darüber, ob Sie überhaupt Tokenzahlen sehen: bolt.diy erstellt seinen OpenAI-Client ohne strikte Kompatibilität, sodass das SDK den Endpunkt nie auffordert, die Nutzung im Stream einzuschließen. Kunavos Dispatcher fordert die Nutzung upstream an und leitet die Frames weiter, daher sollte der abschließende Nutzungs-Frame weiterhin eintreffen – das ist eine codebasierte Schlussfolgerung aus beiden Seiten und kein getestetes Ergebnis. Kunavo entfernt außerdem vor dem Dispatch Parameter, die ein Modell nicht akzeptiert. Das ist hier relevant, weil der Prompt-Enhancer-Pfad von bolt.diy ausdrücklich eine Temperatur sendet und Claude Sonnet 5 diesen Parameter ablehnt. Erstellen Sie ein Kunavo-Konto, sobald Sie einen Schlüssel aufladen möchten.

Häufig gestellte Fragen

Wie viel kostet bolt.diy?

bolt.diy kostet 0 $. Es handelt sich um Software unter MIT-Lizenz ohne Pläne, Tarife, Konten oder gehosteten Dienst — die Domain bolt.diy leitet auf das GitHub-Repository weiter, daher gibt es keine Preisseite (überprüft am 19. September 2026). Sie bezahlen die Modell-API-Rechnung des von Ihnen ausgewählten Anbieters sowie gegebenenfalls Ihr eigenes Hosting, falls Sie es nicht auf Ihrem eigenen Rechner ausführen. Das kostenpflichtige Produkt mit Tarifen ab 25 $ pro Monat ist bolt.new, der separate gehostete Dienst, von dem dieses Projekt geforkt wurde.

Ist bolt.diy dasselbe wie bolt.new?

Nein. bolt.diy ist ein GitHub-Fork von stackblitz/bolt.new, bestätigt durch die Repository-API am 19. September 2026, und beide werden vollständig unterschiedlich abgerechnet. bolt.new ist ein gehostetes, tokenbasiertes Produkt: Auf der Preisseite werden ein kostenloser Tarif mit 1M Tokens pro Monat und einem Tageslimit von 300K, Pro ab 25 $ monatlich mit 10M Tokens sowie Teams für 30 $ monatlich pro Mitglied aufgeführt. bolt.diy bietet nichts davon — keine enthaltenen Tokens, kein Konto, kein Abonnement. Das Repository coleam00/bolt.new-any-llm ist ebenfalls kein anderes Projekt: Es ist der ursprüngliche Name von bolt.diy und leitet jetzt zu stackblitz-labs/bolt.diy weiter.

Was ist die beste API für bolt.diy?

Es gibt keinen eindeutigen Gewinner, da bolt.diy die drei Wege im Code sehr unterschiedlich behandelt. Eine direkte Anbieter-API ist am besten, wenn Sie den ganzen Tag einen Anbieter verwenden und bolt.diy dafür einen erstklassigen Provider bereitstellt, da Sie dann dessen tatsächliche Modellliste und Kontextwerte erhalten. OpenRouter ist am besten, wenn Sie im Auswahlfeld Preise pro Modell und Kontextfenster sehen möchten — sein Provider liest beides aus der aktuellen Modellliste — allerdings fällt die eigene Gebühr von OpenRouter für den Guthabenkauf an. Ein OpenAI-kompatibles Gateway über den OpenAI-Like-Provider ist am besten, wenn Sie einen Schlüssel und ein Guthaben für mehrere Modellfamilien wünschen; dafür wird jedes Modell, das aus Ihrer /models-Antwort erkannt wird, mit einem fest codierten Kontext von 8.000 Tokens beschriftet, und der providerweite Standard für die Ausgabe von 8.192 Tokens gilt für jede ID außer denen, deren Name mit o1, o3 oder gpt-5 beginnt. Ein lokales Modell über Ollama oder LM Studio eignet sich für private oder einmalige Aufgaben ohne Gebühr pro Anfrage.

Was ist die günstigste API für bolt.diy?

Am günstigsten pro Token zu sein und eine App am günstigsten fertigzustellen, sind unterschiedliche Fragen. Die Gemini-API von Google bietet für die Flash-Familie tatsächlich einen kostenlosen Tarif, und bolt.diy unterstützt ihn nativ; auf Googles eigener Preisseite steht jedoch, dass Inhalte des kostenlosen Tarifs zur Verbesserung der Produkte verwendet werden — ein wichtiger Aspekt, wenn Sie eine Kundencodebasis in den Chat einfügen. Die kostenlosen Modelle von OpenRouter kosten nichts, sind aber bei weniger als 10 Guthaben über die gesamte Laufzeit auf 20 Anfragen pro Minute und 50 Anfragen pro Tag begrenzt. Da bolt.diy nach dem Hinzufügen von Dateien zu Ihrem Projekt drei Modellaufrufe pro Nachricht ausführt, entsprechen 50 Anfragen pro Tag ungefähr 16 solchen Nachrichten. Jenseits der kostenlosen Optionen sollten Sie die Preise pro Million vergleichen und anschließend messen: Ein günstiges Modell, das vier Versuche für eine funktionierende Komponente benötigt, kann mehr kosten als eines, das nur einen Versuch braucht.

Welches ist das beste Modell für bolt.diy?

Die eigenen Empfehlungen von bolt.diy sind veraltet und sollten datiert statt befolgt werden. Die veröffentlichte Dokumentations-FAQ, zuletzt am 4. September 2025 bearbeitet, nennt Claude 3.5 Sonnet, GPT-4o, Claude 4 Opus, Gemini 2.0 Flash, DeepSeek Coder und Qwen 2.5 Coder; die FAQ.md im Repository-Stamm, zuletzt am 28. Januar 2025 bearbeitet, nennt erneut eine ältere Auswahl und ergänzt, dass Modelle mit weniger als etwa 7 Milliarden Parametern bolt.diy typischerweise überhaupt nicht steuern können. Beide wurden am 19. September 2026 überprüft. Der dauerhafte Teil dieser Empfehlung ist die Untergrenze, nicht die Namen: bolt.diy fordert ein Modell auf, vollständige Dateien in einem strukturierten Artefaktformat auszugeben, daher neigen kleine lokale Modelle dazu, das Format zu beschädigen. Wählen Sie ein aktuelles Frontier- oder Mid-Tier-Modell und beachten Sie das Standard-Ausgabelimit des OpenAI-Like-Providers von 8.192 Tokens pro Anfrage — angewendet auf jede ID außer denen, deren Name mit o1, o3 oder gpt-5 beginnt; für diese sendet bolt.diy einen Token-Limit-Schlüssel, den das festgelegte SDK nicht erkennt, sodass überhaupt kein Limit den Endpunkt erreicht.

Wie verbinde ich eine benutzerdefinierte API mit bolt.diy?

Verwenden Sie den Provider namens OpenAI-Like, der in den Einstellungen unter Local Providers statt unter Cloud Providers erscheint und standardmäßig deaktiviert ist. Setzen Sie OPENAI_LIKE_API_BASE_URL auf das Präfix, unter dem sowohl /models als auch /chat/completions bereitgestellt werden, und OPENAI_LIKE_API_KEY auf Ihren Schlüssel. Welche Build-Variante Sie ausführen, bestimmt, wo der Schlüssel eingetragen wird: Bei dem Commit, auf den der stabile Branch zeigt, und daher in den Desktop-Binärdateien von v1.0.0, erscheint im Chat-UI ein Schlüsselfeld; in main und im Image ghcr.io erscheint es nicht, weil ein Refactoring vom 6. September 2025 einen immer wahren Ausdruck entfernt hat, der es sichtbar gehalten hatte. In diesen Builds muss der Schlüssel aus der Serverumgebung kommen, und der Server muss neu gestartet werden. In keiner der beiden Varianten gibt es ein Textfeld für die Modell-ID — IDs werden per GET an /models Ihrer Basis-URL mit einem Bearer-Token erkannt und unverändert verwendet.

Kann ich OpenRouter mit bolt.diy verwenden?

Ja, und es handelt sich um einen separaten Provider, nicht um einen Trick mit der Basis-URL. bolt.diy enthält einen OpenRouter-Provider, dessen einziger Konfigurationsschlüssel OPEN_ROUTER_API_KEY ist; der Endpunkt openrouter.ai/api/v1 ist im Quellcode fest codiert, daher kann darüber kein anderes Gateway erreicht werden. Dieser Provider ist außerdem die einzige Stelle, an der bolt.diy echte Zahlen anzeigt: Er erstellt die Bezeichnung jedes Auswahlfeldeintrags aus den eigenen Prompt- und Completion-Preisen der aktuellen Modellliste sowie deren tatsächlicher Kontextlänge — Werte, die der OpenAI-Like-Provider nie liest. In der eigenen Dokumentation von OpenRouter steht, dass kein Aufschlag auf die Inferenz erhoben wird, beim Guthabenkauf jedoch Gebühren von 5,5 % über Stripe und 5 % über Krypto anfallen (überprüft am 19. September 2026).

Warum zeigt bolt.diy für mein Modell einen 8K-Kontext an, und warum ist der Provider als nicht funktionsfähig markiert?

Beides sind bekannte Verhaltensweisen im Code von bolt.diy und keine Fehler Ihres Endpunkts. Jedes aus Ihrer /models-Antwort erkannte Modell erhält im Quellcode maxTokenAllowed: 8000; das von Ihrem Endpunkt zurückgegebene Feld context_length wird nie gelesen, sodass selbst ein Modell mit einer Million Tokens ungefähr als 8K angezeigt wird. Modelle, die Sie in OPENAI_LIKE_API_MODELS deklarieren, behalten stattdessen das dort eingetragene Limit. In beiden Fällen steuert die Zahl die Bezeichnung im Auswahlfeld und ein serverseitiges Warnprotokoll; im Streaming-Pfad wird die Anfrage weder begrenzt noch der Chat gekürzt. Separat führt das Gesundheitsabzeichen der Einstellungen für lokale Provider im Browser einen GET an /models Ihrer Basis-URL ohne jeglichen Authorization-Header aus. Ein Endpunkt, der einen Schlüssel verlangt, weist dies zurück, und das Abzeichen wird rot, während die Generierung weiterhin funktioniert. Beides wurde am 19. September 2026 aus main gelesen.

Wird bolt.diy noch gepflegt?

Das Repository besteht weiterhin und ist nicht archiviert — MIT, rund 20.000 Stars, erstellt im Oktober 2024 — aber die Daten sind die ehrliche Art, den Entwicklungsrhythmus zu beschreiben. Der letzte Commit auf main ist vom 7. Februar 2026, danach gab es keine weiteren. Die einzige 1.x-Version ist v1.0.0 vom 12. Mai 2025, und der stabile Branch, den die README Anfängern zum Klonen empfiehlt, zeigt weiterhin auf diesen Release-Commit. Beiträge gehen weiterhin ein, werden aber nicht zusammengeführt: 56 offene Pull Requests am 19. September 2026. Es wurde kein Archivhinweis, keine Ankündigung zur Einstellung und keine Stellungnahme der Maintainer gefunden; dies sind daher Hinweise auf den Entwicklungsrhythmus, keine veröffentlichte Entscheidung.

Repository, Releases, Branches, Container-Image, Quelldateien und Dokumentation von bolt.diy wurden am 19. September 2026 geprüft; Verhaltensaussagen wurden beim Haupt-Commit 2e254ac und bei dem Commit gelesen, auf den stable verweist. Die Zahlen zu bolt.new und OpenRouter stammen ebenfalls von deren eigenen Seiten und wurden am selben Tag gelesen. Es wurde kein Laufzeittest von bolt.diy gegen Kunavo durchgeführt. Kunavos Tokenpreise stammen aus dem Live-Katalog, und jedes Dollarbeispiel hier ist eine beispielhafte Tokenberechnung und keine gemessene Aufgabenkostenangabe.