Gemini 2.5 FlashAPI
Previous-gen Gemini Flash — extreme value.
Tarif input
$0.09
per 1M tokens
Tarif output
$0.75
per 1M tokens
Prompt caching
Passez cache_control sur les préfixes stables — les hits de cache sont facturés à une fraction du tarif d'input. Les écritures restent au tarif d'input normal.
Calculé automatiquement comme input × 0.2
Spécifications
- ID du modèle
gemini-2-5-flash- Endpoint
POST /v1/chat/completions- Catégorie
- Text
- Fournisseur
- Capacités
- visionfunctionstreaming
Compatibilité OpenAI drop-in
Pointez votre SDK OpenAI existant sur api.kunavo.com/v1 et changez l'ID du modèle. Pas de changement de streaming, pas de nouveau SDK.
Voir la docGemini API pricing guideEssayez vous-même
Récupérez KUNAVO_API_KEY depuis /app/keys puis exécutez le snippet ci-dessous.
curl https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2-5-flash",
"messages": [
{"role": "user", "content": "Hello, Gemini 2.5 Flash"}
],
"stream": false
}'FAQ
How much does Gemini 2.5 Flash cost?
On Kunavo, Gemini 2.5 Flash is $0.09 per 1M input tokens and $0.75 per 1M output tokens — about 70% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.
Can I call Gemini 2.5 Flash with the OpenAI SDK?
Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-2-5-flash". Requests and responses are OpenAI-compatible.
What endpoint does Gemini 2.5 Flash use?
Gemini 2.5 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.
What is Gemini 2.5 Flash good for?
Gemini 2.5 Flash is a text model from Google, with support for vision, function, streaming.