Gemini 3 é a família de modelos atual do Google — Gemini 3 Pro e Gemini 3.1 Pro no topo, e uma linha Flash que vai de Gemini 3 Flash a Gemini 3.8 Flash — nativamente multimodal, com contexto de 1M de tokens e raciocínio em cadeia de pensamento. Hoje você pode chamar a Gemini 3 API na Kunavo por um único endpoint compatível com OpenAI: Gemini 3.1 Pro a $0.70 / $4.20 por 1M de tokens, aproximadamente 65% abaixo da tabela do Google de $2.00 / $12.00, e Gemini 3.8 Flash, o Flash mais recente, a $0.525 / $2.625 — 30% abaixo da tarifa introdutória de $0.75 / $3.75 que o Google cobra para o Flash 3.x até December 31, 2026. Este guia mostra o custo de cada nível, quais slugs estão ativos e o código para chamá-los.
gemini-3-1-pro custa $0.70 / $4.20 por 1M, aproximadamente 65% abaixo da tabela do Google de $2.00 / $12.00. No lado Flash, gemini-3-8-flash ($0.525 / $2.625) é o mais recente, gemini-3-7-flash ($0.525 / $2.625) é a versão anterior e gemini-3-6-flash ($1.05 / $5.25) ainda é oferecido — embora agora custe mais que os dois e mais que a própria tarifa introdutória do Google. Dois slugs permanecem reservados e desativados — os originais gemini-3-pro e gemini-3-flash — porque as fontes upstream testadas não atingem nosso padrão de confiabilidade: erros 503 persistentes e tratamento incorreto de parâmetros (uma fonte ignora completamente maxOutputTokens). Só ativamos um slug quando uma fonte passa por esse teste. Gemini 2.5 Flash também continua ativo no mesmo endpoint.Preços da Gemini 3 API
As tarifas oficiais do Google para a família, lado a lado com o custo de cada nível na Kunavo. Para os modelos 3.x Flash, o Google cobra uma tarifa introdutória até December 31, 2026; por isso, a tabela mostra essa tarifa — a que você pagaria usando o acesso direto hoje — ao lado da tarifa padrão que vem depois:
| Modelo | Entrada / 1M | Saída / 1M | Status na Kunavo |
|---|---|---|---|
| Gemini 3 Pro (tabela do Google, contexto ≤200k) | $2.00 | $12.00 | Reservado — não ativado |
| Gemini 3.1 Pro na Kunavo | $0.70 | $4.20 | Ativo (tabela do Google $2.00 / $12.00) |
| Gemini 3 Flash (tabela do Google) | $0.50 | $3.00 | Reservado — não ativado |
| Gemini 3.6 / 3.7 / 3.8 Flash (tarifa introdutória do Google, até December 31, 2026) | $0.75 | $3.75 | Direto pelo Google; padrão $1.50 / $7.50 a partir de January 1, 2027 |
| Gemini 3.8 Flash na Kunavo — mais recente | $0.525 | $2.625 | Ativo — 30% abaixo da tarifa introdutória do Google |
| Gemini 3.7 Flash na Kunavo | $0.525 | $2.625 | Ativo — 30% abaixo da tarifa introdutória do Google |
| Gemini 3.6 Flash na Kunavo | $1.05 | $5.25 | Ativo — 40% acima da tarifa introdutória do Google; use 3.7 ou 3.8 Flash |
| Gemini 2.5 Flash na Kunavo | $0.09 | $0.75 | Disponível |
A tarifa de cada modelo Gemini atual na Kunavo ao lado da tarifa do Google, além de exemplos de custos calculados, está no guia de preços da Gemini API.
Gemini 3.8 Flash API: preço e tarifa introdutória do Google
Gemini 3.8 Flash é o Flash mais recente do Google, lançado em 2 de setembro de 2026 e voltado para engenharia de software de longo horizonte e execução agêntica, com uma janela de contexto de 1.048.576 tokens e até 65.536 tokens de saída. Na Kunavo, a Gemini 3.8 Flash API custa $0.525 de entrada / $2.625 de saída por 1M de tokens, chamada como gemini-3-8-flash no mesmo endpoint dos demais modelos.
O Google cobra uma tarifa introdutória de $0.75 / $3.75 por 1M de tokens para seus modelos 3.x Flash — 3.6, 3.7 e 3.8 Flash — até December 31, 2026, e a tarifa padrão de $1.50 / $7.50 a partir de January 1, 2027. Comparados à tarifa cobrada hoje pelo Google, Gemini 3.8 Flash e Gemini 3.7 Flash da Kunavo ($0.525 / $2.625) são 30% mais baratos. Gemini 3.6 Flash não é: a $1.05 / $5.25, custa 40% mais que a tarifa introdutória do Google; portanto, use 3.7 e 3.8 Flash — ambos mais recentes e mais baratos.
A Kunavo oferece uma única chave compatível com OpenAI e um único saldo pré-pago para Gemini, Claude, GPT e modelos de imagem e vídeo, sem projeto do Google Cloud e sem cobrança por solicitações com falha. O que ela não oferece é capacidade dedicada: a Kunavo usa capacidade compartilhada, sem cota dedicada nem SLA contratual; se você precisar de qualquer um dos dois, chame o Google diretamente.
Gemini 3.6 Flash — o que mudou
Gemini 3.6 Flash (lançado em 21 de julho de 2026) foi o primeiro Flash 3.x que conseguimos oferecer e é o modelo usado nas medições de tokens de raciocínio desta seção. A tarifa padrão do Google é $1.50 de entrada / $7.50 de saída por 1M de tokens — com tarifas padrão, o mesmo preço de entrada do Gemini 3.5 Flash e uma saída cerca de 17% mais barata — mas, até December 31, 2026, o Google cobra uma tarifa introdutória de $0.75 / $3.75. O Google o posiciona para trabalho agêntico de longo horizonte, afirmando que ele reduz substancialmente o custo de tokens em tarefas de engenharia com várias etapas.
O número que realmente determina sua cobrança não está na tabela de preços: o 3.6 Flash pensa por padrão, e o raciocínio domina o medidor de saída. Em nossos testes, uma resposta factual de uma frase consumiu aproximadamente 120–140 tokens de raciocínio para produzir 7 tokens visíveis de saída. Tokens de raciocínio são cobrados à tarifa de saída, portanto o custo real de uma resposta curta do 3.6 Flash se aproxima mais de 150 tokens de saída do que de 7 — aproximadamente 20 vezes a estimativa ingênua. Há duas consequências práticas:
- Não defina um
max_tokenspequeno. Qualquer valor abaixo de ~150 é consumido pelo raciocínio antes de o modelo emitir uma resposta; você recebe um fragmento truncado e ainda paga pelo thinking. - Faça o orçamento com base no raciocínio, não na saída visível. Para chamadas curtas e em grande volume, um nível Flash sem thinking geralmente é mais barato na prática, mesmo com uma tarifa anunciada por token mais alta.
O Gemini 3.6 Flash continua ativo na Kunavo como gemini-3-6-flash, a $1.05 / $5.25 por 1M, mas isso é 40% acima dos $0.75 / $3.75 cobrados pelo Google até December 31, 2026 e acima do preço dos modelos mais novos na própria Kunavo. Para trabalhos novos, chame gemini-3-8-flash ou gemini-3-7-flash a $0.525 / $2.625, 30% abaixo da tarifa introdutória do Google. Eles também são modelos com thinking, portanto mantenha max_tokens generoso neles.
Chame Gemini na Kunavo hoje
A Kunavo disponibiliza Gemini por meio do endpoint compatível com OpenAI /v1/chat/completions — mantenha o SDK da OpenAI e altere base_url, sem projeto do Google Cloud. Isto chama a Gemini 3.8 Flash API; substitua a string do modelo por gemini-3-7-flash, gemini-3-1-pro ou gemini-2-5-flash e nada mais muda:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
)
# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
model="gemini-3-8-flash",
max_tokens=1024,
messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)Obter uma chave leva um minuto — consulte o guia de chaves da Gemini API. A mesma chave sk-kn- também acessa Claude, GPT, imagem do Nano Banana e vídeo do Veo 3.
Qual nível Gemini devo chamar?
- Cargas de trabalho com contexto longo e raciocínio —
gemini-3-1-proa $0.70 de entrada / $4.20 de saída. É o nível principal do Google para programação, agentes e análise entre modalidades, e o nível Pro que oferecemos. - Trabalho agêntico que raciocina a cada etapa —
gemini-3-8-flasha $0.525 / $2.625, 30% abaixo da tarifa introdutória do Google, ougemini-3-7-flashpelo mesmo preço se seus prompts já tiverem sido validados nele. Raciocínio com latência de Flash; faça o orçamento com base nos tokens de raciocínio, não na saída visível. - Chamadas em grande volume e sensíveis à latência —
gemini-2-5-flasha $0.09 de entrada / $0.75 de saída continua sendo a opção mais eficiente em custo; ele não raciocina por padrão, exatamente por isso permanece barato em respostas curtas. - Não escolha o 3.6 Flash pelo preço —
gemini-3-6-flasha $1.05 / $5.25 custa mais que o 3.7 e o 3.8 Flash na Kunavo e mais que a própria tarifa introdutória do Google; mantenha-o apenas para prompts já validados nele. - Construindo para a próxima atualização — programe usando o formato compatível com OpenAI e trate a string do modelo como configuração; novos slugs Gemini serão disponibilizados no mesmo endpoint.
Perguntas frequentes
O que é a Gemini 3 API?
Gemini 3 é a família de modelos atual do Google — Gemini 3 Pro e 3.1 Pro, Gemini 3 Flash e os modelos mais novos Gemini 3.6, 3.7 e 3.8 Flash — nativamente multimodal, com contexto de 1M de tokens e raciocínio em cadeia de pensamento. A Gemini 3 API é a forma de chamá-los programaticamente: diretamente pelo Google AI Studio / Vertex AI ou por um gateway compatível com OpenAI, como a Kunavo, que oferece hoje o Gemini 3.1 Pro e os modelos 3.6, 3.7 e 3.8 Flash.
Posso chamar a Gemini 3 API na Kunavo hoje?
Sim. Gemini 3.1 Pro está disponível como gemini-3-1-pro a $0.70 de entrada / $4.20 de saída por 1M — cerca de 65% abaixo da lista de $2.00 / $12.00 da Google — e é a opção Pro a escolher. No lado Flash, Gemini 3.8 Flash (gemini-3-8-flash) é o mais recente, a $0.525 / $2.625, 30% abaixo dos $0.75 / $3.75 introdutórios cobrados pela Google pelo Flash 3.x por meio de 31 de dezembro de 2026; Gemini 3.7 Flash (gemini-3-7-flash) tem o mesmo preço, e Gemini 3.6 Flash (gemini-3-6-flash) ainda é oferecido a $1.05 / $5.25, acima da tarifa introdutória da Google. Todos usam o endpoint compatível com OpenAI, sem necessidade de um projeto do Google Cloud. Os slugs originais gemini-3-pro e gemini-3-flash permanecem reservados e não habilitados — as fontes upstream que testamos não atingem nosso padrão de confiabilidade (503s persistentes, tratamento incorreto de parâmetros).
Quanto custa a Gemini 3 API?
A tabela oficial do Google é de $2.00 de entrada / $12.00 de saída por 1M de tokens para Gemini 3 Pro e 3.1 Pro (até 200k de contexto) e de $0.50 / $3.00 para Gemini 3 Flash. Para Gemini 3.6, 3.7 e 3.8 Flash, o Google cobra uma tarifa introdutória de $0.75 / $3.75 até 31 de dezembro de 2026; depois, a tarifa padrão é $1.50 / $7.50 a partir de 1º de janeiro de 2027. Na Kunavo, você paga $0.70 / $4.20 por Gemini 3.1 Pro (aproximadamente 65% abaixo da tabela), $0.525 / $2.625 por Gemini 3.8 Flash e Gemini 3.7 Flash (30% abaixo da tarifa introdutória do Google), e $1.05 / $5.25 por Gemini 3.6 Flash, acima da tarifa introdutória do Google.
Qual Gemini 3 Flash devo usar — 3.6, 3.7 ou 3.8?
Use Gemini 3.8 Flash (gemini-3-8-flash) para trabalhos novos: é o Flash mais recente do Google, lançado em 2 de setembro de 2026, e na Kunavo custa $0.525 / $2.625 por 1M de tokens — 30% abaixo dos $0.75 / $3.75 cobrados hoje pelo Google. O Gemini 3.7 Flash (gemini-3-7-flash) tem o mesmo preço e é adequado para prompts já validados nele. O Gemini 3.6 Flash, a $1.05 / $5.25, custa mais que os dois e 40% mais que a tarifa introdutória do próprio Google; portanto, não é a escolha pelo preço.
Quanto custa a Gemini 3.6 Flash API?
A tarifa padrão da Google para o Gemini 3.6 Flash é $1.50 por 1M tokens de entrada e $7.50 por 1M tokens de saída, a partir de 1º de janeiro de 2027; por meio de 31 de dezembro de 2026, a Google cobra $0.75 / $3.75 como tarifa introdutória. Na Kunavo, gemini-3-6-flash custa $1.05 / $5.25 — 40% acima da tarifa introdutória da Google — portanto o Gemini 3.8 ou 3.7 Flash, ambos mais recentes e a $0.525 / $2.625 na Kunavo, é a melhor compra. A lista de preços também subestima o custo real, porque o 3.6 Flash raciocina por padrão e os tokens de raciocínio são cobrados à tarifa de saída: nos testes, uma resposta de uma frase consumiu cerca de 120–140 tokens de raciocínio para emitir 7 tokens de saída visíveis. Faça o orçamento com base nos tokens de raciocínio, e não na saída visível, e evite um max_tokens abaixo de cerca de 150, ou o orçamento de raciocínio consumirá a resposta antes que uma resposta seja emitida.
Como obtenho uma chave da Gemini 3 API?
Use o Google AI Studio para obter uma chave direta ou uma chave da Kunavo que hoje cobre Gemini 3.1 Pro, os modelos 3.x Flash e 2.5 Flash — além de Claude e GPT; consulte o guia de chaves.
Quais IDs de modelo Gemini 3 estão ativos na Kunavo?
gemini-3-8-flash (o Flash mais recente, $0.525 / $2.625 por 1M), gemini-3-7-flash, gemini-3-6-flash e gemini-3-1-pro ($0.70 / $4.20) estão ativos na Kunavo. Apenas os slugs originais gemini-3-pro e gemini-3-flash permanecem reservados, até que uma fonte atinja nosso padrão de confiabilidade.