O custo da API do Gemini é calculado por token e não há mensalidade. Para testar gratuitamente, o Google AI Studio oferece uma camada gratuita com limites de taxa; em produção, você paga por 1M de tokens, com tarifas separadas para entrada e saída. Em 5 de outubro de 2026, o Gemini 3.8 Flash da Kunavo custa $0,525 de entrada / $2,625 de saída — o Google atualmente cobra o preço promocional temporário de $0,75 / $3,75 pelos modelos Flash 3.x, até 31 de dezembro de 2026; a partir de 2027, volta ao preço padrão de $1,50 / $7,50. A Kunavo é cerca de 30% mais barata que esse preço promocional. O Gemini 2.5 Flash, da geração anterior, custa $0,09 / $0,75, e o Gemini 3.1 Pro, $0,70 / $4,20.
Há uma exceção que precisa ser mencionada primeiro: o Gemini 3.6 Flash. Na Kunavo, ele custa $1,05 / $5,25, Cerca de 40% mais caro que o preço promocional do Google — durante a promoção, chamar diretamente o Google é mais barato. Tanto o 3.7 quanto o 3.8 Flash são mais recentes e mais baratos que ele, Portanto, não escolha o 3.6 por causa do preço.
Tarifas verificadas em 5 de outubro de 2026. Os preços oficiais do Google e os detalhes da camada gratuita estão em ai.google.dev/gemini-api/docs/pricing; os valores da Kunavo são apresentados pelo catálogo de modelos deste site e correspondem aos valores realmente cobrados pela API.
“Custo do Gemini” são, na verdade, três coisas
| Rota | O que é cobrado | Tem chave de API? | Para quem é |
|---|---|---|---|
| Camada gratuita (Google AI Studio) | $0, com limites de taxa | Sim (com limitações) | Testes, aprendizado e pequenas ferramentas pessoais |
| Assinatura do Google AI (Pro / Ultra do aplicativo Gemini) | Mensalidade fixa | Não | Uso apenas no aplicativo Gemini, sem programação |
| API cobrada por uso | Por token, sem mensalidade | Sim | Integração a produtos, processamento em lote e controle de custos |
O mal-entendido mais comum está na linha do meio: assinar o Google AI Pro não aumenta a cota da API. A mensalidade do aplicativo e a API para desenvolvedores são contas separadas; para chamar a API de um programa, você ainda precisa usar a camada gratuita ou pagar por token. Por outro lado, se você apenas conversa no aplicativo Gemini e não programa, a versão gratuita ou uma assinatura é suficiente; não precisa de API.
A API do Gemini é gratuita? O que a camada gratuita permite
Existe uma camada gratuita e ela realmente custa $0: crie uma chave no Google AI Studio e faça chamadas dentro dos limites de taxa sem cobrança, suficiente para testar modelos e criar protótipos. O Google ajusta os números específicos dos limites conforme suas condições; esta página não reproduz valores que podem ficar desatualizados — consulte a página de preços do Google e a documentação dos limites de taxa.
Os limites também são claros: eles não sustentam tráfego de produção e podem mudar a qualquer momento, portanto produção exige pagamento. A Kunavo não oferece cota gratuita; em compensação, não cobra mensalidade — o saldo pré-pago mínimo é $10, e você paga apenas pelo uso; meses sem chamadas custam $0.
Preços da API do Gemini — cada modelo por 1M de tokens
| Modelo | Entrada na Kunavo | Saída na Kunavo | Google oficial (entrada / saída) | Comparação com o preço atual do Google |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0,525 | $2,625 | Preço promocional $0,75 / $3,75 (a partir de 2027: $1,50 / $7,50) | Cerca de 30% mais barato que o preço promocional do Google |
| Gemini 3.7 Flash | $0,525 | $2,625 | Preço promocional $0,75 / $3,75 (a partir de 2027: $1,50 / $7,50) | Cerca de 30% mais barato que o preço promocional do Google |
| Gemini 3.6 Flash | $1,05 | $5,25 | Preço promocional $0,75 / $3,75 (a partir de 2027: $1,50 / $7,50) | Cerca de 40% mais caro que o preço promocional do Google |
| Gemini 3.1 Pro | $0,70 | $4,20 | $2,00 / $12,00 | Cerca de 65% de economia |
| Gemini 2.5 Flash | $0,09 | $0,75 | $0,30 / $2,50 | Cerca de 70% de economia |
As três linhas do Flash 3.x comparam o preço promocional que o Google cobra atualmente, não o preço padrão de 2027. Comparar com o preço padrão produziria números muito mais favoráveis, mas esse não é o valor que você paga hoje ao Google. O Gemini 3.1 Pro tem uma regra adicional: quando o prompt de uma solicitação excede 200K tokens, a solicitação inteira é cobrada a 2 vezes a entrada / 1,5 vez a saída. As especificações estão nas páginas dos modelos Gemini 3.8 Flash, Gemini 3.1 Pro e Gemini 2.5 Flash; todas as tarifas estão na página de preços.
Preço do Gemini 3.8 Flash — quanto custa uma solicitação real
É mais útil ver uma solicitação do que apenas uma tabela de tarifas. Todos os valores abaixo foram calculados com base nas tarifas da tabela anterior:
| Uso | Tokens (entrada / saída) | 3.8 Flash (Kunavo) | 3.8 Flash (preço promocional do Google) | 2.5 Flash | 3.1 Pro |
|---|---|---|---|---|---|
| Uma rodada de conversa | 1.000 / 300 | $0,0013 | $0,0019 | $0,00031 | $0,002 |
| Uma resposta RAG | 8.000 / 500 | $0,0055 | $0,0079 | $0,0011 | $0,0077 |
| Uma análise de documento longo | 20.000 / 2.000 | $0,016 | $0,022 | $0,0033 | $0,022 |
| Classificação de 100 mil documentos | 500 / 20 × 100.000 | $31,50 | $45,00 | $6,00 | $43,40 |
Há um fator que pode aumentar a conta: tokens de raciocínio. O Gemini 3.x Flash e o 3.1 Pro “pensam” antes de responder; os tokens de raciocínio não aparecem na resposta, mas são cobrados à tarifa de saída. A tabela acima não os inclui, portanto o custo real de problemas difíceis será maior — use a quantidade de tokens de saída em usage na resposta. Calcule com seus próprios números:
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
"gemini-3-8-flash": (0.525, 2.625),
"gemini-3-1-pro": (0.70, 4.20),
"gemini-2-5-flash": (0.09, 0.75),
}
def cost(model, inp, out):
i, o = RATES[model]
return inp / 1e6 * i + out / 1e6 * o # 思考 token 按輸出費率計
print(cost("gemini-3-8-flash", 8_000, 500)) # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000) # 10 萬筆分類Chamar o Gemini usando o SDK atual da OpenAI
A Kunavo é um endpoint compatível com a OpenAI: substitua base_url e a chave, preencha model com o nome do modelo Gemini e pronto; não é necessário um projeto ou uma conta de faturamento do Google Cloud. A mesma chave também pode chamar modelos Claude, GPT, de imagem e de vídeo.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 只改這一行
)
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage) # 這次請求計費用的 token 數O passo a passo completo está em Início rápido; se quiser solicitar uma chave diretamente ao Google, consulte como obter uma chave de API do Gemini (em inglês).
Falando com franqueza: quando é melhor procurar diretamente o Google
- Se você precisa de cota ou SLA garantidos. O gateway usa capacidade compartilhada, sem cota dedicada nem SLA garantido por contrato. Quando chegar a esse nível de exigência, solicite acesso diretamente ao Google.
- Se você só pode usar o Gemini 3.6 Flash. Durante a promoção, o preço direto do Google é menor que o da Kunavo.
- Se você só conversa no aplicativo. Se não programa, a versão gratuita ou uma assinatura do Google AI é suficiente; você não precisa da API.
Por outro lado, esta é a opção para quem quer uma única chave para chamar Gemini, Claude e GPT, não quer abrir uma conta de faturamento do Google Cloud ou quer controlar os custos usando um saldo pré-pago.
Pagamentos em Taiwan
Para pagar diretamente ao Google, é necessário ativar o faturamento do projeto no Google Cloud e vincular um cartão de crédito internacional. O saldo da Kunavo passa pelo Stripe e aceita cartões, incluindo JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay e Google Pay; é pré-pago, com recarga mínima de $10 e saldo que não expira, e solicitações malsucedidas não são cobradas; recargas únicas de $100 ou mais recebem bônus adicional ($100 creditam $110).
Em Taiwan, não há canais locais de pagamento — JkoPay e LINE Pay não estão na lista de opções disponíveis; usar um cartão internacional é o único caminho. Os detalhes de cobrança estão na documentação de faturamento.
Como reduzir o custo do Gemini
- Escolha o modelo certo. Se você quer a geração 3.x, use o 3.8 ou o 3.7 Flash; eles são mais novos e mais baratos que o 3.6; Para tarefas simples em grande volume, como classificação e extração, use o 2.5 Flash.
- Peça ao modelo para escrever menos. A saída custa mais que a entrada; especificar formato e extensão da saída no prompt é a forma mais direta de reduzir custos.
- Envie menos contexto. No RAG, recupere trechos poucos e relevantes; não envie a base de conhecimento inteira — cada vez, tudo é cobrado como entrada.
- Mantenha o prompt do 3.1 Pro abaixo de 200K tokens. Acima disso, a solicitação inteira custa 2 vezes a entrada / 1,5 vez a saída.
A configuração de roteamento está no guia de otimização de custos de IA (em inglês). Para comparar outros provedores usando o mesmo cálculo, consulte custos da API da OpenAI e custos do Claude.
Perguntas frequentes
Quanto custa a API do Gemini?
A API do Gemini é cobrada por token, sem mensalidade, com tarifas separadas para entrada e saída. Em 5 de outubro de 2026, as tarifas da Kunavo por 1M de tokens são: Gemini 3.8 Flash, entrada $0,525 / saída $2,625; Gemini 3.1 Pro, $0,70 / $4,20; Gemini 2.5 Flash, $0,09 / $0,75. O Google atualmente cobra um preço promocional temporário de $0,75 / $3,75 pelos modelos Flash 3.x, até 31 de dezembro de 2026; a partir de 2027, será $1,50 / $7,50. O Google AI Studio também oferece uma camada gratuita com limites de taxa para testes.
A API do Gemini pode ser usada gratuitamente?
Pode ser testada, mas não é adequada para produção. O Google AI Studio oferece uma camada gratuita com limites de taxa; dentro desses limites, as chamadas custam $0. Os números dos limites são ajustados pelo Google; consulte a página de preços da API do Gemini. O tráfego de produção exige pagamento: diretamente ao Google ou por um gateway cobrado por token. A Kunavo não oferece cota gratuita, mas também não cobra mensalidade — o saldo pré-pago mínimo é $10, e você paga apenas pelo uso; meses sem chamadas custam $0.
Quanto custa o Gemini 3.8 Flash?
Em 5 de outubro de 2026, o Gemini 3.8 Flash da Kunavo custa $0,525 de entrada / $2,625 de saída por 1M de tokens. O Google cobra atualmente $0,75 / $3,75 pelos modelos Flash 3.x durante uma promoção temporária até 31 de dezembro de 2026; na Kunavo, Cerca de 30% mais barato que o preço promocional do Google. A partir de 1º de janeiro de 2027, o Google voltará ao preço padrão de $1,50 / $7,50. Uma resposta RAG (8.000 tokens de entrada / 500 de saída) custa aproximadamente $0,0055 na Kunavo.
O Gemini 3.6 Flash ainda vale a pena?
Não é recomendável escolhê-lo pelo preço. O Gemini 3.6 Flash da Kunavo custa $1,05 / $5,25, Cerca de 40% mais caro que o preço promocional do Google, portanto, durante a promoção, chamar diretamente o 3.6 pelo Google acaba sendo mais barato. O 3.7 Flash e o 3.8 Flash são mais recentes que o 3.6 e também são mais baratos na Kunavo ($0,525 / $2,625), portanto, a menos que seu código exija especificamente o 3.6, escolha um modelo mais recente.
Posso usar a API do Gemini se assinar o Google AI Pro?
Não. As assinaturas pagas do aplicativo Gemini (Google AI Pro / Ultra) e a API do Gemini para desenvolvedores são dois produtos com dois sistemas de cobrança; a mensalidade não inclui cota de API nem fornece uma chave de API. Para chamar a API a partir de um programa, você ainda precisa usar a camada gratuita ou pagar por token. Da mesma forma, ter uma chave de API não desbloqueia recursos adicionais no aplicativo.
Posso usar a API do Gemini sem uma conta de faturamento do Google Cloud?
Sim, por meio de um gateway compatível com a OpenAI. Na Kunavo, a mesma chave com prefixo sk-kn- pode chamar o Gemini sem projeto ou conta de faturamento do Google Cloud; Claude e GPT também usam o mesmo saldo. A contrapartida é a capacidade compartilhada: não há cota dedicada nem SLA garantido por contrato. Em escala que exige cota ou SLA garantidos, solicite acesso diretamente ao Google.
Como pagar pela API do Gemini em Taiwan?
Para pagar diretamente ao Google, é necessário ativar o faturamento do projeto no Google Cloud e vincular um cartão de crédito internacional. A Kunavo usa recarga pré-paga pelo Stripe: aceita Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay e Google Pay; a recarga mínima é de $10, o saldo não expira e solicitações malsucedidas não são cobradas. Taiwan não tem canais de pagamento locais — JkoPay e LINE Pay não estão na lista de métodos disponíveis.