O Gemini 3.8 Flash chegou com preço promocional, mas quem pretende usar a nova inteligência artificial do Google em aplicativos, automações ou projetos profissionais precisa prestar atenção à data de validade da oferta. Até 31 de dezembro de 2026, a API Standard custa US$ 0,75 por 1 milhão de tokens de entrada e US$ 3,75 por 1 milhão de tokens de saída. A partir de 1º de janeiro de 2027, esses valores dobram para US$ 1,50 e US$ 7,50, respectivamente.
O reajuste não é uma estimativa: os valores de 2027 já aparecem na tabela oficial de preços da API do Gemini. Também é importante não confundir essa cobrança com as mensalidades do Gemini. No aplicativo, o Google confirmou o 3.8 Flash para assinantes dos planos Google AI Pro e Ultra, enquanto desenvolvedores podem acessar o modelo pela API e pelo Google AI Studio.

O lançamento acontece em um momento de disputa intensa no mercado de IA. Para quem está comparando serviços, o Overdrive também reuniu quanto custa usar o ChatGPT 6 e o GPT-6 Astra e colocou frente a frente ChatGPT-6 e Claude Fable 5.1.
Quanto custa o Gemini 3.8 Flash?
Na modalidade Standard da API, o Gemini 3.8 Flash tem dois períodos de preço. O valor promocional permanece válido até o último dia de 2026. No primeiro dia de 2027, tanto a entrada quanto a saída ficam duas vezes mais caras.
| Uso da API Standard | Até 31/12/2026 | A partir de 01/01/2027 | Aumento |
|---|---|---|---|
| 1 milhão de tokens de entrada | US$ 0,75 | US$ 1,50 | 100% |
| 1 milhão de tokens de saída | US$ 3,75 | US$ 7,50 | 100% |
| Context caching por 1 milhão de tokens | US$ 0,075 | US$ 0,15 | 100% |
| Armazenamento de cache por 1 milhão de tokens/hora | US$ 0,50 | US$ 1 | 100% |
Os tokens de saída incluem também os thinking tokens, usados durante o processo de raciocínio do modelo. Isso é importante porque uma resposta aparentemente curta pode envolver mais processamento interno do que apenas o texto exibido ao usuário.
Quanto uma chamada do Gemini 3.8 Flash pode custar na prática?
Imagine uma aplicação que, ao longo do mês, envie 1 milhão de tokens ao Gemini 3.8 Flash e receba outro 1 milhão de tokens de volta. Desconsiderando cache, ferramentas e outros recursos, a conta seria de US$ 4,50 em 2026: US$ 0,75 pela entrada e US$ 3,75 pela saída.
Com a tabela que entra em vigor em janeiro de 2027, exatamente o mesmo volume custaria US$ 9.
| Consumo | Custo em 2026 | Custo em 2027 |
|---|---|---|
| 1M entrada + 1M saída | US$ 4,50 | US$ 9 |
| 10M entrada + 2M saída | US$ 15 | US$ 30 |
| 100M entrada + 20M saída | US$ 150 | US$ 300 |
Os exemplos são simplificados. Uma aplicação que utilize grounding com a Pesquisa Google, armazenamento de contexto, Priority ou outras ferramentas pode ter custos adicionais.
Gemini 3.8 Flash é grátis?
Existe uma camada gratuita da API do Gemini. Na tabela oficial do Google, tokens de entrada e saída do Gemini 3.8 Flash aparecem sem cobrança no Free Tier, mas esse nível tem limites menores e não oferece todos os recursos disponíveis em produção.
Há ainda uma diferença relevante de privacidade entre os níveis. O Google informa que conteúdo processado no Free Tier pode ser usado para melhorar seus produtos. No nível Paid, a documentação afirma que o conteúdo não é utilizado para essa finalidade.
O nível gratuito é indicado principalmente para testes, aprendizado e projetos pequenos. Quem precisa de maior volume, limites superiores, context caching ou Batch API entra na modalidade paga.
Quais planos dão acesso ao Gemini 3.8 Flash no Brasil?
A assinatura do aplicativo Gemini e a cobrança da Gemini Developer API são coisas diferentes.
No anúncio oficial do 3.8 Flash, o Google confirmou o novo modelo para consumidores nos planos Google AI Pro e Google AI Ultra. Em 6 de setembro de 2026, a página brasileira de assinaturas apresenta os seguintes valores:
| Plano | Preço no Brasil | Gemini 3.8 Flash no app |
|---|---|---|
| Sem custo | R$ 0/mês | Não anunciado no lançamento do 3.8 |
| Google AI Plus | R$ 24,99/mês | Não listado pelo Google no anúncio do 3.8 |
| Google AI Pro | R$ 96,99/mês | Sim |
| Google AI Ultra | A partir de R$ 779,90/mês | Sim |
O Ultra também possui uma opção de R$ 999,90 mensais, com limites de uso maiores. Os valores podem ser alterados pelo Google posteriormente.
Isso não significa que pagar R$ 96,99 pelo Google AI Pro forneça uma quantidade equivalente de créditos para usar livremente na API de produção. A assinatura dá benefícios e limites ampliados dentro dos produtos do Google e do ambiente de experimentação, enquanto o uso pago da Gemini Developer API segue sua própria tabela de consumo.
Para entender como o Gemini se encaixa diante dos concorrentes, veja também o comparativo do Overdrive sobre qual é a melhor IA de 2026 entre ChatGPT, Claude, Gemini e Grok.
Quais são os planos da API do Gemini?
A plataforma para desenvolvedores é dividida pelo Google em três grandes níveis: Free, Paid e Enterprise.
- Free: voltado a testes e projetos pequenos, com tokens gratuitos e limites menores;
- Paid: aumenta os limites de produção, libera context caching, Batch API e modelos avançados;
- Enterprise: acrescenta opções como suporte dedicado, segurança e compliance avançados, throughput provisionado e descontos por volume.
Na prática, o custo do desenvolvedor depende mais da quantidade de tokens e da modalidade de inferência escolhida do que de uma assinatura mensal fixa.
Standard, Batch, Flex ou Priority: quanto custa cada opção?
O preço de US$ 0,75 e US$ 3,75 normalmente citado para o Gemini 3.8 Flash corresponde à modalidade Standard. A API também possui opções com características e preços diferentes.
| Modalidade | Entrada em 2026 | Saída em 2026 | Entrada em 2027 | Saída em 2027 |
|---|---|---|---|---|
| Standard | US$ 0,75 | US$ 3,75 | US$ 1,50 | US$ 7,50 |
| Batch | US$ 0,375 | US$ 1,875 | US$ 0,75 | US$ 3,75 |
| Flex | US$ 0,375 | US$ 1,875 | US$ 0,75 | US$ 3,75 |
| Priority | US$ 1,35 | US$ 6,75 | US$ 2,70 | US$ 13,50 |
Valores por 1 milhão de tokens, segundo a tabela oficial do Google.
Batch pode ser especialmente interessante para cargas que não precisam ser respondidas imediatamente. O próprio Google descreve a modalidade como uma forma de obter redução de 50% no custo em relação ao Paid Standard.
Já Priority cobra mais para workloads em que previsibilidade e prioridade de processamento são mais importantes. Flex segue na direção oposta: prioriza economia quando a aplicação consegue aceitar maior flexibilidade na execução.

Quais custos extras podem aparecer na API?
Tokens de entrada e saída são apenas a parte mais visível da conta. Dependendo de como a aplicação for construída, outros itens podem entrar no cálculo.
Context caching
O caching permite reutilizar contextos em vez de enviar repetidamente grandes quantidades de informação ao modelo. No Gemini 3.8 Flash Standard pago, o cache custa US$ 0,075 por 1 milhão de tokens em 2026 e passa para US$ 0,15 em 2027.
Há ainda cobrança pelo armazenamento desse contexto: US$ 0,50 por 1 milhão de tokens por hora até dezembro e US$ 1 a partir de janeiro.
Pesquisa Google e Google Maps
Aplicações pagas também podem fazer grounding com a Pesquisa Google ou Google Maps. A documentação atual oferece uma franquia compartilhada de 5 mil consultas por mês entre modelos Gemini 3.x. Depois disso, o preço indicado é de US$ 14 por mil consultas.
É preciso considerar que uma única solicitação feita pelo usuário ao Gemini pode gerar mais de uma consulta à Pesquisa, e a cobrança considera essas consultas executadas.
O Gemini 3.8 Flash pode gastar mais tokens que o 3.7?
Sim. Esse é um detalhe importante para quem pretende migrar uma aplicação apenas porque o preço nominal por token é igual ao do Gemini 3.7 Flash durante o período promocional.
O próprio Google avisa que o Gemini 3.8 Flash pode usar mais tokens em tarefas longas e complexas. O motivo é uma mudança de comportamento: para resolver problemas difíceis, o modelo pode executar mais etapas de raciocínio, utilizar ferramentas repetidamente e verificar o próprio trabalho antes de entregar a resposta.
Portanto, mesmo preço por milhão de tokens não significa necessariamente a mesma conta final.
Para tarefas simples ou aplicações em que o custo é prioridade, o desenvolvedor pode reduzir o nível de raciocínio ou continuar utilizando o Gemini 3.7 Flash, que permanece suportado.
O que muda do Gemini 3.7 Flash para o 3.8 Flash?
O Gemini 3.8 Flash é apresentado pelo Google como seu Flash mais inteligente até agora. O modelo foi desenvolvido principalmente para engenharia de software de longo alcance, agentes autônomos e fluxos de trabalho empresariais complexos.
Entre as especificações divulgadas estão uma janela de contexto de 1 milhão de tokens, até 64 mil tokens de saída e três níveis ajustáveis de raciocínio: low, medium e high. O padrão é medium.
Isso permite, por exemplo, diminuir o raciocínio em um chatbot que precisa responder rapidamente ou aumentar a profundidade em um agente encarregado de analisar um projeto grande de programação.
Segundo o Google, o modelo apresenta avanços sobre o 3.7 Flash em tarefas de programação, uso autônomo de ferramentas e raciocínio de múltiplas etapas. Ele já está em disponibilidade geral, ou GA, e é considerado pronto para aplicações em produção.
Vale usar o Gemini 3.8 Flash agora ou esperar 2027?
Para quem já pretende desenvolver com o modelo, 2026 é financeiramente mais interessante porque a tabela promocional oferece metade do preço que entrará em vigor em janeiro.
Isso não significa, porém, que seja recomendável migrar uma aplicação inteira sem testes. Como o 3.8 pode consumir mais tokens em determinadas tarefas, o ideal é fazer benchmarks usando dados próximos da carga real do projeto.
Uma estratégia de controle de custos pode combinar o 3.8 Flash apenas para tarefas que realmente se beneficiam de seu raciocínio mais forte com modelos mais econômicos em operações simples. Batch ou Flex também podem reduzir significativamente a despesa quando baixa latência não é essencial.
Outra variável é o ritmo extremamente rápido de lançamentos do Google. O Gemini 3.8 Flash chegou apenas três semanas depois do 3.7 Flash e representa o terceiro modelo Flash anunciado em seis semanas. Isso significa que o catálogo ainda pode mudar até 2027, embora os preços de US$ 1,50 e US$ 7,50 para o 3.8 Flash já estejam oficialmente publicados.
Gemini 3.8 Flash é melhor que ChatGPT e Claude?
Preço é apenas uma parte dessa comparação. O Gemini 3.8 Flash foi claramente posicionado pelo Google como um modelo de alto desempenho com custo relativamente baixo, especialmente para programação e agentes. Já ChatGPT e Claude possuem produtos, ferramentas e estruturas de preço diferentes.
Quem busca uma assinatura de IA para uso cotidiano deve comparar o produto completo, não apenas o valor da API. Já empresas e desenvolvedores precisam olhar para preço por tarefa, quantidade real de tokens, latência, qualidade das respostas e ferramentas necessárias.
No Overdrive, já comparamos ChatGPT-6 com Claude Fable 5.1. O crescimento do Gemini também acompanha uma mudança maior no ecossistema do Google: a empresa está substituindo progressivamente o antigo assistente do Android, como explicado em nosso guia sobre a troca do Google Assistente pelo Gemini.
Perguntas frequentes sobre o preço do Gemini 3.8 Flash
Quanto custa 1 milhão de tokens do Gemini 3.8 Flash?
Até 31 de dezembro de 2026, a API Standard custa US$ 0,75 por 1 milhão de tokens de entrada e US$ 3,75 por 1 milhão de tokens de saída. Em 1º de janeiro de 2027, passa para US$ 1,50 e US$ 7,50, respectivamente.
Gemini 3.8 Flash é grátis?
Existe um Free Tier da Gemini Developer API com tokens de entrada e saída gratuitos, sujeito a limites e condições próprios. O acesso ao modelo no aplicativo Gemini é outra questão: no lançamento, o Google confirmou especificamente os planos Google AI Pro e Ultra.
Google AI Plus tem Gemini 3.8 Flash?
O Google AI Plus existe no Brasil e custa atualmente R$ 24,99 por mês, mas o anúncio oficial de lançamento do Gemini 3.8 Flash cita Pro e Ultra como os planos de consumidor com acesso ao novo modelo. Por isso, não é correto assumir que a assinatura Plus já garanta o 3.8 Flash.
Google AI Pro inclui uso ilimitado da API?
Não. A assinatura do Google AI Pro e o faturamento da Gemini Developer API não devem ser tratados como o mesmo produto. A API possui preços, limites e modalidades de cobrança próprios.
Quando o Gemini 3.8 Flash fica mais caro?
O preço promocional termina em 31 de dezembro de 2026. A nova tabela entra em vigor em 1º de janeiro de 2027.
Quanto vai custar o Gemini 3.8 Flash em 2027?
Na API Standard, serão US$ 1,50 por 1 milhão de tokens de entrada e US$ 7,50 por 1 milhão de tokens de saída. Isso representa o dobro da tarifa promocional de lançamento.
Fontes: Google Brasil, Google AI for Developers — preços, Google AI for Developers — Gemini 3.8 Flash, Gemini — planos no Brasil.
Comentários