Gemini 3.8 Flash vai dobrar de preço em 2027; veja quanto custa

Modelo custa US$ 0,75 por milhão de tokens de entrada até dezembro, mas valor dobra em janeiro; veja API, acesso grátis e planos no Brasil

Imagem oficial de apresentação do Gemini 3.8 Flash e Gemini 3.8 Flash Cyber
TÓPICOS

O Gemini 3.8 Flash chegou com preço promocional, mas quem pretende usar a nova inteligência artificial do Google em aplicativos, automações ou projetos profissionais precisa prestar atenção à data de validade da oferta. Até 31 de dezembro de 2026, a API Standard custa US$ 0,75 por 1 milhão de tokens de entrada e US$ 3,75 por 1 milhão de tokens de saída. A partir de 1º de janeiro de 2027, esses valores dobram para US$ 1,50 e US$ 7,50, respectivamente.

O reajuste não é uma estimativa: os valores de 2027 já aparecem na tabela oficial de preços da API do Gemini. Também é importante não confundir essa cobrança com as mensalidades do Gemini. No aplicativo, o Google confirmou o 3.8 Flash para assinantes dos planos Google AI Pro e Ultra, enquanto desenvolvedores podem acessar o modelo pela API e pelo Google AI Studio.

Imagem oficial de apresentação do Gemini 3.8 Flash e Gemini 3.8 Flash Cyber
Gemini 3.8 Flash é a nova geração do modelo rápido do Google para programação, agentes e tarefas complexas. Imagem: Google/Divulgação

O lançamento acontece em um momento de disputa intensa no mercado de IA. Para quem está comparando serviços, o Overdrive também reuniu quanto custa usar o ChatGPT 6 e o GPT-6 Astra e colocou frente a frente ChatGPT-6 e Claude Fable 5.1.

Quanto custa o Gemini 3.8 Flash?

Na modalidade Standard da API, o Gemini 3.8 Flash tem dois períodos de preço. O valor promocional permanece válido até o último dia de 2026. No primeiro dia de 2027, tanto a entrada quanto a saída ficam duas vezes mais caras.

Uso da API StandardAté 31/12/2026A partir de 01/01/2027Aumento
1 milhão de tokens de entradaUS$ 0,75US$ 1,50100%
1 milhão de tokens de saídaUS$ 3,75US$ 7,50100%
Context caching por 1 milhão de tokensUS$ 0,075US$ 0,15100%
Armazenamento de cache por 1 milhão de tokens/horaUS$ 0,50US$ 1100%

Os tokens de saída incluem também os thinking tokens, usados durante o processo de raciocínio do modelo. Isso é importante porque uma resposta aparentemente curta pode envolver mais processamento interno do que apenas o texto exibido ao usuário.

Quanto uma chamada do Gemini 3.8 Flash pode custar na prática?

Imagine uma aplicação que, ao longo do mês, envie 1 milhão de tokens ao Gemini 3.8 Flash e receba outro 1 milhão de tokens de volta. Desconsiderando cache, ferramentas e outros recursos, a conta seria de US$ 4,50 em 2026: US$ 0,75 pela entrada e US$ 3,75 pela saída.

Com a tabela que entra em vigor em janeiro de 2027, exatamente o mesmo volume custaria US$ 9.

ConsumoCusto em 2026Custo em 2027
1M entrada + 1M saídaUS$ 4,50US$ 9
10M entrada + 2M saídaUS$ 15US$ 30
100M entrada + 20M saídaUS$ 150US$ 300

Os exemplos são simplificados. Uma aplicação que utilize grounding com a Pesquisa Google, armazenamento de contexto, Priority ou outras ferramentas pode ter custos adicionais.

Gemini 3.8 Flash é grátis?

Existe uma camada gratuita da API do Gemini. Na tabela oficial do Google, tokens de entrada e saída do Gemini 3.8 Flash aparecem sem cobrança no Free Tier, mas esse nível tem limites menores e não oferece todos os recursos disponíveis em produção.

Há ainda uma diferença relevante de privacidade entre os níveis. O Google informa que conteúdo processado no Free Tier pode ser usado para melhorar seus produtos. No nível Paid, a documentação afirma que o conteúdo não é utilizado para essa finalidade.

O nível gratuito é indicado principalmente para testes, aprendizado e projetos pequenos. Quem precisa de maior volume, limites superiores, context caching ou Batch API entra na modalidade paga.

Quais planos dão acesso ao Gemini 3.8 Flash no Brasil?

A assinatura do aplicativo Gemini e a cobrança da Gemini Developer API são coisas diferentes.

No anúncio oficial do 3.8 Flash, o Google confirmou o novo modelo para consumidores nos planos Google AI Pro e Google AI Ultra. Em 6 de setembro de 2026, a página brasileira de assinaturas apresenta os seguintes valores:

PlanoPreço no BrasilGemini 3.8 Flash no app
Sem custoR$ 0/mêsNão anunciado no lançamento do 3.8
Google AI PlusR$ 24,99/mêsNão listado pelo Google no anúncio do 3.8
Google AI ProR$ 96,99/mêsSim
Google AI UltraA partir de R$ 779,90/mêsSim

O Ultra também possui uma opção de R$ 999,90 mensais, com limites de uso maiores. Os valores podem ser alterados pelo Google posteriormente.

Isso não significa que pagar R$ 96,99 pelo Google AI Pro forneça uma quantidade equivalente de créditos para usar livremente na API de produção. A assinatura dá benefícios e limites ampliados dentro dos produtos do Google e do ambiente de experimentação, enquanto o uso pago da Gemini Developer API segue sua própria tabela de consumo.

Para entender como o Gemini se encaixa diante dos concorrentes, veja também o comparativo do Overdrive sobre qual é a melhor IA de 2026 entre ChatGPT, Claude, Gemini e Grok.

Quais são os planos da API do Gemini?

A plataforma para desenvolvedores é dividida pelo Google em três grandes níveis: Free, Paid e Enterprise.

  • Free: voltado a testes e projetos pequenos, com tokens gratuitos e limites menores;
  • Paid: aumenta os limites de produção, libera context caching, Batch API e modelos avançados;
  • Enterprise: acrescenta opções como suporte dedicado, segurança e compliance avançados, throughput provisionado e descontos por volume.

Na prática, o custo do desenvolvedor depende mais da quantidade de tokens e da modalidade de inferência escolhida do que de uma assinatura mensal fixa.

Standard, Batch, Flex ou Priority: quanto custa cada opção?

O preço de US$ 0,75 e US$ 3,75 normalmente citado para o Gemini 3.8 Flash corresponde à modalidade Standard. A API também possui opções com características e preços diferentes.

ModalidadeEntrada em 2026Saída em 2026Entrada em 2027Saída em 2027
StandardUS$ 0,75US$ 3,75US$ 1,50US$ 7,50
BatchUS$ 0,375US$ 1,875US$ 0,75US$ 3,75
FlexUS$ 0,375US$ 1,875US$ 0,75US$ 3,75
PriorityUS$ 1,35US$ 6,75US$ 2,70US$ 13,50

Valores por 1 milhão de tokens, segundo a tabela oficial do Google.

Batch pode ser especialmente interessante para cargas que não precisam ser respondidas imediatamente. O próprio Google descreve a modalidade como uma forma de obter redução de 50% no custo em relação ao Paid Standard.

Já Priority cobra mais para workloads em que previsibilidade e prioridade de processamento são mais importantes. Flex segue na direção oposta: prioriza economia quando a aplicação consegue aceitar maior flexibilidade na execução.

Tabela oficial de benchmarks do Gemini 3.8 Flash comparando o modelo com outras inteligências artificiais
Google afirma que o Gemini 3.8 Flash avançou em programação, agentes autônomos e raciocínio complexo. Imagem: Google/Divulgação

Quais custos extras podem aparecer na API?

Tokens de entrada e saída são apenas a parte mais visível da conta. Dependendo de como a aplicação for construída, outros itens podem entrar no cálculo.

Context caching

O caching permite reutilizar contextos em vez de enviar repetidamente grandes quantidades de informação ao modelo. No Gemini 3.8 Flash Standard pago, o cache custa US$ 0,075 por 1 milhão de tokens em 2026 e passa para US$ 0,15 em 2027.

Há ainda cobrança pelo armazenamento desse contexto: US$ 0,50 por 1 milhão de tokens por hora até dezembro e US$ 1 a partir de janeiro.

Pesquisa Google e Google Maps

Aplicações pagas também podem fazer grounding com a Pesquisa Google ou Google Maps. A documentação atual oferece uma franquia compartilhada de 5 mil consultas por mês entre modelos Gemini 3.x. Depois disso, o preço indicado é de US$ 14 por mil consultas.

É preciso considerar que uma única solicitação feita pelo usuário ao Gemini pode gerar mais de uma consulta à Pesquisa, e a cobrança considera essas consultas executadas.

O Gemini 3.8 Flash pode gastar mais tokens que o 3.7?

Sim. Esse é um detalhe importante para quem pretende migrar uma aplicação apenas porque o preço nominal por token é igual ao do Gemini 3.7 Flash durante o período promocional.

O próprio Google avisa que o Gemini 3.8 Flash pode usar mais tokens em tarefas longas e complexas. O motivo é uma mudança de comportamento: para resolver problemas difíceis, o modelo pode executar mais etapas de raciocínio, utilizar ferramentas repetidamente e verificar o próprio trabalho antes de entregar a resposta.

Portanto, mesmo preço por milhão de tokens não significa necessariamente a mesma conta final.

Para tarefas simples ou aplicações em que o custo é prioridade, o desenvolvedor pode reduzir o nível de raciocínio ou continuar utilizando o Gemini 3.7 Flash, que permanece suportado.

O que muda do Gemini 3.7 Flash para o 3.8 Flash?

O Gemini 3.8 Flash é apresentado pelo Google como seu Flash mais inteligente até agora. O modelo foi desenvolvido principalmente para engenharia de software de longo alcance, agentes autônomos e fluxos de trabalho empresariais complexos.

Entre as especificações divulgadas estão uma janela de contexto de 1 milhão de tokens, até 64 mil tokens de saída e três níveis ajustáveis de raciocínio: low, medium e high. O padrão é medium.

Isso permite, por exemplo, diminuir o raciocínio em um chatbot que precisa responder rapidamente ou aumentar a profundidade em um agente encarregado de analisar um projeto grande de programação.

Segundo o Google, o modelo apresenta avanços sobre o 3.7 Flash em tarefas de programação, uso autônomo de ferramentas e raciocínio de múltiplas etapas. Ele já está em disponibilidade geral, ou GA, e é considerado pronto para aplicações em produção.

Vale usar o Gemini 3.8 Flash agora ou esperar 2027?

Para quem já pretende desenvolver com o modelo, 2026 é financeiramente mais interessante porque a tabela promocional oferece metade do preço que entrará em vigor em janeiro.

Isso não significa, porém, que seja recomendável migrar uma aplicação inteira sem testes. Como o 3.8 pode consumir mais tokens em determinadas tarefas, o ideal é fazer benchmarks usando dados próximos da carga real do projeto.

Uma estratégia de controle de custos pode combinar o 3.8 Flash apenas para tarefas que realmente se beneficiam de seu raciocínio mais forte com modelos mais econômicos em operações simples. Batch ou Flex também podem reduzir significativamente a despesa quando baixa latência não é essencial.

Outra variável é o ritmo extremamente rápido de lançamentos do Google. O Gemini 3.8 Flash chegou apenas três semanas depois do 3.7 Flash e representa o terceiro modelo Flash anunciado em seis semanas. Isso significa que o catálogo ainda pode mudar até 2027, embora os preços de US$ 1,50 e US$ 7,50 para o 3.8 Flash já estejam oficialmente publicados.

Gemini 3.8 Flash é melhor que ChatGPT e Claude?

Preço é apenas uma parte dessa comparação. O Gemini 3.8 Flash foi claramente posicionado pelo Google como um modelo de alto desempenho com custo relativamente baixo, especialmente para programação e agentes. Já ChatGPT e Claude possuem produtos, ferramentas e estruturas de preço diferentes.

Quem busca uma assinatura de IA para uso cotidiano deve comparar o produto completo, não apenas o valor da API. Já empresas e desenvolvedores precisam olhar para preço por tarefa, quantidade real de tokens, latência, qualidade das respostas e ferramentas necessárias.

No Overdrive, já comparamos ChatGPT-6 com Claude Fable 5.1. O crescimento do Gemini também acompanha uma mudança maior no ecossistema do Google: a empresa está substituindo progressivamente o antigo assistente do Android, como explicado em nosso guia sobre a troca do Google Assistente pelo Gemini.

Perguntas frequentes sobre o preço do Gemini 3.8 Flash

Quanto custa 1 milhão de tokens do Gemini 3.8 Flash?

Até 31 de dezembro de 2026, a API Standard custa US$ 0,75 por 1 milhão de tokens de entrada e US$ 3,75 por 1 milhão de tokens de saída. Em 1º de janeiro de 2027, passa para US$ 1,50 e US$ 7,50, respectivamente.

Gemini 3.8 Flash é grátis?

Existe um Free Tier da Gemini Developer API com tokens de entrada e saída gratuitos, sujeito a limites e condições próprios. O acesso ao modelo no aplicativo Gemini é outra questão: no lançamento, o Google confirmou especificamente os planos Google AI Pro e Ultra.

Google AI Plus tem Gemini 3.8 Flash?

O Google AI Plus existe no Brasil e custa atualmente R$ 24,99 por mês, mas o anúncio oficial de lançamento do Gemini 3.8 Flash cita Pro e Ultra como os planos de consumidor com acesso ao novo modelo. Por isso, não é correto assumir que a assinatura Plus já garanta o 3.8 Flash.

Google AI Pro inclui uso ilimitado da API?

Não. A assinatura do Google AI Pro e o faturamento da Gemini Developer API não devem ser tratados como o mesmo produto. A API possui preços, limites e modalidades de cobrança próprios.

Quando o Gemini 3.8 Flash fica mais caro?

O preço promocional termina em 31 de dezembro de 2026. A nova tabela entra em vigor em 1º de janeiro de 2027.

Quanto vai custar o Gemini 3.8 Flash em 2027?

Na API Standard, serão US$ 1,50 por 1 milhão de tokens de entrada e US$ 7,50 por 1 milhão de tokens de saída. Isso representa o dobro da tarifa promocional de lançamento.

Fontes: Google Brasil, Google AI for Developers — preços, Google AI for Developers — Gemini 3.8 Flash, Gemini — planos no Brasil.

Leia também

Software e IA 27 matérias

Comentários

Deixe seu comentário

Seu e-mail não será publicado. Campos com * são obrigatórios.

Ainda sem comentários. Puxe o primeiro assunto.

Mais de Software e IA

Ver mais sobre Software e IA

Explore o Overdrive