Gemini 3.7 Flash chega pela metade do preço do 3.5 — mas só até 2027
Por LW Forge — mantenedora do LLM Scout · Atualizado em 31 de agosto de 2026
O Google lançou o Gemini 3.7 Flash em meados de agosto de 2026, e a manchete não é sobre as capacidades do modelo — é sobre o preço. Confirmado diretamente na página oficial de preços da API Gemini do Google, o novo tier Flash chega custando cerca de metade do que o Gemini 3.5 Flash custa hoje, com um detalhe que vale planejar: a tarifa é explicitamente temporária.
Os números reais
| Modelo | Entrada (US$/1M tokens) | Saída (US$/1M tokens) | Observações |
|---|---|---|---|
| Gemini 3.5 Flash | US$ 1,50 | US$ 9,00 | Flash atual, tarifa fixa |
| Gemini 3.7 Flash (até 31/12/2026) | US$ 0,75 | US$ 3,75 | Tarifa de lançamento |
| Gemini 3.7 Flash (a partir de 01/01/2027) | US$ 1,50 | US$ 7,50 | Tarifa padrão assume |
A entrada cai 50%, e a saída cai 58% pelo resto de 2026. A partir de 1º de janeiro de 2027, a tarifa de entrada volta a igualar o 3.5 Flash (US$ 1,50), enquanto a saída se estabiliza em US$ 7,50 — ainda 17% mais barata que os US$ 9,00 do 3.5 Flash, só que sem o desconto de lançamento. A própria tabela de preços do Google lista as duas tarifas lado a lado, então isso não é boato nem cupom por tempo limitado — é o cronograma publicado do modelo.
É um formato diferente de "temporário" do que já acompanhamos antes. Quando a OpenAI cortou o GPT-5.6 Luna e o Terra em julho de 2026, a redução foi permanente — sem data de expiração. Quando a tarifa de lançamento do Claude Sonnet 5 virou permanente em agosto, isso removeu uma expiração que estava originalmente programada. O Gemini 3.7 Flash vai na direção oposta: um desconto real com uma data de expiração real já registrada. Se você está orçando o lançamento de um produto ou um contrato de vários meses em torno dessa tarifa, inclua o salto de 1º de janeiro de 2027 na conta, não só o número de hoje.
Onde ele fica em relação ao resto do tier barato
A tarifa de lançamento do Gemini 3.7 Flash é competitiva, mas não é a opção mais barata do mercado. Para contexto, no momento desta publicação: o GPT-5.6 Luna, da OpenAI, está em US$ 0,20/US$ 1,20; o GLM-5.2 em US$ 1,40/US$ 4,40; e o Claude Haiku 4.5 em US$ 1,00/US$ 5,00. A tarifa de lançamento do Gemini 3.7 Flash (US$ 0,75/US$ 3,75) fica abaixo do Haiku e do GLM-5.2 tanto na entrada quanto na saída, mas o Luna continua significativamente mais barato em custo puro por token. Onde o Gemini 3.7 Flash tende a ganhar é na combinação de uma janela de contexto grande com o ferramental mais amplo do Google (grounding, function calling, entrada multimodal nativa) por um preço mais perto do tier de entrada do que do tier intermediário — veja o panorama completo de onde cada provedor está nas APIs de LLM mais baratas de 2026.
Quanto isso custa na prática
Rodando a conta para uma carga moderada: 2.000 tokens de entrada e 500 de saída por requisição, 50.000 requisições por mês (formato comum de uma feature de triagem de suporte ou resumo).
- Na tarifa atual do 3.5 Flash: (2.000 × US$ 1,50 + 500 × US$ 9,00) / 1.000.000 × 50.000 = US$ 375 de entrada + US$ 225 de saída = US$ 600/mês.
- Na tarifa de lançamento do 3.7 Flash: (2.000 × US$ 0,75 + 500 × US$ 3,75) / 1.000.000 × 50.000 = US$ 75 de entrada + US$ 93,75 de saída = US$ 168,75/mês.
- Na tarifa padrão do 3.7 Flash a partir de 2027: (2.000 × US$ 1,50 + 500 × US$ 7,50) / 1.000.000 × 50.000 = US$ 150 + US$ 187,50 = US$ 337,50/mês.
Isso é uma redução de 72% até o fim de 2026, que se estabiliza numa redução ainda real de 44% quando a tarifa padrão assumir — na mesma carga, só migrando do 3.5 Flash para o 3.7 Flash. Rode o volume real de requisições da sua aplicação na calculadora de tokens para ver onde sua carga se encaixa, e use a comparação de custo GPT vs Claude se o Gemini for um entre vários provedores que você está avaliando, não uma escolha padrão.
O que fica na prática
Se você já usa o Gemini 3.5 Flash, migrar para o 3.7 Flash é quase um upgrade de graça — mesmo tier, preço menor, e o Google está posicionando explicitamente como o substituto, o mesmo padrão do 3.5 Flash substituindo o 2.5 Flash no início de 2026. Se você está escolhendo um provedor para um projeto novo e o custo puro por token é o critério decisivo, ainda vale comparar com o Luna e o GLM-5.2 em vez de assumir que o desconto de manchete do Flash o torna a opção mais barata em absoluto — não torna, ainda que por pouco. O que ele faz é encurtar a distância, e dá ao Google um tier de entrada crível pelo resto de 2026 que praticamente não existia há um mês.
Perguntas frequentes
Quando a tarifa de lançamento do Gemini 3.7 Flash termina?
A tarifa de US$ 0,75/US$ 3,75 por milhão de tokens vale até 31 de dezembro de 2026. A partir de 1º de janeiro de 2027, a tarifa padrão de US$ 1,50/US$ 7,50 assume, segundo a própria página de preços do Google.
O Gemini 3.7 Flash é mais barato que o Gemini 3.5 Flash?
Sim, tanto na tarifa de lançamento quanto na tarifa padrão de 2027. A tarifa de lançamento corta a entrada em 50% e a saída em 58% em relação ao 3.5 Flash; a tarifa padrão de 2027 ainda mantém a saída 17% mais barata, com a entrada empatada.
O Gemini 3.7 Flash é a API de LLM mais barata disponível?
Não. O GPT-5.6 Luna, da OpenAI, a US$ 0,20/US$ 1,20 por milhão de tokens, continua mais barato em custo puro por token. A vantagem do Gemini 3.7 Flash é combinar uma janela de contexto grande e o ferramental mais amplo do Google por um preço mais perto do tier de entrada.
Preços verificados diretamente na página oficial de preços da API Gemini do Google em 2026-08-29.