Gemini 3.7 Flash: Google lança modelo de IA focado em código e agentes

Nova versão da linha Flash estreia com API 50% mais barata até o fim de 2026

Por Marcos Guimarães13 ago 2026
Gemini 3.7 Flash: Google lança modelo de IA focado em código e agentes

O que aconteceu

O Google anunciou o Gemini 3.7 Flash, nova versão do seu modelo de IA para codificação, agentes e trabalho de conhecimento. A empresa descreve a novidade como o "modelo de trabalho mais inteligente até agora para codificação e agentes" (VentureBeat). O modelo chega com um corte temporário de 50% nos preços da API: até o fim de 2026, custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída; a partir de 1º de janeiro de 2027, os valores passam a US$ 1,50 e US$ 7,50 (Google AI for Developers).

Contexto

O lançamento acontece três semanas depois do Gemini 3.6 Flash, intervalo curto que o Google atribui a feedback de desenvolvedores e a melhorias algorítmicas (VentureBeat). A rápida iteração na linha Flash ocorre enquanto o Gemini 3.5 Pro, o próximo modelo principal da família, segue sem data de lançamento. A Reuters noticiou que o Google não forneceu uma data para o Gemini 3.5 Pro, apesar de o modelo ter sido descrito anteriormente como em testes com parceiros; o Axios também observou que o 3.7 Flash chega antes da versão Pro esperada.

Por que importa

Para equipes de desenvolvimento, o anúncio combina ganhos de inteligência com redução de custo de inferência. O desconto de 50% na API reduz a barreira inicial para quem quer usar o modelo em tarefas de alto volume, como geração de código e operação de agentes. O período promocional até o fim de 2026 também dá meses para as empresas avaliarem se a redução de novas tentativas e de supervisão manual mencionada pelo Google se reflete em menor custo operacional total (VentureBeat).

Impacto

No curto prazo, o preço mais baixo tende a intensificar a disputa por desenvolvedores no mercado de APIs de modelos de linguagem. No médio prazo, o reajuste programado para janeiro de 2027 dobra o custo por token, o que deve ser considerado em projetos de longo prazo. A cadência acelerada de lançamentos da linha Flash também sinaliza que o Google pretende continuar atualizando seus modelos de trabalho com frequência, enquanto a família Pro segue aguardando a próxima geração.

O que muda

Quem usa a API do Gemini ganha uma opção com preço promocional mais baixo e foco em codificação e agentes. A mudança, porém, exige atenção ao prazo do desconto: após 1º de janeiro de 2027, o custo por token dobra. Projetos que planejam escalar com o Gemini 3.7 Flash precisam incorporar esse reajuste no cálculo de custos. Além disso, a comparação com os modelos anteriores muda, pois o ganho de capacidade chega acompanhado de redução de preço, ao menos temporariamente.

O que vem agora

O Google não informou quando o Gemini 3.5 Pro será lançado, embora o modelo já tenha passado por testes com parceiros (Reuters). A empresa deve continuar iterando na linha Flash com base no feedback dos desenvolvedores. Para o mercado, a janela promocional até o fim de 2026 servirá como teste real das promessas de eficiência do modelo, especialmente em tarefas de codificação e agentes.

Fontes