Todos os guias
Notícias10 min de leitura · atualizado 15 ago 2026

O Gemini 3.7 Flash foi lançado três semanas depois do anterior. Eis o que realmente mudou

O modelo de trabalho do Google recebeu sua segunda atualização em um mês, com ganhos reais em codificação e um corte de preço chamativo. Leia as letras miúdas e o corte é temporário, a contabilidade de tokens é mais complexa do que o preço de vitrine sugere, e — ao contrário do que se poderia supor — o Google não afirmou que esse modelo chega ao Gemini Notebook.

Resposta rápida

O que foi lançado: o Gemini 3.7 Flash, disponível de forma geral em 13 de agosto de 2026, três semanas depois do Gemini 3.6 Flash. O Google o chama de "nosso modelo de trabalho mais inteligente até agora para codificação e agentes", com ganhos reais em benchmarks de codificação e de tarefas agênticas.

O corte de preço é temporário. O preço promocional de lançamento de US$ 0,75 por milhão de tokens de entrada / US$ 3,75 por milhão de tokens de saída — metade do preço de lançamento do 3.6 Flash — vale apenas até 31 de dezembro de 2026. A partir de 1º de janeiro de 2027 passa a ser US$ 1,50 / US$ 7,50, dobrando.

Onde ele está disponível hoje: Gemini Spark (assinantes do Google AI Pro/Ultra), a API do Gemini via AI Studio, Google Antigravity, Android Studio, Gemini Enterprise, e GitHub Copilot desde o primeiro dia. Também substituiu o 3.6 Flash como padrão no app Gemini para consumidor final.

Onde ele ainda não está: os materiais do próprio Google não mencionam o Gemini Notebook em lugar nenhum. Se o modelo por trás dos seus chats de notebook no plano gratuito importa para você, isso não foi confirmado como tendo mudado.

Post oficial do blog do Google 'Introducing Gemini 3.7 Flash', datado de 13 de agosto de 2026, assinado por Tulsee Doshi, Senior Director of Product Management.
blog.google, agosto de 2026.

Os números que o Google está destacando

Do próprio anúncio de modelo do Google, os principais ganhos de benchmark em relação ao 3.6 Flash:

Benchmark              3.6 Flash   3.7 Flash
------------------------------------------------
FrontierCode 1.1 Main    34.4%       43.6%
DeepSWE v1.1              49.0%       65.3%
WebDev Arena (Elo)        1538        1588
GDP.pdf (knowledge work)  22.0%       34.0%
AutomationBench           17.0%       30.4%

GDP.pdf is a document-comprehension benchmark across
finance, law and bioscience material. Google's own
figures also put 3.7 Flash ahead of Claude Sonnet 5
(28.0%) and GPT-5.6 Terra (24.7%) on the same test —
Google's benchmark, not independently reproduced.

Vale parar no resultado do GDP.pdf, porque é o mais relevante para os leitores deste site, mesmo que nada aqui use esse modelo diretamente: é um teste de leitura precisa de documentos profissionais densos, e o resultado de 34% alegado pelo Google supera tanto o Claude Sonnet 5 quanto o GPT-5.6 Terra no mesmo benchmark. Trate isso como o número de um fornecedor, não como um número neutro — ninguém fora do Google reproduziu esse resultado ainda.

A ficha técnica do modelo lista uma janela de contexto de entrada de 1 milhão de tokens, com até 64.000 tokens de saída, um corte de conhecimento em março de 2026, e entrada em texto, imagem, áudio e vídeo (saída apenas em texto). Testes independentes de velocidade da Artificial Analysis mediram aproximadamente 340 tokens por segundo, o que a colocam como a mais rápida entre os modelos que eles medem atualmente.

O corte de preço, e a parte dele que expira

O preço promocional do Google é real: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, metade do que o 3.6 Flash custava no lançamento. Também tem uma data de expiração que recebeu muito menos cobertura do que o corte em si. A partir de 1º de janeiro de 2027, o preço passa a ser US$ 1,50 e US$ 7,50 — voltando para perto de onde o 3.6 Flash começou. Se você está construindo algo sobre essa API para o longo prazo, planeje o orçamento pelo preço de janeiro, não pelo preço de lançamento.

Há uma segunda ressalva além do preço de vitrine. A avaliadora independente eesel AI, testando o modelo para cargas de trabalho de suporte e automação, descobriu que o 3.7 Flash eliminou o nível de raciocínio "mínimo" que tornava o 3.6 Flash utilizável para tarefas de classificação baratas e de alto volume — o novo piso é "baixo", que pensa mais por padrão. Os tokens de raciocínio também são cobrados na taxa de saída, mesmo que a API só retorne um resumo deles; a própria amostra da eesel mostrou 297 tokens de raciocínio contra 171 tokens de saída retornados numa tarefa. A estimativa deles é que a sobrecarga de raciocínio mais pesado adiciona aproximadamente 40% mais tokens cobrados por tarefa em comparação ao 3.6 Flash, o que corrói uma fatia relevante do corte de preço chamativo justamente para as cargas de trabalho em que o Flash costumava ser a opção barata. O veredito deles: "Se você escolheu o Flash originalmente porque era o nível barato, o 3.7 não é o seu caminho de upgrade."

Onde ele realmente está disponível

Disponibilidade confirmada no dia do lançamento: Gemini Spark, o assistente agêntico dentro do app Gemini, para assinantes do Google AI Pro e Ultra em mais de 160 países; a API do Gemini via AI Studio; Google Antigravity; Android Studio; a Gemini Enterprise Agent Platform e o app Gemini Enterprise; e o GitHub Copilot, ativo no mesmo dia no VS Code, Visual Studio, Copilot CLI, JetBrains, Xcode e Eclipse para os níveis Pro, Pro+, Max, Business e Enterprise (administradores dos níveis Business e Enterprise precisam ativá-lo). No próprio app Gemini para consumidor final, o 3.7 Flash substituiu o 3.6 Flash como padrão no seletor de modelos no Android, iOS, web e macOS a partir da mesma tarde.

O próprio enquadramento de Sundar Pichai, publicado no dia do lançamento: "Nossos modelos Flash são cavalos de batalha que oferecem desempenho a um ótimo preço. Então, estamos lançando atualizações rapidamente para colocá-los nas mãos dos desenvolvedores. E agora, apenas 3 semanas depois de lançar o 3.6 Flash, o 3.7 Flash mostra ganhos significativos, inclusive em codificação e trabalho agêntico."

O que ele não confirma: o Gemini Notebook

Vale afirmar isso claramente em vez de presumir continuidade, porque é a pergunta que nossos leitores realmente vão ter. Nada no anúncio do Google, na ficha técnica do modelo, ou nas duas matérias dedicadas a esse lançamento, menciona o Gemini Notebook. A presença confirmada voltada ao consumidor final é o Gemini Spark e o seletor de modelos do app Gemini geral — uma superfície separada do Gemini Notebook, que tem seu próprio modelo por trás das cenas e seu próprio ritmo de lançamentos. Se um Flash mais rápido e mais barato chegando aos seus chats de notebook no plano gratuito ou aos seus Audio Overviews importa para você, isso ainda não aconteceu, e o Google não disse quando ou se vai acontecer.

Por que o modelo barato lança rápido enquanto o carro-chefe emperra

O intervalo de três semanas entre o 3.6 e o 3.7 Flash não acontece isoladamente. O Gemini 3.5 Pro — o carro-chefe que o Google prometeu "no mês que vem" no I/O de 19 de maio de 2026 — está agora em seu quarto mês consecutivo de atraso, e na chamada de resultados mais recente do Google, Pichai teria desviado de perguntas diretas sobre o lançamento.

Esse atraso acontece junto com uma reformulação real de liderança na DeepMind. Em 5 de agosto de 2026, Demis Hassabis deixou o cargo de CEO da DeepMind para se tornar cientista-chefe da Alphabet e presidente do conselho da DeepMind, citando mais tempo para a Isomorphic Labs, sua iniciativa de descoberta de medicamentos; Koray Kavukcuoglu assumiu as operações do dia a dia como SVP. Diversas figuras seniores, incluindo o veterano engenheiro do Google Jeff Dean, também mudaram de função ou saíram no mesmo período, e uma reunião geral no dia seguinte revelou algumas equipes migrando da DeepMind para o Google corporativo. As ações da Alphabet caíram aproximadamente 4% no dia em que as mudanças foram anunciadas.

Nada disso está confirmado como a causa do atraso do Pro — o Google não afirmou isso diretamente. Mas o padrão é consistente: o modelo que o Google consegue lançar rápido e barato continua sendo lançado rápido e barato, enquanto o que precisa ser o melhor do mundo continua escorregando, durante os mesmos meses em que sua organização de pesquisa está sendo reestruturada.

Perguntas frequentes

O Gemini 3.7 Flash é realmente mais barato que o 3.6 Flash?

Sim, mas só até 31 de dezembro de 2026. O preço promocional é US$ 0,75/US$ 3,75 por milhão de tokens de entrada/saída, metade do preço de lançamento do 3.6 Flash. A partir de 1º de janeiro de 2027 sobe para US$ 1,50/US$ 7,50 — voltando para perto de onde o 3.6 Flash começou, não um corte permanente.

O Gemini 3.7 Flash é o modelo por trás do Gemini Notebook?

Não confirmado. Os materiais de lançamento do Google listam Gemini Spark, a API do Gemini, Antigravity, Android Studio, Gemini Enterprise e GitHub Copilot como onde ele está disponível. O Gemini Notebook não é mencionado em lugar nenhum do anúncio.

O Gemini 3.7 Flash é melhor que o Claude ou o GPT para codificação?

Pelos próprios benchmarks do Google, sim, por uma margem real no FrontierCode e no DeepSWE. Esses são números do Google, não reproduzidos de forma independente, e ao menos uma avaliadora independente (eesel AI) descobriu que, ao considerar a sobrecarga mais pesada de tokens de raciocínio do 3.7 Flash, o GPT-5.6 Terra ainda vence especificamente em tarefas agênticas de codificação de longo horizonte.

Por que o Gemini 3.7 Flash foi lançado tão pouco tempo depois do 3.6 Flash?

O Google enquadra isso como um ritmo acelerado de atualizações para sua linha Flash. Também está sendo lançado enquanto o Gemini 3.5 Pro, o modelo carro-chefe prometido para meados de 2026, permanece atrasado, já em seu quarto mês além do prometido, durante um período de mudanças de liderança na DeepMind — o Google não ligou as duas coisas diretamente.

O 3.7 Flash ainda é a opção barata para tarefas de alto volume?

Menos claramente do que o 3.6 Flash era. Ele eliminou o nível de raciocínio "mínimo" que tornava o 3.6 Flash viável para trabalho barato de classificação, e os tokens de raciocínio são cobrados na taxa de saída. Uma avaliação independente estimou aproximadamente 40% mais tokens cobrados por tarefa como resultado, o que corrói o corte de preço chamativo justamente para esse caso de uso.

Continuar lendo