O que foi lançado: o Gemini 3.7 Flash, disponível de forma geral em 13 de agosto de 2026, três semanas depois do Gemini 3.6 Flash. O Google o chama de "nosso modelo de trabalho mais inteligente até agora para codificação e agentes", com ganhos reais em benchmarks de codificação e de tarefas agênticas.
O corte de preço é temporário. O preço promocional de lançamento de US$ 0,75 por milhão de tokens de entrada / US$ 3,75 por milhão de tokens de saída — metade do preço de lançamento do 3.6 Flash — vale apenas até 31 de dezembro de 2026. A partir de 1º de janeiro de 2027 passa a ser US$ 1,50 / US$ 7,50, dobrando.
Onde ele está disponível hoje: Gemini Spark (assinantes do Google AI Pro/Ultra), a API do Gemini via AI Studio, Google Antigravity, Android Studio, Gemini Enterprise, e GitHub Copilot desde o primeiro dia. Também substituiu o 3.6 Flash como padrão no app Gemini para consumidor final.
Onde ele ainda não está: os materiais do próprio Google não mencionam o Gemini Notebook em lugar nenhum. Se o modelo por trás dos seus chats de notebook no plano gratuito importa para você, isso não foi confirmado como tendo mudado.

Os números que o Google está destacando
Do próprio anúncio de modelo do Google, os principais ganhos de benchmark em relação ao 3.6 Flash:
Benchmark 3.6 Flash 3.7 Flash
------------------------------------------------
FrontierCode 1.1 Main 34.4% 43.6%
DeepSWE v1.1 49.0% 65.3%
WebDev Arena (Elo) 1538 1588
GDP.pdf (knowledge work) 22.0% 34.0%
AutomationBench 17.0% 30.4%
GDP.pdf is a document-comprehension benchmark across
finance, law and bioscience material. Google's own
figures also put 3.7 Flash ahead of Claude Sonnet 5
(28.0%) and GPT-5.6 Terra (24.7%) on the same test —
Google's benchmark, not independently reproduced.Vale parar no resultado do GDP.pdf, porque é o mais relevante para os leitores deste site, mesmo que nada aqui use esse modelo diretamente: é um teste de leitura precisa de documentos profissionais densos, e o resultado de 34% alegado pelo Google supera tanto o Claude Sonnet 5 quanto o GPT-5.6 Terra no mesmo benchmark. Trate isso como o número de um fornecedor, não como um número neutro — ninguém fora do Google reproduziu esse resultado ainda.
A ficha técnica do modelo lista uma janela de contexto de entrada de 1 milhão de tokens, com até 64.000 tokens de saída, um corte de conhecimento em março de 2026, e entrada em texto, imagem, áudio e vídeo (saída apenas em texto). Testes independentes de velocidade da Artificial Analysis mediram aproximadamente 340 tokens por segundo, o que a colocam como a mais rápida entre os modelos que eles medem atualmente.
O corte de preço, e a parte dele que expira
O preço promocional do Google é real: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, metade do que o 3.6 Flash custava no lançamento. Também tem uma data de expiração que recebeu muito menos cobertura do que o corte em si. A partir de 1º de janeiro de 2027, o preço passa a ser US$ 1,50 e US$ 7,50 — voltando para perto de onde o 3.6 Flash começou. Se você está construindo algo sobre essa API para o longo prazo, planeje o orçamento pelo preço de janeiro, não pelo preço de lançamento.
Há uma segunda ressalva além do preço de vitrine. A avaliadora independente eesel AI, testando o modelo para cargas de trabalho de suporte e automação, descobriu que o 3.7 Flash eliminou o nível de raciocínio "mínimo" que tornava o 3.6 Flash utilizável para tarefas de classificação baratas e de alto volume — o novo piso é "baixo", que pensa mais por padrão. Os tokens de raciocínio também são cobrados na taxa de saída, mesmo que a API só retorne um resumo deles; a própria amostra da eesel mostrou 297 tokens de raciocínio contra 171 tokens de saída retornados numa tarefa. A estimativa deles é que a sobrecarga de raciocínio mais pesado adiciona aproximadamente 40% mais tokens cobrados por tarefa em comparação ao 3.6 Flash, o que corrói uma fatia relevante do corte de preço chamativo justamente para as cargas de trabalho em que o Flash costumava ser a opção barata. O veredito deles: "Se você escolheu o Flash originalmente porque era o nível barato, o 3.7 não é o seu caminho de upgrade."
Onde ele realmente está disponível
Disponibilidade confirmada no dia do lançamento: Gemini Spark, o assistente agêntico dentro do app Gemini, para assinantes do Google AI Pro e Ultra em mais de 160 países; a API do Gemini via AI Studio; Google Antigravity; Android Studio; a Gemini Enterprise Agent Platform e o app Gemini Enterprise; e o GitHub Copilot, ativo no mesmo dia no VS Code, Visual Studio, Copilot CLI, JetBrains, Xcode e Eclipse para os níveis Pro, Pro+, Max, Business e Enterprise (administradores dos níveis Business e Enterprise precisam ativá-lo). No próprio app Gemini para consumidor final, o 3.7 Flash substituiu o 3.6 Flash como padrão no seletor de modelos no Android, iOS, web e macOS a partir da mesma tarde.
O próprio enquadramento de Sundar Pichai, publicado no dia do lançamento: "Nossos modelos Flash são cavalos de batalha que oferecem desempenho a um ótimo preço. Então, estamos lançando atualizações rapidamente para colocá-los nas mãos dos desenvolvedores. E agora, apenas 3 semanas depois de lançar o 3.6 Flash, o 3.7 Flash mostra ganhos significativos, inclusive em codificação e trabalho agêntico."
O que ele não confirma: o Gemini Notebook
Vale afirmar isso claramente em vez de presumir continuidade, porque é a pergunta que nossos leitores realmente vão ter. Nada no anúncio do Google, na ficha técnica do modelo, ou nas duas matérias dedicadas a esse lançamento, menciona o Gemini Notebook. A presença confirmada voltada ao consumidor final é o Gemini Spark e o seletor de modelos do app Gemini geral — uma superfície separada do Gemini Notebook, que tem seu próprio modelo por trás das cenas e seu próprio ritmo de lançamentos. Se um Flash mais rápido e mais barato chegando aos seus chats de notebook no plano gratuito ou aos seus Audio Overviews importa para você, isso ainda não aconteceu, e o Google não disse quando ou se vai acontecer.
Por que o modelo barato lança rápido enquanto o carro-chefe emperra
O intervalo de três semanas entre o 3.6 e o 3.7 Flash não acontece isoladamente. O Gemini 3.5 Pro — o carro-chefe que o Google prometeu "no mês que vem" no I/O de 19 de maio de 2026 — está agora em seu quarto mês consecutivo de atraso, e na chamada de resultados mais recente do Google, Pichai teria desviado de perguntas diretas sobre o lançamento.
Esse atraso acontece junto com uma reformulação real de liderança na DeepMind. Em 5 de agosto de 2026, Demis Hassabis deixou o cargo de CEO da DeepMind para se tornar cientista-chefe da Alphabet e presidente do conselho da DeepMind, citando mais tempo para a Isomorphic Labs, sua iniciativa de descoberta de medicamentos; Koray Kavukcuoglu assumiu as operações do dia a dia como SVP. Diversas figuras seniores, incluindo o veterano engenheiro do Google Jeff Dean, também mudaram de função ou saíram no mesmo período, e uma reunião geral no dia seguinte revelou algumas equipes migrando da DeepMind para o Google corporativo. As ações da Alphabet caíram aproximadamente 4% no dia em que as mudanças foram anunciadas.
Nada disso está confirmado como a causa do atraso do Pro — o Google não afirmou isso diretamente. Mas o padrão é consistente: o modelo que o Google consegue lançar rápido e barato continua sendo lançado rápido e barato, enquanto o que precisa ser o melhor do mundo continua escorregando, durante os mesmos meses em que sua organização de pesquisa está sendo reestruturada.
Perguntas frequentes
O Gemini 3.7 Flash é realmente mais barato que o 3.6 Flash?
Sim, mas só até 31 de dezembro de 2026. O preço promocional é US$ 0,75/US$ 3,75 por milhão de tokens de entrada/saída, metade do preço de lançamento do 3.6 Flash. A partir de 1º de janeiro de 2027 sobe para US$ 1,50/US$ 7,50 — voltando para perto de onde o 3.6 Flash começou, não um corte permanente.
O Gemini 3.7 Flash é o modelo por trás do Gemini Notebook?
Não confirmado. Os materiais de lançamento do Google listam Gemini Spark, a API do Gemini, Antigravity, Android Studio, Gemini Enterprise e GitHub Copilot como onde ele está disponível. O Gemini Notebook não é mencionado em lugar nenhum do anúncio.
O Gemini 3.7 Flash é melhor que o Claude ou o GPT para codificação?
Pelos próprios benchmarks do Google, sim, por uma margem real no FrontierCode e no DeepSWE. Esses são números do Google, não reproduzidos de forma independente, e ao menos uma avaliadora independente (eesel AI) descobriu que, ao considerar a sobrecarga mais pesada de tokens de raciocínio do 3.7 Flash, o GPT-5.6 Terra ainda vence especificamente em tarefas agênticas de codificação de longo horizonte.
Por que o Gemini 3.7 Flash foi lançado tão pouco tempo depois do 3.6 Flash?
O Google enquadra isso como um ritmo acelerado de atualizações para sua linha Flash. Também está sendo lançado enquanto o Gemini 3.5 Pro, o modelo carro-chefe prometido para meados de 2026, permanece atrasado, já em seu quarto mês além do prometido, durante um período de mudanças de liderança na DeepMind — o Google não ligou as duas coisas diretamente.
O 3.7 Flash ainda é a opção barata para tarefas de alto volume?
Menos claramente do que o 3.6 Flash era. Ele eliminou o nível de raciocínio "mínimo" que tornava o 3.6 Flash viável para trabalho barato de classificação, e os tokens de raciocínio são cobrados na taxa de saída. Uma avaliação independente estimou aproximadamente 40% mais tokens cobrados por tarefa como resultado, o que corrói o corte de preço chamativo justamente para esse caso de uso.