A Google lançou o Gemini 3.8 Flash em 2 de setembro de 2026, três semanas depois do 3.7. É o terceiro Flash em seis semanas. Continua na faixa rápida e barata da linha. Logan Kilpatrick, da equipe do Gemini, disse que o preço é o mesmo do 3.7 e a velocidade, quase a mesma.
A empresa descreve o 3.8 como o modelo de volume mais capaz até agora, feito para código em tarefas longas e para agentes que seguem sozinhos vários passos. Não é o Pro. Ainda assim, a tabela oficial compara o Flash com o Claude Opus 5 e o GPT-5.6 Sol. Em alguns testes o 3.8 empata ou passa. Em outros, perde de longe. Isso abre a possibilidade de a Google voltar a se posicionar na fronteira. Ainda é cedo para afirmar.
O que a Google anunciou
O 3.8 Flash já está na API Gemini, no Google AI Studio, no Android Studio e no Antigravity, o ambiente de agentes da Google, onde passa a ser o modelo padrão. No app Gemini, entra para assinantes Pro e Ultra. Empresas acessam pela Gemini Enterprise.
O preço de introdução segue US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, até 31 de dezembro de 2026. Token é o pedaço de texto que a API cobra. A partir de 1º de janeiro de 2027 volta a US$ 1,50 e US$ 7,50. A janela continua de 1 milhão de tokens, o limite de texto que entra de uma vez.
Há um segundo modelo, o 3.8 Flash Cyber, voltado a achar falha de software e aplicar correção. Fica no Fairwind Program, só para organizações aprovadas. Não é o tema desta nota.
Os testes oficiais
Os gráficos abaixo saíram no post de Logan Kilpatrick no dia do lançamento. São testes de laboratório, no recorte que a Google escolheu. Servem para ver o salto sobre o 3.7 e a distância até Opus 5 e GPT-5.6 Sol. Não dizem se o modelo resolve peça, contrato ou sistema real.
No DeepSWE v1.1, engenharia de software em tarefas longas, o 3.8 Flash marca 73,7%. O 3.7 ficou em 65,3%. O Opus 5 lidera por pouco, com 74,0%. O GPT-5.6 Sol marca 72,7%. É o recorte em que o Flash mais se aproxima desses dois.
No Terminal-bench 4.0, agentes em geral, o quadro inverte. O 3.8 Flash marca 19,1%. O Opus 5, 51,8%. No OSWorld-2.0, uso de computador, 59,0% contra 75,4% do Opus. No GDPVal-AA v2, trabalho de conhecimento, o Elo do 3.8 é 1.545. O do Opus 5 é 1.824.
Na leitura de PDF (GDP.pdf), o 3.8 Flash marca 35,0%. O 3.7 tinha 34,0%. O GPT-5.6 Sol lidera, com 40,0%. O salto desta vez não está no documento.
Onde o Flash lidera o recorte da Google
No Vals Finance Agent v2, tarefas de analista financeiro, o 3.8 Flash marca 61,4%, à frente do 3.7 (59,0%) e do Opus 5 (58,6%).
No HLE-Verified, raciocínio em várias áreas, o 3.8 Flash marca 54,9%. Opus 5, 54,4%. GPT-5.6 Sol, 54,5%. A diferença cabe no empate.
No Harvey's Legal Agent Benchmark, fluxos jurídicos com arquivo e ferramenta, a métrica da tabela é o all-pass: a tarefa só conta se o modelo passa em todos os critérios. O 3.8 Flash marca 10,0% nesse recorte. O 3.7, 8,8%. O Opus 5, 6,7%. Lidera a tabela da Google. Em valor absoluto, nove em cada dez tarefas ainda falham. Serve para comparar esses modelos, não para usar o resultado sem conferir o original.
Preço e o que a tabela permite dizer
O 3.8 Flash não coloca a Google de volta no topo. Continua o modelo de volume: rápido, barato até o fim do ano, agora mais próximo de Opus e GPT em parte dos testes de código e de agente. A possibilidade de a empresa se reposicionar na fronteira existe. Depende do Pro, do uso real e dos testes em que o Flash ainda perde de longe.
Fonte: Anúncio oficial Introducing Gemini 3.8 Flash and 3.8 Flash Cyber (2 set 2026). Gráficos: Logan Kilpatrick. Antigravity. Ficha do modelo.