Nota Ferramentas 5 min de leitura

Google lança Gemini 3.8 Flash. Em alguns testes, chega perto dos modelos de fronteira

Terceiro Flash em seis semanas, no mesmo preço do 3.7. Os gráficos oficiais colocam o modelo rápido da Google ao lado de Opus 5 e GPT-5.6 Sol em alguns testes. Em outros, o vão continua grande.

Mesa com papéis e laptop; cartão com logo Gemini 3.8 Flash.

A Google lançou o Gemini 3.8 Flash em 2 de setembro de 2026, três semanas depois do 3.7. É o terceiro Flash em seis semanas. Continua na faixa rápida e barata da linha. Logan Kilpatrick, da equipe do Gemini, disse que o preço é o mesmo do 3.7 e a velocidade, quase a mesma.

A empresa descreve o 3.8 como o modelo de volume mais capaz até agora, feito para código em tarefas longas e para agentes que seguem sozinhos vários passos. Não é o Pro. Ainda assim, a tabela oficial compara o Flash com o Claude Opus 5 e o GPT-5.6 Sol. Em alguns testes o 3.8 empata ou passa. Em outros, perde de longe. Isso abre a possibilidade de a Google voltar a se posicionar na fronteira. Ainda é cedo para afirmar.

O que a Google anunciou

O 3.8 Flash já está na API Gemini, no Google AI Studio, no Android Studio e no Antigravity, o ambiente de agentes da Google, onde passa a ser o modelo padrão. No app Gemini, entra para assinantes Pro e Ultra. Empresas acessam pela Gemini Enterprise.

O preço de introdução segue US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, até 31 de dezembro de 2026. Token é o pedaço de texto que a API cobra. A partir de 1º de janeiro de 2027 volta a US$ 1,50 e US$ 7,50. A janela continua de 1 milhão de tokens, o limite de texto que entra de uma vez.

Há um segundo modelo, o 3.8 Flash Cyber, voltado a achar falha de software e aplicar correção. Fica no Fairwind Program, só para organizações aprovadas. Não é o tema desta nota.

Os testes oficiais

Os gráficos abaixo saíram no post de Logan Kilpatrick no dia do lançamento. São testes de laboratório, no recorte que a Google escolheu. Servem para ver o salto sobre o 3.7 e a distância até Opus 5 e GPT-5.6 Sol. Não dizem se o modelo resolve peça, contrato ou sistema real.

Tabela oficial do Gemini 3.8 Flash frente ao 3.7 Flash, ao Claude Opus 5, ao Claude Sonnet 5, ao GPT-5.6 Sol e ao GPT-5.6 Terra.
Tabela de 2 de setembro de 2026. Fonte: Logan Kilpatrick / Google.

No DeepSWE v1.1, engenharia de software em tarefas longas, o 3.8 Flash marca 73,7%. O 3.7 ficou em 65,3%. O Opus 5 lidera por pouco, com 74,0%. O GPT-5.6 Sol marca 72,7%. É o recorte em que o Flash mais se aproxima desses dois.

No Terminal-bench 4.0, agentes em geral, o quadro inverte. O 3.8 Flash marca 19,1%. O Opus 5, 51,8%. No OSWorld-2.0, uso de computador, 59,0% contra 75,4% do Opus. No GDPVal-AA v2, trabalho de conhecimento, o Elo do 3.8 é 1.545. O do Opus 5 é 1.824.

Na leitura de PDF (GDP.pdf), o 3.8 Flash marca 35,0%. O 3.7 tinha 34,0%. O GPT-5.6 Sol lidera, com 40,0%. O salto desta vez não está no documento.

Onde o Flash lidera o recorte da Google

No Vals Finance Agent v2, tarefas de analista financeiro, o 3.8 Flash marca 61,4%, à frente do 3.7 (59,0%) e do Opus 5 (58,6%).

Gemini 3.8 Flash marca 61,4% no Vals Finance Agent v2, à frente do 3.7 Flash, do Claude Opus 5 e dos GPT-5.6.
Vals Finance Agent v2. Fonte: Logan Kilpatrick / Google, 2 set 2026.

No HLE-Verified, raciocínio em várias áreas, o 3.8 Flash marca 54,9%. Opus 5, 54,4%. GPT-5.6 Sol, 54,5%. A diferença cabe no empate.

Gemini 3.8 Flash marca 54,9% no HLE-Verified, quase empatado com Opus 5 (54,4%) e GPT-5.6 Sol (54,5%).
HLE-Verified. Fonte: Logan Kilpatrick / Google, 2 set 2026.

No Harvey's Legal Agent Benchmark, fluxos jurídicos com arquivo e ferramenta, a métrica da tabela é o all-pass: a tarefa só conta se o modelo passa em todos os critérios. O 3.8 Flash marca 10,0% nesse recorte. O 3.7, 8,8%. O Opus 5, 6,7%. Lidera a tabela da Google. Em valor absoluto, nove em cada dez tarefas ainda falham. Serve para comparar esses modelos, não para usar o resultado sem conferir o original.

Gemini 3.8 Flash marca 10,0% no Harvey's Legal Agent Benchmark (all-pass), à frente do 3.7 Flash (8,8%) e do Opus 5 (6,7%).
Harvey's Legal Agent Benchmark. Fonte: Logan Kilpatrick / Google, 2 set 2026.

Preço e o que a tabela permite dizer

O 3.8 Flash não coloca a Google de volta no topo. Continua o modelo de volume: rápido, barato até o fim do ano, agora mais próximo de Opus e GPT em parte dos testes de código e de agente. A possibilidade de a empresa se reposicionar na fronteira existe. Depende do Pro, do uso real e dos testes em que o Flash ainda perde de longe.

Fonte: Anúncio oficial Introducing Gemini 3.8 Flash and 3.8 Flash Cyber (2 set 2026). Gráficos: Logan Kilpatrick. Antigravity. Ficha do modelo.