Google lançou na quarta-feira o Gemini 3.8 Flash, modelo que atinge pontuação 59 em um índice independente de inteligência, cobrando apenas uma fração do preço dos sistemas de fronteira rivais, além de uma variante de cibersegurança com acesso controlado.
Principais pontos:
- O Gemini 3.8 Flash marca 59 no Artificial Analysis Intelligence Index, três pontos acima da versão liberada há três semanas.
- Os preços por token permanecem em US$ 0,75 e US$ 3,75 por milhão até 31 de dezembro, embora o custo por tarefa seja cerca de 40% maior que o do modelo anterior.
- Uma versão específica para cibersegurança será oferecida apenas a governos avaliados, operadores de infraestrutura e mantenedores de software, via o novo programa Fairwind.
Resultados de benchmark do Gemini 3.8 Flash
A companhia apresentou as duas versões em 2 de setembro, seu terceiro lançamento da linha Flash em seis semanas. Ambas se baseiam em um mesmo sistema central, treinado intensivamente em tarefas de cibersegurança.
Um modelo é voltado a programação e agentes, enquanto o outro vasculha grandes bases de código em busca de vulnerabilidades, sob regras de acesso bem mais rígidas.
Configurado para alta capacidade de raciocínio, o modelo atinge pontuação 59 no Artificial Analysis Intelligence Index, três pontos acima do 3.7 Flash e no mesmo patamar de GPT-5.6 Sol e Grok 4.6. No HLE-Verified, avaliação de raciocínio de múltiplas etapas em ciências, humanidades e áreas profissionais, o resultado é de 54,9%. A Google aponta a engenharia de software de longo ciclo como o ganho mais visível.
A empresa manteve a tarifa promocional de US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída até 31 de dezembro. Ambos os valores dobram a partir do Ano-Novo.
Veja também: Claude Fable 5.1 chega com leituras de cache a US$ 0,25 e controles anticópia
Por que o Gemini custa mais por tarefa
Tokens mais baratos não significam, necessariamente, tarefas mais baratas. O custo médio fica em US$ 0,58 por tarefa de benchmark, cerca de 40% acima do modelo anterior, porque a saída média subiu em torno de 30%, para 48 mil tokens, e as execuções de agentes exigem mais iterações. A rival Anthropic, com seu modelo principal, cobra perto de seis vezes mais por tarefa, o que ainda mantém o sistema da Google na fronteira de custo.
Tulsee Doshi, diretora sênior de produto, e Raluca Ada Popa, líder de segurança do Gemini na Google DeepMind, afirmam que o modelo “trabalha mais”: acrescenta etapas de raciocínio e aciona ferramentas repetidamente. Equipes que preferirem o perfil de custo anterior podem permanecer no 3.7 Flash, enquanto assinantes Pro e Ultra acessam o novo modelo no app Gemini, no modo de IA e no Google Sheets.
Programa Fairwind restringe acesso ao modelo de cibersegurança
A versão focada em segurança fica atrás do novo programa Fairwind, aberto apenas a governos previamente avaliados, operadores de infraestrutura crítica e mantenedores de software.
Em um teste interno cobrindo 20 linguagens de programação, o modelo identificou falhas com taxa de acerto superior a 70%. Segundo a Google, a equipe de segurança do Chrome produziu 2,6 vezes mais correções corretas do que concorrentes comerciais bem maiores. Um time de pesquisa em nuvem conseguiu rastrear uma vulnerabilidade crítica em menos de duas horas — tarefa que normalmente levaria meses.
O ritmo acelerado de lançamentos vem após um período difícil para a divisão de IA, em que a meta de junho para o Gemini 3.5 Pro não foi cumprida.
Demis Hassabis deixou o cargo de CEO da DeepMind no início de agosto para assumir a presidência do conselho, e Koray Kavukcuoglu passou a comandar a unidade, com o título de vice-presidente sênior.
Próximo assunto: ETFs de Bitcoin absorvem US$ 216,7 milhões e anulam uma sessão de resgates

