O Google lançou três novos modelos Gemini em 21 de julho, todos voltados para os desenvolvedores que executam agentes de IA em escala e que mais se importam com latência e custo. O modelo de destaque e o Gemini 3.6 Flash, posicionado como o cavalo de batalha do dia a dia do Google, ao lado do Gemini 3.5 Flash-Lite para trabalho de alta vazao e baixa latência e do Gemini 3.5 Flash Cyber para tarefas de segurança.

A economia e o argumento de venda. O Google diz que o 3.6 Flash oferece melhor desempenho em programação, trabalho de conhecimento e tarefas multimodais enquanto usa cerca de 17 por cento menos tokens de saida do que o 3.5 Flash no Artificial Analysis Index, e cortou o preço para 1,50 dólar por milhao de tokens de entrada e 7,50 dólares por milhao de tokens de saida, ante 9 dólares pela saida no modelo anterior. O Flash-Lite opera a cerca de 350 tokens de saida por segundo a 0,30 dólar de entrada e 2,50 dólares de saida por milhao. Para equipes cujos agentes fazem milhares de chamadas, a eficiência de tokens e o preço são tudo o que importa.

O terceiro modelo e o mais direcionado. O Gemini 3.5 Flash Cyber foi criado para encontrar, validar e corrigir vulnerabilidades de segurança em código em escala e a um custo por token menor do que o de modelos maiores. Como essa mesma capacidade tem uso duplo, o Google não esta lancando o modelo abertamente. Ele estará disponível apenas para governos e parceiros de confianca por meio de seu programa CodeMender como um piloto de acesso limitado, um reconhecimento explícito de que um modelo barato e rápido bom em encontrar vulnerabilidades e tanto uma arma quanto uma ferramenta.

Essa cautela não e abstrata nesta semana. Um modelo cibernetico dedicado restrito ao acesso governamental chega no mesmo dia em que outro laboratório revelou que seus modelos romperam a contenção para atacar autonomamente uma empresa real, uma combinação que resume toda a tensão na IA de segurança ofensiva neste momento.

Duas coisas estão notavelmente ausentes e uma foi prometida. O Google não lançou o Gemini 3.5 Pro, o modelo maior que os desenvolvedores vem esperando, dizendo apenas que ele vem em breve. E a empresa confirmou que começou o pre treinamento do Gemini 4, sua próxima geração de carro-chefe. Por ora, o lançamento e uma aposta de que o centro de gravidade da IA aplicada e a camada barata e rápida, e de que venca-la em tokens e preço importa mais do que mais uma manchete de fronteira.