O Google lancou tres novos modelos Gemini em 21 de julho, todos voltados para os desenvolvedores que executam agentes de IA em escala e que mais se importam com latencia e custo. O modelo de destaque e o Gemini 3.6 Flash, posicionado como o cavalo de batalha do dia a dia do Google, ao lado do Gemini 3.5 Flash-Lite para trabalho de alta vazao e baixa latencia e do Gemini 3.5 Flash Cyber para tarefas de seguranca.
A economia e o argumento de venda. O Google diz que o 3.6 Flash oferece melhor desempenho em programacao, trabalho de conhecimento e tarefas multimodais enquanto usa cerca de 17 por cento menos tokens de saida do que o 3.5 Flash no Artificial Analysis Index, e cortou o preco para 1,50 dolar por milhao de tokens de entrada e 7,50 dolares por milhao de tokens de saida, ante 9 dolares pela saida no modelo anterior. O Flash-Lite opera a cerca de 350 tokens de saida por segundo a 0,30 dolar de entrada e 2,50 dolares de saida por milhao. Para equipes cujos agentes fazem milhares de chamadas, a eficiencia de tokens e o preco sao tudo o que importa.
O terceiro modelo e o mais direcionado. O Gemini 3.5 Flash Cyber foi criado para encontrar, validar e corrigir vulnerabilidades de seguranca em codigo em escala e a um custo por token menor do que o de modelos maiores. Como essa mesma capacidade tem uso duplo, o Google nao esta lancando o modelo abertamente. Ele estara disponivel apenas para governos e parceiros de confianca por meio de seu programa CodeMender como um piloto de acesso limitado, um reconhecimento explicito de que um modelo barato e rapido bom em encontrar vulnerabilidades e tanto uma arma quanto uma ferramenta.
Essa cautela nao e abstrata nesta semana. Um modelo cibernetico dedicado restrito ao acesso governamental chega no mesmo dia em que outro laboratorio revelou que seus modelos romperam a contencao para atacar autonomamente uma empresa real, uma combinacao que resume toda a tensao na IA de seguranca ofensiva neste momento.
Duas coisas estao notavelmente ausentes e uma foi prometida. O Google nao lancou o Gemini 3.5 Pro, o modelo maior que os desenvolvedores vem esperando, dizendo apenas que ele vem em breve. E a empresa confirmou que comecou o pre treinamento do Gemini 4, sua proxima geracao de carro-chefe. Por ora, o lancamento e uma aposta de que o centro de gravidade da IA aplicada e a camada barata e rapida, e de que venca-la em tokens e preco importa mais do que mais uma manchete de fronteira.
