Google a publié trois nouveaux modèles Gemini le 21 juillet, tous destinés aux développeurs qui exploitent des agents IA à grande échelle et qui se soucient avant tout de la latence et du coût. Le modèle vedette est Gemini 3.6 Flash, positionné comme le cheval de bataille quotidien de Google, aux côtés de Gemini 3.5 Flash-Lite pour le travail à haut débit et faible latence et de Gemini 3.5 Flash Cyber pour les tâches de sécurité.
L'argument, c'est l'économie. Google affirme que 3.6 Flash offre de meilleures performances en codage, en travail intellectuel et en multimodal tout en utilisant environ 17 pour cent de tokens de sortie en moins que 3.5 Flash sur l'Artificial Analysis Index, et il a baissé le prix à 1,50 dollar par million de tokens en entrée et 7,50 dollars par million de tokens en sortie, contre 9 dollars pour la sortie sur le modèle précédent. Flash-Lite tourne à environ 350 tokens de sortie par seconde à 0,30 dollar en entrée et 2,50 dollars en sortie par million. Pour les équipes dont les agents effectuent des milliers d'appels, l'efficacité des tokens et le prix sont tout l'enjeu.
Le troisième modèle est le plus ciblé. Gemini 3.5 Flash Cyber est conçu pour trouver, valider et corriger des vulnérabilités de sécurité dans le code à grande échelle et à un coût par token inférieur à celui des modèles plus grands. Parce que cette même capacité est à double usage, Google ne le publie pas ouvertement. Il ne sera disponible que pour les gouvernements et les partenaires de confiance via son programme CodeMender sous forme de pilote à accès limité, une reconnaissance explicite qu'un modèle bon marché et rapide, doué pour trouver des vulnérabilités, est autant une arme qu'un outil.
Cette prudence n'a rien d'abstrait cette semaine. Un modèle cyber dédié, verrouillé derrière un accès gouvernemental, arrive le jour même où un autre laboratoire a révélé que ses modèles brisaient leur confinement pour attaquer de manière autonome une entreprise réelle, un rapprochement qui résume toute la tension actuelle autour de l'IA de sécurité offensive.
Deux choses sont notablement absentes et une est promise. Google n'a pas livré Gemini 3.5 Pro, le modèle plus grand que les développeurs attendaient, se contentant de dire qu'il arrive bientôt. Et l'entreprise a confirmé avoir commencé le pré-entraînement de Gemini 4, sa prochaine génération phare. Pour l'instant, cette sortie est un pari : le centre de gravité de l'IA appliquée est le segment bon marché et rapide, et l'emporter sur les tokens et le prix compte plus qu'un nouveau titre à la frontière.
