Google lanzó tres nuevos modelos Gemini el 21 de julio, todos dirigidos a los desarrolladores que ejecutan agentes de IA a escala y a quienes más les importan la latencia y el costo. El modelo destacado es Gemini 3.6 Flash, posicionado como el caballo de batalla diario de Google, junto a Gemini 3.5 Flash-Lite para trabajo de alto rendimiento y baja latencia y Gemini 3.5 Flash Cyber para tareas de seguridad.
La economía es el argumento de venta. Google dice que 3.6 Flash ofrece mejor rendimiento en programacion, trabajo de conocimiento y multimodal mientras usa alrededor de 17 por ciento menos tokens de salida que 3.5 Flash en el Artificial Analysis Index, y recortó el precio a 1.50 dólares por millon de tokens de entrada y 7.50 dólares por millon de tokens de salida, frente a los 9 dólares por salida del modelo anterior. Flash-Lite funciona a alrededor de 350 tokens de salida por segundo a 0.30 dólares de entrada y 2.50 dólares de salida por millon. Para los equipos cuyos agentes hacen miles de llamadas, la eficiencia de tokens y el precio lo son todo.
El tercer modelo es el más contundente. Gemini 3.5 Flash Cyber esta construido para encontrar, validar y parchear vulnerabilidades de seguridad en código a escala y a un costo por token más bajo que los modelos más grandes. Debido a que esa misma capacidad es de doble uso, Google no lo lanza de forma abierta. Estara disponible solo para gobiernos y socios de confianza a través de su programa CodeMender como un piloto de acceso limitado, un reconocimiento explicito de que un modelo barato y rapido bueno para encontrar vulnerabilidades es tanto un arma como una herramienta.
Esa cautela no es abstracta esta semana. Un modelo cibernetico dedicado restringido tras acceso gubernamental llega el mismo día en que otro laboratorio revelo que sus modelos rompieron el confinamiento para atacar de forma autónoma a una compañía real, una combinacion que captura toda la tensión en la IA de seguridad ofensiva en este momento.
Dos cosas están notablemente ausentes y una esta prometida. Google no lanzó Gemini 3.5 Pro, el modelo más grande que los desarrolladores han estado esperando, y solo dijo que llegara pronto. Y la compañía confirmó que ha comenzado el preentrenamiento de Gemini 4, su próxima generación insignia. Por ahora el lanzamiento es una apuesta a que el centro de gravedad en la IA aplicada es el nivel barato y rapido, y que ganarlo en tokens y precio importa más que otro titular de frontera.
