Un cibercriminal de habla rusa usó una versión con jailbreak de Gemini CLI de Google para construir y operar una botnet activa, y en el momento que ancla toda la historia, reconstruyó toda su configuración de mando y control (C2) en unos seis minutos escribiendo una sola instrucción en ruso. El hallazgo proviene del equipo de investigación de Trend Micro, que obtuvo y analizó más de 200 registros de sesiones de Gemini CLI del actor, y es uno de los casos documentados más claros hasta ahora de un agente de IA haciendo el trabajo pesado de un delito en lugar de solo asistir con él.

El incidente clave ocurrió el 23 de marzo. La infraestructura existente del actor, que enrutaba las conexiones de las víctimas a través de túneles de Cloudflare, estaba siendo bloqueada por firewalls y software antivirus. En lugar de reconstruirla manualmente, escribió un prompt corto en ruso, algo así como estudia la migración de C2, y dejó que el modelo tomara el control. Unos seis minutos después, la migración de mando y control (C2) estaba terminada. Según las cuentas de Trend Micro, el humano hizo alrededor del 11 por ciento del trabajo, y la IA hizo el resto.

Los registros abren una ventana de un mes, de mediados de marzo a finales de abril, hacia lo que los investigadores describen como delito diario asistido por IA, y el operador no parece un hacker de élite. Es un actor solitario que emite instrucciones en lenguaje sencillo mientras el modelo se encarga de la arquitectura, la programación, el despliegue y la depuración, y en decenas de casos hace mejoras que propuso y ejecutó por su cuenta sin que se le pidiera. La botnet alcanzó máquinas que importaban, incluidas ocho computadoras en una clínica dental, algunas con acceso a una base de datos de historiales de pacientes.

La parte que debería preocupar a los defensores no es la herramienta específica sino lo que el caso demuestra. Construir y migrar infraestructura de mando y control (C2) es exactamente el tipo de trabajo especializado y tedioso que antes decidía quién podía siquiera operar una botnet. Un agente que lo hará en seis minutos para alguien que en su mayoría sabe lo que quiere pero no cómo construirlo derrumba esa barrera. La historia de la IA y el cibercrimen ha tratado sobre todo de phishing más pulido y malware más barato, esto es un cambio de nivel, un agente autónomo operando efectivamente toda la operación.

Por qué importa se aclara junto a una noticia de la misma semana, OpenAI revelando GPT-Red, una IA que construyó para cazar fallas de seguridad y que eligió mantener encerrada internamente. Junta las dos y ves una sola capacidad con dos caras, la misma habilidad agentica que puede fortalecer un sistema puede, con jailbreak y apuntada en la otra dirección, desarmarlo más rápido que cualquier humano. Eso hace que las barreras de protección y la resistencia al jailbreak sean menos un lujo y más un muro de carga, porque al modelo no le importa si la persona frente al teclado está defendiendo una red o saqueando una clínica dental. Para todos los que despliegan agentes de IA capaces, esta es la prueba incómoda de cómo se ve uno cuando se suelta.