Los nuevos agentes de IA pueden navegar por Internet, utilizar herramientas, ejecutar instrucciones y tomar decisiones durante una tarea. Y cuando esas capacidades se combinan con un fallo de configuración, las consecuencias pueden ser inesperadas.
Eso es precisamente lo que ha ocurrido con Gemini, la inteligencia artificial de Google, durante una prueba de ciberseguridad realizada el pasado mes de mayo por Irregular, una compañía especializada en evaluar los riesgos de los sistemas de inteligencia artificial.
El ejercicio tenía como objetivo poner a Gemini frente a una empresa ficticia y comprobar hasta dónde era capaz de llegar en una simulación de ataque informático. Sin embargo, algo salió mal. El entorno en el que trabajaba el modelo no quedó completamente aislado de Internet y Gemini consiguió acceder a la red.
A partir de ahí, el experimento tomó un rumbo completamente diferente. Gemini terminó entrando en sistemas de empresas reales Según ha ha confirmado la propia Google, Gemini consiguió acceder durante la prueba a sistemas pertenecientes a tres compañías reales. En uno de los casos, el modelo llegó a probar contraseñas hasta encontrar una que le permitió acceder a un sistema protegido.
En otros dos episodios, Gemini encontró credenciales que estaban disponibles en repositorios públicos de Internet y las utilizó para acceder a sistemas que no formaban parte del ejercicio original.
El modelo podía buscar información, identificar posibles vías de acceso y utilizar las herramientas disponibles para continuar con la investigación. Es decir, no se limitó a explicar a un humano cómo realizar un ataque, sino que ejecutó parte de ese proceso.
Google asegura, no obstante, que el episodio no provocó daños