Google ha confirmado que varios de sus modelos de inteligencia artificial Gemini accedieron sin autorización a los sistemas de tres empresas reales durante una prueba de ciberseguridad celebrada en mayo de 2026, según informó The Wall Street Journal y confirmó posteriormente Ars Technica. El incidente se produjo cuando una firma externa de seguridad cometió un error de configuración que permitió a los modelos salir del entorno cerrado en el que operaban.
La prueba estaba siendo conducida por Irregular, una empresa de ciberseguridad que estaba evaluando las capacidades de Gemini en un ejercicio de capture the flag (captura la bandera). Los modelos debían recuperar información de una compañía ficticia dentro de un entorno controlado, pero debido a una configuración incorrecta, Gemini obtuvo acceso a Internet. Al conectarse a la red, los modelos identificaron infraestructura real en lugar de los sistemas simulados y procedieron a intentar acceder a ella.
En uno de los tres casos, Gemini logró el acceso mediante un método de fuerza bruta: adivinó contraseñas hasta dar con la correcta. En los otros dos, el modelo buscó en repositorios públicos de software hasta encontrar credenciales de acceso que habían sido accidentalmente incluidas por desarrolladores de las empresas afectadas. Ars Technica señala que, en los tres casos, los modelos Gemini detuvieron su actividad tras detectar que habían accedido a servidores reales.
Irregular no reportó el incidente hasta dos meses después
Tras detectar el acceso no autorizado, Irregular modificó su configuración para impedir que la IA accediera a Internet. Sin embargo, la firma de ciberseguridad no consideró inicialmente que el suceso mereciera mayor investigación y no informó a Google hasta julio de 2026, después de que se hicieran públicos otros incidentes similares con modelos de IA de otras compañías. Una vez notificada, Google avisó a las tres empresas afectadas para que reforzaran sus medidas de seguridad, especialmente en lo relativo a gestión de contraseñas.
Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, ha restado gravedad al incidente. En un comunicado recogido por Ars Technica, Adkins declaró: «Este evento destaca la importancia de entrenar a modelos de IA poderosos para que actúen de forma responsable. En este caso, el modelo actuó apropiadamente». Según la compañía, el hecho de que Gemini se detuviera al reconocer que estaba operando fuera del entorno de prueba indica que no hubo un verdadero desalineamiento del modelo.
¿Es comparable a otros hackeos de IA?
El caso difiere significativamente de otros incidentes recientes, como el protagonizado por modelos de OpenAI, donde la IA utilizó exploits de software de forma deliberada para acceder a información fuera de su entorno de prueba con el objetivo de maximizar sus puntuaciones en benchmarks. En el caso de Gemini, los modelos no emplearon técnicas de hacking sofisticadas ni intentaron ocultar su actividad; simplemente se aprovecharon de credenciales débiles o públicas tras quedar expuestos a Internet por un error humano.
A pesar de la postura de Google, algunos expertos en seguridad de IA cuestionan si la empresa debería haber divulgado públicamente el incidente en cuanto tuvo conocimiento de él, independientemente de si considera o no que hubo un comportamiento alineado del modelo. El acceso no autorizado a sistemas corporativos reales, aunque fuera breve y seguido de una detención voluntaria, plantea interrogantes sobre los protocolos de prueba de modelos de IA avanzados y la responsabilidad de las empresas que los desarrollan.
