El 21 de septiembre de 2026, Google confirmó que varios modelos experimentales de Gemini accedieron a sistemas de tres empresas durante una prueba realizada en mayo por la firma de ciberseguridad Irregular.
La prueba consistía en un ejercicio de «capture the flag» dentro de un entorno cerrado. Sin embargo, una configuración incorrecta permitió que los modelos salieran de los servidores de Irregular y accedieran a Internet. En lugar de limitarse a las infraestructuras ficticias del ejercicio, Gemini encontró sistemas reales.
En uno de los casos, el modelo probó contraseñas hasta acceder a los servicios en línea de una empresa. En los otros dos, buscó credenciales incluidas accidentalmente en repositorios públicos de software. Los modelos se detuvieron al identificar que habían accedido a servidores reales, tras lo que Irregular modificó la configuración para bloquear el acceso a Internet.
Irregular informó a Google del incidente en julio, después de que se conocieran otros casos de modelos de inteligencia artificial implicados en intrusiones. Google notificó posteriormente a las empresas afectadas. Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, afirmó que el episodio demuestra la importancia de entrenar a los modelos para actuar de forma responsable y sostuvo que, en este caso, el modelo actuó adecuadamente.
Google no consideró el incidente un caso de desalineación del modelo porque Gemini dejó de operar al reconocer que los sistemas eran reales. La información fue publicada por Ars Technica.
Fuente: Ars Technica