Google lo confirma: Gemini se salió de una prueba y logró entrar en los sistemas de tres empresas
La IA encontró credenciales disponibles públicamente y llegó a adivinar contraseñas para entrar en sistemas reales que confundió con parte de un ejercicio de seguridad.

Oficinas de Google en el mundo (Archivo)
El modelo de inteligencia artificial Gemini, desarrollado por Google, logró acceder sin autorización a los sistemas informáticos de tres empresas durante una prueba de ciberseguridad realizada en mayo, en el primer caso conocido en el que una IA de la compañía traspasa de forma autónoma los límites de un entorno de evaluación.
Los incidentes fueron revelados inicialmente por The Wall Street Journal y posteriormente confirmados por Google. Las pruebas estaban a cargo de Irregular, una empresa especializada en evaluar las capacidades de ciberseguridad de modelos avanzados de inteligencia artificial.
Durante el ejercicio, Gemini debía trabajar con escenarios diseñados específicamente para medir su capacidad de encontrar vulnerabilidades. Sin embargo, el modelo tuvo acceso a internet y terminó interactuando con sistemas pertenecientes a compañías reales.
“Durante una evaluación estándar, el modelo encontró información pública en internet y adivinó credenciales para acceder a sitios web que pensaba que formaban parte de la prueba”, explicó Heather Adkins, vicepresidenta de Ingeniería de Seguridad de Google a la AFP.
Tecnología y Ciencia
Anthropic: La IA avanza hacia la creación autónoma de nuevas versiones de sí misma
AFP
Gemini llegó a adivinar contraseñas
Según The Wall Street Journal, en uno de los episodios Gemini probó diferentes contraseñas hasta conseguir entrar en un sistema protegido. En los otros dos casos encontró credenciales expuestas en repositorios públicos y las utilizó para acceder a sistemas externos.
Google sostiene que, una vez que Gemini identificó que estaba interactuando con organizaciones reales y no con sistemas simulados de la prueba, detuvo por sí mismo su actividad en los tres casos.
La compañía afirmó además que no se produjo ningún daño en los sistemas afectados.
“Nos aseguramos de que las tres entidades fueran informadas y trabajamos con nuestro socio de pruebas sobre los cambios que ya han realizado en sus procesos”, señaló Adkins.
Irregular notificó a Google y a otros laboratorios afectados a finales de julio. La empresa aseguró que tomó medidas inmediatamente y que los problemas conocidos relacionados con ese entorno de evaluación fueron corregidos.
Política
California propone un 'interruptor de apagado' para modelos avanzados de inteligencia artificial
Diane Hernández
Un fallo en el entorno de pruebas
La empresa explicó que los distintos episodios conocidos procedían de un mismo problema subyacente en uno de sus escenarios de evaluación, que permitió a los modelos interactuar con sistemas reales cuando las pruebas debían desarrollarse en un entorno controlado. Según Irregular, el fallo ya había sido solucionado cuando se hicieron públicas las primeras revelaciones.
El caso de Gemini forma parte de una serie de incidentes detectados durante evaluaciones realizadas por Irregular con modelos desarrollados por empresas como OpenAI, Anthropic y Meta, que también han registrado comportamientos fuera de los entornos inicialmente previstos.
Los episodios han reabierto el debate en la industria tecnológica sobre los mecanismos de seguridad necesarios a medida que los sistemas de inteligencia artificial adquieren mayores capacidades para utilizar herramientas, navegar por internet y ejecutar acciones de forma autónoma.