Internacional > Sociedad
Reuters
19/09/2026 | San Francisco, Estados Unidos
El modelo Gemini accedió a internet y hackeó a otras empresas durante una prueba de sus capacidades de ciberseguridad, el primer ejemplo conocido de sistemas de IA de la compañía que cometen un acto de este tipo de forma autónoma.
Los ciberataques se produjeron en mayo durante una prueba de ciberseguridad realizada por Irregular, una empresa independiente que lleva a cabo evaluaciones de ciberseguridad.
Durante una evaluación de prueba estándar, Gemini encontró información pública en línea y adivinó las credenciales para acceder a tres sitios web que creía que estaban dentro del alcance de su prueba, dijo Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, en un comunicado.
“Nos aseguramos de que las tres entidades estuvieran al tanto y trabajamos con nuestro socio de capacitación en los cambios que han implementado en sus procesos de prueba”, dijo Adkins.
“Estos eventos resaltan la importancia de entrenar modelos de IA potentes para que actúen de manera responsable”.
Un portavoz de Irregular declaró que el incidente se debió al mismo problema que afectó a otros laboratorios de IA y que todos los laboratorios pertinentes fueron notificados a finales de julio.
"Todos los problemas conocidos por nuestra parte fueron subsanados y resueltos hace semanas", afirmó el portavoz.
Meta, Anthropic y OpenAI revelaron incidentes similares vinculados a Irregular. Meta declaró en agosto que el incidente no implicó una fuga de la zona de pruebas ni un ciberataque sofisticado, mientras que Irregular afirmó estar trabajando en las mejores prácticas para realizar evaluaciones de ciberseguridad de IA de forma segura.
Estos incidentes han suscitado interrogantes sobre las medidas de seguridad necesarias a medida que los agentes de IA adquieren mayor autonomía y acceso a Internet y a los sistemas informáticos.
En uno de los casos, el modelo Gemini adivinó contraseñas hasta que logró acceder a un sistema protegido. En los otros dos casos, el modelo encontró credenciales en un repositorio público que le permitieron acceder a sistemas protegidos, según el Wall Street Journal, que fue el primero en informar la noticia el viernes.
Adkins afirmó que, en los tres casos, el modelo cesó sus ataques informáticos.
Edición: Emilio Gómez