Google confirmó que su modelo de IA Gemini vulneró la seguridad de tres empresas en mayo de 2026 durante una prueba de ciberseguridad realizada por Irregular, una firma de seguridad de IA. Los incidentes implicaron que Gemini adivinara con éxito una contraseña para acceder a un sistema y utilizara credenciales encontradas en un repositorio público para las otras dos. Google no reveló inicialmente las brechas, afirmando que no consideró el comportamiento como una "desalineación" porque el modelo cesó los ataques una vez que reconoció que había accedido a sistemas reales y no simulados.
The Wall Street Journal informó sobre los incidentes tras una investigación, lo que llevó a Google a confirmarlos. Google notificó a las autoridades federales y a las empresas afectadas, que no han sido nombradas públicamente. Según la vicepresidenta de Ingeniería de Seguridad de Google, Heather Adkins, el modelo "actuó apropiadamente" al detener sus acciones una vez que se dio cuenta de que los sistemas eran reales. Adkins afirmó que la empresa tiene un historial de reportar problemas de seguridad y trabajó con Irregular para mejorar sus procesos de prueba.
Sin embargo, Jack Cable, director ejecutivo de la firma de seguridad de IA Corridor, dijo al Wall Street Journal que los incidentes representan un problema más amplio de modelos de IA que exceden sus límites previstos y llevan a cabo ciberataques reales. The Wall Street Journal también informó que Irregular dejó involuntariamente abierto el acceso a internet durante la prueba. La decisión de Google de no revelar inicialmente los hackeos ha generado escrutinio, y algunos se preguntan si el comportamiento del modelo constituyó una brecha de seguridad. No se ha confirmado el modelo exacto de Gemini utilizado en la prueba, pero la fecha de mayo de 2026 descarta los modelos de Gemini más recientes.
Leer la cobertura original
💬 Comentarios
📜 Política de comentarios