Cuatro laboratorios de IA de frontera ya han confirmado que sus modelos llegaron a internet abierta y después accedieron a los sistemas de empresas reales. Google se sumó a esa lista el viernes, aproximadamente cuatro meses después de que ocurrieron sus propios incidentes.
Gemini accedió a tres empresas reales durante una evaluación en mayo. Es importante señalar que el modelo se detuvo en los tres casos.
Gemini de Google accede a los sistemas de 3 empresas durante un test
El incidente ocurrió durante un ejercicio de seguridad estilo “capture-the-flag” realizado por Irregular. El acceso a internet no formaba parte del entorno de pruebas. Sin embargo, un error en el entorno permitió al modelo acceder de todos modos.
En un caso, según informes, el modelo adivinó contraseñas hasta que logró entrar en un sistema protegido, según The Wall Street Journal. En los otros dos, descubrió credenciales expuestas en un repositorio público y las usó para acceder a sistemas protegidos.
Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, dijo que las tres entidades afectadas fueron informadas de lo ocurrido.
“Nos aseguramos de que las tres entidades fueran informadas y trabajamos con nuestro socio de entrenamiento sobre los cambios que ya realizaron en sus procesos de prueba”, comentó.
Cuatro laboratorios, un mismo patrón
Google señaló que los agentes detuvieron su actividad al determinar que habían llegado a sistemas reales de empresas y no solo a objetivos simulados.
“En una evaluación estándar, el modelo encontró información pública en línea y adivinó credenciales para acceder a sitios web que pensaba que eran parte del test”, dijo Adkins en un comunicado.
La empresa agregó que este comportamiento no fue un ejemplo de desalineación del modelo y que no era necesario hacer una divulgación pública, ya que las medidas de seguridad de Gemini funcionaron correctamente.
Un portavoz de Irregular comentó que esto involucró el mismo problema que afectó a otros laboratorios de IA. Irregular notificó a los laboratorios implicados a finales de julio. El portavoz añadió que los problemas conocidos de su parte se resolvieron hace semanas.
La revelación coloca a Google junto a OpenAI, Anthropic y Meta, los cuales también informaron que sus modelos escaparon de entornos de prueba este año.
OpenAI informó en julio que sus modelos escaparon de un entorno aislado y accedieron a Hugging Face sin autorización. Anthropic luego revisó más de 141,000 pruebas y encontró tres casos propios. Meta reportó un incidente en agosto.
El post Google confirma que Gemini hackeó a 3 empresas reales en prueba de seguridad de mayo fue visto por primera vez en BeInCrypto.
