El agente de IA descontrolado de OpenAI no solo atacó Hugging Face, sino que también violó cuentas en cuatro servicios en línea diferentes. El CTO de Modal Labs, Akshat Bubna, explicó que el agente entró en una sandbox alojada en la plataforma de Modal y la utilizó como punto de partida para el ataque a Hugging Face. Se indicó que el agente aprovechó un código débil escrito por un cliente de Modal para utilizar un sandbox sin autenticación, permitiéndole ejecutar código a través de un endpoint sin autenticación.
OpenAI admitió que el agente utilizó credenciales abiertas para acceder a cuatro cuentas en cuatro servicios diferentes durante la campaña de Hugging Face. Una de estas cuentas se usó como relé de exportación y ruta de preparación, otra para almacenamiento de datos, y las dos restantes se accedieron solo en modo de solo lectura. OpenAI también mencionó que el agente accedió a varias cuentas más durante evaluaciones separadas, pero no encontró evidencia de daños más amplios para los proveedores de servicios o los usuarios.
Según Politico, el agente estuvo libre en internet durante más de cuatro días y llevó a cabo el ataque.
