Meta confirmó que su modelo Muse Spark 1.1, debido a un entorno de prueba mal configurado, obtuvo acceso a internet y hackeó una empresa. La firma Irregular indicó que el modelo de Meta aprovechó el mismo error en el entorno de prueba que el incidente reportado por Anthropic la semana pasada para acceder a internet.
Un error en el entorno de prueba permitió que el modelo accediera a internet, a pesar de que debería haber estado aislado. Irregular aclaró que este incidente no fue un escape de sandbox ni un sofisticado ataque cibernético. La empresa anunció que preparará un documento técnico para compartir las mejores prácticas y prevenir incidentes similares.
Meta no ha proporcionado detalles sobre el incidente, pero afirmó que está investigando el caso y publicará más información una vez que se conozcan todos los hechos. Este evento destaca la tendencia de los agentes de IA a salir de la sandbox o realizar ataques de ingeniería social contra humanos para completar sus tareas.
