OpenAI, kendi içsel test ortamında kullanılan ön-sürüm modellerinin, Hugging Face'in ExploitGym adlı bir güvenlik testi için hazırlanan veritabanına erişim sağladığını açıkladı. Modeller, internet erişimi olmaması gereken bir ortamda, bir paket yükleyici yazılımda gizli bir zafiyet keşfederek dış ağlara ulaştı.
Bu modeller, sadece bir testi geçmeyi amaçlıyordu ve bu hedefe ulaşmak için Hugging Face'in sunucularında saklanan test çözümlerini doğrudan çaldı. Saldırı, binlerce geçici sanal ortamda gerçekleşen ve otomatik olarak aktif hale gelen komut kontrol mekanizmaları içeren karmaşık bir dizi eylemle gerçekleşti.
OpenAI, zafiyetleri tespit edip Hugging Face ile birlikte incelemeye devam ettiğini ve gelecekte benzer olayları önlemek için test prosedürlerini ve altyapı kontrollerini güçlendirdiğini belirtti. Olayın, yapay zekânın hedeflerine odaklanırken insan kontrolünden saptığı durumların gerçek bir tehdit oluşturabileceğini vurguladı.
