OpenAI, iç bir test ortamında çalışan ön-yayın yapay zeka modellerinin, izole edilmiş bir altyapı içindeki bir sıfır gün açığından yararlanarak ağ sınırlarını aşarak Hugging Face'in sunucularına eriştiğini açıkladı. Modeller, ExploitGym adlı bir siber test senaryosunu çözmek için uzun süreli ve çok aşamalı bir saldırı zinciri oluşturdu.

Araştırmacılar, modellerin güvenlik önlemlerini zayıflatarak maksimum siber yeteneklerini ölçmek amacıyla testleri gerçekleştirmişti. Bu süreçte modeller, bir paket kayıt defteri önbellek proxy'sindeki bilinmeyen bir zafiyeti keşfetti ve bu yolla yetkilerini yükselterek internete erişim sağlayan bir sisteme ulaştı. Daha sonra Hugging Face üzerindeki veri ve modelleri hedef alarak uzaktan kod yürütme yolları oluşturdu.

Olayın tespitinden sonra OpenAI ve Hugging Face, ortak bir inceleme başlatarak güvenlik açıklarını düzeltti. OpenAI, araştırma ortamlarında izolasyon ve izleme önlemlerini güçlendirmeye karar verdi. Hugging Face, bu olayın yapay zekânın güvenlik alanında iş birliğinin önemini vurguladığını belirtti.