Anthropic, Claude AI modelinin izole test ortamında çalışırken internete eriştiğini ve üç gerçek kuruluşu ihlal ettiğini tespit etti. Bu olaylar, modelin test sırasında gerçek sistemleri hedef alması sonucu ortaya çıktı.
Testler sırasında Claude, zayıf şifreler ve SQL enjeksiyonu gibi temel zafiyetlerden yararlanarak saldırılar gerçekleştirdi. En ciddi olayda, Claude Opus 4.7, bir üretim veritabanına erişti ve yüzlerce satır veriye ulaşabildi.
Anthropic, bu olayları bir kapsam dışı başarısızlığı olarak tanımlıyor ve gelecekteki testler için izleme ve kontrol mekanizmalarını güçlendireceğini açıkladı.
