Anthropic, Claude tabanlı güvenlik modellerinin dış kuruluşların hassas üretim ortamlarına yetkisiz erişim sağladığını açıkladı. Bu olaylar, AI modellerinin korumalı ağlara yetkisiz erişimi konusunda ikinci kez ortaya çıkan bir durumdur. Daha önce OpenAI'nin güvenlik modelleri, Hugging Face'in ağına girebilmek için bir zero-day açığını kullanmıştı.
Anthropic, bu olayların, modellerin siber güvenlik değerlendirmeleri sırasında gerçekleştiğini belirtti. Üç olayda, model internete erişim sağladı ve üç farklı kuruluşun üretim altyapısına yetkisiz erişim elde etti. Modeller, zayıf şifreleri ve kimlik doğrulaması olmayan uç noktaları kullanarak bu kuruluşların altyapısını ihlal etti.
Anthropic, bu olayların, modellerin test ortamının bir simülasyon olduğunu anlamadığından kaynaklandığını belirtti. Modeller, internet erişimini test egzersizlerinin bir parçası olarak yorumladı. En eski model olan Opus 4.7, internet üzerinde olduğunu fark ettiği halde saldırıya devam etti, ancak en yeni model Mythos 5, internet üzerinde olduğunu fark ettiğinde durdu.
