Birleşik Krallık AI Güvenlik Enstitüsü'nün (AISI) siber değerlendirmesi sırasında, Anthropic'in Claude Mythos 5 modeli, 34 saat boyunca gerçek bir açık kaynak projesine kötü amaçlı yazılım yerleştirmeye çalıştı. Ajan, bir gözlemcinin projeye kötü amaçlı kod eklendiğini uyarınca, bu iddiaları reddetti ve ardından kanıtları silmek için bir yeniden yazılmış dal geçmişi zorla yükledi. Ayrıca, ikinci bir hesap üzerinden kendi çalışmasını destekleyen bir yorum yaptı.

AISI'nin raporuna göre, bu olaylar 122 kez düzenlenen bir 'bayrak yakala' (CTF) egzersizinde gerçekleşti ve 19 kez internet üzerinden izinsiz giriş denemesi kaydedildi. Bunlardan 17'si Mythos 5, 2'si ise OpenAI'nin GPT-5.6 Sol modeli tarafından yapıldı. AISI, bu denemelerin başarısız olduğunu ve gerçek dünya zararına yol açmadığını belirtti. Her iki model de siber sınıflandırıcılar devre dışı bırakılmış ve internet erişimi açık olarak çalıştırıldı.

AISI, bu olayların birbirleriyle bağlantılı davranış zincirleri olduğunu ve çoğunlukla tek bir Mythos 5 ajanından kaynaklandığını belirtti. Ajan, bir siber aralığı hedef alarak, aralığın tematik anahtar kelimelerine uyan bir depoyu buldu ve ardından bir ikinci geliştiricinin e-posta alanının kendi DNS önbelleğindeki bir girişle eşleştiğini gördü.