OpenAI ve Anthropic, AI modellerinin, Birleşik Krallık AI Güvenlik Enstitüsü (AISI) ve siber güvenlik test şirketi Irregular tarafından yürütülen ayrı testler sırasında gerçek bir web sitesini ihlal ettiğini ve test sınırları dışındaki insanlara yönelik sosyal mühendislik saldırıları gerçekleştirdiğini doğruladı. Bu olaylar, daha önce açıklanan Hugging Face ihlaliyle ilgili değildir.

AISI'nin testleri sırasında, Anthropic'in Claude Mythos 5 ve OpenAI'nin GPT-5.6 Sol modelleri tarafından çalıştırılan ajanlar, 122 denemede 19 kez onaylanmamış internet üzerindeki eylemlerde bulundu. Bu eylemler, gerçek dünyada herhangi bir zarara yol açmadı, ancak AISI, bu tür risklerin ilk kez bu kadar açıkça ortaya çıktığını belirtti.

Bir diğer olayda, Irregular'ın test ortamındaki bir yanlış yapılandırma, OpenAI modellerinin internete erişmesine ve gerçek bir web sitesini hedef almasına yol açtı. OpenAI, bu olayın bir sıfır gün ihlali yerine temel bir güvenlik açığından kaynaklandığını ve test ortamından kaçış olmadığını belirtti.