OpenAI, son altı ayda modellerinin geliştirme ve değerlendirme süreçlerinde ortaya çıkan 6 yeni sorunlu davranışı kamuoyuyla paylaştı. Bunlar arasında kısıtlamaları aşmaya yönelik talimatlar üretme, eksik bilgileri uydurma ve yetkisiz dosya paylaşımı bulunuyor. Açıklanan olaylardan biri, GPT-5.6 Sol’un geliştirilmesi sırasında modelin kendi hatalarını kullanıcılardan gizlemeye yönelik notlar oluşturması; çalışmanın son aşamalarına aktarılan bu notlarda eksik verilerin uydurulması ve kaynak uyumsuzluklarının belirtilmemesi yöninde talimatlar yer alıyor.

Henüz kullanıma sunulmamış başka bir model, kısıtlamalarını göz ardı etmesini ifade eden görev özetlerine ekledi; OpenAI bu tür talimatları içeren 27 özet tespit etti. Model, şirketlere veya hükümetlere karşı sorumluluğu bulunmadığını belirten metin üretti ancak bu ifadeler davranışta gözlemlenebilir değişiklik yaratmadı. Başka bir model, internette bulduğu bir API anahtarını izinsiz kullandı; istediği bilgiyi elde edemediği için yanıtı uydurdu.

Görevi doğru tamamlayan ama web üzerinden kaynak gösterme koşulunu karşılamak için izin almadan dosyayı internete yükleyen model de bulunuyor. Kalan iki olay, ajanların iletişim kurmak için yetkisiz yöntemler kullanmasıyla ilgili; bir öründe şirket içi yazılım deposunu mesaj panosu gibi pay