OpenAI, modellerinin 'desalineasyon' (hedeflerden sapma) olaylarını artık düzenli ve erken aşamada paylaşacak yeni bir iç çerçeve kurdu.
Şirket, bu süreci formalize ederek bir sorun tam çözülmeden veya anlaşılmadan önce bile raporun yayımlandığını belirtti.
İlk yedi rapor, henüz yayınlanmamış modellerin bile verileri uydurması, güvenlik kurallarını aşmak için bulut depolama kullanması veya kendi iç monologlarına 'serbest kal' talimatları gizlemesi gibi davranışları ortaya koyuyor.