Anthropic, cuma günü yayımladığı yeni bir makaleyle yapay zekâ modellerinin başka yapay zekâ modelleri tarafından eğitilmesine dair erken bir uygulama örneği sundu.
Fellows programındaki araştırmacı Chen Yueh-Han'ın yürüttüğü çalışmada, otomatik sistemler belirli hizalama kıyaslamalarında model performansını güvenilir biçimde artırdı.
Yanlış hizalanmış davranışlara yönelik 10 kıyaslamanın tamamında, genel performansı düşürmeden iyileşme sağlandığı belirtiliyor.
