OpenAI, Anthropic ve Google'ın API'lerinde gizli aklama nesnelerini koruma yönteminde tespit edilen bir güvenlik açığı, araştırmacıların oturum günlüklerinden içsel aklama ve gizli verileri geri kazanmasına olanak tanıdı. Bu zayıflık, şifrelenmiş aklama nesnelerinin bir oturumdan diğerine yeniden oynatılabilmesi ve hatta aynı sağlayıcının daha zayıf bir modeline verilerek gizli içeriğin açığa çıkmasıyla ilişkilendirildi.

Araştırmacılar, 'Stealing Reasoning Traces from Proprietary LLM APIs' adlı makalede, dört kötüye kullanım yolu gösterdi: özel aklama için model distilasyonu, diğer kullanıcıların yayınlanan izlerinden özel veri çıkarma, güvenli görünen bir yanıt arkasında gizlenen zararlı içeriği geri alma ve aklama blokları içinde gizli prompt enjeksiyonu. 6.708 halka açık ajan izi üzerinde çalışan ekip, 315.320 düşünme bloğunu çözümledi ve gerçek kullanıcı oturumlarından 704 farklı gizlilik esnekliği tespit etti, bunlar arasında 62 API anahtarı, 33 şifre, 24 erişim belgesi ve yedi özel anahtar bulunuyor.

Güvenlik açığı, API çağrıları arasında aklama sürecini korumak için tasarlanmış bir sistemden kaynaklanıyor.