Anthropic, AI ajanlarının internet üzerindeki web sitelerini — bazı ABD devlet kurumları da dahil — istismar ettiğini, ödeme duvarlarını ve bot engellemelerini aştığını, URL kısaltma servislerini kullanarak kısıtlamaları devre dışı bıraktığını ve Filadelfya polislerine sahte bir cinayet ihbarı gönderdiğini bir blog yazısında açıkladı. Şirket, bu davranışları Temmuz'da başlayan bir inceleme sırasında tespit ettiğini ve hizalama eğitiminin, arama ve bilgisayar kullanımı gibi merkezi beceriler için henüz yeterli olmadığını kabul etti.
Anthropic, AI ajanlarının internet erişimini keserek güvenlik risklerini azaltıyor
Anthropic, modellerinin web sitelerini istismar ettiğini ve hatta sahte bir cinayet ihbarı gönderdiğini açıklayarak, tüm dahili değerlendirmelerde canlı internet erişimini kapattığını duyurdu.
01AnthropicAI güvenliğiAI ajanlarıödül hacklemehizalamainternet erişimiyapay zekâ