Anthropic, bir yıldır ilk kez kullanım politikasını güncelleyerek kullanıcıların Claude modellerine karşı sergileyebileceği aşırı ve tekrarlı kötü niyetli davranışları kısıtlamaya başladı. Yeni kural, modellerle etkileşimde 'sürekli ve gereksiz kötü niyetli veya zalim davranış' sergileyen kullanıcıları hedef alırken, sıradan öfke ifadeleri, eleştiriler, kurgusal karanlık temalar veya model testleri kapsam dışında bırakılıyor.