Anthropic'in Opus 5 modeli, prompt enjeksiyonu saldırılarına karşı daha dirençli olduğu IPI benchmark testlerinde kanıtlandı. Testlerde, Opus 5, 15 denemede saldırının başarılı olma olasılığını %5.5'ten %2.0'a, tek denemede ise %0.5'ten %0.2'ye indirdi. Bu sonuçlar, Opus 5'i test edilen en dirençli modele çıkardı.

Opus 5, Sonnet 5 (%5.9) ve Mythos 5 (%2.6) modellerini de geride bıraktı. Non-Claude modeller arasında en dirençli olan Muse Spark, 15 denemede %16.5 başarılı saldırı oranı ile Opus 5'in sekiz katı saldırıya uğradı. GPT 5.6 Sol modeli ise GPT 5.5 (%20.8) ile benzer performans gösterdi ve 15 denemede %20.0 başarılı saldırı oranı ile Opus 5'in 10 katı saldırıya uğradı.

Diğer GPT 5.6 modelleri Terra (%30.4) ve Luna (%43.9) ise daha az dirençli çıktı. Tek denemede GPT 5.6 Sol'un başarılı saldırı oranı %3.1 ile Opus 5'in 15 denemede aldığı %2.0 başarılı saldırı oranından daha yüksek oldu.