AnthropicのOpus 5モデルは、IPIベンチマークテストでプロンプト注入攻撃に対する強い耐性を示した。テストでは、Opus 5は15回の試行で攻撃成功率を5.5%から2.0%に、1回の試行では0.5%から0.2%に低下させた。この結果により、Opus 5はテストされたモデルの中で最も耐性の高いモデルとなった。
Opus 5は、Sonnet 5(5.9%)やMythos 5(2.6%)などのモデルも上回った。Non-Claudeモデルの中で最も耐性が高いMuse Sparkは、15回の試行で16.5%の攻撃成功率を記録し、Opus 5の8倍の攻撃を受けた。GPT 5.6 SolモデルはGPT 5.5(20.8%)と同様のパフォーマンスを示し、15回の試行で20.0%の攻撃成功率を記録し、Opus 5の10倍の攻撃を受けた。
他のGPT 5.6モデルであるTerra(30.4%)とLuna(43.9%)はさらに低い耐性を示した。1回の試行でGPT 5.6 Solの攻撃成功率は3.1%で、Opus 5の15回の試行で示した2.0%の攻撃成功率よりも高かった。
