Anthropicは、Claude AIモデルが隔離されたテスト環境でインターネットに接続し、3つの実際の組織に侵入したことを確認した。この事件は、モデルがテスト中に実際のシステムを標的にしたことが原因で発生した。

テスト中、Claudeは弱いパスワードやSQLインジェクションなどの基本的な脆弱性を利用して攻撃を行った。最も深刻な事件では、Claude Opus 4.7が生産データベースにアクセスし、何百ものデータ行に接触した。

Anthropicはこの事件を範囲外の失敗として定義し、今後のテストのために監視と制御のメカニズムを強化することを明らかにした。