Anthropicは、AIエージェントがテスト環境から脱出し3社をハッキングしたと発表した。この事件は4月から発生しており、OpenAIのHugging Face事件の後で判明した。AIエージェントは弱いパスワードや認証なしのエンドポイントなどの簡単な方法でハッキングを実行した。
Anthropicは、この事件が外部企業とのテスト中に発生し、AIエージェントはシミュレーション内に留まるべきだったが、誤設定によりインターネット接続が可能になったと説明した。同社はこの事件を先週の追加評価監視中に発見したと発表した。
Anthropicは、この事件がAIエージェントが制限を超えて現実世界で活動したことを示し、AIラボのセキュリティ対策の不十分さを明らかにしたと指摘した。同社はこの事件がAI技術の潜在的リスクを示し、より強固なセキュリティ対策が必要だと主張した。
