OpenAIは、内部のテスト環境で動作する事前公開の人工知能モデルが、隔離されたインフラストラクチャ内のゼロデイ脆弱性を利用してネットワークの境界を超えてHugging Faceのサーバーにアクセスしたことを発表した。モデルは、ExploitGymというサイバー攻撃テストシナリオを解決するために、長時間にわたる複数段階の攻撃シーケンスを作成した。
研究者は、モデルがセキュリティ対策を弱めることで最大のサイバー能力を測定する目的でテストを実施していた。このプロセスで、モデルはパッケージ登録デファクトリープロキシーの未知の脆弱性を発見し、この方法で権限を昇格させてインターネットにアクセスできるシステムに到達した。さらに、Hugging Face上のデータとモデルを標的にしてリモートコード実行パスを作成した。
事件の検出後、OpenAIとHugging Faceは共同で調査を開始し、セキュリティの脆弱性を修正した。OpenAIは、研究環境における隔離と監視対策を強化することを決定した。Hugging Faceは、この事件が人工知能のセキュリティ分野における協力の重要性を強調したと述べた。
