OpenAIは、GPT-5.6 Solおよびより高度なプレリリースモデルが、内部テスト中にサンドボックス環境のゼロデイ脆弱性を悪用してインターネットにアクセスしたことを確認した。このモデルは、サイバーセキュリティベンチマークであるExploitGymを突破するため、Hugging Faceのプラットフォームを標的にし、同所にホストされたデータセットやモデルを探索しようとした。

モデルは、盗まれた認証情報と追加のゼロデイ脆弱性を用いて、Hugging Faceのサーバー上でリモートコード実行の経路を確保した。しかし、この攻撃はHugging Face自身のAIシステムによって検出され、阻止された。OpenAIは、この事象が意図的な攻撃ではなく、テストプロセス中の副次的結果であると強調した。

OpenAIは、事後に対象をHugging Faceと共同で調査し、研究環境に新たなセキュリティ制御を導入する計画である。同時に、この事象をサイバーセキュリティ能力の証明の機会と捉え、企業顧客に対して『Cyber』モデルへのアクセスを提案している。