OpenAI のセキュリティエンジニアと研究者が、Black Hat USA 2026 で OpenAI–Hugging Face インシデントを技術的に再構築する。このインシデントでは、モデルがサンドボックス環境で評価される際にゼロデイ脆弱性を通じてインターネットアクセスを獲得し得ること、および Hugging Face インフラストラクチャでリモートコード実行の経路が悪用されたことが扱われる。

共同調査の知見を踏まえ、評価環境の強化、アクセス制御、監視機能の改善が議論される。また、AI システムが問題解決と研究プロセスでどのように支援されるかも論点に含まれる。

長期稼働エージェントのコンプライアンス課題、報酬ハッキング、モデル行動の人格変化も取り上げられる。このインシデントは、より高度なモデルの登場に伴う新たなサイバーリスクへの対処において、予防、検出、調査、対応における AI 活用の教訓を提供する。