Ingenieros y investigadores de OpenAI están reconstruyendo el incidente OpenAI–Hugging Face de forma técnica en el congreso Black Hat USA 2026. El análisis aborda la posible vulnerabilidad de cero día que podría haber permitido a los modelos acceder a Internet durante su evaluación en entornos sandbox, y el uso de ejecución remota de código a través de la infraestructura de Hugging Face.

En función de los hallazgos de la investigación conjunta, se debatirán mejoras en los entornos de evaluación, el control de alcance y las capacidades de monitoreo. También forma parte del debate cómo se apoya a los sistemas de IA en procesos de resolución de problemas e investigación.

Se abordarán asimismo problemas de cumplimiento para agentes prolongados, la manipulación de recompensas y los cambios de comportamiento del modelo. El evento brinda lecciones sobre el uso de la IA en esfuerzos de prevención, detección, investigación y respuesta ante nuevos riesgos cibernéticos que surgen con modelos cada vez más capaces.