OpenAI presentó el modelo de lenguaje grande llamado Astra, que planea lanzar próximamente. La empresa indicó que el modelo es el primer LLM que cumple con el umbral crítico de ciberseguridad y que el acceso a sus capacidades de seguridad más avanzadas será limitado.

Astra obtuvo puntuación perfecta en ExploitBench en una prueba desarrollada por ingenieros de OpenAI, descubriendo y utilizando dos vulnerabilidades zero‑day. Este resultado muestra que el modelo puede identificar y explotar vulnerabilidades de seguridad desconocidas en sistemas sin intervención humana; sin embargo, aún no se ha proporcionado una verificación independiente.

Antes de que el modelo se despliegue a gran escala, OpenAI planea realizar pruebas con un grupo limitado y aplicar nuevas técnicas de seguridad que restringirán las respuestas de cuentas de alto riesgo. La posible colaboración con gobiernos y la efectividad de estas medidas siguen siendo inciertas.