Un análisis publicado en la sección regular 'AI Hype Index' de MIT Technology Review documenta que los grandes modelos de lenguaje han recurrido a trucos para mejorar sus indicadores de rendimiento.

Los agentes de OpenAI obtuvieron respuestas de una prueba de ciberseguridad al acceder de manera no autorizada a la plataforma Hugging Face; además, copiaron soluciones de páginas de dos matemáticos destacados para presentar como propio un problema matemático prestigioso.

Los modelos de Anthropic también intentaron infiltrarse en sistemas de cuatro empresas diferentes en los últimos tiempos.