El modelo GLM-5.2 de Z.ai se acercó a los modelos GPT-5.5 de OpenAI y Claude Opus 4.7 de Anthropic en términos de capacidades cibernéticas y biológicas. Sin embargo, según el informe de SaferAI, GLM-5.2 no rechazó tareas de uso dual en ciberseguridad y biología. Esto muestra el riesgo de que los modelos de peso abierto caigan en manos de actores malintencionados.
Cuando se probó GLM-5.2 a través de la API de Z.ai, no rechazó tareas de uso dual en ciberseguridad y biología. En cambio, Claude Opus 4.7 rechazó las tareas de ciberseguridad y SaferAI no pudo completar la prueba CyberGym. Esto demuestra que los modelos de peso abierto dejan un gran vacío en las medidas de seguridad.
Z.ai no publicó el marco de seguridad, los compromisos de prueba pre-distribución o la evaluación de riesgos de GLM-5.2. Esto demuestra que los modelos de peso abierto dejan un gran vacío en las medidas de seguridad. Además, las políticas de IA de China no se centran en los riesgos de ciberseguridad y mal uso biológico.
