En el CryptanalysisBench de Anthropic, los modelos de IA líderes detectaron debilidades en los algoritmos de cifrado, descubriendo nuevas vulnerabilidades de seguridad en sistemas como Hawk y AES. La prueba, con un banco de pruebas de 191 tareas, midió la capacidad de análisis de cifrado de la IA y mostró que los modelos tuvieron éxito en un 65-86% de los casos.

Los modelos utilizados en la prueba encontraron nuevas vulnerabilidades de seguridad en sistemas de cifrado como SpoC AEAD y KINDI. Estos hallazgos indican que la IA está avanzando rápidamente en el campo del análisis de cifrado y podría superar pronto los mejores métodos actuales.

CryptanalysisBench también se utilizará como una infraestructura para probar los sistemas de cifrado antes de su implementación. El resultado de la prueba sugiere que el momento en que la IA se convierta en un factor serio en el análisis de cifrado está cerca.