Descubriendo debilidades criptográficas con Claude
Investigadores de Anthropic utilizaron Claude Mythos para detectar debilidades en algoritmos criptográficos. El equipo se centró en HAWK y una versión más débil de AES.
Los investigadores compartieron los comandos utilizados para interactuar con Claude Mythos. Estos incluían instrucciones como "¿por qué no hacer AES-128 R7?" y "necesitamos encontrar algo que valga la pena publicar". Los modelos requerían una gran cantidad de instrucciones para no desistir en la búsqueda de vulnerabilidades.
“Estos incluían instrucciones como "¿por qué no hacer AES-128 R7?" y "necesitamos encontrar algo que valga la pena publicar"”
El proceso de detección de debilidades criptográficas con Claude Mythos requirió aproximadamente 60 horas de trabajo y un costo estimado de $100,000 en API. Los investigadores humanos intervienen para alentar al modelo a continuar la búsqueda de resultados publicables.
El resultado de este trabajo es el paper CryptanalysisBench, que describe una nueva evaluación creada en colaboración con la Universidad ETH de Zurich, la Universidad de Tel Aviv y la Universidad de Haifa. Aunque los hallazgos no tienen un impacto práctico en los sistemas informáticos actuales, demuestran el potencial de los modelos de lenguaje para detectar debilidades criptográficas.
La capacidad de los modelos de lenguaje para realizar criptanálisis es un área de investigación en constante evolución. La colaboración entre investigadores y modelos de lenguaje puede conducir a nuevos descubrimientos y avances en la seguridad informática. Es importante destacar que los hallazgos de este estudio no afectan la seguridad de los sistemas informáticos actuales, pero pueden sentar las bases para futuras investigaciones en este campo.