Los sistemas automatizados ya crean nuevas vulnerabilidades en vez de limitarse a copiar ciegamente errores humanos.

El modelo Claude Mythos Preview logró encontrar por sí solo un nuevo método de ataque contra una versión simplificada de uno de los algoritmos de cifrado más extendidos. La verificación no mostró una amenaza directa para los sistemas bancarios ni para la comunicación protegida, pero demostró lo rápido que la inteligencia artificial se aproxima a tareas que hasta hace poco se consideraban accesibles solo para especialistas en criptografía.
La empresa Anthropic probó el modelo en una variante debilitada del estándar AES. Este enfoque permite evaluar la resistencia del algoritmo real sin intentar vulnerar un sistema de protección completo. Claude Mythos Preview propuso un método que aceleró el ataque entre 200 y 1000 veces en comparación con los mejores resultados de trabajos anteriores.
AES protege el tráfico de internet, las redes inalámbricas, los repositorios de datos, las operaciones bancarias y la correspondencia privada. La vulnerabilidad encontrada no afecta a la versión del estándar que se utiliza hoy, por lo que los servicios modernos no corren un peligro inmediato. Sin embargo, la experiencia de Anthropic mostró que la IA ya es capaz de buscar nuevos métodos de criptoanálisis, no solo de reproducir soluciones conocidas.
Según el especialista de Anthropic Nicholas Carlini, hace apenas un año los modelos no podían resolver ni siquiera tareas que él resolvía en la adolescencia. Ahora, los sistemas más avanzados ofrecen resultados que antes no estaban descritos en trabajos científicos.
Al principio Claude Mythos Preview se negó a analizar la tarea porque consideró que no era posible mejorar los métodos existentes. Tras indicaciones adicionales, el modelo trabajó en la solución durante aproximadamente una semana y creó casi por completo de forma autónoma el nuevo ataque. Luego, dos especialistas verificaron los cálculos durante casi un mes y concluyeron que el método funciona correctamente.
El modelo también mejoró el ataque contra el sistema criptográfico HAWK. El algoritmo se desarrolla para proteger tanto frente a ordenadores convencionales como frente a computadoras cuánticas. HAWK todavía no se aplica en la práctica; sin embargo, el Instituto Nacional de Estándares y Tecnología de EE. UU. lo considera como un posible estándar futuro. Los autores de HAWK confirmaron el ataque encontrado, y criptógrafos independientes verificaron los resultados relativos a AES.
Antes de la publicación, Anthropic entregó el material al gobierno de EE. UU. y a socios del sector. La empresa limita el acceso a Claude Mythos Preview porque el modelo sabe encontrar y explotar vulnerabilidades en software. Desde abril el sistema se proporciona únicamente a ciertas instituciones y organizaciones estatales.
Los algoritmos criptográficos son la base de casi todas las operaciones protegidas en internet. Durante mucho tiempo, las computadoras cuánticas se consideraron la principal amenaza futura para estos algoritmos, porque pueden acelerar significativamente la búsqueda de claves. El trabajo de Anthropic muestra que un riesgo comparable podría surgir antes debido al rápido crecimiento de las capacidades de la inteligencia artificial.
El exasesor jurídico principal de la Agencia de Seguridad Nacional de EE. UU., Glenn Gerstell, estima que las capacidades de cómputo actuales no son suficientes para romper un cifrado resistente en un plazo razonable. Al mismo tiempo, los modelos evolucionan más rápido de lo previsto, por lo que no se puede descartar que dentro de unos años la IA pueda poner en duda la fiabilidad de los algoritmos en los que se sustenta la seguridad del internet moderno.