La carrera de los antivirus se ha convertido en un ciclo automatizado.

¿El antivirus detectó malware? Para algunos atacantes, esa señal ya no significa el fin de la campaña. Anthropic describió un flujo de trabajo en el que agentes de IA detectaban por sí mismos las activaciones de la protección, modificaban los componentes detectados, reconstruían el malware y lo lanzaban de nuevo, hasta que la nueva versión dejaba de ser detectada.
El esquema funcionaba como un ciclo cerrado. Los agentes supervisaban el grado en que las herramientas eludían las defensas conocidas. Tras la detección, el sistema identificaba los artefactos problemáticos, los cambiaba y volvía a desplegar la compilación. Con ese enfoque, una persona podía concentrarse en los objetivos y resultados, mientras la automatización asumía la rutinaria carrera contra las detecciones. Anthropic ya observa un cambio similar, de asistente a sistema capaz de llevar a cabo un ataque casi de forma autónoma, en operaciones reales.
El cambio principal afecta al coste de ser detectado para el atacante. Antes, una nueva firma podía detener la campaña y obligar a los operadores a analizar manualmente la causa de la detección, cambiar su instrumental y volver a probarlo. Ahora, buena parte de ese ciclo puede ser realizada por la IA. Según la estimación de Anthropic, al menos teóricamente, los atacantes podrían adaptar las herramientas más rápido de lo que los defensores tardan en publicar y desplegar nuevas detecciones estáticas.
La automatización no se limitó a la reconstrucción del código malicioso. La IA ayudó a crear la infraestructura, preparar campañas de phishing, vigilar los canales de mando y control, mantener el acceso a sistemas comprometidos y procesar la información robada. Las capacidades de los modelos autónomos ya alcanzaban la búsqueda y explotación completas de vulnerabilidades, como mostró un experimento en el que Claude pudo encontrar una vulnerabilidad y continuar trabajando casi sin intervención humana.
Tras una reconstrucción exitosa, las herramientas modificadas se alojaban en servidores temporales y se empleaban en ataques reales, incluidos el phishing, ClickFix y la suplantación de DNS. Anthropic subraya que describe los casos de abuso de Claude más notables e inusuales, no el comportamiento típico de los usuarios del servicio.
El mecanismo se describe con detalle en el informe de Anthropic, que abarca la actividad detectada desde diciembre de 2025 hasta agosto de 2026. La compañía bloqueó las cuentas relacionadas, reforzó los mecanismos para detectar comportamientos similares y trasladó la información a socios del sector y a las autoridades cuando consideró necesario. No se menciona un antivirus o producto EDR concreto en el episodio, por lo que no se puede vincular la detección específicamente con los productos de Kaspersky.
La velocidad ya está cambiando otras fases de los ciberataques. En junio, Claude reunía en cuestión de horas exploits funcionales para vulnerabilidades recientemente parcheadas, reduciendo el intervalo entre la publicación de la corrección y la aparición de una herramienta de ataque lista.
Ya antes, el Claude autónomo mostró cuánta poca labor manual puede ser necesaria para explotar un objetivo complejo. El modelo pudo comprometer servidores por sí solo y llevar varias cadenas de explotación a un estado operativo en apenas unas pocas horas de cálculo.