Cloudflare desarrolló un sistema de pruebas que permite a un modelo de lenguaje grande (LLM, por sus siglas en inglés; el tipo de IA que está detrás de ChatGPT) actuar como un hacker e intentar eludir su firewall de aplicaciones web (WAF). El sistema ejecutó 45 escenarios que incluían XSS, SQLi, CMDi, SSRF, LFI y Log4j en un entorno de pruebas, y generó 1.107 intentos de solicitud. Tras una revisión humana, 49 intentos se consideraron hallazgos reales; 48 correspondían a inyección de comandos o SSRF. El trabajo dio lugar a tres nuevas detecciones en el conjunto de reglas gestionadas, publicadas el 21 de julio.
Por qué importa
La prueba demuestra que la IA puede detectar rápidamente puntos débiles en un WAF y ayudar a Cloudflare a mejorar la protección de todos sus clientes.