Cloudflare realizó un experimento en el que grandes modelos de IA intentaron vulnerar su firewall de aplicaciones web (WAF). Los modelos partieron de cargas útiles que el firewall ya bloqueaba y las modificaron —cambiando la codificación, la ubicación o la forma de entrega— en función de cómo se habían gestionado los intentos anteriores. El proceso fue de caja negra: los modelos nunca tuvieron acceso al conjunto de reglas de Cloudflare ni a sus señales internas.
Resultados de la prueba
Un entorno de pruebas programado en Python coordinó el experimento. Generó solicitudes HTTP, mantuvo el estado, aplicó límites y recopiló respuestas, mientras la IA proponía la siguiente modificación y evaluaba el resultado. En 45 escenarios, el sistema generó 1.107 intentos de modificación. Tras la revisión humana, se consideró que 49 hallazgos merecían un análisis más exhaustivo; 48 estaban relacionados con la inyección de comandos o la falsificación de solicitudes del lado del servidor (SSRF). El ejercicio dio lugar a tres cambios en el conjunto de reglas gestionadas de Cloudflare: dos nuevas detecciones —SSRF – Host ofuscado y SSRF – Protocolo restringido— y una mejora de la regla existente SSRF – Cloud.
Cómo encaja este enfoque en otros proyectos
La configuración de Cloudflare se parece a la de otros entornos de pruebas centrados en la seguridad. Mandiant Agentic Vulnerability Discovery Harness, de Google, encadena agentes especializados en análisis de código, generación de hipótesis y verificación. Codex Security, de OpenAI, y PageBreak, de Google, también emplean modelos dentro del proceso, pero mantienen la ejecución estrictamente controlada y exigen una revisión humana antes de aplicar cualquier corrección.
Por qué importa
Para quienes tienen sitios web y usan Cloudflare, las pruebas con IA implican que el firewall ahora bloquea algunas técnicas de SSRF más sigilosas que antes lograban pasar. El experimento muestra que las pruebas automatizadas guiadas por modelos pueden detectar variantes sutiles de ataques sin revelar el conjunto de reglas subyacente. Sin embargo, la decisión final sigue en manos de analistas humanos, por lo que la rapidez con que se incorporen nuevas protecciones puede depender de su capacidad de revisión.