Cloudflare a mené une expérience au cours de laquelle de grands modèles d’IA ont tenté de contourner son pare-feu applicatif (WAF). Les modèles sont partis de charges utiles déjà bloquées par le pare-feu, puis les ont modifiées — en changeant leur encodage, leur emplacement ou leur mode de transmission — selon la réaction aux tentatives précédentes. Le processus fonctionnait en boîte noire : les modèles n’ont jamais eu accès aux règles de Cloudflare ni à ses signaux internes.
Résultats du test
Un environnement de test en Python a orchestré l’expérience. Il construisait des requêtes HTTP, conservait leur état, imposait des limites et recueillait les réponses, tandis que l’IA proposait la modification suivante et en évaluait le résultat. Au fil de 45 scénarios, le système a généré 1 107 tentatives de modification. Après examen par des humains, 49 résultats ont été jugés dignes d’un suivi, dont 48 concernaient l’injection de commandes ou la falsification de requêtes côté serveur (SSRF). L’exercice a entraîné trois changements dans le Managed Ruleset de Cloudflare : deux nouvelles détections — SSRF – Obfuscated Host et SSRF – Restricted Protocol — ainsi qu’une amélioration de la règle SSRF – Cloud existante.
Comment cette approche s’inscrit dans le paysage
Le dispositif de Cloudflare ressemble à d’autres environnements de test axés sur la sécurité. Mandiant Agentic Vulnerability Discovery Harness de Google enchaîne des agents spécialisés dans l’analyse de code, la formulation d’hypothèses et leur vérification. Codex Security d’OpenAI et PageBreak de Google font également intervenir un modèle, tout en encadrant étroitement son exécution et en exigeant une vérification humaine avant l’application de toute correction.
Pourquoi c'est important
Pour les propriétaires de sites qui utilisent Cloudflare, ces tests pilotés par l’IA permettent désormais au pare-feu de bloquer quelques techniques SSRF plus discrètes qui lui échappaient jusque-là. Ils montrent que des tests automatisés guidés par des modèles peuvent mettre au jour des variantes d’attaque subtiles sans révéler les règles sous-jacentes. Toutefois, la décision finale revient toujours à des analystes humains : la rapidité de déploiement des nouvelles protections peut donc dépendre de leur capacité à examiner les résultats.