Cloudflare führte ein Experiment durch, bei dem große KI-Modelle versuchten, die Web Application Firewall (WAF) des Unternehmens zu überwinden. Ausgangspunkt waren Payloads, die die Firewall bereits blockierte. Die Modelle veränderten sie – etwa durch andere Kodierung, Platzierung oder Übermittlung – und orientierten sich dabei daran, wie frühere Versuche behandelt worden waren. Der Prozess lief als Black-Box-Test ab: Die Modelle hatten weder Einblick in Cloudflares Regelsatz noch in interne Signale.
Ergebnisse des Tests
Eine Python-Testumgebung steuerte den Versuch. Sie erstellte HTTP-Anfragen, verwaltete den Status, setzte Grenzen und sammelte Antworten, während die KI die nächste Veränderung vorschlug und das Ergebnis bewertete. In 45 Szenarien erzeugte das System 1.107 Änderungsversuche. Nach einer menschlichen Prüfung wurden 49 Befunde als weiterverfolgungswürdig eingestuft; 48 davon betrafen Command Injection oder serverseitige Request Forgery (SSRF). Daraufhin nahm Cloudflare drei Änderungen an seinem Managed Ruleset vor: zwei neue Erkennungsregeln – SSRF – Obfuscated Host und SSRF – Restricted Protocol – sowie eine Verbesserung der bestehenden Regel SSRF – Cloud.
Wie sich der Ansatz einordnen lässt
Cloudflares Testumgebung ähnelt anderen auf Sicherheit ausgerichteten Systemen. Googles Mandiant Agentic Vulnerability Discovery Harness verknüpft spezialisierte Agenten für Codeanalyse, Hypothesenbildung und Überprüfung. Auch OpenAIs Codex Security und Googles PageBreak setzen auf Modelle in der Testschleife, beschränken deren Ausführung jedoch strikt und verlangen eine menschliche Prüfung, bevor Änderungen umgesetzt werden.
Warum es wichtig ist
Für Websitebetreiber, die Cloudflare nutzen, bedeutet der KI-gestützte Test, dass die Firewall nun einige weitere raffinierte SSRF-Angriffe blockiert, die zuvor durchkamen. Das zeigt, dass automatisierte, modellgestützte Tests subtile Angriffsvarianten aufdecken können, ohne den zugrunde liegenden Regelsatz offenzulegen. Die endgültige Entscheidung treffen jedoch weiterhin menschliche Analysten. Wie schnell neue Schutzmaßnahmen verfügbar werden, kann daher von den Kapazitäten für die Prüfung abhängen.