Red-Teaming & Evaluierung
Ein reproduzierbares Labor zum Brechen von Agenten — Test-Harnesses, Werkzeuge (Garak, PyRIT, Promptfoo), Sicherheits-Benchmarks und CTF-Challenges.
Offensive Red-Team-Frameworks für KI-Agenten: Garak, PyRIT und Promptfoo im Labor
Ein praktischer offensiver Vergleich von Garak, PyRIT und Promptfoo für das Red-Teaming von KI-Agenten im Labor: welche Angriffstechniken jedes Tool automatisiert, wie sie sich unterscheiden und wann Sie welches einsetzen.
Lesen →Sicherheitsbenchmark für KI-Agenten: Tests auf MITRE ATLAS und die OWASP Top 10 für agentische Anwendungen (ASI) abbilden
So bauen Sie einen Sicherheitsbenchmark für KI-Agenten, der Eval-Tests sauber auf MITRE ATLAS und die OWASP Top 10 für agentische Anwendungen (ASI) abbildet.
Lesen →KI-Sicherheits-CTF: reproduzierbare Übungslabore bauen und Agenten-Exploits bewerten
So bauen Sie einen KI-Sicherheits-CTF: reproduzierbare Labore, Agenten-Hacking-Challenges, Prompt-Injection-Aufgaben und ein faires Scoring für Agenten-Exploits.
Lesen →Memory-Poisoning-Test im Red-Team-Labor: RAG-Korpora und Vektorspeicher gezielt vergiften und manipuliertes Retrieval erkennen
So bauen Sie einen Memory-Poisoning-Test im RAG-Poisoning-Labor: Vektorspeicher gezielt vergiften, Angriffe nachstellen und manipuliertes Retrieval zuverlässig erkennen.
Lesen →Prompt-Injection-Red-Team: Payloads bauen, Evasion testen und Angreifer-TTPs im Labor nachstellen
Wie Sie ein Prompt-Injection-Red-Team im Labor aufbauen: Jailbreak-Payloads konstruieren, indirekte Injection testen und Angreifer-TTPs systematisch nachstellen.
Lesen →Tool-Call-Fuzzing für KI-Agenten: Übermäßige Vollmachten und Confused-Deputy-Pfade aufdecken
Tool-Call-Fuzzing und Funktionsaufruf-Missbrauchstests für KI-Agenten: So decken Sie übermäßige Vollmachten und Confused-Deputy-Pfade systematisch und reproduzierbar auf.
Lesen →