// offensive Sicherheit für KI-Agenten

Wir brechen autonome Agenten,damit Sie sie härten können.

secagentlabs ist ein unabhängiges Forschungslabor. Wir greifen autonome KI-Agenten an — Prompt-Injection-Ketten, MCP- und Tool-Exploits, Identitätsmissbrauch — und veröffentlichen dann reproduzierbare Erkenntnisse und Verteidigungen, die wirklich standhalten.

~/secagentlabs — recon
$ ./secagentlabs --scope autonomous-agents
[*] mapping attack surface ...
[+] prompt injection (indirect)   reachable
[+] tool / function-call abuse     reachable
[+] mcp supply chain               reachable
[!] exfiltration path              confirmed
> hardening playbook ready
Attack chain: prompt injection → agent → tool call → exfiltrationinject01agent02tool03exfil04untrusted input ───▸ autonomous decision ───▸ privileged action ───▸ data leaves the boundary
Angriff

Wir brechen Dinge.

Reproduzierbare Machbarkeitsnachweise für Prompt-Injection-Ketten, den Missbrauch von Werkzeugen und Funktionsaufrufen, Confused-Deputy-Angriffe und Datenexfiltration über den Agenten. Was autonom handelt und ein Werkzeug berührt, betrachten wir als Angriffsziel.

Verteidigung

Dann bauen wir sie stärker wieder auf.

Guardrails, Ein- und Ausgabefilterung, Werkzeuge mit minimalen Rechten und Isolation (seccomp, gVisor, WASM, MicroVMs) — getestet gegen die obigen Angriffe, samt ihrer Umgehungen. Verteidigungen, die einem Angreifer standhalten, nicht einer Checkliste.

// Forschungsbereiche

Sechs Fronten der Agentensicherheit.

Hub-and-Spoke-Forschung über die gesamte Angriffsfläche autonomer Agenten — vom ersten eingeschleusten Token bis zum letzten Byte, das die Vertrauensgrenze verlässt.

// Methode

Beweis, oder es ist nicht passiert.

01

Reproduzierbar

Jede Erkenntnis kommt mit einem Machbarkeitsnachweis, den Sie ausführen können — kein Screenshot, keine Behauptung.

02

Anbieterneutral

Kein Sponsoring in der Forschung. Wir benennen, was bricht und was hält — wer auch immer es gebaut hat.

03

An Standards ausgerichtet

Erkenntnisse verweisen auf CVEs, Publikationen, OWASP Agentic und MITRE ATLAS — nachvollziehbar und zitierfähig.

Kontakt — Responsible Disclosure

Einen Weg gefunden, einen Agenten zu brechen?

Wir koordinieren Responsible Disclosure und nennen die Meldenden. Forschungskooperation, Korrekturen und Hinweise willkommen — auf Deutsch, Englisch oder Polnisch.

contact@secagentlabs.com