// ofensywne bezpieczeństwo agentów AI

Łamiemy autonomicznych agentów,żebyś umiał je utwardzić.

secagentlabs to niezależne laboratorium badawcze. Atakujemy autonomicznych agentów AI — łańcuchy prompt injection, exploity MCP i narzędzi, nadużycia tożsamości — a potem publikujemy odtwarzalne wyniki i obrony, które naprawdę działają.

~/secagentlabs — recon
$ ./secagentlabs --scope autonomous-agents
[*] mapping attack surface ...
[+] prompt injection (indirect)   reachable
[+] tool / function-call abuse     reachable
[+] mcp supply chain               reachable
[!] exfiltration path              confirmed
> hardening playbook ready
Attack chain: prompt injection → agent → tool call → exfiltrationinject01agent02tool03exfil04untrusted input ───▸ autonomous decision ───▸ privileged action ───▸ data leaves the boundary
atak

Łamiemy zabezpieczenia.

Odtwarzalne dowody koncepcji dla łańcuchów prompt injection, nadużyć narzędzi i wywołań funkcji, ataków zdezorientowanego zastępcy oraz wycieku danych przez agenta. Jeśli coś działa autonomicznie i sięga po narzędzie — traktujemy to jako cel.

obrona

Potem budujemy je mocniej.

Bariery ochronne, filtrowanie wejścia i wyjścia, narzędzia o minimalnych uprawnieniach oraz izolacja (seccomp, gVisor, WASM, microVM) — testowane przeciw powyższym atakom, łącznie z ich obejściami. Obrony, które wytrzymują przeciwnika, a nie listę kontrolną.

// obszary badań

Sześć frontów bezpieczeństwa agentów.

Badania w modelu hub-and-spoke na całej powierzchni ataku autonomicznych agentów — od pierwszego wstrzykniętego tokenu po ostatni bajt, który opuszcza granicę zaufania.

// metoda

Dowód, albo się nie wydarzyło.

01

Odtwarzalność

Każdy wynik dostaje dowód koncepcji, który da się uruchomić — nie zrzut ekranu, nie deklarację.

02

Niezależność

Żadnego sponsoringu w badaniach. Nazywamy to, co pęka, i to, co się broni — niezależnie od producenta.

03

Zgodność ze standardami

Wyniki wiążemy z CVE, publikacjami, OWASP Agentic i MITRE ATLAS — sprawdzalnie i cytowalnie.

kontakt — odpowiedzialne ujawnianie

Masz sposób na złamanie agenta?

Koordynujemy odpowiedzialne ujawnianie i cytujemy zgłaszających. Współpraca badawcza, sprostowania i tropy mile widziane — po polsku, angielsku lub niemiecku.

contact@secagentlabs.com