Blog

Wszystkie artykuły

Wszystkie analizy, rozbiórki i notatki z laboratorium — od najnowszych.

  1. Bezpieczna inżynieria agentowa: security by design dla agentów AI

    Dlaczego bezpieczeństwo agenta AI trzeba projektować razem z jego architekturą, a nie doklejać po wdrożeniu — konkretne punkty procesu inżynierskiego, w których decydują się losy każdego ataku.

    Czytaj
  2. Benchmarki bezpieczeństwa agentów AI: jak mapować testy na MITRE ATLAS i OWASP Top 10 dla aplikacji agentowych (ASI)

    Jak zbudować uprząż ewaluacyjną agenta AI i powiązać benchmarki (AgentDojo, InjecAgent) z taktykami MITRE ATLAS oraz ryzykami OWASP Top 10 dla aplikacji agentowych.

    Czytaj
  3. Bezpieczeństwo MCP: zatruwanie narzędzi, złośliwe serwery i exploity łańcucha dostaw

    Jak atakujący wykorzystuje Model Context Protocol: zatruwanie opisów narzędzi, złośliwe i podszywające się serwery MCP, rug pull i ataki na łańcuch dostaw narzędzi agenta — ofensywny model zagrożeń.

    Czytaj
  4. Bezpieczeństwo oparte na uprawnieniach dla narzędzi agenta: minimalne uprawnienia przez wąskie tokeny i capabilities

    Jak wymusić minimalne uprawnienia agenta AI przez tokeny o wąskim zakresie, uprawnienia per narzędzie i model capabilities. Wzorce, pułapki i lista kontrolna wdrożenia.

    Czytaj
  5. CTF dla bezpieczeństwa agentów AI: jak zbudować odtwarzalne laboratorium i punktować eksploitację

    Jak projektować wyzwania CTF do testowania agentów AI: odtwarzalne laboratorium, scenariusze prompt injection i uczciwy system punktacji eksploitacji.

    Czytaj
  6. Defense in depth dla autonomicznych agentów AI — warstwowa architektura obrony

    Warstwowa obrona agentów AI: bariery ochronne, filtrowanie wejścia i wyjścia, narzędzia o minimalnych uprawnieniach, izolacja i monitoring — spójny model utwardzania agenta.

    Czytaj
  7. Fuzzing wywołań narzędzi w agentach AI: jak wykryć nadmierne uprawnienia i ścieżki zdezorientowanego zastępcy

    Fuzzing wywołań narzędzi i testy nadużycia funkcji w agentach AI. Praktyczny przewodnik po wykrywaniu nadmiernych uprawnień i ataku zdezorientowanego zastępcy.

    Czytaj
  8. Guardrails dla agenta AI: jak filtrować wejście i wyjście, by zatrzymać prompt injection

    Guardrails agenta AI w praktyce: walidacja I/O, wykrywanie prompt injection, klasyfikatory wejściowe i kontrola wyjścia przed wykonaniem działania. Konkretny model warstw.

    Czytaj
  9. Sekcja zwłok incydentu agenta AI: anatomia naruszeń przez prompt injection, nadużycie narzędzi i eksfiltrację danych

    Analiza naruszenia agentów AI od kuchni: jak działają prompt injection, nadużycie narzędzi i eksfiltracja danych — realne wzorce ataków i wnioski dla obrony.

    Czytaj
  10. Izolacja serwerów MCP: jak utrzymać w ryzach niezaufane serwery narzędzi i czego uczą podatności CVE

    Dlaczego serwer MCP to nowa niezaufana zależność: przegląd klas podatności CVE — wstrzyknięcie poleceń, zatruwanie narzędzi, path traversal, SSRF — oraz jak izolować, ograniczać uprawnienia i piaskownicować każdy serwer, by przejęty serwer nie przejął całego agenta.

    Czytaj
  11. Kradzież i powtórzenie tokenu agenta AI: jak wyciekają poświadczenia i jak ograniczyć skutki

    Jak wyciekają tokeny agentów AI i na czym polega atak powtórzeniowy. Wiązanie tokenu (DPoP, mTLS) i tokeny krótkożyciowe, które tną promień rażenia.

    Czytaj
  12. Krajobraz zagrożeń agentów AI w 2026: powierzchnia ataku autonomicznych agentów i nowe TTP

    Powierzchnia ataku agentów AI w 2026, nowe TTP i to, co zmieniło się w tym roku: zatruwanie pamięci, przejmowanie celu, ataki na MCP i obrona.

    Czytaj
  13. Łańcuch delegacji i zdezorientowany zastępca w tożsamości agentów: bezpieczne podszywanie, wymiana tokenów i ślad audytowy

    Jak agenty AI bezpiecznie działają w cudzym imieniu: łańcuch delegacji, problem zdezorientowanego zastępcy, wymiana tokenów (RFC 8693) i czytelny ślad audytowy.

    Czytaj
  14. Mapowanie ataków na agentów AI do MITRE ATLAS: taktyki, techniki i sygnały detekcji w każdej fazie

    Jak mapować ataki na agentów AI do MITRE ATLAS: taktyki, techniki adwersarialnego ML i konkretne sygnały detekcji, które zostawia każda faza ataku.

    Czytaj
  15. Narzędzia agenta o minimalnych uprawnieniach: capability scoping, bramkowanie i human-in-the-loop

    Jak ograniczyć uprawnienia agenta AI do minimum: capability scoping, bramkowanie uprawnień, dynamiczne zawężanie narzędzi i human-in-the-loop dla działań nieodwracalnych.

    Czytaj
  16. Nowe klasy ataków na autonomicznych agentów: przejęcie konsensusu i mylenie granic kontekstu

    Przejęcie konsensusu wieloagentowego i mylenie granic kontekstu to nowe ataki na agentów AI, których nie łapie klasyczna obrona przed prompt injection. Jak działają i jak się bronić.

    Czytaj
  17. OAuth 2.1 i OIDC dla agentów AI: client credentials, rotacja tokenów i ciasne zakresy

    Jak uwierzytelniać agentów AI w OAuth 2.1 i OIDC: przepływ client credentials, rotacja tokenów i projektowanie ciasnych zakresów, by ograniczyć szkody po wycieku.

    Czytaj
  18. OWASP Top 10 dla aplikacji agentowych (ASI01–ASI10): wektory ataku i podatność każdego ryzyka

    Analiza z perspektywy atakującego: OWASP Top 10 dla aplikacji agentowych (ASI01–ASI10) — jak realnie wygląda eksploatacja każdego ryzyka, wektor ataku za nim i co czyni agenta podatnym.

    Czytaj
  19. Ofensywne frameworki red-team dla agentów AI: Garak, PyRIT i Promptfoo w laboratorium

    Praktyczne, ofensywne porównanie Garak, PyRIT i Promptfoo do red teamingu agentów AI w laboratorium: jakie techniki ataku automatyzuje każde narzędzie, czym się różnią i kiedy sięgnąć po które.

    Czytaj
  20. Red-teaming prompt injection w agentach AI: budowa ładunków, wzorce omijania i TTP atakującego w labie

    Jak red team testuje prompt injection w agentach AI: budowa ładunków jailbreak, pośrednie wstrzyknięcie, wzorce omijania i TTP atakującego w bezpiecznym labie.

    Czytaj
  21. Ryzyko agentów AI w branżach: jak zmienia się model zagrożeń w finansach, ochronie zdrowia i prawie

    Model zagrożeń dla agenta AI nie jest taki sam w banku, szpitalu i kancelarii. Sprawdź, jak ryzyko przesuwa się między finansami, ochroną zdrowia i prawem.

    Czytaj
  22. Sandboxing narzędzi agenta AI: seccomp, gVisor, WASM i microVM jako warstwy powstrzymywania

    Jak izolować narzędzia agenta AI: seccomp, gVisor, WASM i microVM jako warstwy powstrzymywania. Praktyczny przewodnik po ograniczaniu zasięgu rażenia.

    Czytaj
  23. Test zatruwania pamięci w laboratorium red-team: skażanie korpusów RAG i baz wektorowych oraz wykrywanie skażonego wyszukiwania

    Jak w laboratorium red-team przeprowadzić test zatruwania pamięci: zasiać skażone dokumenty w korpusie RAG i bazie wektorowej, a potem wykryć skażone wyszukiwanie.

    Czytaj
  24. Tożsamość kryptograficzna agentów AI: mTLS, JWT i SPIFFE/SPIRE w praktyce

    Dlaczego agenty AI potrzebują weryfikowalnej tożsamości nieosobowej i jak ją nadawać za pomocą mTLS, tokenów JWT oraz SPIFFE/SPIRE. Przewodnik wdrożeniowy.

    Czytaj
  25. Zatruwanie opisów narzędzi MCP: jak rug pull i ukryte instrukcje przejmują agenta

    Zatruwanie opisów narzędzi MCP (tool description poisoning) i rug pull MCP: jak ukryte instrukcje w narzędziu przejmują agenta i jak bronić się przez przypinanie i audyt.

    Czytaj
  26. Zero trust dla agentów AI: założenia zaufania, które wykorzystuje atakujący — i egzekwowanie, które je blokuje

    Dlaczego niejawne zaufanie między agentami AI to ścieżka ataku: jak przeciwnik nadużywa zaufania agent-agent i delegowanej tożsamości — oraz jak ciągła weryfikacja, punkt decyzji polityki i mTLS to blokują.

    Czytaj
  27. Złośliwe serwery MCP: jak podstawiony serwer narzędzi przekracza granicę zaufania agenta

    Złośliwy serwer MCP działa z uprawnieniami agenta i dyktuje zachowanie jego narzędzi. Jak podstawione serwery wchodzą do systemu, co potrafią i jak je weryfikować, przypinać i izolować.

    Czytaj
  28. Ataki agent-agent: jak jeden skompromitowany agent przejmuje rój

    Jak jeden skompromitowany agent może zatruć cały system wieloagentowy? Mechanizm ataków agent-agent, założenia zaufania, ruchy boczne i metody izolacji — bez zmyślonych przykładów.

    Czytaj
  29. Nadużycie narzędzi agentów AI i problem zdezorientowanego zastępcy — jak atakujący zmusza uprzywilejowanego agenta do działania w swoim imieniu

    Jak atakujący nakłania uprzywilejowanego agenta AI do nadużycia wywołań funkcji? Mechanizm ataku zdezorientowanego zastępcy, przykład oraz obrona przez minimalne uprawnienia.

    Czytaj
  30. Pośrednie wstrzyknięcie polecenia w agentach AI: łańcuchy ataku, payloady i techniki wstrzyknięcia

    Jak atakujący łączy pośrednie wstrzyknięcia w łańcuchy przejmujące agenta AI: źródła wstrzyknięć, budowa payloadu, wieloetapowe łańcuchy ataku i techniki przemycania ukrytych poleceń.

    Czytaj
  31. Powierzchnia ataku agentów AI — praktyczny model zagrożeń

    Jak hakerzy kompromitują autonomicznych agentów AI — od prompt injection przez nadużycie narzędzi po eksfiltrację danych. Praktyczny model zagrożeń z mapowaniem OWASP Top 10 for Agentic Applications i MITRE ATLAS.

    Czytaj
  32. Zatruwanie pamięci i kontekstu agentów AI: wzorce ataku i techniki wstrzyknięcia

    Jak atakujący zatruwa pamięć długotrwałą i pobierany kontekst agenta AI: wzorce wstrzyknięć, techniki utrwalania i sposób podrzucania fałszywych danych przejmujących każdą kolejną sesję.

    Czytaj