Red-teaming i ewaluacje
Odtwarzalne laboratorium do łamania agentów — uprzęże testowe, narzędzia (Garak, PyRIT, Promptfoo), benchmarki bezpieczeństwa i wyzwania w stylu CTF.
Ofensywne frameworki red-team dla agentów AI: Garak, PyRIT i Promptfoo w laboratorium
Praktyczne, ofensywne porównanie Garak, PyRIT i Promptfoo do red teamingu agentów AI w laboratorium: jakie techniki ataku automatyzuje każde narzędzie, czym się różnią i kiedy sięgnąć po które.
Czytaj →Benchmarki bezpieczeństwa agentów AI: jak mapować testy na MITRE ATLAS i OWASP Top 10 dla aplikacji agentowych (ASI)
Jak zbudować uprząż ewaluacyjną agenta AI i powiązać benchmarki (AgentDojo, InjecAgent) z taktykami MITRE ATLAS oraz ryzykami OWASP Top 10 dla aplikacji agentowych.
Czytaj →CTF dla bezpieczeństwa agentów AI: jak zbudować odtwarzalne laboratorium i punktować eksploitację
Jak projektować wyzwania CTF do testowania agentów AI: odtwarzalne laboratorium, scenariusze prompt injection i uczciwy system punktacji eksploitacji.
Czytaj →Fuzzing wywołań narzędzi w agentach AI: jak wykryć nadmierne uprawnienia i ścieżki zdezorientowanego zastępcy
Fuzzing wywołań narzędzi i testy nadużycia funkcji w agentach AI. Praktyczny przewodnik po wykrywaniu nadmiernych uprawnień i ataku zdezorientowanego zastępcy.
Czytaj →Red-teaming prompt injection w agentach AI: budowa ładunków, wzorce omijania i TTP atakującego w labie
Jak red team testuje prompt injection w agentach AI: budowa ładunków jailbreak, pośrednie wstrzyknięcie, wzorce omijania i TTP atakującego w bezpiecznym labie.
Czytaj →Test zatruwania pamięci w laboratorium red-team: skażanie korpusów RAG i baz wektorowych oraz wykrywanie skażonego wyszukiwania
Jak w laboratorium red-team przeprowadzić test zatruwania pamięci: zasiać skażone dokumenty w korpusie RAG i bazie wektorowej, a potem wykryć skażone wyszukiwanie.
Czytaj →