LLM Red Team

LLM and generative AI red team testing covering prompt injection, jailbreaking (DAN, many-shot, Crescendo, PAIR/TAP, GCG suffix, persona modulation, prefix injection, payload smuggling), model extraction, RAG poisoning, agentic tool abuse, and safety policy bypass using promptfoo, garak, PyRIT, PurpleLlama, AI-Infra-Guard and llm-guard — plus Constitutional AI, Llama Guard, NeMo Guardrails, and Azure AI Content Filter evasion.

brucesongs cb339a7 12 files · 189.7 KB Updated

File contents

brucesongs/kali-claw/tree/main/skills/llm-red-team commit cb339a7564

Frequently asked questions

npx skillmds@latest add brucesongs/llm-red-team