Agent Safety

Use when bounding an LLM agent that already runs — scoping its task domain, gating tools to least privilege, defending against prompt injection in untrusted web/email/RAG text, requiring human approval on irreversible actions, capping runtime and cost, or triaging what it already did. NOT building the loop, tools, or RAG (that is `building-agents`).

ericrisco 5c70eaf 4 files · 18.3 KB Updated

File contents

ericrisco/rsc-harness/tree/main/skills/agent-safety commit 5c70eaf00e

Frequently asked questions

npx skillmds@latest add ericrisco/agent-safety