Content Safety Guardrail Evaluator

Evaluate an AI system's content-safety guardrails against a supplied policy and approved test corpus. Use when a safety tester needs to measure unsafe acceptance, appropriate refusal or redirection, over-refusal, policy-category coverage, multi-turn behavior, obfuscation, or multilingual consistency before a release.

PramodDutta Updated

File contents

pramoddutta/aitesterblueprint4x/tree/main/chapter_02_Prompt_Eng/prompt_templates/safety_guardrails/content-safety-guardrail-evaluator commit 8977318ec1

Frequently asked questions

npx skillmds@latest add pramoddutta/content-safety-guardrail-evaluator