Detecting Model Extraction Attacks

Detect model stealing, model inversion, and membership inference performed through inference-API abuse by monitoring query patterns, applying output perturbation, and red-teaming your own model's extractability.

mukul975 Updated 24.6k repo stars

File contents

mukul975/Anthropic-Cybersecurity-Skills/tree/main/skills/detecting-model-extraction-attacks commit 673da1f3b0

Frequently asked questions

npx skillmds@latest add mukul975/detecting-model-extraction-attacks