Ml Research Engineer Safeguards

Guides ML/research engineering for safeguards—safety classifier development, harm benchmarks and eval suites, labeled dataset design, fine-tuning and ablations, calibration and slice analysis, attack-surface research memos, and promotion criteria for new moderation models. Use when building or evaluating guardrail models, designing safety benchmarks, measuring precision/recall on policy categories, comparing mitigation techniques, or writing research reports on classifier improvements—not for production inference gateways (ml-infrastructure-engineer-safeguards), PII/leakage privacy research (privacy-research-engineer-safeguards), red-team attack campaigns (ai-redteam), AI governance policy (ai-risk-governance), general non-safety research (ai-researcher), or token-efficiency studies (research-engineer-scientist-tokens).

daemon-blockint-tech 25db826 7 files · 13.7 KB Updated

File contents

daemon-blockint-tech/agentic-enteprises-skill/tree/main/ml-research-engineer-safeguards commit 25db8263b1

Frequently asked questions

npx skillmds@latest add daemon-blockint-tech/ml-research-engineer-safeguards