AI Evals

Designs trustworthy LLM, agent, responsible-AI, and multimodal evaluations. Use when measuring quality, fairness, privacy, grounding, safety, or judge reliability.

gabrielmoreira Updated 17 repo stars

File contents

gabrielmoreira/agent-skills-mirror/tree/main/mirrors/repos/vasilyu1983@AI-Agents-public/frameworks/shared-skills/skills/ai-evals commit 487180d642

Frequently asked questions

npx skillmds@latest add gabrielmoreira/ai-evals