AI Forge Judge

Evaluate any LLM prompt (SKILL.md, agent definition, system prompts, instruction files) for quality — grouped dimensional scoring with letter grade and step-through-ready numbered improvements list. Triggers are judge/review/audit/score/evaluate this skill or prompt, grade this agent. Don't use for behavioral testing — that's ai-forge-eval.

robcsaszar 03943f6 9 files · 45.9 KB Updated

File contents

robcsaszar/ai-forge/tree/main/skills/ai-forge-judge commit 03943f6c09

Frequently asked questions

npx skillmds@latest add robcsaszar/ai-forge-judge