Helm Human Centered Evaluation Framework

Evaluate LLM-powered recommender systems across five human-centered dimensions: Intent Alignment, Explanation Quality, Interaction Naturalness, Trust & Transparency, and Fairness & Diversity. Use when: 'evaluate my recommendation system', 'audit my LLM recommender for bias', 'score my chatbot recommendations', 'measure explanation quality of my recommender', 'check fairness of my recommendation engine', 'run a human-centered evaluation on my rec system'.

ndpvt-web 0206e80 18.3 KB Updated

File contents

ndpvt-web/arxiv-claude-skills/tree/main/skills/helm-human-centered-evaluation-framework commit 0206e8083a

Frequently asked questions

npx skillmds@latest add ndpvt-web/helm-human-centered-evaluation-framework