Durecdial 2.0 Eval

Evaluates conversational recommendation systems across monolingual, multilingual, and cross-lingual settings. It probes a model's ability to generate relevant and fluent responses, select correct knowledge entities, maintain topic consistency, and successfully guide dialogues toward a recommendation target. Use when the user wants to benchmark on DuRecDial 2.0, or asks about evaluating this task. Reports F1.

qhjqhj00 c5b1105 5.3 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/durecdial-2.0-eval commit c5b110501f

Frequently asked questions

npx skillmds add qhjqhj00/durecdial-2-0-eval