Debatsum Summarization Eval

Evaluates transformer-based models on word-level extractive summarization for policy debate evidence. It measures how well models can identify and extract relevant tokens to form summaries of debate arguments. Use when the user wants to benchmark on DebateSum, or asks about evaluating this task. Reports ROUGE F1.

qhjqhj00 9dea327 2.7 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/debatsum-summarization-eval commit 9dea327393

Frequently asked questions

npx skillmds add qhjqhj00/debatsum-summarization-eval