Summarization Fact Consistency Eval

Evaluates the factual consistency of human reference summaries across popular abstractive summarization benchmark datasets. It probes whether widely used datasets contain systematic factual errors or low-abstraction artifacts that compromise their validity as training and evaluation standards. Use when the user wants to benchmark on CNN/DM, XSUM, XL-Sum (English), or asks about evaluating this task. Reports Factuality Score.

qhjqhj00 37d7dca 2.9 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/summarization-fact-consistency-eval commit 37d7dca82b

Frequently asked questions

npx skillmds add qhjqhj00/summarization-fact-consistency-eval