Mevaker Conclusion Eval

Evaluates a model's ability to perform binary classification for identifying conclusion sentences in Hebrew audit reports, and to rank sentence pairs by semantic similarity for hierarchical conclusion allocation. Use when the user wants to benchmark on MevakerConcSen, PS (Parallel Sentences), or asks about evaluating this task. Reports F1, Kendall Rank Correlation (KRC).

qhjqhj00 54209e2 3.0 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/mevaker-conclusion-eval commit 54209e21f9

Frequently asked questions

npx skillmds add qhjqhj00/mevaker-conclusion-eval