Acl Experiments

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expectations in NLP reviewing.

brycewang-stanford d6ece25 5.6 KB Updated 1k repo stars

File contents

brycewang-stanford/Awesome-Journal-Skills/tree/main/ACL-Skills/skills/acl-experiments commit d6ece25433

Frequently asked questions

npx skillmds add brycewang-stanford/acl-experiments