Pearmut Human Evaluation Of Translation Made Trivi

Systematic evaluation toolkit for assessing large language models across multiple dimensions, enabling comprehensive benchmarking of agent capabilities and comparative analysis of model performance.

adu2021 Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/pearmut-human-evaluation-of-translation-made-trivi commit ea0c8dca34

Frequently asked questions

npx skillmds@latest add adu2021/pearmut-human-evaluation-of-translation-made-trivi