Wmt24 Docmt Eval

Evaluates document-level machine translation quality using multi-turn conversational prompting strategies with LLMs, measuring contextual coherence and translation accuracy across multiple language directions and domains. Use when the user wants to benchmark on WMT 24 General Track, WMT 23 Chinese-to-English, or asks about evaluating this task. Reports dBLEU.

qhjqhj00 cab3892 3.7 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/wmt24-docmt-eval commit cab38921bb

Frequently asked questions

npx skillmds add qhjqhj00/wmt24-docmt-eval