Multilingual Medical Benchmarks Eval

Evaluates multilingual text-to-text models on medical argument mining (sequence labeling) and abstractive question answering across English, Spanish, French, and Italian. Use when the user wants to benchmark on AbstRCT, BioASQ 6B, or asks about evaluating this task. Reports sequence-level F1.

qhjqhj00 023bdf3 3.0 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/multilingual-medical-benchmarks-eval commit 023bdf3a8f

Frequently asked questions

npx skillmds add qhjqhj00/multilingual-medical-benchmarks-eval