Korean Vlm Benchmarks Eval

Evaluates vision-language models on Korean multimodal comprehension, document/table/chart understanding, and open-ended generation capabilities using translated and newly curated benchmarks. Use when the user wants to benchmark on K-MMBench, K-SEED, K-MMStar, K-DTCBench, K-LLaVA-W, or asks about evaluating this task. Reports accuracy.

qhjqhj00 1b286c8 3.3 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/korean-vlm-benchmarks-eval commit 1b286c82bb

Frequently asked questions

npx skillmds add qhjqhj00/korean-vlm-benchmarks-eval