Mme Realworld Mmbench Eval

Evaluates multimodal large language models on real-world visual perception and reasoning tasks, as well as fine-grained visual-language understanding across multiple dimensions. Use when the user wants to benchmark on MME-Realworld, MMBench, or asks about evaluating this task. Reports Overall score.

qhjqhj00 bea7d6e 3.0 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/mme-realworld-mmbench-eval commit bea7d6e522

Frequently asked questions

npx skillmds add qhjqhj00/mme-realworld-mmbench-eval