Test Time Rl Vlm

Adapt vision-language models at inference without labeled data by generating multiple predictions and rewarding high-frequency outputs. Trigger: improve VLM accuracy on deployment with self-generated supervision signals.

adu2021 cfd6fdf 9.7 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/test-time-rl-vlm commit cfd6fdf6f3

Frequently asked questions

npx skillmds@latest add adu2021/test-time-rl-vlm