Dmlr Latent Reasoning

Improve multimodal reasoning at test-time through confidence-guided latent optimization without retraining. Iteratively refine learnable latent think tokens via policy gradient using confidence reward. Dynamically select and update relevant image patches based on internal confidence levels. Maintain high efficiency with all optimization in latent space.

adu2021 b60f28c 3.5 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/dmlr-latent-reasoning commit b60f28cbc8

Frequently asked questions

npx skillmds@latest add adu2021/dmlr-latent-reasoning