Llava Visual Instruction Tuning

Multimodal visual instruction tuning combining CLIP vision encoders with large language models.

robertoatila Updated

File contents

robertoatila/jarvis-skill-registry/tree/main/skills/llava-visual-instruction-tuning commit 7744821fac

Frequently asked questions

npx skillmds@latest add robertoatila/llava-visual-instruction-tuning