Multimodal Embedding Generator

Generate cross-modal embeddings with CLIP, SigLIP, and ImageBind for text-image-audio search. Activate on: multimodal search, text-to-image search, cross-modal embeddings, CLIP embeddings, visual search. NOT for: text-only embeddings (ai-engineer), image classification (computer-vision-pipeline).

curiositech Updated 10 repo stars

File contents

curiositech/windags-skills/tree/main/skills/multimodal-embedding-generator commit a5e724ed7c

Frequently asked questions

npx skillmds@latest add curiositech/multimodal-embedding-generator