Clip Multimodal

Procedimiento para usar CLIP (Contrastive Language-Image Pretraining) para embedding de imágenes y texto, búsqueda semántica, y clasificación zero-shot

ntizar 7db4180 2.4 KB Updated

File contents

ntizar/mastermind/tree/main/agent/skills/deep-learning/clip-multimodal commit 7db418009d

Frequently asked questions

npx skillmds@latest add ntizar/clip-multimodal