Multimodal Models

Use when "CLIP", "Whisper", "Stable Diffusion", "SDXL", "speech-to-text", "text-to-image", "image generation", "transcription", "zero-shot classification", "image-text similarity", "inpainting", "ControlNet"

eyadsibai Updated

File contents

eyadsibai/ltk/tree/main/plugins/ltk-data/skills/multimodal-models commit 5a28d2071c

Frequently asked questions

npx skillmds@latest add eyadsibai/multimodal-models