Multimodal LLM

Vision, audio, video generation, and multimodal LLM integration patterns. Use when processing images, transcribing audio, generating speech, generating AI video (Kling, Sora, Veo, Runway), or building multimodal AI pipelines. Use when this capability is needed.

tomevault-io 024b8d0 2 files · 7.6 KB Updated

File contents

tomevault-io/skills-registry/tree/main/yonatangross--orchestkit--multimodal-llm commit 024b8d011c

Frequently asked questions

npx skillmds@latest add tomevault-io/multimodal-llm