Media Gen

AI media generation with 4 atomic capabilities: text-to-image, image-to-image, text-to-video, image-to-video. Supports Gemini (via flow2api) and GPT (via CPA/Codex) image providers, plus Veo 3.1 video models. Auto-selects model by aspect ratio, LLM prompt enhancement, batch generation with concurrency=5. Use when user asks to generate images, create videos, draw, paint, animate, or produce any visual media content.

dimthink 7c8148f 4 files · 13.3 KB Updated

File contents

dimthink/media-gen/tree/main/ commit 7c8148f546

Frequently asked questions

npx skillmds@latest add dimthink/media-gen