Ck:ai Multimodal

Analyze images/audio/video with Gemini API (better vision than Codex). Generate images (Imagen 4), videos (Veo 3). Use for vision analysis, transcription, OCR, design extraction, multimodal AI.

manhvann Updated

File contents

manhvann/codexkit/tree/main/.agents/skills/ai-multimodal commit 3f89f0f6ad

Frequently asked questions

npx skillmds@latest add manhvann/ck-ai-multimodal