Managing Vision Agents

Image analysis with multi-modal LLMs (GPT-4V, Gemini Vision), object detection integration, image generation pipelines, and visual question answering

gitwalter 86fd768 4 files · 29.6 KB Updated

File contents

gitwalter/antigravity-agent-factory/tree/main/.agent/skills/chain/managing-vision-agents commit 86fd768e6c

Frequently asked questions

npx skillmds@latest add gitwalter/managing-vision-agents