Results for “animal-recognition”
2 skillsblip-2-vision-language
Generate image captions, answer visual questions, and perform image-text retrieval using BLIP-2's Q-Former architecture with frozen vision encoders and LLMs.
10.4k · bundle
infinite-gratitude
Coordinates multiple research agents to gather information on a topic across GitHub, HuggingFace, papers, competitors, and best practices, then compiles findings into a structured report.
31 · bundle