vision AI Agent Skills

Browse 7 skills related to vision

sticker-analyzer

1.8k
openclawopenclaw

Analyze images in media/stickers using Vision API to identify and filter meme/sticker content vs screenshots or documents.

visionimage-analysisstickers+1
186 days ago

vision

249
0xSero0xSero

Analyze images, screenshots, diagrams, and visual content - Use when you need to understand visual content like screenshots, architecture diagrams, UI mockups, or error screenshots.

visionimagesscreenshots+1
185 days ago

multimodal-llm

97
yonatangrossyonatangross

Vision, audio, and multimodal LLM integration patterns. Use when processing images, transcribing audio, generating speech, or building multimodal AI pipelines.

visionaudiomultimodal+4
185 days ago

clip-aware-embeddings

43
curiositechcuriositech

Semantic image-text matching with CLIP and alternatives. Use for image search, zero-shot classification, similarity matching. NOT for counting objects, fine-grained classification (celebrities, car models), spatial reasoning, or compositional queries. Activate on "CLIP", "embeddings", "image similarity", "semantic search", "zero-shot classification", "image-text matching".

clipembeddingsvision+2
186 days ago

image-mining

30
SimHackerSimHacker

I mine pixels for atoms. Reality is just compressed resources.

moollmvisionextraction+2
186 days ago

product-context-template

7
YoungLeadersDotTechYoungLeadersDotTech

Generic product context template for creating product vision, goals, and constraints skills. Auto-invoke when user requests product skill creation, product context framework, or strategic alignment templates. Do NOT load during actual product work (use project-specific skills instead).

templateproduct-contextvision+1
185 days ago

senior-computer-vision

arielperez82arielperez82

World-class computer vision skill for image/video processing, object detection, segmentation, and visual AI systems. Expertise in PyTorch, OpenCV, YOLO, SAM, diffusion models, and vision transformers. Includes 3D vision, video analysis, real-time processing, and production deployment. Use when building vision AI systems, implementing object detection, training custom vision models, or optimizing inference pipelines.

analysiscomputerengineering+3
185 days ago