LogoClawIndex
CasesSkillsAbout
LogoClawIndex

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.

Skills tagged: Vision-language

Browse skills that share this tag.

  • blip-2-vision-language - BLIP-2 vision-language task support
    MultimodalVision-languageImage captioningVisual question answering

    ★ 0 · Updated 2026-10-05

    Use BLIP-2 for image captioning, visual question answering, image-text retrieval, feature extraction, and multimodal chat.

    ⚙ Generate image captions⚙ Answer visual questions⚙ Retrieve image-text matches