LogoClawIndex
CasesSkillsAbout
LogoClawIndex

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.

Skills with capability: Run LLM-as-judge evaluations

Browse skills that share this capability.

  • llm-evaluation - Evaluate LLM application performance
    LLM evaluationautomated metricshuman evaluationLLM judge

    ★ 18 · Updated 2026-09-28

    Evaluate LLM applications using automated metrics, human assessment, LLM judges, and A/B testing.

    ⚙ Measure automated metrics⚙ Assess human evaluation dimensions⚙ Compare model outputs