LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

run-evals - 运行现有技能评估

使用现有测试用例执行和迭代技能评估

标签

更新于: 2026-03-23
测试评估基准测试质量保证CI/CD技能开发

能力

典型输入

典型输出

该技能可以做什么

  • 运行评估命令
  • 读取评估配置
  • 读取基准结果
  • 创建反馈文件
  • 修改评估配置
  • 比较评估结果
  • 生成改进建议
  • 验证阈值条件
  • 比较技能版本

输入

  • evals/evals.json 文件
  • 技能目录
  • 旧技能路径
  • CI 阈值

输出

  • benchmark.json 文件
  • feedback.json 文件
  • 评估报告
  • 比较报告
  • CI 退出码

要求

  • 现有的 evals/evals.json
  • @github/copilot-sdk
  • npx snapeval CLI
  • Copilot CLI 认证
  • Node.js 环境

来源

  • 规范: SKILL.md
运行评估命令
读取评估配置
读取基准结果
创建反馈文件
evals/evals.json 文件
技能目录
旧技能路径
benchmark.json 文件
feedback.json 文件
评估报告