LogoClawIndex
案例技能关于
LogoClawIndex

promptfoo - Promptfoo LLM评估框架

使用评估框架测试和比较LLM输出

标签

更新于: 2026-03-09
LLM测试评估框架提示工程质量保证AI测试

能力

编写评估配置创建测试用例调试评估运行处理断言

典型输入

promptfooconfig.yaml文件测试用例文件断言规则

典型输出

评估结果输出比较测试报告

该技能可以做什么

  • 编写评估配置
  • 创建测试用例
  • 调试评估运行
  • 处理断言
  • 比较LLM输出

输入

  • promptfooconfig.yaml文件
  • 测试用例文件
  • 断言规则
  • LLM提供商配置
  • 变量数据

输出

  • 评估结果
  • 输出比较
  • 测试报告
  • 性能指标

要求

  • Node.js环境
  • npx访问权限
  • promptfoo.dev访问权限
  • YAML/JSON配置文件

来源

  • 规范: SKILL.md

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。