LogoClawIndex
案例技能关于
LogoClawIndex

agentic-eval - Agent 评估模式

提供用于评估和改进 AI Agent 输出的模式与技术。

标签

更新于: 2026-09-16
评估反思评估器优化器LLM裁判质量控制

能力

典型输入

典型输出

该技能可以做什么

  • 实现自我批判与反思循环
  • 构建评估器-优化器管道
  • 创建测试驱动的代码重构工作流
  • 设计基于细则的评估系统
  • 设计 LLM 裁判评估系统
  • 测量并提高响应质量

输入

  • 任务描述
  • 评估标准
  • 代码规范
  • 评估细则

输出

  • 优化后的 Agent 输出
  • 结构化 JSON 评估得分
  • 修复后的代码实现

要求

    来源

    • 规范: SKILL.md

    ClawIndex

    OpenClaw Skills 与 Use Case 索引

    ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

    索引

    Skills·
    Cases

    Meta

    关于·
    声明·
    邮箱·
    GitHub
    © 2026 ClawIndex 保留所有权利。
    实现自我批判与反思循环
    构建评估器-优化器管道
    创建测试驱动的代码重构工作流
    设计基于细则的评估系统
    任务描述
    评估标准
    代码规范
    优化后的 Agent 输出
    结构化 JSON 评估得分
    修复后的代码实现