agentic-eval - Agent 评估模式提供用于评估和改进 AI Agent 输出的模式与技术。标签更新于: 2026-09-16评估反思评估器优化器LLM裁判质量控制能力典型输入典型输出该技能可以做什么实现自我批判与反思循环构建评估器-优化器管道创建测试驱动的代码重构工作流设计基于细则的评估系统设计 LLM 裁判评估系统测量并提高响应质量输入任务描述评估标准代码规范评估细则输出优化后的 Agent 输出结构化 JSON 评估得分修复后的代码实现要求来源规范: SKILL.md