agentic-eval - Agent 评估模式评估反思评估器优化器LLM裁判更新于 2026-09-16提供用于评估和改进 AI Agent 输出的模式与技术。⚙ 实现自我批判与反思循环⚙ 构建评估器-优化器管道⚙ 创建测试驱动的代码重构工作流