Agentic Evaluation Patterns
用于评估和改进AI智能体输出的模式与技术。适用于:实现自我批评与反思循环;构建面向质量关键生成任务的评估器-优化器流水线;创建测试驱动的代码优化工作流;设计基于评分标准或LLM作为评判者的评估系统;为智能体输出(代码、报告、分析)添加迭代改进;衡量并提升智能体响应质量。
安装命令
npx skills add https://github.com/github/awesome-copilot --skill agentic-eval
用于评估和改进AI智能体输出的模式与技术。适用于:实现自我批评与反思循环;构建面向质量关键生成任务的评估器-优化器流水线;创建测试驱动的代码优化工作流;设计基于评分标准或LLM作为评判者的评估系统;为智能体输出(代码、报告、分析)添加迭代改进;衡量并提升智能体响应质量。
npx skills add https://github.com/github/awesome-copilot --skill agentic-eval