代码开发

LLM Evaluation

使用自动化指标、人工反馈和基准测试,为LLM应用实施全面的评估策略。适用于测试LLM性能、衡量AI应用质量或建立评估框架时。

作者:wshobson 下载:0 GitHub Star:0 评分:暂无 翻译

安装命令

npx skills add https://github.com/wshobson/agents --skill llm-evaluation