
Llm Evaluation
@clawhub_codenova58/llm-evaluation
作者:codenova58
关于这个 Skill
深度大模型评估工作流:涵盖质量维度、黄金集、人机指标对比、回归套件、离在线信号及安全发布门禁。
工作流编排上下文管理工具调用
Skill 文件与使用说明
查看 SKILL.md 以及作者随 Skill 发布的其他说明和配置文件。
正在读取文件列表
详细信息
- 分类
- AI Agent
- 来源
- clawhub
- 版本
- 1.0.0
- 更新时间
- 2026年9月24日