simple-evals:轻量级语言模型评估库,提供基准测试与透明结果
Star
0
Fork
0
代码
介绍
代码
Issues
Pull Requests
流水线
Actions
项目讨论
Wiki
项目成员
5
分析
项目设置
Star
0
Fork
0
开源轻量级语言模型评估工具,支持MMLU、GPQA等主流基准测试,提供零样本思维链评估,含多模型基准结果对比,助力模型性能透明化分析。【此简介由AI生成】
main
分支
3
Tags
0
IDE
下载zip
Clone
README
项目介绍
开源轻量级语言模型评估工具,支持MMLU、GPQA等主流基准测试,提供零样本思维链评估,含多模型基准结果对比,助力模型性能透明化分析。【此简介由AI生成】
MIT
Python
86
提交数
定制我的领域
README
举报项目
51
4.58 K
499
访问 GitHub
举报项目