alpaca_eval:基于LLM的指令跟随语言模型自动评估工具项目

用户可快速、低成本评估指令跟随语言模型性能。该项目提供与人类标注高度相关(0.98)的自动评估器,含排行榜、评估工具包及20K人类偏好数据,支持模型开发中的高效迭代。【此简介由AI生成】

分支2Tags0

项目介绍

用户可快速、低成本评估指令跟随语言模型性能。该项目提供与人类标注高度相关(0.98)的自动评估器,含排行榜、评估工具包及20K人类偏好数据,支持模型开发中的高效迭代。【此简介由AI生成】

定制我的领域