用户可通过该项目对大语言模型性能进行全面评估,支持多模型部署方式(API、Huggingface、vLLM),提供“推理-评估-评分”自动化工作流,采用“配置即代码”理念,支持规则、LLM 及 CoT 等多种评估方法。【此简介由AI生成】