Search-R1:基于强化学习的推理与搜索引擎调用LLM训练框架项目

Search-R1: An Efficient, Scalable RL Training Framework for Reasoning & Search Engine Calling interleaved LLM based on veRL

分支1Tags0

项目介绍

搜索-R1:一种基于veRL的高效、可扩展的推理与搜索引擎调用交织的长语言模型(LLM)强化学习训练框架。【此简介由AI生成】

定制我的领域
185.16 K463访问 GitHub