OpenManus-RL:基于PPO算法的智能体强化学习训练框架项目

A live stream development of RL tunning for LLM agents

分支43Tags1

项目介绍

实时直播:大型语言模型(LLM)智能体强化学习(RL)调参过程【此简介由AI生成】

定制我的领域
554.14 K589访问 GitHub