ART:基于 Python 的强化学习框架项目

Agent Reinforcement Trainer: train multi-step agents for real-world tasks using GRPO. Give your agents on-the-job training. Reinforcement learning for Qwen3.6, GPT-OSS, Llama, and more!

分支298Tags59

项目介绍

开放管道艺术(代理强化训练器):训练大型语言模型代理【此简介由AI生成】

定制我的领域
6610.66 K981访问 GitHub