已关闭
[Bug]: GRPO微调qwen2.5-7b-vl模型,报错。 #550
xiaochi111创建于 7月31日关闭于 14 天前
7月31日 添加了label:bug
yeqm
8月7日 评论:
8月7日 评论:
👋 您好,欢迎向 MindSpeed MM 提交 Issue!
我们已收到您的反馈,感谢你对开源社区的支持。🎉
📅 处理时效: 维护团队将在 24 小时内 查看并回复您的问题(工作日)。
🚨 紧急联系: 如果您的问题非常紧急,可通过微信联系我们。
请确保 Issue 描述清晰,包含复现步骤和日志,这将帮助我们更快定位问题。谢谢!


ningmenglh
14 天前 评论:
14 天前 评论:
感谢使用MindSpeed-MM仓,现在rl系列模型及其特性支持都在https://github.com/verl-project/verl 该仓维护,可以考虑使用verl仓进行rl的训练


14 天前 将 ningmenglh 设为负责人
14 天前 issue状态由 TODO 改变为 DONE
14 天前 关闭了 issue
14 天前 添加了label:resolved
在提交新问题之前,请确保您已经在社区中搜索过相关问题,并使用了社区中提供的资源/工具后,仍未找到满意的解决方式。
⚠️ 安全信息提醒:请仔细检查提供的文本内容,确保其不包含敏感数据信息,包括但不限于:
在分享配置信息或代码示例时,请将敏感信息脱敏处理,或使用
<TOKEN>等占位符替代原有内容。环境信息
版本信息:

报错信息:

🐛 问题描述
使用官方的参数配置,Actor 权重到 vLLM 时分桶出现问题
欢迎加入社区,感谢您对社区的贡献 🎉!