| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
[docs]: 修正文档中文本错误 Co-authored-by: dty_30041779<daitianyi1@h-partners.com> # message auto-generated for no-merge-commit merge: !148 merge master into master [docs]: 修正文档中文本错误 Created-by: dty_30041779 Commit-by: dty_30041779 Merged-by: cann-robot Description: # Pull Request 模板 ---- ## 描述 修正文档中文本错误 ## 类型 - [ ] Bug 修复 - [ ] 新功能 - [ ] 重构(即不是新增功能,也不是修改bug的代码变动) - [ ] 构建过程或辅助工具的变动 - [x] 文档内容更新 ## 如何测试 描述测试这个变更的步骤,包括哪些文件需要被修改。 ## Checklist: - [ ] 我的代码遵循这个项目的代码风格 - [ ] 我已经自己测试过我的代码 - [x] 我已经更新了相应的文档 - [ ] 我已经在标题中正确使用了类型标签(例如: feat, fix, refactor, docs, test) ## 其他信息 在这里可以添加任何与这个 Pull Request 相关的其他说明。 See merge request: cann/cann-recipes-train!148 | 27 天前 | |
Add English README for Qwen2.5 RL training example Co-authored-by: FENG LI<fengli1996513@163.com> # message auto-generated for no-merge-commit merge: !157 merge add-english-readme into master Add English README for Qwen2.5 RL training example Created-by: lilycicii Commit-by: FENG LI Merged-by: cann-robot Description: 基于中文版的README_single.md 写了英文版。 See merge request: cann/cann-recipes-train!157 | 2 个月前 | |
update: 更新文件 requirements.txt Co-authored-by: dty_30041779<daitianyi1@h-partners.com> # message auto-generated for no-merge-commit merge: !162 merge master into master update: 更新文件 requirements.txt Created-by: dty_30041779 Commit-by: dty_30041779 Merged-by: cann-robot Description: # Pull Request 模板 ---- ## 描述 requirements中缺少pyarrow依赖,会导致解析数据集时报错 ## 类型 - [x] Bug 修复 - [ ] 新功能 - [ ] 重构(即不是新增功能,也不是修改bug的代码变动) - [ ] 构建过程或辅助工具的变动 - [ ] 文档内容更新 ## 如何测试 描述测试这个变更的步骤,包括哪些文件需要被修改。 ## Checklist: - [ ] 我的代码遵循这个项目的代码风格 - [x] 我已经自己测试过我的代码 - [x] 我已经更新了相应的文档 - [ ] 我已经在标题中正确使用了类型标签(例如: feat, fix, refactor, docs, test) ## 其他信息 在这里可以添加任何与这个 Pull Request 相关的其他说明。 See merge request: cann/cann-recipes-train!162 | 1 个月前 | |
feat(wordle): 支持 TorchTitan-NPU 训练后端 Co-authored-by: qianbi1999<zhoujian157@huawei.com> # message auto-generated for no-merge-commit merge: !180 merge feat/qwen3-wordle-torchtitan-npu-pr into master feat(wordle): 支持 TorchTitan-NPU 训练后端 Created-by: qianbi1999 Commit-by: qianbi1999 Merged-by: cann-robot Description: ## 描述 为 Qwen3-1.7B Wordle GRPO 样例增加 TorchTitan-NPU 训练后端。在保持模型、数据、奖励函数、GRPO 算法、六轮 AgentLoop 和 vLLM rollout 不变的基础上,将 Actor 与 Reference Model 接入 TorchTitan Engine,支持在单机两张 Ascend NPU 上完成完整 RL 训练迭代。 ## 主要改动 - 新增 TorchTitan-NPU 独立启动入口,采用 FSDP2 两卡分片、参数与优化器 CPU offload、激活重计算以及 Qwen3 TND 变长注意力。 - 使用 uv 创建隔离环境,并固定 verl、TorchTitan、TorchTitan-NPU、vLLM、vLLM-Ascend 等依赖的版本和源码提交。 - 增加 TorchTitan-NPU 接入所需补丁,覆盖 NPU 模型初始化、Qwen3 序列长度、Actor 权重同步、优化器卸载、检查点缓存释放及相关构建兼容性适配。 - 提供适用于当前 verl 版本的 Wordle AgentLoop 实现,并保持原有多轮交互及奖励计算语义。 - 保留原 FSDP 启动入口,并统一训练 batch、随机种子、熵系数、学习率 warmup 和验证采样等配置。 - 更新 Wordle 样例说明,补充 TorchTitan-NPU 环境准备、启动方法和目录说明。 本 PR 共修改 17 个文件,范围限定在 llm_rl/qwen3_wordle/。提交内容不包含模型、数据集、运行时源码、虚拟环境、训练日志或检查点。 ## 类型 - [ ] Bug 修复 - [x] 新功能 - [ ] 重构 - [ ] 构建过程或辅助工具的变动 - [ ] 文档内容更新 ## 使用方法 按照 llm_rl/qwen3_wordle/torchtitan_backend/README.md 准备 CANN 9.0、Python 3.11、GCC/G++ 11+ 和 uv 0.12.0。在 llm_rl/qwen3_wordle/ 目录下执行: bash bash torchtitan_backend/setup_backend.sh TOTAL_TRAINING_STEPS=3 SAVE_FREQ=-1 TEST_FREQ=-1 \ bash torchtitan_backend/run_qwen3_1.7b_wordle_torchtitan_npu.sh ## 验证结果 - PR CI、CodeCheck、pre-commit、Shell 语法、Python 语法及 diff 空白检查通过。 - 7 个补丁通过命名检查、首次应用和重复执行检查。 - Wordle AgentLoop 状态转换测试通过,覆盖正确猜词、普通猜词、重复猜词和非法输出场景。 - TorchTitan-NPU 已完成连续 3 个 RL step 的运行验证,单步耗时分别为 660.13、635.87 和 608.80 秒。 - 最新提交 3752ed7 完成额外单步端到端回归,覆盖 rollout、奖励计算、old/ref log-prob、advantage、Actor 更新和权重同步;training/global_step=1,单步耗时 650.09 秒,训练结束后进程和 NPU 显存正常释放。 上述短程运行用于验证训练链路和后端适配,不作为模型收敛效果或性能收益结论。 ## Checklist - [x] 我的代码遵循这个项目的代码风格 - [x] 我已经自己测试过我的代码 - [x] 我已经更新了相应的文档 - [x] 我已经在标题中正确使用了类型标签 ## 其他信息 - 配套课程 PR:https://gitcode.com/cann/cann-learning-hub/pull/789 See merge request: cann/cann-recipes-train!180 | 21 天前 |