👋 您好,欢迎向 MindSpeed-LLM 提交 Issue!
我们已收到您的反馈,感谢你对开源社区的支持。🎉
📅 处理时效: 维护团队将在 24 小时内 查看并回复您的问题(工作日)。
🔍 自助查询: 在等待期间,建议您先查阅社区文档,可能已有解决方案:
🚨 紧急联系: 如果您的问题非常紧急,可通过以下方式联系我们:
📧 邮箱:[ leizhenzhen4@huawei.com ]
请确保 Issue 描述清晰,包含复现步骤和日志,这将帮助我们更快定位问题。谢谢!


您好,感谢您的反馈。
开启自动权重转换功能,即支持原始权重直接训练,需要添加--enable-hf2mg-convert参数,开启后需加载原始权重,否则会报错找不到safetrnsor文件。根据您的链接,在26.0.0分支中,examples/mcore/qwen3/pretrain_qwen3_8b_4K_ptd.sh脚本默认没有--enable-hf2mg-convert参数,未使能自动权重转换,应当填入权重转换时保存的权重路径。请确认您的代码的版本。
相关文档详见https://gitcode.com/Ascend/MindSpeed-LLM/blob/26.0.0/docs/zh/pytorch/training/pretrain/mcore/train_from_hf.md 中 “HF→MG转换 (--enable-hf2mg-convert) 约束条件”部分:“不支持Megatron格式权重:开启此参数后,不支持使用离线转换的Megatron格式权重”
再次感谢您的反馈,如果您目前没有其他问题,我们将根据流程关闭此 issue。
如后续有新的疑问或补充内容,欢迎随时重新打开本 issue,或另起一个新的 issue 进行提问。
感谢您的理解与支持!


在提交新问题之前,请确保您已经在社区中搜索过相关问题,并使用了社区中提供的资源/工具后,仍未找到满意的解决方式。
📚 文档问题描述
https://gitcode.com/Ascend/MindSpeed-LLM/blob/26.0.0/docs/zh/pytorch/training/quick_start.md
修改并保存预训练参数配置,配置示例如下:
CKPT_LOAD_DIR="./model_weights/qwen3_mcore/" # 权重加载路径,填入权重转换时保存的权重路径
CKPT_SAVE_DIR="./ckpt/qwen3-8b" # 训练完成后的权重保存路径
DATA_PATH="./dataset/alpaca_text_document" # 数据集路径,填入数据预处理时保存的数据路径,注意需要添加后缀,如使用Alpaca数据集预处理会生成alpaca_text_document.bin和.idx,则在数据集路径后再加上alpaca_text_document
TOKENIZER_PATH="./model_from_hf/qwen3_hf/" # 词表路径,填入下载的开源权重词表路径**<
实际上CKPT_LOAD_DIR需要写原始权重路径,如写转换后的,会报错找不到safetrnsor文件,既然代码支持原始权重直接训练,请描述同步修改。不然会报错
建议的替代/修复方案
欢迎加入社区,感谢您对社区的贡献 🎉!