| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
docs目录基本概念md文件名改为英文 Co-authored-by: chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !4182 merge master into master docs目录基本概念md文件名改为英文 Created-by: gitcode-chenjiao Commit-by: chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> docs目录基本概念md文件名改为英文: 避免link中的中文字符引发的跳转异常,例如两段式接口.md变成%E4%B8%A4%E6%AE%B5%E5%BC%8F%E6%8E%A5%E5%8F%A3.md,不易于维护,可能导致其他平台跳转有问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2283](https://gitcode.com/cann/ops-math/issues/2283) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> docs/zh/context所有md和对应的link ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4182 | 19 天前 | |
WeightQuantPreprocess增加mm分支对bias为1维的支持 Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !4233 merge weight_quant_preprocess_2 into master WeightQuantPreprocess增加mm分支对bias为1维的支持 Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> WeightQuantPreprocess增加mm分支对bias为1维的支持 此 PR 主要扩展了 weight_quant_preprocess 算子在非 GMM(即 MM)分支下对 biasOptional 输入形状的校验逻辑,使其支持 1 维 bias(形状为 (n)),同时保持对原有 2 维 bias(形状为 (1, n))的兼容。GMM 分支则仍严格限定 bias 必须为 2 维。相应更新了单元测试用例,补充了 1 维 bias 的正常、异常以及 GMM 场景下的形状非法用例。 CheckBiasOptionalViewShape 校验逻辑重构: 在 weight_quant_preprocess_registry.cpp 中,将 bias 必须为 2 维的检查移入 isGmm 分支内;非 GMM 分支新增对 1 维和 2 维 bias 的分别校验——1 维时要求 biasViewShape.GetDim(IDX_0) == n,2 维时要求 (1, n),并更新了对应的错误提示信息。 注册表注释更新: NPU_DATA_FLOW_REGISTRY 中 CheckBiasOptionalViewShape<false> 的注释从 "bias shape 要求 (1, n)" 改为 "bias shape 要求 (n) 或 (1, n)",以反映新的校验规则。 新增正常场景测试用例: 在 test_aclnn_weight_quant_preprocess_l2.cpp 的 mmNormalCases 中新增 ascend950_test_MM_MX_A8W4_bias_1d(1 维 bias {128},期望成功)和 ascend950_test_MM_MX_A8W4_bias_2d(2 维 bias {1, 128},期望成功)。 新增异常场景测试用例: 在 casesParams 中新增 ascend950_test_bias_1d_shape_invalid(1 维 bias 形状 {127} 与 n=128 不匹配,期望 ACLNN_ERR_PARAM_INVALID)和 ascend950_test_GMM_bias_1d_shape_invalid(GMM 场景传入 1 维 bias {128},期望校验失败)。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2323](https://gitcode.com/cann/ops-math/issues/2323) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 本地验证用例56个全部通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4233 | 14 天前 | |
WeightQuantPreprocess增加mm分支对bias为1维的支持 Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !4233 merge weight_quant_preprocess_2 into master WeightQuantPreprocess增加mm分支对bias为1维的支持 Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> WeightQuantPreprocess增加mm分支对bias为1维的支持 此 PR 主要扩展了 weight_quant_preprocess 算子在非 GMM(即 MM)分支下对 biasOptional 输入形状的校验逻辑,使其支持 1 维 bias(形状为 (n)),同时保持对原有 2 维 bias(形状为 (1, n))的兼容。GMM 分支则仍严格限定 bias 必须为 2 维。相应更新了单元测试用例,补充了 1 维 bias 的正常、异常以及 GMM 场景下的形状非法用例。 CheckBiasOptionalViewShape 校验逻辑重构: 在 weight_quant_preprocess_registry.cpp 中,将 bias 必须为 2 维的检查移入 isGmm 分支内;非 GMM 分支新增对 1 维和 2 维 bias 的分别校验——1 维时要求 biasViewShape.GetDim(IDX_0) == n,2 维时要求 (1, n),并更新了对应的错误提示信息。 注册表注释更新: NPU_DATA_FLOW_REGISTRY 中 CheckBiasOptionalViewShape<false> 的注释从 "bias shape 要求 (1, n)" 改为 "bias shape 要求 (n) 或 (1, n)",以反映新的校验规则。 新增正常场景测试用例: 在 test_aclnn_weight_quant_preprocess_l2.cpp 的 mmNormalCases 中新增 ascend950_test_MM_MX_A8W4_bias_1d(1 维 bias {128},期望成功)和 ascend950_test_MM_MX_A8W4_bias_2d(2 维 bias {1, 128},期望成功)。 新增异常场景测试用例: 在 casesParams 中新增 ascend950_test_bias_1d_shape_invalid(1 维 bias 形状 {127} 与 n=128 不匹配,期望 ACLNN_ERR_PARAM_INVALID)和 ascend950_test_GMM_bias_1d_shape_invalid(GMM 场景传入 1 维 bias {128},期望校验失败)。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2323](https://gitcode.com/cann/ops-math/issues/2323) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 本地验证用例56个全部通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4233 | 14 天前 | |
WeightQuantPreprocess增加mm分支对bias为1维的支持 Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !4233 merge weight_quant_preprocess_2 into master WeightQuantPreprocess增加mm分支对bias为1维的支持 Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> WeightQuantPreprocess增加mm分支对bias为1维的支持 此 PR 主要扩展了 weight_quant_preprocess 算子在非 GMM(即 MM)分支下对 biasOptional 输入形状的校验逻辑,使其支持 1 维 bias(形状为 (n)),同时保持对原有 2 维 bias(形状为 (1, n))的兼容。GMM 分支则仍严格限定 bias 必须为 2 维。相应更新了单元测试用例,补充了 1 维 bias 的正常、异常以及 GMM 场景下的形状非法用例。 CheckBiasOptionalViewShape 校验逻辑重构: 在 weight_quant_preprocess_registry.cpp 中,将 bias 必须为 2 维的检查移入 isGmm 分支内;非 GMM 分支新增对 1 维和 2 维 bias 的分别校验——1 维时要求 biasViewShape.GetDim(IDX_0) == n,2 维时要求 (1, n),并更新了对应的错误提示信息。 注册表注释更新: NPU_DATA_FLOW_REGISTRY 中 CheckBiasOptionalViewShape<false> 的注释从 "bias shape 要求 (1, n)" 改为 "bias shape 要求 (n) 或 (1, n)",以反映新的校验规则。 新增正常场景测试用例: 在 test_aclnn_weight_quant_preprocess_l2.cpp 的 mmNormalCases 中新增 ascend950_test_MM_MX_A8W4_bias_1d(1 维 bias {128},期望成功)和 ascend950_test_MM_MX_A8W4_bias_2d(2 维 bias {1, 128},期望成功)。 新增异常场景测试用例: 在 casesParams 中新增 ascend950_test_bias_1d_shape_invalid(1 维 bias 形状 {127} 与 n=128 不匹配,期望 ACLNN_ERR_PARAM_INVALID)和 ascend950_test_GMM_bias_1d_shape_invalid(GMM 场景传入 1 维 bias {128},期望校验失败)。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2323](https://gitcode.com/cann/ops-math/issues/2323) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 本地验证用例56个全部通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4233 | 14 天前 | |
新增接口WeightQuantPreprocess Co-authored-by: yan-chengyi123<yanchengyi@huawei.com> Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !3832 merge WeightQuantPreprocess into master 新增接口WeightQuantPreprocess Created-by: renzetao Commit-by: renzetao;yan-chengyi123 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 本次 PR 新增了 WeightQuantPreprocess 算子接口,用于对量化推理中的权重张量进行预处理转换。主要支持两类数据流:MM_MX_A8W4(矩阵乘,2维权重)和 GMM_MX_A8W4(分组矩阵乘,3维权重),均面向 FLOAT4_E2M1 权重 / FLOAT8_E8M0 scale 的 Mx 量化场景。核心流程是将 ND/NCL 格式的权重转置后通过 TransData 转换为 FORMAT_FRACTAL_NZ_C0_32 格式,并对 weightScale 和 bias 做直接拷贝。接口采用两段式设计(GetWorkspaceSize + 执行),并通过 DataFlowEntry 注册表按 NPU 架构匹配数据流、校验参数、执行业务逻辑。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2230](https://gitcode.com/cann/ops-math/issues/2230) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 本地验证GMM-MxA8W4,QBMM-MxA8W4 的历史用例pass ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 新增了conversion/weight_quant_preprocess/docs/aclnnWeightQuantPreprocess.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3832 | 27 天前 | |
新增接口WeightQuantPreprocess Co-authored-by: yan-chengyi123<yanchengyi@huawei.com> Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !3832 merge WeightQuantPreprocess into master 新增接口WeightQuantPreprocess Created-by: renzetao Commit-by: renzetao;yan-chengyi123 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 本次 PR 新增了 WeightQuantPreprocess 算子接口,用于对量化推理中的权重张量进行预处理转换。主要支持两类数据流:MM_MX_A8W4(矩阵乘,2维权重)和 GMM_MX_A8W4(分组矩阵乘,3维权重),均面向 FLOAT4_E2M1 权重 / FLOAT8_E8M0 scale 的 Mx 量化场景。核心流程是将 ND/NCL 格式的权重转置后通过 TransData 转换为 FORMAT_FRACTAL_NZ_C0_32 格式,并对 weightScale 和 bias 做直接拷贝。接口采用两段式设计(GetWorkspaceSize + 执行),并通过 DataFlowEntry 注册表按 NPU 架构匹配数据流、校验参数、执行业务逻辑。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2230](https://gitcode.com/cann/ops-math/issues/2230) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 本地验证GMM-MxA8W4,QBMM-MxA8W4 的历史用例pass ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 新增了conversion/weight_quant_preprocess/docs/aclnnWeightQuantPreprocess.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3832 | 27 天前 |
WeightQuantPreprocess
本目录仅包含WeightQuantPreprocess算子对应的aclnn接口;如您想要贡献该算子的AscendC实现,请参考贡献流程。