| 修改quant算子aclnn的文档 Co-authored-by: transformer910<tianye82@h-partners.com> # message auto-generated for no-merge-commit merge: !4582 merge br_quant_md_fix into master 修改quant算子aclnn的文档 Created-by: transformer910 Commit-by: transformer910 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 1. 修改aclnnQuantize.md 2. 修改aclnnDynamicQuantV2.md ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!4582 | 3 个月前 |
| md文档和示例代码修复 Co-authored-by: Chen_HaoWen<chenhaowen12@huawei.com> # message auto-generated for no-merge-commit merge: !2978 merge master_qbn into master md文档和示例代码修复 Created-by: Chen_HaoWen Commit-by: Chen_HaoWen Merged-by: cann-robot Description: ## 描述 md文档和示例代码修复 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!2978 | 5 个月前 |
| 放开 dynamicquantv2 中 dst_type_max 取值约束 Co-authored-by: transformer910<tianye82@h-partners.com> # message auto-generated for no-merge-commit merge: !4341 merge br_dquant_fix into master 放开 dynamicquantv2 中 dst_type_max 取值约束 Created-by: transformer910 Commit-by: transformer910 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 放开 dynamicquantv2 中 dst_type_max 取值约束。原先支持hifloat8的几个精度阈值0, 15, 56, 224, 32768,改为支持0 - 32768 的取值范围。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/2426 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地验证通过,冒烟用例通过。 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!4341 | 4 个月前 |
| remove simplified_key, default value is 0 Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !4892 merge master into master remove simplified_key, default value is 0 Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 当simplified_key中属性只有default=0,且ascendc_config中配置了算子,那么simplified_key.ini文件可以删除,因为默认值为0. 修改了ascendc_config.json文件,将算子host/config中配置了soc,但是未在ascendc_config.json中的算子补充上去。 ## 关联的Issue [#1985](https://gitcode.com/cann/ops-nn/issues/1985) ## 测试 编译950、910bpass ## 文档更新 更新了ascendc_config.json配置了算子的simplified_key的ini文件 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!4892 | 3 个月前 |
| dynamic_quant_v2算子新增pertensor量化模式的groupIndex支持 Co-authored-by: LiWeiJian16<liweijian16@huawei.com> # message auto-generated for no-merge-commit merge: !3976 merge dynamic_quant_moe_pertensor into master dynamic_quant_v2算子新增pertensor量化模式的groupIndex支持 Created-by: liweijian16 Commit-by: liweijian16;LiWeiJian16 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 本次PR扩展了动态量化算子对MoE(Mixture of Experts)模型场景的支持,核心解决了算子原有pertensor(按张量)量化模式无法处理分组索引(group_index)的问题。通过本次修改,动态量化算子能够正确支持MoE架构下按张量进行全局缩放因子计算的量化需求,从而满足更复杂模型的量化任务。 修改方案描述 修改方案分为框架层和内核实现层。在框架层,移除了输入校验中对pertensor模式不支持group_index的限制,并新增了TPL_MOE_PER_TENSOR_FULL_LOAD和TPL_MOE_PER_TENSOR_LARGE_SHAPE两种量化模式枚举,扩展了内核分发逻辑以支持新模式。在内核实现层,新增了两个针对MoE场景优化的高性能量化内核:DynamicQuantRegbaseMoeFullLoadPertensor和DynamicQuantMoeLargeShapePertensor。它们均采用向量化指令优化,支持分组平滑,通过分阶段计算全局缩放因子和偏移量,并最终完成数据量化输出,以高效处理不同数据规模的MoE模型。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/2281 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> - [x] 泛化用例 (500条) - [x] 网络用例 (92条) - [x] 二级冒烟 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及文档更新。 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!3976 | 3 个月前 |
| dynamic_quant_v2算子新增pertensor量化模式的groupIndex支持 Co-authored-by: LiWeiJian16<liweijian16@huawei.com> # message auto-generated for no-merge-commit merge: !3976 merge dynamic_quant_moe_pertensor into master dynamic_quant_v2算子新增pertensor量化模式的groupIndex支持 Created-by: liweijian16 Commit-by: liweijian16;LiWeiJian16 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 本次PR扩展了动态量化算子对MoE(Mixture of Experts)模型场景的支持,核心解决了算子原有pertensor(按张量)量化模式无法处理分组索引(group_index)的问题。通过本次修改,动态量化算子能够正确支持MoE架构下按张量进行全局缩放因子计算的量化需求,从而满足更复杂模型的量化任务。 修改方案描述 修改方案分为框架层和内核实现层。在框架层,移除了输入校验中对pertensor模式不支持group_index的限制,并新增了TPL_MOE_PER_TENSOR_FULL_LOAD和TPL_MOE_PER_TENSOR_LARGE_SHAPE两种量化模式枚举,扩展了内核分发逻辑以支持新模式。在内核实现层,新增了两个针对MoE场景优化的高性能量化内核:DynamicQuantRegbaseMoeFullLoadPertensor和DynamicQuantMoeLargeShapePertensor。它们均采用向量化指令优化,支持分组平滑,通过分阶段计算全局缩放因子和偏移量,并最终完成数据量化输出,以高效处理不同数据规模的MoE模型。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/2281 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> - [x] 泛化用例 (500条) - [x] 网络用例 (92条) - [x] 二级冒烟 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及文档更新。 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!3976 | 3 个月前 |
| Format update: Adjusted the license description format in all relevant files. Co-authored-by: jiangqi<jiangqi47@h-partners.com> # message auto-generated for no-merge-commit merge: !366 merge license6 into master Format update: Adjusted the license description format in all relevant files. Created-by: jiangqi2025 Commit-by: jiangqi Merged-by: turing_project1 Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #123--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!366 | 8 个月前 |
| 放开 dynamicquantv2 中 dst_type_max 取值约束 Co-authored-by: transformer910<tianye82@h-partners.com> # message auto-generated for no-merge-commit merge: !4341 merge br_dquant_fix into master 放开 dynamicquantv2 中 dst_type_max 取值约束 Created-by: transformer910 Commit-by: transformer910 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 放开 dynamicquantv2 中 dst_type_max 取值约束。原先支持hifloat8的几个精度阈值0, 15, 56, 224, 32768,改为支持0 - 32768 的取值范围。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/2426 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地验证通过,冒烟用例通过。 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!4341 | 4 个月前 |