| 【QuantBatchMatmul算子】mxfp8量化模式支持weightnz aclnn接口资料 Co-authored-by: fengxingpan1<fengxingpan@h-partners.com> # message auto-generated for no-merge-commit merge: !1297 merge nznote into master 【QuantBatchMatmul算子】mxfp8量化模式支持weightnz aclnn接口资料 Created-by: fengxingpan1 Commit-by: fengxingpan1 Merged-by: cann-robot Description: ## 描述 QuantBatchMatmul算子 aclnnQuantMatmulWeightNz接口支持mxfp8 weightNz特性,更新aclnnQuantMatmulWeightNz接口文档,并修改.h注释 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/675 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 更新了README.md文件matmul/quant_batch_matmul_v3/docs/aclnnQuantMatmulWeightNz.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1297 | 5 个月前 |
| 【QBMMv4】新增int8支持GB量化场景 Co-authored-by: bynshard<zhangbingshuai@huawei.com> # message auto-generated for no-merge-commit merge: !1126 merge devqbmm into master 【QBMMv4】新增int8支持GB量化场景 Created-by: steppecat Commit-by: bynshard Merged-by: cann-robot Description: ## 描述 【QuantBatchMatMulv4】新增int8支持GB量化场景,同时支持bias 量化场景支持:int8输入的pergroup-perblock场景。 修改算子:QuantBatchMatmulV4 ## 关联的Issue Issue #629 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1126 | 6 个月前 |
| nn类onnx算子插件支持 Co-authored-by: x00842564<xuyanke@huawei.com> Co-authored-by: ouyangxiantian<ouyangxiantian@h-partners.com> # message auto-generated for no-merge-commit merge: !452 merge master into master nn类onnx算子插件支持 Created-by: yanke-xu Commit-by: x00842564;ouyangxiantian Merged-by: cann-robot Description: ## 描述 涉及的onnx插件算子列表: 1. Elu 2. NPUFastGelu 3. NPUGeglu 4. NPUGeluV2 5. HardSigmoid 6. LeakyRelu 7. Mish 8. Selu 9. Shrink 10. NPUSoftmaxCrossEntropyWithLogits 11. Softmax 12. ThresholdedRelu 13. AdaCast 14. AdaptiveAvgPool2d 15. AdaptiveMaxPool2d 16. AscendAntiQuant 17. AscendDequant 18. AscendDequantS16 19. AscendQuant 20. AscendRequant 21. AscendRequantS16 22. BasicGRUInplaceFillWindowCache 23. BasicLSTMInplaceFillWindowCache 24. BatchMatMul 25. BatchNormalization 26. Celu 27. ConstantOfShape 28. DynSeqOuter 29. GlobalLpPool 30. GlobalMaxPool 31. GroupNormRelu 32. GRU 33. Hardmax 34. If 35. InstanceNormalization 36. Int8Dequantize 37. Int8GivenIntTensorFill 38. Int8Quantize 39. Int8Transpose 40. LogSoftmax 41. LRN 42. LSTM 43. LSTMP 44. MatMul 45. MeanVarianceNormalization 46. MovingSumWithSigmoid 47. NPUAnchorResponseFlags 48. NPUDropoutWithAddSoftmax 49. NPUGru 50. Resize 51. Size 52. SoftmaxCrossEntropyLoss 53. TopK 54. Unique 55. Shape 56. GatherElements 57. GatherND 58. Compress 59. Gather 60. NonZero 61. NPUScatter 62. ScatterElements 63. Scatter 64. QuantBatchMatMul 65. WeightQuantBatchMatmulV2 66. NPUAddRmsNorm 67. NPUGroupNormSilu 68. LpNormalization 69. NPURmsNorm 70. NPUAntiQuant 71. NPUAscendQuantV2 72. NPUDynamicQuant 73. NPUDynamicQuantV2 74. NPUGroupQuant 75. NPUQuantize ## 关联的Issue None ## 测试 编译构建、冒烟测试、静态扫描 ## 文档更新 None ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!452 | 7 个月前 |
| Matmul使用的SocVerison整改为NpuArch新接口 Co-authored-by: wangmingli<wangmingli6@h-partners.com> # message auto-generated for no-merge-commit merge: !1850 merge 9.0.0-beta.1 into 9.0.0-beta.1 Matmul使用的SocVerison整改为NpuArch新接口 Created-by: wangmingli Commit-by: wangmingli Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 根据开源要求,Matmul目录下的950的SocVerison需要使用NpuArch新接口作为区分代码分支的判断逻辑; 因此本PR对代码中涉及使用950的socversion的地方进行了替换,并对UT测试框架进行了兼容NpuArch的适配,对存量的Ascend910_95等命名的函数和类名进行了更改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/701 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地mm用例验证 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1850 | 5 个月前 |
| Arch编码更新 Co-authored-by: yang-di52<yangdi52@huawei.com> # message auto-generated for no-merge-commit merge: !1116 merge ut_test into master Arch编码更新 Created-by: yang-di52 Commit-by: yang-di52 Merged-by: cann-robot Description: ## 描述 Arch编码更新 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1116 | 6 个月前 |
| 优化QBMM pertoken decode性能 Co-authored-by: wuyi_huawei<wuyi36@hisilicon.com> # message auto-generated for no-merge-commit merge: !1225 merge master into master 优化QBMM pertoken decode性能 Created-by: wuyi_huawei Commit-by: wuyi_huawei Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 将m<=256的KC走入pertoken增量优化模板: 1.不带batch/bias; 2.M<=256(1~256); 3.K/N都64对齐(64~16K)的A false, Weight-ND时btrans=true/Weight-NZ时btrans=false用例; 4.每个核上只处理一个baseM ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #415 <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 测试2900个用例,新走进优化模板精度pass,性能收益:在大shape下收益5.5%,N<=4096下收益12%。 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。-->NA ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1225 | 5 个月前 |
| 优化QBMM pertoken decode性能 Co-authored-by: wuyi_huawei<wuyi36@hisilicon.com> # message auto-generated for no-merge-commit merge: !1225 merge master into master 优化QBMM pertoken decode性能 Created-by: wuyi_huawei Commit-by: wuyi_huawei Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 将m<=256的KC走入pertoken增量优化模板: 1.不带batch/bias; 2.M<=256(1~256); 3.K/N都64对齐(64~16K)的A false, Weight-ND时btrans=true/Weight-NZ时btrans=false用例; 4.每个核上只处理一个baseM ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #415 <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 测试2900个用例,新走进优化模板精度pass,性能收益:在大shape下收益5.5%,N<=4096下收益12%。 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。-->NA ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1225 | 5 个月前 |
| Matmul使用的SocVerison整改为NpuArch新接口 Co-authored-by: wangmingli<wangmingli6@h-partners.com> # message auto-generated for no-merge-commit merge: !1850 merge 9.0.0-beta.1 into 9.0.0-beta.1 Matmul使用的SocVerison整改为NpuArch新接口 Created-by: wangmingli Commit-by: wangmingli Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 根据开源要求,Matmul目录下的950的SocVerison需要使用NpuArch新接口作为区分代码分支的判断逻辑; 因此本PR对代码中涉及使用950的socversion的地方进行了替换,并对UT测试框架进行了兼容NpuArch的适配,对存量的Ascend910_95等命名的函数和类名进行了更改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/701 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地mm用例验证 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1850 | 5 个月前 |
| 支持wqbmmv2/qbmmv4 pta nz场景单算子并优化图模式下NZ场景 Co-authored-by: 张泉新<zhangquanxin7@h-partners.com> # message auto-generated for no-merge-commit merge: !851 merge master into master 支持wqbmmv2/qbmmv4 pta nz场景单算子并优化图模式下NZ场景 Created-by: zhangquanxin Commit-by: 张泉新 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 支持wqbmmv2/qbmmv4 pta nz场景单算子; 伪量化图模式支持NZ_C0_2数据格式。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> Issue #https://gitcode.com/cann/ops-nn/issues/476 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 二级冒烟 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/quant_batch_matmul_v3/CMakeLists.txt matmul/quant_batch_matmul_v3/docs/aclnnQuantMatmulWeightNz.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!851 | 6 个月前 |
| add kirin9030 ops: index matmul pooling Co-authored-by: zengjuan<zengjuan2@huawei.com> # message auto-generated for no-merge-commit merge: !1091 merge master into master add kirin9030 ops: index matmul pooling Created-by: zengjuan Commit-by: zengjuan Merged-by: cann-robot Description: ## 描述 add kirin9030 ops: index matmul pooling index/apply_top_k_top_p_with_sorted index/embedding_bag index/gather_elements_v2 index/inplace_index_add_with_sorted index/linear_index index/scatter_add_with_sorted index/scatter_list matmul/batch_mat_mul_v3 matmul/gemm_v2 matmul/mat_mul_v3 matmul/quant_batch_matmul_v3 matmul/quant_batch_matmul_v4 matmul/transpose_batch_mat_mul matmul/weight_quant_batch_matmul_v2 pooling/adaptive_avg_pool3d pooling/adaptive_max_pool3d pooling/avg_pool3_d pooling/max_pool3d_with_argmax_v2 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/723 ## 测试 蓝区门禁、黄区门禁、算子二级冒烟 ## 文档更新 无 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!1091 | 5 个月前 |