| x1 x2 int8输入,scale为float32和bfloat32场景,且为perchannel和pertoken场景支持大于65535,修复资料 Co-authored-by: wmg1<wangmingguang2@h-partners.com> # message auto-generated for no-merge-commit merge: !6978 merge cherry-pick-mr-6684-1783050783143-auto into 9.1.0 x1 x2 int8输入,scale为float32和bfloat32场景,且为perchannel和pertoken场景支持大于65535,修复资料 Created-by: wmg1 Commit-by: wmg1 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->x1 x2 int8输入,scale为float32和bfloat32场景,且为perchannel和pertoken场景支持内轴大于65535 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->https://gitcode.com/cann/ops-nn/issues/3811 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!6978 | 1 个月前 |
| wqbmmv3 do not support nz in dav3510 Co-authored-by: zhangquanxin<zhangquanxin7@h-partners.com> # message auto-generated for no-merge-commit merge: !4100 merge wqbmmv3_not_support_nz into master wqbmmv3 do not support nz in dav3510 Created-by: zhangquanxin Commit-by: zhangquanxin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> DAV_3510架构上,weight参数只支持FORMAT_ND格式,不支持FORMAT_FRACTAL_NZ。aclnnWeightQuantBatchMatmulV2接口已有此检查,V3接口缺失,需要统一添加格式校验。 通过将aclnnWeightQuantBatchMatmulV2中的格式检查逻辑抽取为独立函数 CheckWeightFormat(),然后在V2和V3两个接口中统一调用实现功能, 同时避免重复代码,提高可维护性。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> issue https://gitcode.com/cann/ops-nn/issues/2455 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 二级冒烟 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 无 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!4100 | 3 个月前 |
| nn类onnx算子插件支持 Co-authored-by: x00842564<xuyanke@huawei.com> Co-authored-by: ouyangxiantian<ouyangxiantian@h-partners.com> # message auto-generated for no-merge-commit merge: !452 merge master into master nn类onnx算子插件支持 Created-by: yanke-xu Commit-by: x00842564;ouyangxiantian Merged-by: cann-robot Description: ## 描述 涉及的onnx插件算子列表: 1. Elu 2. NPUFastGelu 3. NPUGeglu 4. NPUGeluV2 5. HardSigmoid 6. LeakyRelu 7. Mish 8. Selu 9. Shrink 10. NPUSoftmaxCrossEntropyWithLogits 11. Softmax 12. ThresholdedRelu 13. AdaCast 14. AdaptiveAvgPool2d 15. AdaptiveMaxPool2d 16. AscendAntiQuant 17. AscendDequant 18. AscendDequantS16 19. AscendQuant 20. AscendRequant 21. AscendRequantS16 22. BasicGRUInplaceFillWindowCache 23. BasicLSTMInplaceFillWindowCache 24. BatchMatMul 25. BatchNormalization 26. Celu 27. ConstantOfShape 28. DynSeqOuter 29. GlobalLpPool 30. GlobalMaxPool 31. GroupNormRelu 32. GRU 33. Hardmax 34. If 35. InstanceNormalization 36. Int8Dequantize 37. Int8GivenIntTensorFill 38. Int8Quantize 39. Int8Transpose 40. LogSoftmax 41. LRN 42. LSTM 43. LSTMP 44. MatMul 45. MeanVarianceNormalization 46. MovingSumWithSigmoid 47. NPUAnchorResponseFlags 48. NPUDropoutWithAddSoftmax 49. NPUGru 50. Resize 51. Size 52. SoftmaxCrossEntropyLoss 53. TopK 54. Unique 55. Shape 56. GatherElements 57. GatherND 58. Compress 59. Gather 60. NonZero 61. NPUScatter 62. ScatterElements 63. Scatter 64. QuantBatchMatMul 65. WeightQuantBatchMatmulV2 66. NPUAddRmsNorm 67. NPUGroupNormSilu 68. LpNormalization 69. NPURmsNorm 70. NPUAntiQuant 71. NPUAscendQuantV2 72. NPUDynamicQuant 73. NPUDynamicQuantV2 74. NPUGroupQuant 75. NPUQuantize ## 关联的Issue None ## 测试 编译构建、冒烟测试、静态扫描 ## 文档更新 None ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!452 | 8 个月前 |
| fix(qbmm): 迁移公共校验安全整改到 9.1.0 Co-authored-by: zhaoyingchao<zhaoyingchao1@hisilicon.com> Co-authored-by: gitcode-bot<noreply@gitcode.com> # message auto-generated for no-merge-commit merge: !7027 merge fix/9.1.0-qbmm-common-check into 9.1.0 fix(qbmm): 迁移公共校验安全整改到 9.1.0 Created-by: zhaoyingchao2 Commit-by: zhaoyingchao;gitcode-bot Merged-by: cann-robot Description: ## 描述 参考已合入 master 的 PR #6889(【qbmm】公共校验逻辑拆分与安全性增强),将 QBMM V4 公共校验与安全防护相关改动迁移到 9.1.0 分支: - 新增 matmul/quant_batch_matmul_v3/op_api/quant_matmul_v4_common.h,沉淀 V4 参数校验中的公共常量、tuple 类型、A8W4/MX/TCG 场景判断、NZ K0 选择、对齐检查和 format 判断等公共逻辑。 - aclnn_quant_matmul_v4.cpp 引入公共头文件并复用 quant_matmul_v4 命名空间,移除文件内重复定义,降低维护成本。 - 对 isA8W4Float、isA8W4Int、isMx、isA8W4Msd、IsMicroScaling、IsFormatNZ 等公共判断函数补充 nullptr 防护,避免可选 tensor 在场景识别中被直接解引用。 - 同步 AdaptiveSlidingWindowMXBasicAPITiling::GetApiLevel 的参数命名整改。 迁移说明:PR #6889 中部分 kernel 宏前移逻辑依赖 master 分支已有的宏头文件路径,9.1.0 分支当前不存在该头文件。因此本次迁移保留 9.1.0 现有平台宏路径,仅同步公共校验拆分、nullptr 防护和无副作用的参数命名整改。 ## 关联的Issue 关联Issue #3839:https://gitcode.com/cann/ops-nn/issues/3839 ## 测试 - 已执行 git diff --check upstream/9.1.0..HEAD,无空白错误。 - 已执行冲突标记检查:rg -n "<<<<<<<|=======|>>>>>>>",未发现残留冲突标记。 - 已检查新公共头文件与 PR #6889 中最终版本的 Git blob 一致:1eeffc4d1112e371c8d4efed327dd0e91bbe0fb7。 - 未执行完整编译/LLT:当前本地环境未配置 CANN 编译链路和对应运行环境。 ## 文档更新 不涉及文档更新。 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!7027 | 2 个月前 |
| docs: restore WeightNz FP8 support notes Co-authored-by: Hu1L1<chenshujian5@huawei.com> # message auto-generated for no-merge-commit merge: !5874 merge doc/weightnz-split into master docs: restore WeightNz FP8 support notes Created-by: Hu1L1 Commit-by: Hu1L1 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 为 quant_batch_matmul_v3 接入 ops-tensor Blaze Cube Tensor API 内核,支持 WeightNz 权重格式及 HIFP8 等低精度量化 MatMul 资料修改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/3078 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 资料修改,不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> aclnnQuantMatmulWeightNz.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!5874 | 2 个月前 |
| qbmm算子,x2 input, 外轴大于65536,weightnz场景,部分case有精度问题 Co-authored-by: liyuanqiang<liyuanqiang@huawei.com> # message auto-generated for no-merge-commit merge: !7301 merge 910qbmm into 9.1.0 qbmm算子,x2 input, 外轴大于65536,weightnz场景,部分case有精度问题 Created-by: liyuanqiang Commit-by: liyuanqiang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #issue: [#3847](https://gitcode.com/cann/ops-nn/issues/3847) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7301 | 1 个月前 |
| 【Blaze】update Epilogue namespace Co-authored-by: LINxu233<linxu5@huawei.com> # message auto-generated for no-merge-commit merge: !7493 merge fix-namespace-9.1.0 into 9.1.0 【Blaze】update Epilogue namespace Created-by: LINxu233 Commit-by: LINxu233 Merged-by: cann-robot Description: ## 描述 适配Tensor仓重构 切换Epilogue组件namespace ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4059 ## 测试 MM aswt ## 文档更新 已更新 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!7493 | 1 个月前 |
| qbmm算子,x2 input, 外轴大于65536,weightnz场景,部分case有精度问题 Co-authored-by: liyuanqiang<liyuanqiang@huawei.com> # message auto-generated for no-merge-commit merge: !7301 merge 910qbmm into 9.1.0 qbmm算子,x2 input, 外轴大于65536,weightnz场景,部分case有精度问题 Created-by: liyuanqiang Commit-by: liyuanqiang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #issue: [#3847](https://gitcode.com/cann/ops-nn/issues/3847) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7301 | 1 个月前 |
| fix qbmmv3 depend Co-authored-by: liuyufan0725<liuyufan9@huawei.com> # message auto-generated for no-merge-commit merge: !5065 merge qbmm_depend into master fix qbmmv3 depend Created-by: liuyufan0725 Commit-by: liuyufan0725 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 删除qbmmv3的冗余依赖,包括mat_mul_v3、batch_mat_mul_v3、gemm_v3 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue [#2788](https://gitcode.com/cann/ops-nn/issues/2788) 关联Issue [#2749](https://gitcode.com/cann/ops-nn/issues/2749) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 编ascend950、910b的qbmmv3自定义算子包并执行run_example均功能正常    ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!5065 | 3 个月前 |
| 批量修改md中冗余空格 Co-authored-by: wuyao51511<wuyao61@h-partners.com> # message auto-generated for no-merge-commit merge: !6027 merge master into master 批量修改md中冗余空格 Created-by: wuyao51511 Commit-by: wuyao51511 Merged-by: cann-robot Description: ## 描述 文档空格问题清理 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!6027 | 2 个月前 |