| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
npu_arch整改 Co-authored-by: wuyufei<wuyufei13@huawei.com> # message auto-generated for no-merge-commit merge: !6048 merge 1952 into master npu_arch整改 Created-by: wuyufei Commit-by: wuyufei Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 此 PR 旨在对 matmul 模块进行 "npu_arch 整改"——将分散在各处的 defined(__NPU_ARCH__) && (__NPU_ARCH__ == 5102) 硬编码架构判断替换为语义化的功能宏(__FIXED_POINT_ONLY_CUBE_TO_L0C__、__LUT_SUPPORT__、__CUBE_S8S4_S4S4__),同时新增一个统一的宏头文件 common/inc/op_kernel/macro.h 供所有文件通过 #include 引入。改动涉及 21 个文件,在每个文件顶部添加了条件编译的 #include 宏头文件块,并将原有的 __NPU_ARCH__ == 5102 条件逐一替换为对应的功能宏。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue [#3520](https://gitcode.com/cann/ops-nn/issues/3520) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!6048 | 3 个月前 | |
fusedmatmul新增可选参数innerprecise Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !6426 merge fusedaddmul into master fusedmatmul新增可选参数innerprecise Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->该 PR 为 FusedMatMul 算子新增了一个可选属性 inner_precise(整型,默认值为 0),用于控制矩阵乘内部向量融合计算的精度模式:0 表示高精度,1 表示高性能。该改动贯穿了算子的全链路——从算子定义、Proto 声明、API 接口、推导形状、Tiling 校验到二进制配置文件,确保 inner_precise 能在各层正确传递和校验。此外,在 aclnn_fused_matmul.cpp 中引入了 GetInnerPrecise() 函数,在特定条件下(非 FP32_ADD 计算类型、fusedOpType 为 add/mul、x/x2/x3 均为同一种 fp16 或 bf16 类型)自动将 innerPrecise 设为 1(高性能),其余情况保持 0(高精度)。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue [#3571](https://gitcode.com/cann/ops-nn/issues/3571) ## 测试 <!--描述进行了哪些测试来验证你的改动。-->本地构造用例验证通过,日志打印符合预期,冒烟通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。-->不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!6426 | 3 个月前 |