| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
增加UT用例 Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !10242 merge npugpu into master 增加UT用例 Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->补充alpha和beta等于0时的UT ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #5737 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->UT流水线通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。-->不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10242 | 18 天前 | |
matmul类算子原型迁移 Co-authored-by: jgx12<jingaoxiang@huawei.com> # message auto-generated for no-merge-commit merge: !10262 merge matmul_ir into master matmul类算子原型迁移 Created-by: jgx12 Commit-by: jgx12 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 对 matmul 类算子的算子原型(OP 原型定义)进行迁移:将 BatchMatMul、BatchMatMulV2、MatMul、MatMulV2 等算子的 REG_OP 定义从公共头文件 common/inc/op_graph/op_nn_proto_extend.h 中移除,分别迁移到新增的独立目录头文件 matmul/mat_mul_v3/op_graph/mat_mul_proto_extend.h(定义 MatMul 与 MatMulV2)和 matmul/batch_mat_mul_v3/op_graph/batch_mat_mul_proto_extend.h(定义 BatchMatMul 与 BatchMatMulV2) ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/6171 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->  ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 无 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10262 | 1 天前 | |
support add_all_module_source支持一个算子 只配置一个CMakeList.txt Co-authored-by: chenqi317<chenqi317@huawei.com> # message auto-generated for no-merge-commit merge: !8380 merge master into master support add_all_module_source支持一个算子 只配置一个CMakeList.txt Created-by: chenqi317 Commit-by: chenqi317 Merged-by: cann-robot Description: 此 PR 引入了新的 CMake 宏 add_all_modules_sources 作为算子顶层 CMakeLists.txt 的统一编译入口,旨在简化算子构建配置。同时,底层函数 add_kernel_sources 和 AddOpTestCase 也进行了适配,支持从算子顶层目录调用,替代原先必须在特定子目录(如 op_kernel、tests/ut/op_kernel)内调用的限制。整体改动通过自适应目录位置、收编 UT 源收集逻辑,提升构建系统的灵活性和可维护性。 主要改动 新增 add_all_modules_sources 宏:在 cmake/func.cmake 中新增统一入口宏,支持 OPTYPE、ACLNNTYPE、DEPENDENCIES、COMPUTE_UNIT、TILING_DIR、DISABLE_IN_OPP 等参数;自动适配 op_api 目录在算子根或 op_host 子目录下的两种布局,内部复用 add_modules_sources 并触发 add_all_ut_sources 收集 UT 源。 新增 add_all_ut_sources 宏:在 cmake/func.cmake 中新增 UT 源收集宏,根据 UT_TEST_ALL、OP_API_UT、OP_HOST_UT、OP_GRAPH_UT 等条件分别收集 tests/ut/op_api、tests/ut/op_host、tests/ut/op_graph 下的测试源文件,并兼容历史布局 tests/ut/op_host/op_api。 add_kernel_sources 适配新调用位置:当 CMAKE_CURRENT_SOURCE_DIR 不以 /op_kernel 结尾时,自动将 SOURCE_DIR 拼接 /op_kernel 子目录,使该函数支持从算子顶层目录被调用。 AddOpTestCase 支持自定义 UT 源目录:新增 UT_SRC_DIR 参数用于指定 UT 源文件所在目录;_tiling_def.h 的 include 路径和 *.cpp 测试用例文件的 file(GLOB) 扫描路径均改用 _ut_src_dir 变量,替代原先硬编码的 CMAKE_CURRENT_SOURCE_DIR。 AddOpTestCase 优化算子目录推导:优先使用 add_op_subdirectory 设置的全局变量 OP_DIR 确定算子根目录,当该变量未定义或为空时才回退到原有的三级父目录推导逻辑(tests/ut/op_kernel 内部调用方式),增强了从算子顶层调用的兼容性。 See merge request: cann/ops-nn!8380 | 1 个月前 | |
fix st test action Co-authored-by: he_kan<hekan4@huawei.com> # message auto-generated for no-merge-commit merge: !10822 merge ci into master fix st test action Created-by: he_kan Commit-by: he_kan Merged-by: cann-robot Description: ## 描述 修正现有st问题和yml问题 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10822 | 1 天前 | |
fix convert weight to int4 pack error Co-authored-by: zhangquanxin<zhangquanxin7@h-partners.com> # message auto-generated for no-merge-commit merge: !10538 merge convert_int4pack_example_fix into master fix convert weight to int4 pack error Created-by: zhangquanxin Commit-by: zhangquanxin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 该 PR 修复了 test_aclnn_convert_weight_to_int4_pack.cpp 示例在 Ascend950 上跑不通的问题:将原先 NZ/转置场景的写法改为 ND 格式下的标准流程(n 改为 16 保证 INT4 打包内轴为偶数),并把 CreateAclTensorInt4 合并进 CreateAclTensor(按 hostData 实际字节数申请内存,天然兼容 INT4 打包),删除了 CEIL_DIV/CEIL_ALIGN 宏及死代码分支,保留 unique_ptr 资源管理。同时修正了文档 aclnnConvertWeightToINT4Pack.md 中 Ascend 950 段两个示例:NZ 场景的 matmul 调用由 aclnnWeightQuantBatchMatmulV2 改为 950 专用的 aclnnWeightQuantBatchMatmulNz 接口,按示例风格重构并统一 unique_ptr 管理,附带修复 FLOAT 示例中 fp8_e8m0 scale 初值错误(1 改为 0b01111111)。 修复了A8W4 NZ场景下, 日志输出的shape两边没有括号问题。 修复了AntiQuantMatmulFusionPass融合日志缺少约束问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> issue https://gitcode.com/cann/ops-nn/issues/5143 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ut验证 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/convert_weight_to_int4_pack/docs/aclnnConvertWeightToINT4Pack.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!10538 | 11 天前 | |
fix aclnn doc problem Co-authored-by: zhangquanxin<zhangquanxin7@h-partners.com> # message auto-generated for no-merge-commit merge: !10912 merge modify_doc_problem_0921 into master fix aclnn doc problem Created-by: zhangquanxin Commit-by: zhangquanxin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 本 PR 为文档修正类改动,主要更新 matmul 相关 aclnn 接口头文件中的注释说明,使参数的数据类型支持列表与实际接口能力保持一致。涉及 aclnnQuantMatmulWeightNz、aclnnQuantMatmulV5 与 aclnnWeightQuantBatchMatmulNz 三个接口的注释,补充了部分数据类型说明并修正了 yScale 的参数描述与标点格式。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> issue https://gitcode.com/cann/ops-nn/issues/6091 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/dual_level_quant_batch_matmul/docs/aclnnDualLevelQuantMatmulWeightNz.md matmul/quant_batch_matmul_v4/docs/aclnnQuantMatmulV5.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!10912 | 7 天前 | |
flat_quant: 目录整改,op_api从op_host/op_api提升为与op_host同级目录 Co-authored-by: yushan-kite<zhangyushan11@huawei.com> # message auto-generated for no-merge-commit merge: !10669 merge flat_quant into master flat_quant: 目录整改,op_api从op_host/op_api提升为与op_host同级目录 Created-by: yushan-kite Commit-by: yushan-kite Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 目录整改,op_api从op_host/op_api提升为与op_host同级目录 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5953 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> UT ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10669 | 8 天前 | |
[Fix] fix mis-matched dtype in aclrtMemcpy of aclnnFusedLinearCrossEntropyLossGrad examples Co-authored-by: jisihuai<jisihuai@h-partners.com> # message auto-generated for no-merge-commit merge: !10010 merge test into master [Fix] fix mis-matched dtype in aclrtMemcpy of aclnnFusedLinearCrossEntropyLossGrad examples Created-by: jisihuai Commit-by: jisihuai Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 解决aclnnFusedLinearCrossEntropyLossGrad examples/markdown中float32与bf16类型冲突问题 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> example样例编译运行成功 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10010 | 20 天前 | |
feat(fused_linear_online_max_sum): FusedLinearOnlineMaxSum 支持 Ascend 950(arch35) Co-authored-by: ykxxlzhong<luzhihong3@hisilicon.com> # message auto-generated for no-merge-commit merge: !10517 merge long_tail into master feat(fused_linear_online_max_sum): FusedLinearOnlineMaxSum 支持 Ascend 950(arch35) Created-by: ykxxlzhong Commit-by: ykxxlzhong Merged-by: cann-robot Description: ## 变更说明 FusedLinearOnlineMaxSum 当前仅支持 A2/A3(arch22)。本 PR 为算子适配 Ascend 950PR/950DT(DAV_3510 / arch35),补齐 vocabulary 并行交叉熵前半段(matmul + online max/sum)在 A5 上的算子能力。 ## 关联的ISSUE [#5973](https://gitcode.com/cann/ops-nn/issues/5973) ## 变更内容 ### 算子实现 - op_kernel/fused_linear_online_max_sum.h:共享 kernel 模板参数化改造;A2/A3 原有逻辑用 __NPU_ARCH__ 宏隔离保持不变,A5 独有 float 路径独立宏隔离(mm 输出固定 FP32,hp/lm 分支经 arch35 宏隔离) - op_kernel/arch35/fused_linear_online_max_sum.cpp:arch35 kernel 入口 - op_kernel/arch35/fused_linear_online_max_sum_tiling_data.h / _tiling_key.h:arch35 纯 struct tiling 定义与 tiling key - op_host/fused_linear_online_max_sum_tiling.cpp:arch35 tiling 适配 - op_host/fused_linear_online_max_sum_def.cpp:新增 ascend950 AICore 配置 - op_host/config/ascend950/fused_linear_online_max_sum_binary.json:950 二进制配置 - CMakeLists.txt:新增 arch35 kernel 源(ascend950/ascend350 编译单元) ### 文档 - docs/aclnnFusedLinearOnlineMaxSum.md:950 产品支持改为"支持";修正 targetMask 公式(>= vocabEndIndex)与 padding 位取值说明;补充 950 默认确定性实现说明 ### 测试 - tests/assets/{aclnn,e2e,kernel}_fused_linear_online_max_sum_golden.py:TTK golden,浮点输出统一 cross_check L2 三方交叉校验(int/uint 输出 binary_equal) ## 测试与验证 - TTK:golden 三方比对依赖 GPU third_party,远端 XPU 不可用时浮点输出 GOLDEN_FAILURE - RDV:执行A2/A3 RDV看护用例,修改未影响A2/A3输出结果 See merge request: cann/ops-nn!10517 | 5 天前 | |
fmm/tbmm的aclnn接口日志问题修复 Co-authored-by: gaozheng<gaozheng16@huawei.com> # message auto-generated for no-merge-commit merge: !10532 merge dts_fmm_log into master fmm/tbmm的aclnn接口日志问题修复 Created-by: pzyy00 Commit-by: gaozheng Merged-by: cann-robot Description: ## 描述 fmm/tbmm aclnn接口日志与资料问题描述不一致,根据资料对日志进行修改 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/6118 ## 测试 本地验证ok ## 文档更新 不涉及 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [ ] AI辅助编写 See merge request: cann/ops-nn!10532 | 6 天前 | |
matmul算子添加ut,提升ut覆盖率 Co-authored-by: wangwei_mayday<wangwei1183@huawei.com> # message auto-generated for no-merge-commit merge: !10210 merge ut_test_new into master matmul算子添加ut,提升ut覆盖率 Created-by: wangwei_mayday Commit-by: wangwei_mayday Merged-by: cann-robot Description: ## 描述 当前matmul算子行覆盖率和函数覆盖率较低,对matmul算子中的tbmm,tqbmm,matmulv3,bmm等算子增加ut,全面覆盖 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->关联Issue [#4993](https://gitcode.com/cann/ops-nn/issues/4993) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ x ] 其他,请描述:添加测试用例 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ x ] AI辅助编写 See merge request: cann/ops-nn!10210 | 17 天前 | |
AI意见修改 Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !9630 merge gemmziliao into master AI意见修改 Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->对 matmul 系列算子(addmv、fused_matmul、gemm)的 host 侧接口代码进行健壮性加固与逻辑整理 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #5481 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->冒烟测试通过,资料整改 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/gemm/docs/aclnnGemm.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9630 | 26 天前 | |
log_fix Co-authored-by: Alpha123_<202230091296@mail.scut.edu.cn> # message auto-generated for no-merge-commit merge: !8828 merge master into master log_fix Created-by: Alpha123_ Commit-by: Alpha123_ Merged-by: cann-robot Description: ## 描述 算子的信息中存在拼写错误,且日志中存在中文、缺失度量等问题,影响日志可读性和易用性 整改issue ## 关联的Issue [https://gitcode.com/cann/ops-nn/issues/4864](url) ## 文档更新 [https://gitcode.com/cann/ops-nn/tree/master/matmul/addmv](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/batch_mat_mul_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/common](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/fused_mat_mul](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/gemm_v2](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/gemm_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/mat_mul_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/matmul_v2_compress_dequant](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/mv](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/rotate_quant](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/transpose_batch_mat_mul](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/transpose_quant_batch_mat_mul](url) ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8828 | 1 个月前 | |
master:gemmV3修复数组越界访问,添加维度检查 Co-authored-by: AlbertYoung192<yangtao363@huawei.com> # message auto-generated for no-merge-commit merge: !10068 merge master into master master:gemmV3修复数组越界访问,添加维度检查 Created-by: AlbertYoung192 Commit-by: AlbertYoung192 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> gemmV3存在数组越界访问问题,需要添加维度检查 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5787 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 二级冒烟、本地自验证 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10068 | 18 天前 | |
matmul类算子原型迁移 Co-authored-by: jgx12<jingaoxiang@huawei.com> # message auto-generated for no-merge-commit merge: !10262 merge matmul_ir into master matmul类算子原型迁移 Created-by: jgx12 Commit-by: jgx12 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 对 matmul 类算子的算子原型(OP 原型定义)进行迁移:将 BatchMatMul、BatchMatMulV2、MatMul、MatMulV2 等算子的 REG_OP 定义从公共头文件 common/inc/op_graph/op_nn_proto_extend.h 中移除,分别迁移到新增的独立目录头文件 matmul/mat_mul_v3/op_graph/mat_mul_proto_extend.h(定义 MatMul 与 MatMulV2)和 matmul/batch_mat_mul_v3/op_graph/batch_mat_mul_proto_extend.h(定义 BatchMatMul 与 BatchMatMulV2) ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/6171 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->  ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 无 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10262 | 1 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 19 天前 | |
fit ascend350 Co-authored-by: wuyufei<wuyufei13@huawei.com> # message auto-generated for no-merge-commit merge: !10649 merge master into master fit ascend350 Created-by: wuyufei Commit-by: wuyufei Merged-by: cann-robot Description: ## 描述 本 PR 围绕 MatmulEmuSplitWeight 算子对 ascend350 平台的适配展开,主要通过新增平台配置、放开 SocVersion 校验、注册 tiling 入口以及补充单元测试,使该算子能够在 Ascend350 上被识别与调度。改动同时保持对原有 Ascend950 平台的支持。 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/6014 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!10649 | 9 天前 | |
修复matmul目录下L2_DFX_PHASE_1宏DFX_IN缺失参数或顺序不符问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10408 merge fix_dfx_in_matmul_5526 into master 修复matmul目录下L2_DFX_PHASE_1宏DFX_IN缺失参数或顺序不符问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 概述 修复 issue #5526 中 matmul 目录下的 10 处 L2_DFX_PHASE_1 宏 DFX_IN 缺失参数或顺序不符问题(issue 中其余目录问题已由其他 PR 修复,本 PR 处理遗留的 matmul 部分): | 算子接口 | 修复内容 | |---|---| | aclnnDualLevelQuantMatmulWeightNz | 补充 transposeX1/transposeX2/level0GroupSize/level1GroupSize | | aclnnMatmulCompressDequant | 补充 offsetW | | aclnnQuantMatmulV3 | 补充 transposeX1/transposeX2 | | aclnnQuantMatmulV4 | 补充 transposeX1/transposeX2 | | aclnnQuantMatmulReduceSumWeightNz | 补充 yScale/x1Offset/x2Offset/yOffset/bias/transposeX1/transposeX2/groupSize/dims/keepDims | | aclnnRotateQuant | 补充 axis/roundMode/scaleAlg/dstTypeMax/trans | | aclnnWeightQuantBatchMatmul | DFX_IN 参数顺序与接口参数顺序对齐 | | aclnnWeightQuantBatchMatmulV2 | 补充 antiquantGroupSize | | aclnnWeightQuantBatchMatmulV3 | 补充 antiquantGroupSize/innerPrecise | | aclnnWeightQuantBatchMatmulNz | 补充 antiquantGroupSize | ## 验证 - 所有改动文件已通过 clang-format v18.1.8 --style=file 全文件检查 - 仅修改 DFX_IN 宏参数列表,不涉及任何功能逻辑变更 ## 关联的Issue fixes #5526 See merge request: cann/ops-nn!10408 | 14 天前 | |
aclnn_einsum.cpp文件整改 Co-authored-by: wangwei_mayday<wangwei1183@huawei.com> # message auto-generated for no-merge-commit merge: !9204 merge master into master aclnn_einsum.cpp文件整改 Created-by: wangwei_mayday Commit-by: wangwei_mayday Merged-by: cann-robot Description: ## 描述 当前matmul/batch_mat_mul_v3/op_host/op_api/aclnn_einsum.cpp下面存在以下这些问题: 1.HandleAxB2AB 缺少空指针检查导致段错误,函数中leftMatrix,rightMatrix和result这三个参数军缺乏空指针校验 2.UniqueExecutor 析构时 561102 警告导致内部状态损坏,HandleABCDxABCED2ABCE 和 HandleAxB2AB的OP_CHECK_WRONG_DIMENSION判断在uniqueExecutor构造之后析构之前,OP_CHECK_WRONG_DIMENSION 宏在维度检查失败时直接 return ACLNN_ERR_PARAM_INVALID,此时 uniqueExecutor 尚未调用 ReleaseTo(executor),触发析构函数输出 561102 警告,析构函数在清理中间资源时可能损坏了全局内部状态(如 op executor 的内存池),导致后续 API 调用访问已释放的内存。 3.HandleAxB2AB 缺少 output shape 校验,HandleABCDxABCED2ABCE做了校验 4.equation 空指针内部使用 561103 而非 161001,CheckNotNull 返回 false 后,CheckParams 通过 CHECK_RET(CheckNotNull(...), ACLNN_ERR_PARAM_NULLPTR) 转换,最终 aclnnEinsumGetWorkspaceSize 返回 161001 给调用方。因此错误码验证通过,但日志中的 561103 与文档不一致。 以及matmul/mat_mul_v3/op_host/op_tiling/arch35/matmul_v3_common_advanced.h中存在的问题: 已存在全局变量constexpr uint64_t NUM_THREE = 3UL;,无需重复定义constexpr uint64_t THREE_DIM_NUM = 3; 引用到THREE_DIM_NUM的代码都需要做出修改 对以上问题做出整改 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->关联Issue [#5153](https://gitcode.com/cann/ops-nn/issues/5153) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ x ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ x ] AI辅助编写 See merge request: cann/ops-nn!9204 | 28 天前 | |
fix st test action Co-authored-by: he_kan<hekan4@huawei.com> # message auto-generated for no-merge-commit merge: !10822 merge ci into master fix st test action Created-by: he_kan Commit-by: he_kan Merged-by: cann-robot Description: ## 描述 修正现有st问题和yml问题 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10822 | 1 天前 | |
refactor(matmul): unify Tensor API kernels and tune QBMM tiling Co-authored-by: smdbha<panzhijie2@huawei.com> # message auto-generated for no-merge-commit merge: !9970 merge master into master refactor(matmul): unify Tensor API kernels and tune QBMM tiling Created-by: smdbha Commit-by: smdbha Merged-by: cann-robot Description: ## 描述 统一 Ascend 950 上 QuantBatchMatmulV3 与 QuantBatchMatmulInplaceAdd 的 Tensor API 单 batch 内核及 tiling 数据路径: - 将 Cube、MIX 和 MX 的有 batch/无 batch Tensor API 入口合并到对应 Blaze 内核头文件,清理重复的 CMCT 与独立无 batch实现。 - 为非 MX Cube 路径增加无 batch Tensor API tiling 数据、tiling key 和内核分发。 - 优化 Adaptive Sliding Window Cube tiling,包括基础块负载均衡、单轮尾块归一化、L1 2/3/4 buffer 选择、stepK 调整以及 A 全载策略。 - 同步更新 QuantBatchMatmulV3 和 QuantBatchMatmulInplaceAdd 的 Host/Kernel UT 数据及预期 tiling key。 ## 关联的Issue 关联 Issue:[#5624](https://gitcode.com/cann/ops-nn/issues/5624) ## 测试 - git diff --check upstream/master f9ffee7bd46711d6a9016b5a566f06d1081a5a7e 通过。 - 提交中已更新相关 Host/Kernel UT 用例及预期数据。 ## 文档更新 无。 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:Tensor API 内核与 tiling 路径重构 ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!9970 | 5 天前 | |
docs: 新增QuantBatchMatmulV4/WeightQuantBatchMatmulV2算子Ascend IR接口文档 Co-authored-by: maqijun<maqijun@h-partners.com> # message auto-generated for no-merge-commit merge: !10747 merge docs/ascendir_quant_mm into master docs: 新增QuantBatchMatmulV4/WeightQuantBatchMatmulV2算子Ascend IR接口文档 Created-by: maqijun Commit-by: maqijun Merged-by: cann-robot Description: ## 描述 为方便在nn仓直接查询常用算子的算子原型IR定义,参考PR https://gitcode.com/cann/ops-nn/pull/10433 的格式,按照新模板补充IR资料,新增QuantBatchMatmulV4、WeightQuantBatchMatmulV2两个算子的Ascend IR接口文档。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5994 ## 测试 无 ## 文档更新 matmul/quant_batch_matmul_v4/docs/ascendir_QuantBatchMatmulV4.md matmul/weight_quant_batch_matmul_v2/docs/ascendir_WeightQuantBatchMatmulV2.md ## 类型标签 - [x] 文档更新 ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!10747 | 5 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 19 天前 | |
fix(matmul): 修复量化 MatMul shape 报错缺少方括号(master) Co-authored-by: Hu1L1<chenshujian5@huawei.com> # message auto-generated for no-merge-commit merge: !11033 merge codex/fix-qbmm-bias-shape-brackets-master into master fix(matmul): 修复量化 MatMul shape 报错缺少方括号(master) Created-by: Hu1L1 Commit-by: Hu1L1 Merged-by: cann-robot Description: ## 描述 修复 QBMMv3、QBMMIA 和 QuantMatmulActivationQuant 在 shape 校验失败时,错误信息中的实际 shape 缺少方括号的问题。例如实际 shape 为 [16] 时,错误信息由 incorrect shape 16 改为 incorrect shape [16]。 - QBMMv3:为一维 bias 和 x1Scale/x2Scale 的 4 处 shape 上报补上方括号。 - QBMMIA:9 处 shape 上报直接使用 op::ToString(shape).GetString() 保留完整 shape。 - QuantMatmulActivationQuant:8 处 shape 上报同样保留完整 shape,覆盖 x1/x2、scale 和输出校验。 - 删除公共头文件 matmul/common/op_host/log_format_util.h 中的 StripEnclosingSquareBrackets(),清理全部调用和 using 声明。 改动涉及 API 日志格式及公共日志工具清理。校验条件、返回值和计算逻辑保持不变,QBMMv4 tiling 不在本次修改范围内。 目标分支:master。 ## 关联的Issue 关联并修复 [#6129](https://gitcode.com/cann/ops-nn/issues/6129)。 ## 测试 - 本地使用 pre-commit 4.3.0 对完整 PR 的 6 个文件执行 pre-commit run --show-diff-on-failure --files ...,所有适用检查通过(退出码 0)。 - clang-format 18.1.8 已修正 QuantMatmulActivationQuant 的 6 处参数换行,复检通过;这次格式修复没有改变代码 token 或日志字符串。 - OAT 实际扫描 6 个文件通过;复检按脚本规则复用该结果。 - git diff --check 通过。 - 已静态复核两个分支的补丁一致,完整 PR 涉及 6 个文件、21 处 shape 日志及公共函数和无用 using 清理。 - 全仓搜索确认 StripEnclosingSquareBrackets 已无定义或引用。 - 已复核 shape 字符串在日志宏内复制到 std::string 的生命周期。 - 本次改动未执行算子编译、UT 或设备测试。 ## 文档更新 无。 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!11033 | 6 天前 | |
去掉公式中多余的斜杠 Co-authored-by: fwx1169505<fengying27@h-partners.com> # message auto-generated for no-merge-commit merge: !10841 merge master into master 去掉公式中多余的斜杠 Created-by: fengying555682 Commit-by: fwx1169505 Merged-by: cann-robot Description: ## 描述 去掉公式中多余的斜杠 ## 关联的Issue [#6034](https://gitcode.com/cann/ops-nn/issues/6034) ## 测试 已经完成文档语法以及链接一致性检查。 ## 文档更新 matmul/quant_matmul_dequant/docs/aclnnQuantMatmulDequant.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10841 | 9 天前 | |
refactor(matmul): unify Tensor API kernels and tune QBMM tiling Co-authored-by: smdbha<panzhijie2@huawei.com> # message auto-generated for no-merge-commit merge: !9970 merge master into master refactor(matmul): unify Tensor API kernels and tune QBMM tiling Created-by: smdbha Commit-by: smdbha Merged-by: cann-robot Description: ## 描述 统一 Ascend 950 上 QuantBatchMatmulV3 与 QuantBatchMatmulInplaceAdd 的 Tensor API 单 batch 内核及 tiling 数据路径: - 将 Cube、MIX 和 MX 的有 batch/无 batch Tensor API 入口合并到对应 Blaze 内核头文件,清理重复的 CMCT 与独立无 batch实现。 - 为非 MX Cube 路径增加无 batch Tensor API tiling 数据、tiling key 和内核分发。 - 优化 Adaptive Sliding Window Cube tiling,包括基础块负载均衡、单轮尾块归一化、L1 2/3/4 buffer 选择、stepK 调整以及 A 全载策略。 - 同步更新 QuantBatchMatmulV3 和 QuantBatchMatmulInplaceAdd 的 Host/Kernel UT 数据及预期 tiling key。 ## 关联的Issue 关联 Issue:[#5624](https://gitcode.com/cann/ops-nn/issues/5624) ## 测试 - git diff --check upstream/master f9ffee7bd46711d6a9016b5a566f06d1081a5a7e 通过。 - 提交中已更新相关 Host/Kernel UT 用例及预期数据。 ## 文档更新 无。 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:Tensor API 内核与 tiling 路径重构 ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!9970 | 5 天前 | |
flat_quant and rotate_quant support ascend350 Co-authored-by: yushan-kite<zhangyushan11@huawei.com> # message auto-generated for no-merge-commit merge: !10597 merge ascend350 into master flat_quant and rotate_quant support ascend350 Created-by: yushan-kite Commit-by: yushan-kite Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> flat_quant and rotate_quant support ascend350 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5962 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> UT,aclnnFuzz ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!10597 | 8 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 25 天前 | |
fix: sparse_tensor_dense_mat_mul Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !9959 merge fix into master fix: sparse_tensor_dense_mat_mul Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 修复目标为 sparse_tensor_dense_mat_mul(稀疏张量与稠密矩阵相乘)Cmake配置问题。 ## 关联的Issue [#5638](https://gitcode.com/cann/ops-nn/issues/5638) ## 测试 算子执行成功 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9959 | 21 天前 | |
fmm/tbmm的aclnn接口日志问题修复 Co-authored-by: gaozheng<gaozheng16@huawei.com> # message auto-generated for no-merge-commit merge: !10532 merge dts_fmm_log into master fmm/tbmm的aclnn接口日志问题修复 Created-by: pzyy00 Commit-by: gaozheng Merged-by: cann-robot Description: ## 描述 fmm/tbmm aclnn接口日志与资料问题描述不一致,根据资料对日志进行修改 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/6118 ## 测试 本地验证ok ## 文档更新 不涉及 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [ ] AI辅助编写 See merge request: cann/ops-nn!10532 | 6 天前 | |
fix st test action Co-authored-by: he_kan<hekan4@huawei.com> # message auto-generated for no-merge-commit merge: !10822 merge ci into master fix st test action Created-by: he_kan Commit-by: he_kan Merged-by: cann-robot Description: ## 描述 修正现有st问题和yml问题 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10822 | 1 天前 | |
修复matmul目录下L2_DFX_PHASE_1宏DFX_IN缺失参数或顺序不符问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10408 merge fix_dfx_in_matmul_5526 into master 修复matmul目录下L2_DFX_PHASE_1宏DFX_IN缺失参数或顺序不符问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 概述 修复 issue #5526 中 matmul 目录下的 10 处 L2_DFX_PHASE_1 宏 DFX_IN 缺失参数或顺序不符问题(issue 中其余目录问题已由其他 PR 修复,本 PR 处理遗留的 matmul 部分): | 算子接口 | 修复内容 | |---|---| | aclnnDualLevelQuantMatmulWeightNz | 补充 transposeX1/transposeX2/level0GroupSize/level1GroupSize | | aclnnMatmulCompressDequant | 补充 offsetW | | aclnnQuantMatmulV3 | 补充 transposeX1/transposeX2 | | aclnnQuantMatmulV4 | 补充 transposeX1/transposeX2 | | aclnnQuantMatmulReduceSumWeightNz | 补充 yScale/x1Offset/x2Offset/yOffset/bias/transposeX1/transposeX2/groupSize/dims/keepDims | | aclnnRotateQuant | 补充 axis/roundMode/scaleAlg/dstTypeMax/trans | | aclnnWeightQuantBatchMatmul | DFX_IN 参数顺序与接口参数顺序对齐 | | aclnnWeightQuantBatchMatmulV2 | 补充 antiquantGroupSize | | aclnnWeightQuantBatchMatmulV3 | 补充 antiquantGroupSize/innerPrecise | | aclnnWeightQuantBatchMatmulNz | 补充 antiquantGroupSize | ## 验证 - 所有改动文件已通过 clang-format v18.1.8 --style=file 全文件检查 - 仅修改 DFX_IN 宏参数列表,不涉及任何功能逻辑变更 ## 关联的Issue fixes #5526 See merge request: cann/ops-nn!10408 | 14 天前 | |
fix st test action Co-authored-by: he_kan<hekan4@huawei.com> # message auto-generated for no-merge-commit merge: !10822 merge ci into master fix st test action Created-by: he_kan Commit-by: he_kan Merged-by: cann-robot Description: ## 描述 修正现有st问题和yml问题 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10822 | 1 天前 | |
Format update: Adjusted the license description format in all relevant files. Co-authored-by: jiangqi<jiangqi47@h-partners.com> # message auto-generated for no-merge-commit merge: !403 merge license7 into master Format update: Adjusted the license description format in all relevant files. Created-by: jiangqi2025 Commit-by: jiangqi Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!403 | 9 个月前 | |
transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持 Co-authored-by: huangkejie1647<huangkejie3@huawei.com> # message auto-generated for no-merge-commit merge: !8472 merge tqbmm-nn into master transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持 Created-by: huangkejie1647 Commit-by: huangkejie1647 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 此 PR 为 transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持,并重构了 MX 系列精度(MXFP8/MXFP4)的 Kernel 实现路径。主要工作包括:在类型校验与 tiling 层引入 MXFP4 数据类型;新增 TQBMMPrecisionMode::PRECISION_MODE_MXFP4 枚举值及其对应的模板参数组合;使用 Blaze 框架的 QuantBatchMatmulV3BasicAPITilingData 统一 MXFP8 和 MXFP4 的 tiling 数据传递;新增基于 Blaze 的 TqbmmMxTensorApiKernel 内核实现。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#5171](https://gitcode.com/cann/ops-nn/issues/5171) [#5244](https://gitcode.com/cann/ops-nn/issues/5244) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地验证通过,二级冒烟无异常,ut,和文档已补充 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/transpose_quant_batch_mat_mul/docs/aclnnTransposeQuantBatchMatMul.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8472 | 1 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 18 天前 | ||
| 1 天前 | ||
| 1 个月前 | ||
| 1 天前 | ||
| 11 天前 | ||
| 7 天前 | ||
| 8 天前 | ||
| 20 天前 | ||
| 5 天前 | ||
| 6 天前 | ||
| 17 天前 | ||
| 26 天前 | ||
| 1 个月前 | ||
| 18 天前 | ||
| 1 天前 | ||
| 19 天前 | ||
| 9 天前 | ||
| 14 天前 | ||
| 28 天前 | ||
| 1 天前 | ||
| 5 天前 | ||
| 5 天前 | ||
| 19 天前 | ||
| 6 天前 | ||
| 9 天前 | ||
| 5 天前 | ||
| 8 天前 | ||
| 25 天前 | ||
| 21 天前 | ||
| 6 天前 | ||
| 1 天前 | ||
| 14 天前 | ||
| 1 天前 | ||
| 9 个月前 | ||
| 1 个月前 |