| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
修复nan处理逻辑 Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !10076 merge npugpu into master 修复nan处理逻辑 Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->修改addmm,addmv两个算子对于alpha/beta都等于0的nan处理逻辑,和其他算子保持一致 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #5737 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->本地测试通过冒烟通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10076 | 8 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
support add_all_module_source支持一个算子 只配置一个CMakeList.txt Co-authored-by: chenqi317<chenqi317@huawei.com> # message auto-generated for no-merge-commit merge: !8380 merge master into master support add_all_module_source支持一个算子 只配置一个CMakeList.txt Created-by: chenqi317 Commit-by: chenqi317 Merged-by: cann-robot Description: 此 PR 引入了新的 CMake 宏 add_all_modules_sources 作为算子顶层 CMakeLists.txt 的统一编译入口,旨在简化算子构建配置。同时,底层函数 add_kernel_sources 和 AddOpTestCase 也进行了适配,支持从算子顶层目录调用,替代原先必须在特定子目录(如 op_kernel、tests/ut/op_kernel)内调用的限制。整体改动通过自适应目录位置、收编 UT 源收集逻辑,提升构建系统的灵活性和可维护性。 主要改动 新增 add_all_modules_sources 宏:在 cmake/func.cmake 中新增统一入口宏,支持 OPTYPE、ACLNNTYPE、DEPENDENCIES、COMPUTE_UNIT、TILING_DIR、DISABLE_IN_OPP 等参数;自动适配 op_api 目录在算子根或 op_host 子目录下的两种布局,内部复用 add_modules_sources 并触发 add_all_ut_sources 收集 UT 源。 新增 add_all_ut_sources 宏:在 cmake/func.cmake 中新增 UT 源收集宏,根据 UT_TEST_ALL、OP_API_UT、OP_HOST_UT、OP_GRAPH_UT 等条件分别收集 tests/ut/op_api、tests/ut/op_host、tests/ut/op_graph 下的测试源文件,并兼容历史布局 tests/ut/op_host/op_api。 add_kernel_sources 适配新调用位置:当 CMAKE_CURRENT_SOURCE_DIR 不以 /op_kernel 结尾时,自动将 SOURCE_DIR 拼接 /op_kernel 子目录,使该函数支持从算子顶层目录被调用。 AddOpTestCase 支持自定义 UT 源目录:新增 UT_SRC_DIR 参数用于指定 UT 源文件所在目录;_tiling_def.h 的 include 路径和 *.cpp 测试用例文件的 file(GLOB) 扫描路径均改用 _ut_src_dir 变量,替代原先硬编码的 CMAKE_CURRENT_SOURCE_DIR。 AddOpTestCase 优化算子目录推导:优先使用 add_op_subdirectory 设置的全局变量 OP_DIR 确定算子根目录,当该变量未定义或为空时才回退到原有的三级父目录推导逻辑(tests/ut/op_kernel 内部调用方式),增强了从算子顶层调用的兼容性。 See merge request: cann/ops-nn!8380 | 1 个月前 | |
fix: sc清理魔鬼参数、多余行、未使用参数、不规范比较方式、python文件编码格式 Co-authored-by: yushan-kite<zhangyushan11@huawei.com> # message auto-generated for no-merge-commit merge: !9985 merge sc into master fix: sc清理魔鬼参数、多余行、未使用参数、不规范比较方式、python文件编码格式 Created-by: yushan-kite Commit-by: yushan-kite Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 当前matmul组件下存在编译告警问题,涉及fix: sc清理魔鬼参数、多余行、未使用参数、不规范比较方式、python文件编码格式。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5631 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> UT ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9985 | 8 天前 | |
md大模型检测低错修复 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !9420 merge master into master md大模型检测低错修复 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md aidd大模型检测低错修复 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5254 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> acl*.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9420 | 21 天前 | |
Revert "WQBMM和QBMM 算子兼容性整改" Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !10058 merge huitui into master Revert "WQBMM和QBMM 算子兼容性整改" Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 回退兼容性相关修改,直至 Ascend 支持相关内容 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #5678 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10058 | 10 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
[Fix] fix mis-matched dtype in aclrtMemcpy of aclnnFusedLinearCrossEntropyLossGrad examples Co-authored-by: jisihuai<jisihuai@h-partners.com> # message auto-generated for no-merge-commit merge: !10010 merge test into master [Fix] fix mis-matched dtype in aclrtMemcpy of aclnnFusedLinearCrossEntropyLossGrad examples Created-by: jisihuai Commit-by: jisihuai Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 解决aclnnFusedLinearCrossEntropyLossGrad examples/markdown中float32与bf16类型冲突问题 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> example样例编译运行成功 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10010 | 9 天前 | |
docs: 修正 IndexFill/ScatterNd/FusedLinearOnlineMaxSum/WeightQuantBatchMatmulV2/LSTM 文档示例笔误 Co-authored-by: weike<weike13@huawei.com> # message auto-generated for no-merge-commit merge: !10123 merge codex/pr-37ebcb4-docs-fix into master docs: 修正 IndexFill/ScatterNd/FusedLinearOnlineMaxSum/WeightQuantBatchMatmulV2/LSTM 文档示例笔误 Created-by: m0_55003149 Commit-by: weike Merged-by: cann-robot Description: ## 描述 修正 5 个算子文档示例中的笔误(对应本地提交 37ebcb4cb): - aclnnInplaceIndexFill:示例中日志打印的函数名由 aclnnIndexFill 改为 aclnnInplaceIndexFill; - aclnnScatterNd:示例注释由 aclnnAdd 改为 aclnnScatterNd; - aclnnFusedLinearOnlineMaxSum:示例中变量名 tatgetDeviceAddr 拼写修正为 targetDeviceAddr; - aclnnWeightQuantBatchMatmulV2:示例中 LOG_PRINT 的 aclnnCast2 修正为 aclnnCast; - aclnnLSTM:公式中隐藏状态向量符号 h_i 修正为 h_t。 ## 关联的Issue (https://gitcode.com/cann/ops-nn/issues/5704) ## 测试 纯文档修改,无代码逻辑变更,不需要运行测试。 ## 文档更新 本次改动仅涉及 5 个算子 .md 文档的示例/描述修正。 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!10123 | 9 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 8 天前 | |
AI意见修改 Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !9630 merge gemmziliao into master AI意见修改 Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->对 matmul 系列算子(addmv、fused_matmul、gemm)的 host 侧接口代码进行健壮性加固与逻辑整理 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #5481 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->冒烟测试通过,资料整改 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/gemm/docs/aclnnGemm.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9630 | 15 天前 | |
log_fix Co-authored-by: Alpha123_<202230091296@mail.scut.edu.cn> # message auto-generated for no-merge-commit merge: !8828 merge master into master log_fix Created-by: Alpha123_ Commit-by: Alpha123_ Merged-by: cann-robot Description: ## 描述 算子的信息中存在拼写错误,且日志中存在中文、缺失度量等问题,影响日志可读性和易用性 整改issue ## 关联的Issue [https://gitcode.com/cann/ops-nn/issues/4864](url) ## 文档更新 [https://gitcode.com/cann/ops-nn/tree/master/matmul/addmv](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/batch_mat_mul_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/common](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/fused_mat_mul](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/gemm_v2](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/gemm_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/mat_mul_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/matmul_v2_compress_dequant](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/mv](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/rotate_quant](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/transpose_batch_mat_mul](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/transpose_quant_batch_mat_mul](url) ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8828 | 22 天前 | |
GEMM当beta=0时跳过beta*input Co-authored-by: liyuanqiang<liyuanqiang@huawei.com> # message auto-generated for no-merge-commit merge: !9242 merge beta0 into master GEMM当beta=0时跳过beta*input Created-by: liyuanqiang Commit-by: liyuanqiang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> GEMM:beta * input + alpha (mat1 @ mat2) beta=0 时 input 矩阵的 NaN/Inf 会通过 Axpy 传播到输出,本 PR 通过跳过 beta*input 计算修复此问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> issue: [#5180](https://gitcode.com/cann/ops-nn/issues/5180) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9242 | 15 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 8 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 8 天前 | |
aclnn_einsum.cpp文件整改 Co-authored-by: wangwei_mayday<wangwei1183@huawei.com> # message auto-generated for no-merge-commit merge: !9204 merge master into master aclnn_einsum.cpp文件整改 Created-by: wangwei_mayday Commit-by: wangwei_mayday Merged-by: cann-robot Description: ## 描述 当前matmul/batch_mat_mul_v3/op_host/op_api/aclnn_einsum.cpp下面存在以下这些问题: 1.HandleAxB2AB 缺少空指针检查导致段错误,函数中leftMatrix,rightMatrix和result这三个参数军缺乏空指针校验 2.UniqueExecutor 析构时 561102 警告导致内部状态损坏,HandleABCDxABCED2ABCE 和 HandleAxB2AB的OP_CHECK_WRONG_DIMENSION判断在uniqueExecutor构造之后析构之前,OP_CHECK_WRONG_DIMENSION 宏在维度检查失败时直接 return ACLNN_ERR_PARAM_INVALID,此时 uniqueExecutor 尚未调用 ReleaseTo(executor),触发析构函数输出 561102 警告,析构函数在清理中间资源时可能损坏了全局内部状态(如 op executor 的内存池),导致后续 API 调用访问已释放的内存。 3.HandleAxB2AB 缺少 output shape 校验,HandleABCDxABCED2ABCE做了校验 4.equation 空指针内部使用 561103 而非 161001,CheckNotNull 返回 false 后,CheckParams 通过 CHECK_RET(CheckNotNull(...), ACLNN_ERR_PARAM_NULLPTR) 转换,最终 aclnnEinsumGetWorkspaceSize 返回 161001 给调用方。因此错误码验证通过,但日志中的 561103 与文档不一致。 以及matmul/mat_mul_v3/op_host/op_tiling/arch35/matmul_v3_common_advanced.h中存在的问题: 已存在全局变量constexpr uint64_t NUM_THREE = 3UL;,无需重复定义constexpr uint64_t THREE_DIM_NUM = 3; 引用到THREE_DIM_NUM的代码都需要做出修改 对以上问题做出整改 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->关联Issue [#5153](https://gitcode.com/cann/ops-nn/issues/5153) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ x ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ x ] AI辅助编写 See merge request: cann/ops-nn!9204 | 17 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 8 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 14 天前 | |
修复aclnnQuantMatmulReduceSumWeightNz 文档及示例中的冗余头文件和 BF16 输出处理问题 Co-authored-by: HuangKun8682<huangkun61@huawei.com> # message auto-generated for no-merge-commit merge: !9876 merge personal_fix_qbmm_doc_problem into master 修复aclnnQuantMatmulReduceSumWeightNz 文档及示例中的冗余头文件和 BF16 输出处理问题 Created-by: HuangKun8682 Commit-by: HuangKun8682 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 修复aclnnQuantMatmulReduceSumWeightNz 文档及示例中的冗余头文件和 BF16 输出处理问题 保留有效公共头文件: #include "aclnnop/aclnn_quant_matmul_reduce_sum.h" 删除示例中未使用的头文件: - aclnn_permute.h - aclnn_quant_matmul_weight_nz.h - aclnn_trans_quant_param_v2.h 新增 Bfloat16ToFloat,按 BF16 位模式补齐 FP32 的低 16 位后转换并打印。 将 x2Scale 初始化值改为 0x3F80,即 BF16 数值 1.0。 将输出初始化值改为 BF16 数值 0.0。 同步修改文档调用示例和对应 C++ example。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> Issue [#5565](https://gitcode.com/cann/ops-nn/issues/5565) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地运行example:  ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> aclnnQuantMatmulReduceSumWeightNz.md ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9876 | 11 天前 | |
fix aclnnRotateQuant的资料描述 Co-authored-by: yushan-kite<zhangyushan11@huawei.com> # message auto-generated for no-merge-commit merge: !10160 merge dst_md into master fix aclnnRotateQuant的资料描述 Created-by: yushan-kite Commit-by: yushan-kite Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> aclnnRotateQuant算子的资料描述不够详细,增加详细的补充.,以及更正为当前代码现有的能力 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5717 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/rotate_quant/docs/aclnnRotateQuant.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!10160 | 8 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 14 天前 | |
fix: sparse_tensor_dense_mat_mul Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !9959 merge fix into master fix: sparse_tensor_dense_mat_mul Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 修复目标为 sparse_tensor_dense_mat_mul(稀疏张量与稠密矩阵相乘)Cmake配置问题。 ## 关联的Issue [#5638](https://gitcode.com/cann/ops-nn/issues/5638) ## 测试 算子执行成功 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9959 | 10 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
tensor api代码snake风格适配 Co-authored-by: li-yuanjie-da<liyuanjie5@h-partners.com> # message auto-generated for no-merge-commit merge: !9359 merge master into master tensor api代码snake风格适配 Created-by: li-yuanjie-da Commit-by: li-yuanjie-da Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> tensor api代码snake风格适配 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> 关联Issue #5747 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 线上冒烟用例 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9359 | 8 天前 | |
修改matmul算子aclnn文档及示例代码已知问题 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !10002 merge fix_matmul_docs_910b into master 修改matmul算子aclnn文档及示例代码已知问题 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 修改说明 根据文档易用性问题清单,修改 matmul 算子 aclnn 文档资料问题,并同步修改 910B(Atlas A2)/310P 相关示例代码,共 13 个文件(10 md + 3 cpp)。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5689 ### 文档资料修改 - **aclnnAddmm&aclnnInplaceAddmm**:修正 InplaceAddmm 参数表 mat1/mat2 的 Reduce 维度描述;Addmm 的 out 描述补充完整公式语义 - **aclnnAddmmWeightNz**:shape 描述全角括号统一为半角方括号 - **aclnnQuantMatmulV2**:迁移说明函数名 aclnnTransQuantParamV2 修正为 aclnnTransQuantParam,与示例代码一致 - **aclnnMatmulCompress / aclnnMatmulCompressDequant**:msModelSlim 示例补充 weight_path 定义;bias 数据类型描述 INT8 修正为 INT32(与参数表及示例一致);注明 export 产物路径 ### 910B 示例代码修改(资料与接口同步) - **aclnnBaddbmm/aclnnInplaceBaddbmm**:示例调用 alpha/beta 参数顺序修正为与函数原型一致(beta 在前) - **aclnnMatmulWeightNz**:0x3C00 注释语义修正为 float16 的 1.0;950PR 示例 cubeMathType 修正为 0 并使用 ACL_FORMAT_FRACTAL_NZ 枚举替代魔法数字 29 - **aclnnWeightQuantBatchMatmul**:示例改为调用 aclnnTransQuantParam 生成 deqScale,修复原示例手动循环填充导致 deqScale 全 0、输出错误的问题;creat→create - **aclnnFusedQuantMatmulWeightNz**:groupSizeOptional 描述由传入nullptr修正为建议传入0 - **aclnnFusedQuantMatmul**:示例注释 [M]/[N] 统一为小写 [m]/[n] - **aclnnMatmulCompressDequant**:LOG_PRINT 的 %s 传 std::string 修正为 c_str() ### 验证 910B3(Atlas A2)实机验证,CANN 9.2.0-beta.1,以下用例全部编译运行通过: - aclnnBaddbmm / aclnnInplaceBaddbmm:两接口输出结果一致(验证 alpha/beta 顺序修正正确) - aclnnBatchMatMulWeightNz(arch22,aclnnTransMatmulWeight 权重转换流程)、aclnnMatmulWeightNz、aclnnFusedQuantMatmul、aclnnFusedQuantMatmulWeightNz:输出结果均正常 - aclnnWeightQuantBatchMatmul:deqScale 由 aclnnTransQuantParam 生成,输出不再全 0,结果与修复前验证一致 See merge request: cann/ops-nn!10002 | 8 天前 | |
docs: 修正 IndexFill/ScatterNd/FusedLinearOnlineMaxSum/WeightQuantBatchMatmulV2/LSTM 文档示例笔误 Co-authored-by: weike<weike13@huawei.com> # message auto-generated for no-merge-commit merge: !10123 merge codex/pr-37ebcb4-docs-fix into master docs: 修正 IndexFill/ScatterNd/FusedLinearOnlineMaxSum/WeightQuantBatchMatmulV2/LSTM 文档示例笔误 Created-by: m0_55003149 Commit-by: weike Merged-by: cann-robot Description: ## 描述 修正 5 个算子文档示例中的笔误(对应本地提交 37ebcb4cb): - aclnnInplaceIndexFill:示例中日志打印的函数名由 aclnnIndexFill 改为 aclnnInplaceIndexFill; - aclnnScatterNd:示例注释由 aclnnAdd 改为 aclnnScatterNd; - aclnnFusedLinearOnlineMaxSum:示例中变量名 tatgetDeviceAddr 拼写修正为 targetDeviceAddr; - aclnnWeightQuantBatchMatmulV2:示例中 LOG_PRINT 的 aclnnCast2 修正为 aclnnCast; - aclnnLSTM:公式中隐藏状态向量符号 h_i 修正为 h_t。 ## 关联的Issue (https://gitcode.com/cann/ops-nn/issues/5704) ## 测试 纯文档修改,无代码逻辑变更,不需要运行测试。 ## 文档更新 本次改动仅涉及 5 个算子 .md 文档的示例/描述修正。 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!10123 | 9 天前 | |
Format update: Adjusted the license description format in all relevant files. Co-authored-by: jiangqi<jiangqi47@h-partners.com> # message auto-generated for no-merge-commit merge: !403 merge license7 into master Format update: Adjusted the license description format in all relevant files. Created-by: jiangqi2025 Commit-by: jiangqi Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!403 | 8 个月前 | |
transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持 Co-authored-by: huangkejie1647<huangkejie3@huawei.com> # message auto-generated for no-merge-commit merge: !8472 merge tqbmm-nn into master transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持 Created-by: huangkejie1647 Commit-by: huangkejie1647 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 此 PR 为 transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持,并重构了 MX 系列精度(MXFP8/MXFP4)的 Kernel 实现路径。主要工作包括:在类型校验与 tiling 层引入 MXFP4 数据类型;新增 TQBMMPrecisionMode::PRECISION_MODE_MXFP4 枚举值及其对应的模板参数组合;使用 Blaze 框架的 QuantBatchMatmulV3BasicAPITilingData 统一 MXFP8 和 MXFP4 的 tiling 数据传递;新增基于 Blaze 的 TqbmmMxTensorApiKernel 内核实现。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#5171](https://gitcode.com/cann/ops-nn/issues/5171) [#5244](https://gitcode.com/cann/ops-nn/issues/5244) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地验证通过,二级冒烟无异常,ut,和文档已补充 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/transpose_quant_batch_mat_mul/docs/aclnnTransposeQuantBatchMatMul.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8472 | 21 天前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 8 天前 | ||
| 8 天前 | ||
| 1 个月前 | ||
| 8 天前 | ||
| 21 天前 | ||
| 10 天前 | ||
| 8 天前 | ||
| 9 天前 | ||
| 9 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 15 天前 | ||
| 22 天前 | ||
| 15 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 17 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 14 天前 | ||
| 11 天前 | ||
| 8 天前 | ||
| 14 天前 | ||
| 10 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 9 天前 | ||
| 8 个月前 | ||
| 21 天前 |