| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
AI意见修改 Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !9630 merge gemmziliao into master AI意见修改 Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->对 matmul 系列算子(addmv、fused_matmul、gemm)的 host 侧接口代码进行健壮性加固与逻辑整理 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #5481 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->冒烟测试通过,资料整改 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/gemm/docs/aclnnGemm.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9630 | 6 天前 | |
Matmul类算子图融合资料开源 Co-authored-by: jgx12<jingaoxiang@huawei.com> # message auto-generated for no-merge-commit merge: !9636 merge fusion_docs into master Matmul类算子图融合资料开源 Created-by: jgx12 Commit-by: jgx12 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增MatMulBiasAddOpenFusionPass,MatMulReshapeBiasAddFusionPass,MatMulToMatmulV3FusionPass,MatMulUnsqueezeSqueezeFusionPass,ZZMatMulTOQBMMV3FusionPass,BatchMatMul2TransposeBatchMatMulFusionPass图融合资料,配套图融合开源 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5628 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 无 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/batch_mat_mul_v3/docs/BatchMatMulTransposeFusionPass.md matmul/mat_mul_v3/docs/MatMulBiasAddOpenFusionPass.md matmul/mat_mul_v3/docs/MatMulReshapeBiasAddFusionPass.md matmul/mat_mul_v3/docs/MatMulToMatmulV3FusionPass.md matmul/mat_mul_v3/docs/MatMulUnsqueezeSqueezeFusionPass.md matmul/quant_batch_matmul_v3/docs/ZZMatMulTOQBMMV3FusionPass.md matmul/transpose_batch_mat_mul/docs/BatchMatMul2TransposeBatchMatMulFusionPass.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9636 | 1 天前 | |
support add_all_module_source支持一个算子 只配置一个CMakeList.txt Co-authored-by: chenqi317<chenqi317@huawei.com> # message auto-generated for no-merge-commit merge: !8380 merge master into master support add_all_module_source支持一个算子 只配置一个CMakeList.txt Created-by: chenqi317 Commit-by: chenqi317 Merged-by: cann-robot Description: 此 PR 引入了新的 CMake 宏 add_all_modules_sources 作为算子顶层 CMakeLists.txt 的统一编译入口,旨在简化算子构建配置。同时,底层函数 add_kernel_sources 和 AddOpTestCase 也进行了适配,支持从算子顶层目录调用,替代原先必须在特定子目录(如 op_kernel、tests/ut/op_kernel)内调用的限制。整体改动通过自适应目录位置、收编 UT 源收集逻辑,提升构建系统的灵活性和可维护性。 主要改动 新增 add_all_modules_sources 宏:在 cmake/func.cmake 中新增统一入口宏,支持 OPTYPE、ACLNNTYPE、DEPENDENCIES、COMPUTE_UNIT、TILING_DIR、DISABLE_IN_OPP 等参数;自动适配 op_api 目录在算子根或 op_host 子目录下的两种布局,内部复用 add_modules_sources 并触发 add_all_ut_sources 收集 UT 源。 新增 add_all_ut_sources 宏:在 cmake/func.cmake 中新增 UT 源收集宏,根据 UT_TEST_ALL、OP_API_UT、OP_HOST_UT、OP_GRAPH_UT 等条件分别收集 tests/ut/op_api、tests/ut/op_host、tests/ut/op_graph 下的测试源文件,并兼容历史布局 tests/ut/op_host/op_api。 add_kernel_sources 适配新调用位置:当 CMAKE_CURRENT_SOURCE_DIR 不以 /op_kernel 结尾时,自动将 SOURCE_DIR 拼接 /op_kernel 子目录,使该函数支持从算子顶层目录被调用。 AddOpTestCase 支持自定义 UT 源目录:新增 UT_SRC_DIR 参数用于指定 UT 源文件所在目录;_tiling_def.h 的 include 路径和 *.cpp 测试用例文件的 file(GLOB) 扫描路径均改用 _ut_src_dir 变量,替代原先硬编码的 CMAKE_CURRENT_SOURCE_DIR。 AddOpTestCase 优化算子目录推导:优先使用 add_op_subdirectory 设置的全局变量 OP_DIR 确定算子根目录,当该变量未定义或为空时才回退到原有的三级父目录推导逻辑(tests/ut/op_kernel 内部调用方式),增强了从算子顶层调用的兼容性。 See merge request: cann/ops-nn!8380 | 30 天前 | |
Revert "WQBMM和QBMM 算子兼容性整改" Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !10058 merge huitui into master Revert "WQBMM和QBMM 算子兼容性整改" Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 回退兼容性相关修改,直至 Ascend 支持相关内容 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #5678 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10058 | 1 天前 | |
md大模型检测低错修复 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !9420 merge master into master md大模型检测低错修复 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md aidd大模型检测低错修复 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5254 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> acl*.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9420 | 12 天前 | |
Revert "WQBMM和QBMM 算子兼容性整改" Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !10058 merge huitui into master Revert "WQBMM和QBMM 算子兼容性整改" Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 回退兼容性相关修改,直至 Ascend 支持相关内容 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #5678 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10058 | 1 天前 | |
flat_quant golden Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !9654 merge pkg into master flat_quant golden Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 主要为 flat_quant 算子补充 golden(参考实现)测试资产及配套的精度比对工具:新增独立的 ULP 数值比对函数 numeric_ulp_compare、kernel 级 golden 实现 flat_quant_golden.py(含 MX 量化的 numpy 实现 mx_quantize、compute_mx_fp4、compute_int4 及 FlatQuantTestSpec)和 aclnn 级 golden flat_quant_aclnn_golden.py(含 aclnnFlatQuant/V2/V3 对应的 TestSpec),并顺带修正 CI 脚本中算子源码路径查找对 third_party 目录的过滤。该改动主要用于算子精度测试,不涉及业务功能本身。 主要改动 - 新增 ULP 精度比对工具:在 matmul/common/tests/st/arch35/numeric_ulp.py 中新增独立的 numeric_ulp_compare 函数,将 NPU 输出与 golden 输出转为 float32 后按元素比较绝对误差(阈值固定 1.0),并对双方同为 NaN 的情况做豁免处理,返回 pass 与 precision 结果。 - 新增 kernel golden 实现:在 matmul/flat_quant/tests/assets/flat_quant_golden.py 中新增 numpy 版 mx_quantize(支持 float4_e2m1/float4_e1m2/float8_e4m3fn/float8_e5m2 的 block 量化、多种舍入模式 rint/round/floor/ceil/trunc 及 scale_alg 0/1/2 三种 scale 算法)、按 dst_dtype 分发的 compute_mx_fp4(MXFP4 模式)与 compute_int4(INT4 模式)计算函数,以及多输出逐位置配对的 FlatQuantTestSpec,并通过 __spec__ 暴露 flat_quant 入口。 - 新增 aclnn golden 适配层:在 matmul/flat_quant/tests/assets/flat_quant_aclnn_golden.py 中新增 AclnnFlatQuantTestSpec、AclnnFlatQuantV2TestSpec(额外参数 dstTypeMax)、AclnnFlatQuantV3TestSpec(额外参数 groupListOptional、groupListType),参数名与 C API 的 camelCase 一致,golden 逻辑委托 kernel 实现,并在 __spec__ 中映射 aclnnFlatQuant、aclnnFlatQuantV2、aclnnFlatQuantV3。 - 新增输出类型映射:flat_quant_golden.py 定义 MXFP4_DST_DTYPE = 40 与 INT4 分支;flat_quant_aclnn_golden.py 通过 _GE_DTYPE_TO_DST 将 float4_e2m1/int4/int32 输出类型映射到对应量化实现,默认回退 MXFP4。 - 调整 CI 算子路径查找:在 scripts/ci/ops_st_test.sh 的 find_op_code_path 中为 find 增加 -not -path "*/third_party/*" 过滤,避免误匹配 third_party 下的同名算子目录。 ## 关联的Issue [#5549](https://gitcode.com/cann/ops-nn/issues/5549) <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 bash scripts/ci/ops_st_test.sh --soc_version=scend950 --ops=flat_quant执行验证8个用例通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9654 | 5 天前 | |
md大模型检测低错修复 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !9420 merge master into master md大模型检测低错修复 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md aidd大模型检测低错修复 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5254 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> acl*.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9420 | 12 天前 | |
隔离fused_linear_online_max_sum不支持A5(ascend950)的example用例到arch22目录 Co-authored-by: ztj0209<zhangtianjiao6@huawei.com> # message auto-generated for no-merge-commit merge: !9525 merge fix_a5_isolate_fused_linear_online_max_sum into master 隔离fused_linear_online_max_sum不支持A5(ascend950)的example用例到arch22目录 Created-by: ztj0209 Commit-by: ztj0209 Merged-by: cann-robot Description: ## 描述 fused_linear_online_max_sum 算子中 aclnnFusedLinearOnlineMaxSum 接口不支持 ascend950,其 example 用例 test_aclnn_fused_linear_online_max_sum.cpp 原先位于 examples 顶层目录,A5 环境(--soc=ascend950)执行时因接口不支持而报错。 参照 arch 用例隔离机制(参考 !9152),将该用例移动到 examples/arch22/ 下:A5 环境不再扫描执行,910B 环境通过 arch22 目录正常运行。涉及 README 的用例路径链接已同步更新。 ## 关联的Issue [Issue #5205](https://gitcode.com/cann/ops-nn/issues/5205) ## 测试 - 本机 910B3 实测 bash build.sh --run_example fused_linear_online_max_sum eager --soc=ascend910b,test_aclnn_fused_linear_online_max_sum.cpp 经 arch22 目录正常运行(success) - 模拟 build.sh 扫描逻辑验证:--soc=ascend950 下该失败用例不再被扫描 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!9525 | 6 天前 | |
blaze头文件整改 Co-authored-by: AlbertYoung192<yangtao363@huawei.com> # message auto-generated for no-merge-commit merge: !8936 merge master into master blaze头文件整改 Created-by: AlbertYoung192 Commit-by: AlbertYoung192 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> blaze头文件整改,非量化matmul各模板外层kernel文件直接引用include/blaze/gemm/kernel/kernel_universal.h及include/blaze/gemm/block/block_mmad.h ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5510 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地自验证、二级冒烟 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8936 | 2 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 5 天前 | |
AI意见修改 Co-authored-by: szhexin<shangzhexin@huawei.com> # message auto-generated for no-merge-commit merge: !9630 merge gemmziliao into master AI意见修改 Created-by: szhexin Commit-by: szhexin Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。-->对 matmul 系列算子(addmv、fused_matmul、gemm)的 host 侧接口代码进行健壮性加固与逻辑整理 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->Issue #5481 ## 测试 <!--描述进行了哪些测试来验证你的改动。-->冒烟测试通过,资料整改 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/gemm/docs/aclnnGemm.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9630 | 6 天前 | |
log_fix Co-authored-by: Alpha123_<202230091296@mail.scut.edu.cn> # message auto-generated for no-merge-commit merge: !8828 merge master into master log_fix Created-by: Alpha123_ Commit-by: Alpha123_ Merged-by: cann-robot Description: ## 描述 算子的信息中存在拼写错误,且日志中存在中文、缺失度量等问题,影响日志可读性和易用性 整改issue ## 关联的Issue [https://gitcode.com/cann/ops-nn/issues/4864](url) ## 文档更新 [https://gitcode.com/cann/ops-nn/tree/master/matmul/addmv](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/batch_mat_mul_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/common](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/fused_mat_mul](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/gemm_v2](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/gemm_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/mat_mul_v3](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/matmul_v2_compress_dequant](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/mv](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/rotate_quant](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/transpose_batch_mat_mul](url) [https://gitcode.com/cann/ops-nn/tree/master/matmul/transpose_quant_batch_mat_mul](url) ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8828 | 13 天前 | |
GEMM当beta=0时跳过beta*input Co-authored-by: liyuanqiang<liyuanqiang@huawei.com> # message auto-generated for no-merge-commit merge: !9242 merge beta0 into master GEMM当beta=0时跳过beta*input Created-by: liyuanqiang Commit-by: liyuanqiang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> GEMM:beta * input + alpha (mat1 @ mat2) beta=0 时 input 矩阵的 NaN/Inf 会通过 Axpy 传播到输出,本 PR 通过跳过 beta*input 计算修复此问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> issue: [#5180](https://gitcode.com/cann/ops-nn/issues/5180) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9242 | 6 天前 | |
Matmul类算子图融合资料开源 Co-authored-by: jgx12<jingaoxiang@huawei.com> # message auto-generated for no-merge-commit merge: !9636 merge fusion_docs into master Matmul类算子图融合资料开源 Created-by: jgx12 Commit-by: jgx12 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增MatMulBiasAddOpenFusionPass,MatMulReshapeBiasAddFusionPass,MatMulToMatmulV3FusionPass,MatMulUnsqueezeSqueezeFusionPass,ZZMatMulTOQBMMV3FusionPass,BatchMatMul2TransposeBatchMatMulFusionPass图融合资料,配套图融合开源 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5628 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 无 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/batch_mat_mul_v3/docs/BatchMatMulTransposeFusionPass.md matmul/mat_mul_v3/docs/MatMulBiasAddOpenFusionPass.md matmul/mat_mul_v3/docs/MatMulReshapeBiasAddFusionPass.md matmul/mat_mul_v3/docs/MatMulToMatmulV3FusionPass.md matmul/mat_mul_v3/docs/MatMulUnsqueezeSqueezeFusionPass.md matmul/quant_batch_matmul_v3/docs/ZZMatMulTOQBMMV3FusionPass.md matmul/transpose_batch_mat_mul/docs/BatchMatMul2TransposeBatchMatMulFusionPass.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9636 | 1 天前 | |
fix:重构common.h、math_util.h、tiling_type.h、common_func.h Co-authored-by: chenqianyu<chenqianyu1@h-partners.com> # message auto-generated for no-merge-commit merge: !9071 merge cie1 into master fix:重构common.h、math_util.h、tiling_type.h、common_func.h Created-by: FishPotatoChen Commit-by: chenqianyu Merged-by: cann-robot Description: ## 描述 本PR对 matmul 目录下多个算子中的公共头文件进行重命名,通过增加模块前缀( _nn、_mm、matmul_v2_compress_dequant_、transpose_batch_mat_mul_、mmcd_、tbmm_)消除同名文件歧义,提升代码可维护性。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5321 ## 测试 - 所有提交均通过 pre-commit hooks(trailing whitespace、end-of-file、clang-format、codespell) - 所有提交均通过 OAT 合规检查(License Header 校验) - 通过 grep 验证旧文件名无残留引用 ## 文档更新 无 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:重构 ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!9071 | 7 天前 | |
增加mesw算子空指针校验 Co-authored-by: wuyufei<wuyufei13@huawei.com> # message auto-generated for no-merge-commit merge: !9580 merge epilogue into master 增加mesw算子空指针校验 Created-by: wuyufei Commit-by: wuyufei Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 本 PR 为 matmul_emu_split_weight(mesw)算子增加空指针校验,防止在推理 shape 与 tiling 阶段因属性指针或输入/输出描述为空而直接解引用导致崩溃。改动覆盖了算子的 infershape 与 arch35 tiling 两条路径:在解引用属性指针前先获取指针并判空,同时新增统一的输入非空校验流程并接入 GetShapeAttrsInfo() 主流程。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5475 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9580 | 7 天前 | |
fix(MatmulCompressDequant): correct the op name in log. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9686 merge pr/fix_issue_5351 into master fix(MatmulCompressDequant): correct the op name in log. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修正 aclnn_matmul_compress_dequant.cpp 中的日志算子名称不准确问题。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5351 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9686 | 6 天前 | |
aclnn_einsum.cpp文件整改 Co-authored-by: wangwei_mayday<wangwei1183@huawei.com> # message auto-generated for no-merge-commit merge: !9204 merge master into master aclnn_einsum.cpp文件整改 Created-by: wangwei_mayday Commit-by: wangwei_mayday Merged-by: cann-robot Description: ## 描述 当前matmul/batch_mat_mul_v3/op_host/op_api/aclnn_einsum.cpp下面存在以下这些问题: 1.HandleAxB2AB 缺少空指针检查导致段错误,函数中leftMatrix,rightMatrix和result这三个参数军缺乏空指针校验 2.UniqueExecutor 析构时 561102 警告导致内部状态损坏,HandleABCDxABCED2ABCE 和 HandleAxB2AB的OP_CHECK_WRONG_DIMENSION判断在uniqueExecutor构造之后析构之前,OP_CHECK_WRONG_DIMENSION 宏在维度检查失败时直接 return ACLNN_ERR_PARAM_INVALID,此时 uniqueExecutor 尚未调用 ReleaseTo(executor),触发析构函数输出 561102 警告,析构函数在清理中间资源时可能损坏了全局内部状态(如 op executor 的内存池),导致后续 API 调用访问已释放的内存。 3.HandleAxB2AB 缺少 output shape 校验,HandleABCDxABCED2ABCE做了校验 4.equation 空指针内部使用 561103 而非 161001,CheckNotNull 返回 false 后,CheckParams 通过 CHECK_RET(CheckNotNull(...), ACLNN_ERR_PARAM_NULLPTR) 转换,最终 aclnnEinsumGetWorkspaceSize 返回 161001 给调用方。因此错误码验证通过,但日志中的 561103 与文档不一致。 以及matmul/mat_mul_v3/op_host/op_tiling/arch35/matmul_v3_common_advanced.h中存在的问题: 已存在全局变量constexpr uint64_t NUM_THREE = 3UL;,无需重复定义constexpr uint64_t THREE_DIM_NUM = 3; 引用到THREE_DIM_NUM的代码都需要做出修改 对以上问题做出整改 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000-->关联Issue [#5153](https://gitcode.com/cann/ops-nn/issues/5153) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ x ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ x ] AI辅助编写 See merge request: cann/ops-nn!9204 | 8 天前 | |
fix(quant_batch_matmul_inplace_add): 释放 MXFP8 示例 workspace Co-authored-by: smdbha<panzhijie2@huawei.com> # message auto-generated for no-merge-commit merge: !9938 merge backup into master fix(quant_batch_matmul_inplace_add): 释放 MXFP8 示例 workspace Created-by: smdbha Commit-by: smdbha Merged-by: cann-robot Description: ## 描述 QuantBatchMatmulInplaceAdd 的 MXFP8 ACLNN 示例在成功分配 workspace 后,正常返回和后续错误返回路径均缺少配对的 aclrtFree。 在 workspace 分配的 if 块之后构造 std::unique_ptr<void, aclError (*)(void*)> workspaceAddrPtr(workspaceAddr, aclrtFree);,使 workspace 的生命周期覆盖后续算子调用和流同步,并在函数退出时自动释放。 ## 关联的Issue 关联 Issue:[#5608](https://gitcode.com/cann/ops-nn/issues/5608) ## 测试 - git diff --check 通过。 - 静态检查正常返回、后续 CHECK_RET 提前返回及零 workspace 路径的资源生命周期。 ## 文档更新 无。 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!9938 | 2 天前 | |
Matmul类算子图融合资料开源 Co-authored-by: jgx12<jingaoxiang@huawei.com> # message auto-generated for no-merge-commit merge: !9636 merge fusion_docs into master Matmul类算子图融合资料开源 Created-by: jgx12 Commit-by: jgx12 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增MatMulBiasAddOpenFusionPass,MatMulReshapeBiasAddFusionPass,MatMulToMatmulV3FusionPass,MatMulUnsqueezeSqueezeFusionPass,ZZMatMulTOQBMMV3FusionPass,BatchMatMul2TransposeBatchMatMulFusionPass图融合资料,配套图融合开源 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5628 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 无 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/batch_mat_mul_v3/docs/BatchMatMulTransposeFusionPass.md matmul/mat_mul_v3/docs/MatMulBiasAddOpenFusionPass.md matmul/mat_mul_v3/docs/MatMulReshapeBiasAddFusionPass.md matmul/mat_mul_v3/docs/MatMulToMatmulV3FusionPass.md matmul/mat_mul_v3/docs/MatMulUnsqueezeSqueezeFusionPass.md matmul/quant_batch_matmul_v3/docs/ZZMatMulTOQBMMV3FusionPass.md matmul/transpose_batch_mat_mul/docs/BatchMatMul2TransposeBatchMatMulFusionPass.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9636 | 1 天前 | |
Revert "WQBMM和QBMM 算子兼容性整改" Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !10058 merge huitui into master Revert "WQBMM和QBMM 算子兼容性整改" Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 回退兼容性相关修改,直至 Ascend 支持相关内容 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #5678 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10058 | 1 天前 | |
md大模型检测低错修复 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !9420 merge master into master md大模型检测低错修复 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md aidd大模型检测低错修复 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5254 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> acl*.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9420 | 12 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 5 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 5 天前 | |
修复aclnnQuantMatmulReduceSumWeightNz 文档及示例中的冗余头文件和 BF16 输出处理问题 Co-authored-by: HuangKun8682<huangkun61@huawei.com> # message auto-generated for no-merge-commit merge: !9876 merge personal_fix_qbmm_doc_problem into master 修复aclnnQuantMatmulReduceSumWeightNz 文档及示例中的冗余头文件和 BF16 输出处理问题 Created-by: HuangKun8682 Commit-by: HuangKun8682 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 修复aclnnQuantMatmulReduceSumWeightNz 文档及示例中的冗余头文件和 BF16 输出处理问题 保留有效公共头文件: #include "aclnnop/aclnn_quant_matmul_reduce_sum.h" 删除示例中未使用的头文件: - aclnn_permute.h - aclnn_quant_matmul_weight_nz.h - aclnn_trans_quant_param_v2.h 新增 Bfloat16ToFloat,按 BF16 位模式补齐 FP32 的低 16 位后转换并打印。 将 x2Scale 初始化值改为 0x3F80,即 BF16 数值 1.0。 将输出初始化值改为 BF16 数值 0.0。 同步修改文档调用示例和对应 C++ example。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> Issue [#5565](https://gitcode.com/cann/ops-nn/issues/5565) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地运行example:  ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> aclnnQuantMatmulReduceSumWeightNz.md ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9876 | 2 天前 | |
fix:重构common.h、math_util.h、tiling_type.h、common_func.h Co-authored-by: chenqianyu<chenqianyu1@h-partners.com> # message auto-generated for no-merge-commit merge: !9071 merge cie1 into master fix:重构common.h、math_util.h、tiling_type.h、common_func.h Created-by: FishPotatoChen Commit-by: chenqianyu Merged-by: cann-robot Description: ## 描述 本PR对 matmul 目录下多个算子中的公共头文件进行重命名,通过增加模块前缀( _nn、_mm、matmul_v2_compress_dequant_、transpose_batch_mat_mul_、mmcd_、tbmm_)消除同名文件歧义,提升代码可维护性。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5321 ## 测试 - 所有提交均通过 pre-commit hooks(trailing whitespace、end-of-file、clang-format、codespell) - 所有提交均通过 OAT 合规检查(License Header 校验) - 通过 grep 验证旧文件名无残留引用 ## 文档更新 无 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:重构 ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!9071 | 7 天前 | |
Fix misspelled executor parameter in aclnn API doxygen comment. Co-authored-by: void_ptr<baochaojun@huawei.com> # message auto-generated for no-merge-commit merge: !9690 merge pr/fix_issue_5350 into master Fix misspelled executor parameter in aclnn API doxygen comment. Created-by: void_ptr Commit-by: void_ptr Merged-by: cann-robot Description: ## 描述 修复多个两段式 aclnn 接口头文件注释参数名拼写错误 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/5350 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9690 | 5 天前 | |
fix: sparse_tensor_dense_mat_mul Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !9959 merge fix into master fix: sparse_tensor_dense_mat_mul Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 修复目标为 sparse_tensor_dense_mat_mul(稀疏张量与稠密矩阵相乘)Cmake配置问题。 ## 关联的Issue [#5638](https://gitcode.com/cann/ops-nn/issues/5638) ## 测试 算子执行成功 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9959 | 1 天前 | |
Matmul类算子图融合资料开源 Co-authored-by: jgx12<jingaoxiang@huawei.com> # message auto-generated for no-merge-commit merge: !9636 merge fusion_docs into master Matmul类算子图融合资料开源 Created-by: jgx12 Commit-by: jgx12 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增MatMulBiasAddOpenFusionPass,MatMulReshapeBiasAddFusionPass,MatMulToMatmulV3FusionPass,MatMulUnsqueezeSqueezeFusionPass,ZZMatMulTOQBMMV3FusionPass,BatchMatMul2TransposeBatchMatMulFusionPass图融合资料,配套图融合开源 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5628 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 无 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/batch_mat_mul_v3/docs/BatchMatMulTransposeFusionPass.md matmul/mat_mul_v3/docs/MatMulBiasAddOpenFusionPass.md matmul/mat_mul_v3/docs/MatMulReshapeBiasAddFusionPass.md matmul/mat_mul_v3/docs/MatMulToMatmulV3FusionPass.md matmul/mat_mul_v3/docs/MatMulUnsqueezeSqueezeFusionPass.md matmul/quant_batch_matmul_v3/docs/ZZMatMulTOQBMMV3FusionPass.md matmul/transpose_batch_mat_mul/docs/BatchMatMul2TransposeBatchMatMulFusionPass.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9636 | 1 天前 | |
docs-fix Co-authored-by: jisongyuan@h-partners.com<jisongyuan@h-partners.com> # message auto-generated for no-merge-commit merge: !10031 merge master into master docs-fix Created-by: ji-songyuan Commit-by: jisongyuan@h-partners.com Merged-by: cann-robot Description: ## 描述 本 PR 对 fused_adamw 算子接口文档进行约束补充修复,涉及 1 个文件,改动量 +5/-5。 主要解决以下文档缺失约束说明的问题: - **空 Tensor 约束未声明**:5 个 TensorList 输入参数的描述中未明确"不支持空 Tensor"约束,读者无法从文档获知该限制,可能导致传入空 Tensor 触发未定义行为 ### 改动明细 | # | 文件 | 改动 | 说明 | |---|------|------|------| | 1 | optim/fused_adamw/docs/aclnnFusedAdamw.md | +5/-5 | 为 5 个 TensorList 参数(paramsRef、grads、expAvgsRef、expAvgSqsRef、maxExpAvgSqsRef)的描述补充"不支持空 Tensor"约束说明,使用 <ul><li> 列表形式包裹,与文档其他参数的约束说明风格保持一致 | ### 改动原则 - **纯文档修复,不改变任何代码逻辑**:所有改动均为 .md 文件内的文字描述,不涉及 .cpp/.h 源文件 - **对齐实现**:修正后的描述与当前算子实现中空 Tensor 校验逻辑一致 - **聚焦最小改动**:仅补充缺失约束说明,不做额外的文档重构 ## 关联的Issue issue #4847 ## 测试 - 文档改动无需编译/功能测试,通过人工 review 验证描述与代码实现一致 - 改动不影响算子行为,CI 编译与功能测试结果不受影响 ## 文档更新 本 PR 即为文档更新,涉及以下文件: - optim/fused_adamw/docs/aclnnFusedAdamw.md ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [ ] AI辅助编写 See merge request: cann/ops-nn!10031 | 1 天前 | |
md大模型检测低错修复 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !9420 merge master into master md大模型检测低错修复 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md aidd大模型检测低错修复 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/5254 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> acl*.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!9420 | 12 天前 | |
Revert "WQBMM和QBMM 算子兼容性整改" Co-authored-by: renzetao<renzetao2@huawei.com> # message auto-generated for no-merge-commit merge: !10058 merge huitui into master Revert "WQBMM和QBMM 算子兼容性整改" Created-by: renzetao Commit-by: renzetao Merged-by: cann-robot Description: ## 描述 回退兼容性相关修改,直至 Ascend 支持相关内容 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> #5678 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10058 | 1 天前 | |
Format update: Adjusted the license description format in all relevant files. Co-authored-by: jiangqi<jiangqi47@h-partners.com> # message auto-generated for no-merge-commit merge: !403 merge license7 into master Format update: Adjusted the license description format in all relevant files. Created-by: jiangqi2025 Commit-by: jiangqi Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!403 | 8 个月前 | |
transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持 Co-authored-by: huangkejie1647<huangkejie3@huawei.com> # message auto-generated for no-merge-commit merge: !8472 merge tqbmm-nn into master transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持 Created-by: huangkejie1647 Commit-by: huangkejie1647 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 此 PR 为 transpose_quant_batch_mat_mul(TQBMM)算子新增 MXFP4(DT_FLOAT4_E2M1)精度模式支持,并重构了 MX 系列精度(MXFP8/MXFP4)的 Kernel 实现路径。主要工作包括:在类型校验与 tiling 层引入 MXFP4 数据类型;新增 TQBMMPrecisionMode::PRECISION_MODE_MXFP4 枚举值及其对应的模板参数组合;使用 Blaze 框架的 QuantBatchMatmulV3BasicAPITilingData 统一 MXFP8 和 MXFP4 的 tiling 数据传递;新增基于 Blaze 的 TqbmmMxTensorApiKernel 内核实现。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#5171](https://gitcode.com/cann/ops-nn/issues/5171) [#5244](https://gitcode.com/cann/ops-nn/issues/5244) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 本地验证通过,二级冒烟无异常,ut,和文档已补充 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> matmul/transpose_quant_batch_mat_mul/docs/aclnnTransposeQuantBatchMatMul.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8472 | 12 天前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 6 天前 | ||
| 1 天前 | ||
| 30 天前 | ||
| 1 天前 | ||
| 12 天前 | ||
| 1 天前 | ||
| 5 天前 | ||
| 12 天前 | ||
| 6 天前 | ||
| 2 天前 | ||
| 5 天前 | ||
| 6 天前 | ||
| 13 天前 | ||
| 6 天前 | ||
| 1 天前 | ||
| 7 天前 | ||
| 7 天前 | ||
| 6 天前 | ||
| 8 天前 | ||
| 2 天前 | ||
| 1 天前 | ||
| 1 天前 | ||
| 12 天前 | ||
| 5 天前 | ||
| 5 天前 | ||
| 2 天前 | ||
| 7 天前 | ||
| 5 天前 | ||
| 1 天前 | ||
| 1 天前 | ||
| 1 天前 | ||
| 12 天前 | ||
| 1 天前 | ||
| 8 个月前 | ||
| 12 天前 |