| md大模型检测低错修改 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !5183 merge master into master md大模型检测低错修改 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md大模型检测低错修改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [# 2466](https://gitcode.com/cann/ops-math/issues/2446) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> *.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!5183 | 10 天前 |
| change socversion to npuarch Co-authored-by: liulinxiang<liulinxiang1@huawei.com> # message auto-generated for no-merge-commit merge: !1114 merge master22 into master change socversion to npuarch Created-by: liulinxiang Commit-by: liulinxiang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 将代码里SocVersion::ASCEND950统一整改为使用npuarch ## 关联的Issue https://gitcode.com/cann/ops-math/issues/637 <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 自测OK <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!1114 | 6 个月前 |
| transdata supports nz to nd Co-authored-by: yuanshuai000<yuanshuai70@huawei.com> # message auto-generated for no-merge-commit merge: !2219 merge transdata into master transdata supports nz to nd Created-by: yuanshuai000 Commit-by: yuanshuai000 Merged-by: cann-robot Description: ## 描述 transdata 支持 nz2nd 格式转换,aclnn通路修改。 1. aclnn通路放开nz2nd的格式校验 2. 新增nz输入的校验 3. transdata信息库新增nz2nd数据流 4. 更新aclnnNpuFormatCast文档说明 **目标芯片**: Ascend950 新增支持的格式转换数据流: | srcDtype | srcFormat | dstFormat | |--|--|--| | FLOAT4_E2M1 | FRACTAL_NZ | ND | | FLOAT4_E2M1 | FRACTAL_NZ_C0_32 | ND | | INT8 | FRACTAL_NZ | ND | | INT8 | FRACTAL_NZ_C0_16 | ND | | INT8 | FRACTAL_NZ_C0_32 | ND | | UINT8 | FRACTAL_NZ | ND | | UINT8 | FRACTAL_NZ_C0_16 | ND | | UINT8 | FRACTAL_NZ_C0_32 | ND | | FLOAT8_E4M3FN | FRACTAL_NZ | ND | | FLOAT16 | FRACTAL_NZ | ND | | BFLOAT16 | FRACTAL_NZ | ND | | FLOAT | FRACTAL_NZ | ND | | FLOAT | FRACTAL_NZ_C0_2 | ND | | FLOAT | FRACTAL_NZ_C0_4 | ND | | FLOAT | FRACTAL_NZ_C0_16 | ND | | FLOAT | FRACTAL_NZ_C0_32 | ND | | INT32 | FRACTAL_NZ | ND | | INT32 | FRACTAL_NZ_C0_2 | ND | | INT32 | FRACTAL_NZ_C0_4 | ND | | INT32 | FRACTAL_NZ_C0_16 | ND | | INT32 | FRACTAL_NZ_C0_32 | ND | ## 关联的Issue https://gitcode.com/cann/ops-math/issues/1318 ## 测试 冒烟验证通过,本地自验证所有格式+数据类型组合,功能正常,精度正确。 ## 文档更新 \ops-math\conversion\npu_format_cast\docs\aclnnNpuFormatCast.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!2219 | 4 个月前 |
| feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Co-authored-by: maqijun<maqijun@h-partners.com> # message auto-generated for no-merge-commit merge: !4495 merge feat/weight-quant-preprocess-a16w4 into master feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Created-by: maqijun Commit-by: maqijun Merged-by: cann-robot Description: ## WeightQuantPreprocess A16W4 数据流支持 ### 概述 为 aclnnWeightQuantPreprocess 算子添加 A16W4(INT4/FP4/MXFP4)数据流支持,实现从 ND 格式到 NZ_C0_16 格式的转换。 ### 主要修改 1. FORMAT_FAKE_TO_REAL 映射机制 - 添加 NZ_C0_8 → NZ_C0_16 映射(A16 场景) - 保留 NZ_C0_16 → NZ_C0_32 映射(A8 场景) 2. TransData Kernel 支持 - 添加 int4 → NZ_C0_16 转换 - 添加 float4_e2m1 → NZ_C0_16 转换 3. torch_npu ACL_INT4 支持 - 在 GetAclDataTypeItemSize 中添加 ACL_INT4 case ### 验证结果 所有测试场景通过: | 场景 | 状态 | 说明 | |------|------|------| | A16INT4 PerTensor | ✓ PASS | 数值精度验证通过 | | A16INT4 PerChannel | ✓ PASS | 数值精度验证通过 | | A16INT4 PerGroup | ✓ PASS | 数值精度验证通过 | | A16FP4 PerGroup | ✓ PASS | 端到端成功 | | A16MXFP4 PerGroup | ✓ PASS | 端到端成功 | | MX A8W4 (回归) | ✓ PASS | 确保 A8 场景不受影响 | ### 环境要求 - CANN 版本: cann-9.2.0 或更高 - 使用 source /path/to/cann-9.2.0/set_env.sh 设置环境变量 ### 相关 PR - op-plugin: https://gitcode.com/Ascend/op-plugin/pull/5676 ### 关联Issue - https://gitcode.com/cann/ops-math/issues/2851 See merge request: cann/ops-math!4495 | 13 天前 |
| feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Co-authored-by: maqijun<maqijun@h-partners.com> # message auto-generated for no-merge-commit merge: !4495 merge feat/weight-quant-preprocess-a16w4 into master feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Created-by: maqijun Commit-by: maqijun Merged-by: cann-robot Description: ## WeightQuantPreprocess A16W4 数据流支持 ### 概述 为 aclnnWeightQuantPreprocess 算子添加 A16W4(INT4/FP4/MXFP4)数据流支持,实现从 ND 格式到 NZ_C0_16 格式的转换。 ### 主要修改 1. FORMAT_FAKE_TO_REAL 映射机制 - 添加 NZ_C0_8 → NZ_C0_16 映射(A16 场景) - 保留 NZ_C0_16 → NZ_C0_32 映射(A8 场景) 2. TransData Kernel 支持 - 添加 int4 → NZ_C0_16 转换 - 添加 float4_e2m1 → NZ_C0_16 转换 3. torch_npu ACL_INT4 支持 - 在 GetAclDataTypeItemSize 中添加 ACL_INT4 case ### 验证结果 所有测试场景通过: | 场景 | 状态 | 说明 | |------|------|------| | A16INT4 PerTensor | ✓ PASS | 数值精度验证通过 | | A16INT4 PerChannel | ✓ PASS | 数值精度验证通过 | | A16INT4 PerGroup | ✓ PASS | 数值精度验证通过 | | A16FP4 PerGroup | ✓ PASS | 端到端成功 | | A16MXFP4 PerGroup | ✓ PASS | 端到端成功 | | MX A8W4 (回归) | ✓ PASS | 确保 A8 场景不受影响 | ### 环境要求 - CANN 版本: cann-9.2.0 或更高 - 使用 source /path/to/cann-9.2.0/set_env.sh 设置环境变量 ### 相关 PR - op-plugin: https://gitcode.com/Ascend/op-plugin/pull/5676 ### 关联Issue - https://gitcode.com/cann/ops-math/issues/2851 See merge request: cann/ops-math!4495 | 13 天前 |
| TransData Simt C风格接口修改 Co-authored-by: SimonZzz<zhouquan79@huawei.com> # message auto-generated for no-merge-commit merge: !2604 merge transDataSimtFix into master TransData Simt C风格接口修改 Created-by: SimonZzz Commit-by: SimonZzz Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> TransData Simt C风格接口修改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> https://gitcode.com/cann/ops-math/issues/1512 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 本地修改前后md5sum一致 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!2604 | 3 个月前 |
| feat: 支持八个迁移算子的常量折叠(#2551) Co-authored-by: pan-tong<pantong@huawei.com> # message auto-generated for no-merge-commit merge: !4511 merge feat/constant-folding-infershape into master feat: 支持八个迁移算子的常量折叠(#2551) Created-by: pan-tong Commit-by: pan-tong Merged-by: cann-robot Description: ## 描述 为 Ceil、ConcatV2、Expand、GreaterEqual、InvertPermutation、StridedSlice、StridedSliceV2、TransData 接入 HOSTCPU 常量折叠。 - 为尚未接线的 7 个算子在 CMake 中启用 HOSTCPU TRUE,将现有 AICPU kernel 编入 libopconstant_folding_math.so。 - 8 个算子的 AICPU kernel 使用 OPS_MATH_REGISTER_CPU_KERNELV2,兼容 device 注册和 host CPU Kernel V2 注册。 - 为 GreaterEqual 补齐 OPS_FLAG_OPEN;其余算子沿用已有 OPEN 配置。 - TransData 沿用已有 HOSTCPU 配置,并复用已接入 host object 的 format_transfer 辅助源。 - 增强 Ceil AICPU UT 的输出校验,新增 Ceil 全 Const GE 图常量折叠用例。 本 PR 不修改算子的 infershape 实现。 ## 关联的Issue https://gitcode.com/cann/ops-math/issues/2551 ## 测试 - AICPU UT:8 个算子共 156 个用例全部通过。 - HOSTCPU 构建:libopconstant_folding_math.so 构建成功,包含 8 个算子的 host 注册。 - 安装级 GE 常量折叠:8 个算子的全 Const 图输出均校验通过。 - 逐算子日志确认对应 host kernel 执行,ConstantFoldingPass 返回码均为 0。 - pre-commit:clang-format、codespell、OAT 等检查全部通过。 - GitCode 服务端 Hooks:通过。 ## 文档更新 无。该改动不改变算子接口和使用方式。 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4511 | 27 天前 |
| [PR3/3] migrate transdata aicpu kernel: remaining formats + OpDef + infershape + full UT Co-authored-by: pan-tong<pantong@huawei.com> # message auto-generated for no-merge-commit merge: !4115 merge transdata_pr3 into master [PR3/3] migrate transdata aicpu kernel: remaining formats + OpDef + infershape + full UT Created-by: pan-tong Commit-by: pan-tong Merged-by: cann-robot Description: ## 描述 将canndev仓TransData算子的AICPU kernel迁移到ops-math仓,PR3/3:remaining formats + OpDef + infershape + full UT + example。 ## 关联的Issue #2231 ## 测试 PR3 of 3 (final): remaining format_transfer + OpDef registration + infershape + full UT + example. - format_transfer_fractalz_3d.{cpp,h}: NCDHW/DHWCN/NDHWC <-> FRACTAL_Z_3D - format_transfer_ndc1hwc0.{cpp,h}: NCDHW/NDHWC -> NDC1HWC0 - format_transfer_transpose.{cpp,h}: format transpose - trans_data_aicpu_def.cpp: AICPU OpDef registration (activates custom_math) - trans_data_infershape.cpp: RT2 InferShape - test_trans_data.cpp: full 23 kernel UT cases - test_trans_data_infershape.cpp: 6 infershape UT cases - test_geir_trans_data.cpp: GE IR example - docs/zh/op_list.md: mark trans_data as AI Core/AI CPU This PR activates custom_math TransData. Depends on PR1 + PR2. ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述:算子迁仓 See merge request: cann/ops-math!4115 | 1 个月前 |
| [PR3/3] migrate transdata aicpu kernel: remaining formats + OpDef + infershape + full UT Co-authored-by: pan-tong<pantong@huawei.com> # message auto-generated for no-merge-commit merge: !4115 merge transdata_pr3 into master [PR3/3] migrate transdata aicpu kernel: remaining formats + OpDef + infershape + full UT Created-by: pan-tong Commit-by: pan-tong Merged-by: cann-robot Description: ## 描述 将canndev仓TransData算子的AICPU kernel迁移到ops-math仓,PR3/3:remaining formats + OpDef + infershape + full UT + example。 ## 关联的Issue #2231 ## 测试 PR3 of 3 (final): remaining format_transfer + OpDef registration + infershape + full UT + example. - format_transfer_fractalz_3d.{cpp,h}: NCDHW/DHWCN/NDHWC <-> FRACTAL_Z_3D - format_transfer_ndc1hwc0.{cpp,h}: NCDHW/NDHWC -> NDC1HWC0 - format_transfer_transpose.{cpp,h}: format transpose - trans_data_aicpu_def.cpp: AICPU OpDef registration (activates custom_math) - trans_data_infershape.cpp: RT2 InferShape - test_trans_data.cpp: full 23 kernel UT cases - test_trans_data_infershape.cpp: 6 infershape UT cases - test_geir_trans_data.cpp: GE IR example - docs/zh/op_list.md: mark trans_data as AI Core/AI CPU This PR activates custom_math TransData. Depends on PR1 + PR2. ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述:算子迁仓 See merge request: cann/ops-math!4115 | 1 个月前 |
| md大模型检测低错修改 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !5183 merge master into master md大模型检测低错修改 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> md大模型检测低错修改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [# 2466](https://gitcode.com/cann/ops-math/issues/2446) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> *.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!5183 | 10 天前 |