| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Co-authored-by: maqijun<maqijun@h-partners.com> # message auto-generated for no-merge-commit merge: !4495 merge feat/weight-quant-preprocess-a16w4 into master feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Created-by: maqijun Commit-by: maqijun Merged-by: cann-robot Description: ## WeightQuantPreprocess A16W4 数据流支持 ### 概述 为 aclnnWeightQuantPreprocess 算子添加 A16W4(INT4/FP4/MXFP4)数据流支持,实现从 ND 格式到 NZ_C0_16 格式的转换。 ### 主要修改 1. FORMAT_FAKE_TO_REAL 映射机制 - 添加 NZ_C0_8 → NZ_C0_16 映射(A16 场景) - 保留 NZ_C0_16 → NZ_C0_32 映射(A8 场景) 2. TransData Kernel 支持 - 添加 int4 → NZ_C0_16 转换 - 添加 float4_e2m1 → NZ_C0_16 转换 3. torch_npu ACL_INT4 支持 - 在 GetAclDataTypeItemSize 中添加 ACL_INT4 case ### 验证结果 所有测试场景通过: | 场景 | 状态 | 说明 | |------|------|------| | A16INT4 PerTensor | ✓ PASS | 数值精度验证通过 | | A16INT4 PerChannel | ✓ PASS | 数值精度验证通过 | | A16INT4 PerGroup | ✓ PASS | 数值精度验证通过 | | A16FP4 PerGroup | ✓ PASS | 端到端成功 | | A16MXFP4 PerGroup | ✓ PASS | 端到端成功 | | MX A8W4 (回归) | ✓ PASS | 确保 A8 场景不受影响 | ### 环境要求 - CANN 版本: cann-9.2.0 或更高 - 使用 source /path/to/cann-9.2.0/set_env.sh 设置环境变量 ### 相关 PR - op-plugin: https://gitcode.com/Ascend/op-plugin/pull/5676 ### 关联Issue - https://gitcode.com/cann/ops-math/issues/2851 See merge request: cann/ops-math!4495 | 14 天前 | |
feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Co-authored-by: maqijun<maqijun@h-partners.com> # message auto-generated for no-merge-commit merge: !4495 merge feat/weight-quant-preprocess-a16w4 into master feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Created-by: maqijun Commit-by: maqijun Merged-by: cann-robot Description: ## WeightQuantPreprocess A16W4 数据流支持 ### 概述 为 aclnnWeightQuantPreprocess 算子添加 A16W4(INT4/FP4/MXFP4)数据流支持,实现从 ND 格式到 NZ_C0_16 格式的转换。 ### 主要修改 1. FORMAT_FAKE_TO_REAL 映射机制 - 添加 NZ_C0_8 → NZ_C0_16 映射(A16 场景) - 保留 NZ_C0_16 → NZ_C0_32 映射(A8 场景) 2. TransData Kernel 支持 - 添加 int4 → NZ_C0_16 转换 - 添加 float4_e2m1 → NZ_C0_16 转换 3. torch_npu ACL_INT4 支持 - 在 GetAclDataTypeItemSize 中添加 ACL_INT4 case ### 验证结果 所有测试场景通过: | 场景 | 状态 | 说明 | |------|------|------| | A16INT4 PerTensor | ✓ PASS | 数值精度验证通过 | | A16INT4 PerChannel | ✓ PASS | 数值精度验证通过 | | A16INT4 PerGroup | ✓ PASS | 数值精度验证通过 | | A16FP4 PerGroup | ✓ PASS | 端到端成功 | | A16MXFP4 PerGroup | ✓ PASS | 端到端成功 | | MX A8W4 (回归) | ✓ PASS | 确保 A8 场景不受影响 | ### 环境要求 - CANN 版本: cann-9.2.0 或更高 - 使用 source /path/to/cann-9.2.0/set_env.sh 设置环境变量 ### 相关 PR - op-plugin: https://gitcode.com/Ascend/op-plugin/pull/5676 ### 关联Issue - https://gitcode.com/cann/ops-math/issues/2851 See merge request: cann/ops-math!4495 | 14 天前 | |
增加A2 A3新算子支持 Co-authored-by: slx2008<shaolixin@huawei.com> # message auto-generated for no-merge-commit merge: !448 merge master into master 增加A2 A3新算子支持 Created-by: songkai111 Commit-by: slx2008 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!448 | 8 个月前 | |
feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Co-authored-by: maqijun<maqijun@h-partners.com> # message auto-generated for no-merge-commit merge: !4495 merge feat/weight-quant-preprocess-a16w4 into master feat: WeightQuantPreprocess 新增 A16W4 紧凑排布数据流支持(INT4/FP4/MXFP4) Created-by: maqijun Commit-by: maqijun Merged-by: cann-robot Description: ## WeightQuantPreprocess A16W4 数据流支持 ### 概述 为 aclnnWeightQuantPreprocess 算子添加 A16W4(INT4/FP4/MXFP4)数据流支持,实现从 ND 格式到 NZ_C0_16 格式的转换。 ### 主要修改 1. FORMAT_FAKE_TO_REAL 映射机制 - 添加 NZ_C0_8 → NZ_C0_16 映射(A16 场景) - 保留 NZ_C0_16 → NZ_C0_32 映射(A8 场景) 2. TransData Kernel 支持 - 添加 int4 → NZ_C0_16 转换 - 添加 float4_e2m1 → NZ_C0_16 转换 3. torch_npu ACL_INT4 支持 - 在 GetAclDataTypeItemSize 中添加 ACL_INT4 case ### 验证结果 所有测试场景通过: | 场景 | 状态 | 说明 | |------|------|------| | A16INT4 PerTensor | ✓ PASS | 数值精度验证通过 | | A16INT4 PerChannel | ✓ PASS | 数值精度验证通过 | | A16INT4 PerGroup | ✓ PASS | 数值精度验证通过 | | A16FP4 PerGroup | ✓ PASS | 端到端成功 | | A16MXFP4 PerGroup | ✓ PASS | 端到端成功 | | MX A8W4 (回归) | ✓ PASS | 确保 A8 场景不受影响 | ### 环境要求 - CANN 版本: cann-9.2.0 或更高 - 使用 source /path/to/cann-9.2.0/set_env.sh 设置环境变量 ### 相关 PR - op-plugin: https://gitcode.com/Ascend/op-plugin/pull/5676 ### 关联Issue - https://gitcode.com/cann/ops-math/issues/2851 See merge request: cann/ops-math!4495 | 14 天前 | |
[PR3/3] migrate transdata aicpu kernel: remaining formats + OpDef + infershape + full UT Co-authored-by: pan-tong<pantong@huawei.com> # message auto-generated for no-merge-commit merge: !4115 merge transdata_pr3 into master [PR3/3] migrate transdata aicpu kernel: remaining formats + OpDef + infershape + full UT Created-by: pan-tong Commit-by: pan-tong Merged-by: cann-robot Description: ## 描述 将canndev仓TransData算子的AICPU kernel迁移到ops-math仓,PR3/3:remaining formats + OpDef + infershape + full UT + example。 ## 关联的Issue #2231 ## 测试 PR3 of 3 (final): remaining format_transfer + OpDef registration + infershape + full UT + example. - format_transfer_fractalz_3d.{cpp,h}: NCDHW/DHWCN/NDHWC <-> FRACTAL_Z_3D - format_transfer_ndc1hwc0.{cpp,h}: NCDHW/NDHWC -> NDC1HWC0 - format_transfer_transpose.{cpp,h}: format transpose - trans_data_aicpu_def.cpp: AICPU OpDef registration (activates custom_math) - trans_data_infershape.cpp: RT2 InferShape - test_trans_data.cpp: full 23 kernel UT cases - test_trans_data_infershape.cpp: 6 infershape UT cases - test_geir_trans_data.cpp: GE IR example - docs/zh/op_list.md: mark trans_data as AI Core/AI CPU This PR activates custom_math TransData. Depends on PR1 + PR2. ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述:算子迁仓 See merge request: cann/ops-math!4115 | 1 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 14 天前 | ||
| 14 天前 | ||
| 8 个月前 | ||
| 14 天前 | ||
| 1 个月前 |