| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
新增算子st用例 Co-authored-by: hw-zhangpanpan<zhangpanpan5@huawei.com> Co-authored-by: yu_qinfei<yuqinfei1@h-partners.com> Co-authored-by: ligen<ligen75@h-partners.com> Co-authored-by: yefeicoding<yefei25@huawei.com> # message auto-generated for no-merge-commit merge: !7825 merge st into master 新增算子st用例 Created-by: yefeicoding Commit-by: yefeicoding;yu_qinfei;hw-zhangpanpan;李根;ligen Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4269 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:补充st ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!7825 | 1 个月前 | |
README Rectification Co-authored-by: TH<taohai2@huawei.com> # message auto-generated for no-merge-commit merge: !9746 merge readmeFix into master README Rectification Created-by: TH_HW Commit-by: TH Merged-by: cann-robot Description: ## 描述 整改 GroupedDynamicMxQuant 算子(含 aclnnGroupedDynamicMxQuant 与 aclnnGroupedDynamicMxQuantV2 接口)的资料与校验逻辑:统一文档命名、修正 dstTypeMax 取值区间描述、补充 FP4 输出时尾轴为偶数的参数约束,并新增对应的 V2 接口单测与 ST 用例回归。 主要改动如下: 1. **资料整改**:README.md 与 aclnnGroupedDynamicMxQuant / aclnnGroupedDynamicMxQuantV2 接口文档中,统一将 groupedIndex 命名为 groupIndex;修正公式描述中 mxscale 与 mxscale_pre 的混用及不可见字符;dstTypeMax 取值由 1.75-3.5、6.0-12.0 修正为区间表达 [1.75, 3.5)、[6.0, 12.0](FLOAT4_E1M2 为左闭右开,3.5 不在支持范围内);删除 aclnnGroupedDynamicMxQuant.md 中与实际校验不符的错误场景描述行(approximate、quantMode);V2 文档补充"y 为 FLOAT4_E2M1/FLOAT4_E1M2 时不支持非连续 Tensor"的异常场景;调用示例代码中的变量命名与 fp4/fp8 注释一并修正。 2. **op_api 参数校验修复**:aclnn_grouped_dynamic_mx_quant_v2.cpp 的 CheckShape 新增约束校验——当输出 y 的数据类型为 FLOAT4_E2M1/FLOAT4_E1M2 且 x 尾轴已知时,x 尾轴(第 1 维)长度必须为偶数;FP8 输出与动态尾轴(-1)不受此限制(按蕴含条件"非 FP4,或尾轴未知,或尾轴为偶数"校验),避免将文档仍声明支持的 FP8 合法调用误判为参数非法。 3. **tiling 属性校验修正**:grouped_dynamic_mx_quant_tiling_arch35.cpp 中 dst_type_max 对 FLOAT4_E1M2 的合法区间修正为 [1.75, 3.5),取值 3.5 时不再放行,与资料描述保持一致。 4. **单测新增**:新增 tests/ut/op_api/test_aclnn_grouped_dynamic_mx_quant_v2.cpp,共 14 个用例覆盖 FP8(E4M3FN/E5M2)与 FP4(E2M1/E1M2)输出在偶数、奇数、动态尾轴下的成功与失败(ACLNN_ERR_PARAM_INVALID)场景,其中 FP8 用例为本次校验修复的回归用例。 5. **ST 用例更新**:ttk_kernel_grouped_dynamic_mx_quant_st.csv 用例更新,覆盖 fp8/fp4 各输出类型与 scale_alg、dst_type_max 属性的组合场景。 ## 关联的Issue 无。 ## 测试 - 新增 V2 接口 op_api UT(14 个用例):FP8 输出(含奇数、动态尾轴)调用返回成功,FP4 输出偶数/动态尾轴返回成功,FP4 输出奇数尾轴返回 ACLNN_ERR_PARAM_INVALID,全部通过。 - ST 用例在 ascend950 上回归通过,覆盖 FP8/FP4 输出与 scale_alg、dst_type_max 属性组合。 ## 文档更新 更新了以下文档: - quant/grouped_dynamic_mx_quant/README.md - quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuant.md - quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuantV2.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] 新特性 - [x] Bug修复 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9746 | 6 天前 | |
README Rectification Co-authored-by: TH<taohai2@huawei.com> # message auto-generated for no-merge-commit merge: !9746 merge readmeFix into master README Rectification Created-by: TH_HW Commit-by: TH Merged-by: cann-robot Description: ## 描述 整改 GroupedDynamicMxQuant 算子(含 aclnnGroupedDynamicMxQuant 与 aclnnGroupedDynamicMxQuantV2 接口)的资料与校验逻辑:统一文档命名、修正 dstTypeMax 取值区间描述、补充 FP4 输出时尾轴为偶数的参数约束,并新增对应的 V2 接口单测与 ST 用例回归。 主要改动如下: 1. **资料整改**:README.md 与 aclnnGroupedDynamicMxQuant / aclnnGroupedDynamicMxQuantV2 接口文档中,统一将 groupedIndex 命名为 groupIndex;修正公式描述中 mxscale 与 mxscale_pre 的混用及不可见字符;dstTypeMax 取值由 1.75-3.5、6.0-12.0 修正为区间表达 [1.75, 3.5)、[6.0, 12.0](FLOAT4_E1M2 为左闭右开,3.5 不在支持范围内);删除 aclnnGroupedDynamicMxQuant.md 中与实际校验不符的错误场景描述行(approximate、quantMode);V2 文档补充"y 为 FLOAT4_E2M1/FLOAT4_E1M2 时不支持非连续 Tensor"的异常场景;调用示例代码中的变量命名与 fp4/fp8 注释一并修正。 2. **op_api 参数校验修复**:aclnn_grouped_dynamic_mx_quant_v2.cpp 的 CheckShape 新增约束校验——当输出 y 的数据类型为 FLOAT4_E2M1/FLOAT4_E1M2 且 x 尾轴已知时,x 尾轴(第 1 维)长度必须为偶数;FP8 输出与动态尾轴(-1)不受此限制(按蕴含条件"非 FP4,或尾轴未知,或尾轴为偶数"校验),避免将文档仍声明支持的 FP8 合法调用误判为参数非法。 3. **tiling 属性校验修正**:grouped_dynamic_mx_quant_tiling_arch35.cpp 中 dst_type_max 对 FLOAT4_E1M2 的合法区间修正为 [1.75, 3.5),取值 3.5 时不再放行,与资料描述保持一致。 4. **单测新增**:新增 tests/ut/op_api/test_aclnn_grouped_dynamic_mx_quant_v2.cpp,共 14 个用例覆盖 FP8(E4M3FN/E5M2)与 FP4(E2M1/E1M2)输出在偶数、奇数、动态尾轴下的成功与失败(ACLNN_ERR_PARAM_INVALID)场景,其中 FP8 用例为本次校验修复的回归用例。 5. **ST 用例更新**:ttk_kernel_grouped_dynamic_mx_quant_st.csv 用例更新,覆盖 fp8/fp4 各输出类型与 scale_alg、dst_type_max 属性的组合场景。 ## 关联的Issue 无。 ## 测试 - 新增 V2 接口 op_api UT(14 个用例):FP8 输出(含奇数、动态尾轴)调用返回成功,FP4 输出偶数/动态尾轴返回成功,FP4 输出奇数尾轴返回 ACLNN_ERR_PARAM_INVALID,全部通过。 - ST 用例在 ascend950 上回归通过,覆盖 FP8/FP4 输出与 scale_alg、dst_type_max 属性组合。 ## 文档更新 更新了以下文档: - quant/grouped_dynamic_mx_quant/README.md - quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuant.md - quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuantV2.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] 新特性 - [x] Bug修复 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!9746 | 6 天前 | |
GroupedDynamicMxQuant add cublas algorithm and params Co-authored-by: yeeyanghsia<xiayiyang@huawei.com> # message auto-generated for no-merge-commit merge: !3577 merge GroupedDynamicMxQuant into master GroupedDynamicMxQuant add cublas algorithm and params Created-by: yeeyanghsia Commit-by: yeeyanghsia Merged-by: cann-robot Description: ## 描述 GroupedDynamicMxQuant新增scale的计算方法,新增参数scale_alg,scale_alg=0时,采用原有OCP算法;scale_alg=1时,采用新增cuBLAS算法。 ## 关联的Issue 关联Issue [#2209](https://gitcode.com/cann/ops-nn/issues/2209) ## 测试 出包测试2000+条泛化用例,精度全部PASS,进行性能测试,通过冒烟测试。 ## 文档更新 更新了以下文件: docs/zh/op_api_list.md README.md aclnnGroupedDynamicMxQuantV2.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!3577 | 4 个月前 |