| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
fix npu_rotate_quant bugs and test case Co-authored-by: XianglongZeng<zengxianglong1@huawei.com> # message auto-generated for no-merge-commit merge: !5438 merge master into master fix npu_rotate_quant bugs and test case Created-by: probiotics_53 Commit-by: XianglongZeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [x] 资料更新 # 【修改方案】 is_mx_type 仅与 c10_npu::DType 的值(291/292/296)进行比较,但 torch.float8_e5m2和torch.float8_e4m3fn传入的是 at::ScalarType 的值(23和26)。由于这23/26不等于 291/292,因此 is_mx_type = false → 缩放比例输出(scale)被错误地分配为 ACL_FLOAT。 修复方案:将 dst_dtype_val 统一归一化为 aclDataType,这样两套枚举系统都能被统一处理。c10_npu::GetAclDataType 已经处理了这两种情况(t ≥ 256 → c10_npu::DType;否则 → at::ScalarType)。 # 【资料变更】 对入参的约束做出更清晰的描述,并对A2/A3和A5上的不同约束进行了区分说明 # 【接口变更】 不涉及,此前cann侧已进行变更 # 【功能验证】 A5 atk:  A5 ut:  A2A3 atk:  执行失败的用例为内存超限 A2A3 ut:  # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/op-plugin!5438 | 1 个月前 |