| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
Math仓算子新增Golden文件,方便算子质量看护和精度测试。 Co-authored-by: moonw0lf<duanlian11@h-partners.com> # message auto-generated for no-merge-commit merge: !1782 merge dl_ttk_to_math into master Math仓算子新增Golden文件,方便算子质量看护和精度测试。 Created-by: moonw0lf Commit-by: moonw0lf Merged-by: cann-robot Description: ## 描述 Math仓算子新增Golden文件,方便算子质量看护和精度测试。 ## 关联的Issue https://gitcode.com/cann/ops-math/issues/1040 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!1782 | 4 个月前 | |
整改st目录下的atk用例统一目录格式 Co-authored-by: yue-ma<mayue54@huawei.com> # message auto-generated for no-merge-commit merge: !2579 merge master into master 整改st目录下的atk用例统一目录格式 Created-by: yue-ma Commit-by: yue-ma Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 整改st目录下的atk用例统一目录格式 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> https://gitcode.com/cann/ops-math/issues/1538 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:st用例目录整改 See merge request: cann/ops-math!2579 | 2 个月前 | |
[bugfix] Align A5 div scalar TrueDiv reciprocal and FloorDiv compute dtype with PyTorch CUDA Co-authored-by: wangqi_ai<wangqi195@hisilicon.com> # message auto-generated for no-merge-commit merge: !3531 merge div_bug_fix_9.1.0 into 9.1.0 [bugfix] Align A5 div scalar TrueDiv reciprocal and FloorDiv compute dtype with PyTorch CUDA Created-by: wangqi_ai Commit-by: wangqi_ai Merged-by: cann-robot Description: ## 描述 对齐 A5(Ascend950 / DAV_3510 / RegBase)上 div 标量路径与 PyTorch CUDA 的计算口径,含两处修复: 1. TrueDiv 标量计算口径与倒数: - fp16/bf16 self 经 PromoteLowPrecToFloat 提升到 float 再计算,标量不被提前降精。 该提升同时覆盖 aclnnDivs 与 aclnnDivMods mode=0(trueDiv 入口)。 - aclnnDivs 命中 CanUseMuls 倒数乘快路时,原实现 1.0f / other->ToFloat() 先把标量 舍到 float 再取倒数;CUDA BinaryDivTrueKernel 在 cpu-scalar 分支以 high_prec(double) 取倒数再单次舍入到 float。改为 static_cast<float>(1.0 / other->ToDouble()),口径一致。 注: 该倒数乘快路仅存在于 aclnnDivs;aclnnDivMods mode=0 走 RealDiv,无倒数乘。 2. FloorDiv 计算 dtype(aclnnDivMods / aclnnInplaceDivMods mode=2): 原实现对 fp16/bf16 self 推导出的 promoteType 仍为 fp16/bf16,使标量除数被 ConvertToTensor 提前压到低精度;CUDA 在 accscalar_t(half/bf16→float)下计算 floor div 并以 float 精度读取标量。将 PromoteLowPrecToFloat 的提升从仅 MODE_REAL_DIV 扩展到同时覆盖 MODE_FLOOR_DIV,使 fp16/bf16 self + 标量在 float 下 计算、标量保留精度,输出 dtype 不变(末尾 Cast 回 out)。 两处改动均隔离在 RegBase(IsRegBase 门禁)分支内;对整型/bool/complex 为 no-op (PromoteLowPrecToFloat 幂等);A2/A3 非 RegBase 及 trunc 推导均不受影响。 ## 回合说明 本 PR 为 PR #3342(master 分支已合入)在 9.1.0 分支的 cherry-pick 回合。 ## 关联的Issue - #2042 - 原始 Issue: #2002 - 原始 PR: #3342 ## 测试 新增 Ascend950 平台 UT(math/div/tests/ut/op_api/test_aclnn_div.cpp): - TrueDiv: fp16/bf16/fp32 self + float/double 标量的 aclnnDivs 倒数乘路径,aclnnDivMods mode=0 的 RealDiv 路径,及 inplace 委派路径。 - FloorDiv: fp16/bf16 self + float/double 标量经 aclnnDivMods mode=2 的路径,及 inplace 委派路径。 opapi UT 全量 43/43 通过。数值逐位对齐由真机精度用例覆盖。 ## 文档更新 无 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3531 | 1 个月前 | |
支持Div算子在下一代实现 Co-authored-by: yuhwang<wangyuhang70@huawei.com> # message auto-generated for no-merge-commit merge: !654 merge master into master 支持Div算子在下一代实现 Created-by: yuhwang Commit-by: yuhwang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!654 | 7 个月前 |