| docs(arange): 修正 docs/ 下示例代码相对路径错误 Co-authored-by: chensi79<chensi79@huawei.com> # message auto-generated for no-merge-commit merge: !4400 merge fix/issue-2466-doc-relative-path into master docs(arange): 修正 docs/ 下示例代码相对路径错误 Created-by: chensi79 Commit-by: chensi79 Merged-by: cann-robot Description: Closes #2466 ## 摘要 修正 experimental/math/{arange,acosh,mod}/docs/ 下 md 文档引用示例代码时的相对路径错误。 文档位于 docs/ 子目录,引用 examples/xxx.cpp 会解析为 docs/examples/(不存在),导致读者无法按路径找到示例源码。修正为 ../examples/ 前缀,与文档所在目录层级匹配。 ## 涉及文件 - experimental/math/arange/docs/aclnnArange.md:230 — examples/ → ../examples/(Issue #2466 报告的主问题) - experimental/math/acosh/docs/aclnnAcosh.md:184 — 同类问题 - experimental/math/mod/docs/aclnnFmodScalar&aclnnInplaceFmodScalar.md:32 — 同类问题 - experimental/math/mod/docs/aclnnFmodTensor&aclnnInplaceFmodTensor.md:32 — 同类问题 ## 验证 - 修改前:ls experimental/math/arange/docs/examples/ → 目录不存在 - 修改后:ls ../examples/test_aclnn_*.cpp(从各 docs/ 目录)→ 4 个文件均存在,路径可达 - 对照:experimental/math/bias_add/docs/aclnnBiasAdd.md 已使用正确的 ../examples/ 写法,本 MR 与其保持一致 - pre-commit hooks(trailing whitespace / codespell / OAT)全部通过 ## 测试计划 - [x] 纯文档路径修复,无代码逻辑变更 - [x] 4 处 ../examples/ 路径均已验证指向真实文件 - [x] pre-commit 钩子通过 See merge request: cann/ops-math!4400 | 1 个月前 |
| feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Co-authored-by: forge001<kristin20251209@outlook.com> # message auto-generated for no-merge-commit merge: !3168 merge arange-pr-master into master feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Created-by: forge001 Commit-by: forge001 Merged-by: cann-robot Description: ## 关联 Issue 本 PR 关联需求 issue #1956 ([Requirement|需求建议] Arange 算子贡献)。 ## 任务 社区任务2026 第15题 Arange(aclnnArange)。扩展 experimental/math/arange。 ## 变更内容 - **新增 dtype**:int8 / uint8 / int16(原型注册 + kernel 窄整型 Cast 出入口,硬件饱和语义) - **多核切分**:SetBlockDim(1) 单核 → GetCoreNum() former/tail 动态多核(各核独立无依赖 + 小 shape 退化保护) - **性能优化**:ArithProgression 替代标量 iota 循环;int32 走 native 整数路径,根治 N>2^24 的 FP32 尾数精度失真,对齐 TBE - **支持硬件**:Atlas A2 训练系列产品 / Atlas A3 系列产品(AddConfig ascend910b + ascend910_93) ## 验证 - 功能 ST(L0+L1):80/80 = 100%,507035=0 - UT:op_host 45/45 + op_kernel 10/10 - 性能:全核满载 ≤ TBE int32(2M 0.73× / 4M 0.53× / 8M 0.41×),小 shape 入 3us 容差 - 精度:AscendOpTest 默认阈值 ## 分支说明 本 PR 基于 master(tiling 使用标准头 register/op_impl_registry.h + tiling/platform/platform_ascendc.h)。算子开发与竞赛验收在 9.0.0 分支完成(对应 PR #3166),本 PR 与其唯一差异为 arange_tiling.cpp 的 2 行公共头适配。 ## 设计文档 华为评审通过(cann-ops-competitions MR#261)。 See merge request: cann/ops-math!3168 | 1 个月前 |
| feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Co-authored-by: forge001<kristin20251209@outlook.com> # message auto-generated for no-merge-commit merge: !3168 merge arange-pr-master into master feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Created-by: forge001 Commit-by: forge001 Merged-by: cann-robot Description: ## 关联 Issue 本 PR 关联需求 issue #1956 ([Requirement|需求建议] Arange 算子贡献)。 ## 任务 社区任务2026 第15题 Arange(aclnnArange)。扩展 experimental/math/arange。 ## 变更内容 - **新增 dtype**:int8 / uint8 / int16(原型注册 + kernel 窄整型 Cast 出入口,硬件饱和语义) - **多核切分**:SetBlockDim(1) 单核 → GetCoreNum() former/tail 动态多核(各核独立无依赖 + 小 shape 退化保护) - **性能优化**:ArithProgression 替代标量 iota 循环;int32 走 native 整数路径,根治 N>2^24 的 FP32 尾数精度失真,对齐 TBE - **支持硬件**:Atlas A2 训练系列产品 / Atlas A3 系列产品(AddConfig ascend910b + ascend910_93) ## 验证 - 功能 ST(L0+L1):80/80 = 100%,507035=0 - UT:op_host 45/45 + op_kernel 10/10 - 性能:全核满载 ≤ TBE int32(2M 0.73× / 4M 0.53× / 8M 0.41×),小 shape 入 3us 容差 - 精度:AscendOpTest 默认阈值 ## 分支说明 本 PR 基于 master(tiling 使用标准头 register/op_impl_registry.h + tiling/platform/platform_ascendc.h)。算子开发与竞赛验收在 9.0.0 分支完成(对应 PR #3166),本 PR 与其唯一差异为 arange_tiling.cpp 的 2 行公共头适配。 ## 设计文档 华为评审通过(cann-ops-competitions MR#261)。 See merge request: cann/ops-math!3168 | 1 个月前 |
| feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Co-authored-by: forge001<kristin20251209@outlook.com> # message auto-generated for no-merge-commit merge: !3168 merge arange-pr-master into master feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Created-by: forge001 Commit-by: forge001 Merged-by: cann-robot Description: ## 关联 Issue 本 PR 关联需求 issue #1956 ([Requirement|需求建议] Arange 算子贡献)。 ## 任务 社区任务2026 第15题 Arange(aclnnArange)。扩展 experimental/math/arange。 ## 变更内容 - **新增 dtype**:int8 / uint8 / int16(原型注册 + kernel 窄整型 Cast 出入口,硬件饱和语义) - **多核切分**:SetBlockDim(1) 单核 → GetCoreNum() former/tail 动态多核(各核独立无依赖 + 小 shape 退化保护) - **性能优化**:ArithProgression 替代标量 iota 循环;int32 走 native 整数路径,根治 N>2^24 的 FP32 尾数精度失真,对齐 TBE - **支持硬件**:Atlas A2 训练系列产品 / Atlas A3 系列产品(AddConfig ascend910b + ascend910_93) ## 验证 - 功能 ST(L0+L1):80/80 = 100%,507035=0 - UT:op_host 45/45 + op_kernel 10/10 - 性能:全核满载 ≤ TBE int32(2M 0.73× / 4M 0.53× / 8M 0.41×),小 shape 入 3us 容差 - 精度:AscendOpTest 默认阈值 ## 分支说明 本 PR 基于 master(tiling 使用标准头 register/op_impl_registry.h + tiling/platform/platform_ascendc.h)。算子开发与竞赛验收在 9.0.0 分支完成(对应 PR #3166),本 PR 与其唯一差异为 arange_tiling.cpp 的 2 行公共头适配。 ## 设计文档 华为评审通过(cann-ops-competitions MR#261)。 See merge request: cann/ops-math!3168 | 1 个月前 |
| feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Co-authored-by: forge001<kristin20251209@outlook.com> # message auto-generated for no-merge-commit merge: !3168 merge arange-pr-master into master feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Created-by: forge001 Commit-by: forge001 Merged-by: cann-robot Description: ## 关联 Issue 本 PR 关联需求 issue #1956 ([Requirement|需求建议] Arange 算子贡献)。 ## 任务 社区任务2026 第15题 Arange(aclnnArange)。扩展 experimental/math/arange。 ## 变更内容 - **新增 dtype**:int8 / uint8 / int16(原型注册 + kernel 窄整型 Cast 出入口,硬件饱和语义) - **多核切分**:SetBlockDim(1) 单核 → GetCoreNum() former/tail 动态多核(各核独立无依赖 + 小 shape 退化保护) - **性能优化**:ArithProgression 替代标量 iota 循环;int32 走 native 整数路径,根治 N>2^24 的 FP32 尾数精度失真,对齐 TBE - **支持硬件**:Atlas A2 训练系列产品 / Atlas A3 系列产品(AddConfig ascend910b + ascend910_93) ## 验证 - 功能 ST(L0+L1):80/80 = 100%,507035=0 - UT:op_host 45/45 + op_kernel 10/10 - 性能:全核满载 ≤ TBE int32(2M 0.73× / 4M 0.53× / 8M 0.41×),小 shape 入 3us 容差 - 精度:AscendOpTest 默认阈值 ## 分支说明 本 PR 基于 master(tiling 使用标准头 register/op_impl_registry.h + tiling/platform/platform_ascendc.h)。算子开发与竞赛验收在 9.0.0 分支完成(对应 PR #3166),本 PR 与其唯一差异为 arange_tiling.cpp 的 2 行公共头适配。 ## 设计文档 华为评审通过(cann-ops-competitions MR#261)。 See merge request: cann/ops-math!3168 | 1 个月前 |
| update license Co-authored-by: zhaozi3<zhaozi3@h-partners.com> # message auto-generated for no-merge-commit merge: !417 merge master into master update license Created-by: zhaozi3 Commit-by: zhaozi3 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!417 | 8 个月前 |
| feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Co-authored-by: forge001<kristin20251209@outlook.com> # message auto-generated for no-merge-commit merge: !3168 merge arange-pr-master into master feat(arange): experimental/math/arange 扩展 int8/uint8/int16 + 多核切分 + 性能优化(社区任务2026 #15) Created-by: forge001 Commit-by: forge001 Merged-by: cann-robot Description: ## 关联 Issue 本 PR 关联需求 issue #1956 ([Requirement|需求建议] Arange 算子贡献)。 ## 任务 社区任务2026 第15题 Arange(aclnnArange)。扩展 experimental/math/arange。 ## 变更内容 - **新增 dtype**:int8 / uint8 / int16(原型注册 + kernel 窄整型 Cast 出入口,硬件饱和语义) - **多核切分**:SetBlockDim(1) 单核 → GetCoreNum() former/tail 动态多核(各核独立无依赖 + 小 shape 退化保护) - **性能优化**:ArithProgression 替代标量 iota 循环;int32 走 native 整数路径,根治 N>2^24 的 FP32 尾数精度失真,对齐 TBE - **支持硬件**:Atlas A2 训练系列产品 / Atlas A3 系列产品(AddConfig ascend910b + ascend910_93) ## 验证 - 功能 ST(L0+L1):80/80 = 100%,507035=0 - UT:op_host 45/45 + op_kernel 10/10 - 性能:全核满载 ≤ TBE int32(2M 0.73× / 4M 0.53× / 8M 0.41×),小 shape 入 3us 容差 - 精度:AscendOpTest 默认阈值 ## 分支说明 本 PR 基于 master(tiling 使用标准头 register/op_impl_registry.h + tiling/platform/platform_ascendc.h)。算子开发与竞赛验收在 9.0.0 分支完成(对应 PR #3166),本 PR 与其唯一差异为 arange_tiling.cpp 的 2 行公共头适配。 ## 设计文档 华为评审通过(cann-ops-competitions MR#261)。 See merge request: cann/ops-math!3168 | 1 个月前 |