| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
修复 optim 类算子 README 文档格式及内容 Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !7068 merge master into master 修复 optim 类算子 README 文档格式及内容 Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7068 | 2 个月前 | |
修复 optim 类算子 README 文档格式及内容 Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !7068 merge master into master 修复 optim 类算子 README 文档格式及内容 Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7068 | 2 个月前 | |
修复 optim 类算子 README 文档格式及内容 Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !7068 merge master into master 修复 optim 类算子 README 文档格式及内容 Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7068 | 2 个月前 | |
docs目录基本概念md中文名改为英文名 Co-authored-by: chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !7857 merge master into master docs目录基本概念md中文名改为英文名 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao;chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> docs目录基本概念md文件名改为英文: 避免link中的中文字符引发的跳转异常,例如两段式接口.md变成%E4%B8%A4%E6%AE%B5%E5%BC%8F%E6%8E%A5%E5%8F%A3.md,不易于维护,可能导致其他平台跳转有问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#4260](https://gitcode.com/cann/ops-nn/issues/4260) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> docs/zh/context所有md和对应的link ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7857 | 1 个月前 | |
format cpp Co-authored-by: yang-di52<yangdi52@huawei.com> # message auto-generated for no-merge-commit merge: !6784 merge issue_fix into master format cpp Created-by: yang-di52 Commit-by: yang-di52 Merged-by: cann-robot Description: ## 描述 批量刷新cpp代码格式 ## 关联的Issue [#3791](https://gitcode.com/cann/ops-nn/issues/3791) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:代码格式化 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!6784 | 2 个月前 | |
docs目录基本概念md中文名改为英文名 Co-authored-by: chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !7857 merge master into master docs目录基本概念md中文名改为英文名 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao;chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> docs目录基本概念md文件名改为英文: 避免link中的中文字符引发的跳转异常,例如两段式接口.md变成%E4%B8%A4%E6%AE%B5%E5%BC%8F%E6%8E%A5%E5%8F%A3.md,不易于维护,可能导致其他平台跳转有问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#4260](https://gitcode.com/cann/ops-nn/issues/4260) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> docs/zh/context所有md和对应的link ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7857 | 1 个月前 | |
AIDD拼写和标点问题修改 Co-authored-by: y60124828<yanglou1@h-partners.com> # message auto-generated for no-merge-commit merge: !10060 merge master into master AIDD拼写和标点问题修改 Created-by: yanglu-1 Commit-by: y60124828 Merged-by: cann-robot Description: ## 描述 AIDD拼写和标点问题修改 ## 关联的Issue 关联Issue #5680 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!10060 | 12 天前 | |
docs目录基本概念md中文名改为英文名 Co-authored-by: chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !7857 merge master into master docs目录基本概念md中文名改为英文名 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao;chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> docs目录基本概念md文件名改为英文: 避免link中的中文字符引发的跳转异常,例如两段式接口.md变成%E4%B8%A4%E6%AE%B5%E5%BC%8F%E6%8E%A5%E5%8F%A3.md,不易于维护,可能导致其他平台跳转有问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#4260](https://gitcode.com/cann/ops-nn/issues/4260) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> docs/zh/context所有md和对应的link ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7857 | 1 个月前 | |
format cpp Co-authored-by: yang-di52<yangdi52@huawei.com> # message auto-generated for no-merge-commit merge: !6784 merge issue_fix into master format cpp Created-by: yang-di52 Commit-by: yang-di52 Merged-by: cann-robot Description: ## 描述 批量刷新cpp代码格式 ## 关联的Issue [#3791](https://gitcode.com/cann/ops-nn/issues/3791) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:代码格式化 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!6784 | 2 个月前 | |
docs目录基本概念md中文名改为英文名 Co-authored-by: chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !7857 merge master into master docs目录基本概念md中文名改为英文名 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao;chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> docs目录基本概念md文件名改为英文: 避免link中的中文字符引发的跳转异常,例如两段式接口.md变成%E4%B8%A4%E6%AE%B5%E5%BC%8F%E6%8E%A5%E5%8F%A3.md,不易于维护,可能导致其他平台跳转有问题。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#4260](https://gitcode.com/cann/ops-nn/issues/4260) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ok ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> docs/zh/context所有md和对应的link ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7857 | 1 个月前 | |
feat(ApplyGradientDescent): ApplyGradientDescent算子补齐ascend910b原生AscendC实现 Co-authored-by: zhaohujie<zhaohujie@huawei.com> # message auto-generated for no-merge-commit merge: !7422 merge worktree-apply-gradient-descent into master feat(ApplyGradientDescent): ApplyGradientDescent算子补齐ascend910b原生AscendC实现 Created-by: zhaohujie Commit-by: zhaohujie Merged-by: cann-robot Description: ## 描述 新增 experimental 算子 experimental/optim/apply_gradient_descent/,为 **Ascend 910B(Atlas A2,ascend910b)** 提供 ApplyGradientDescent 的原生实现 —— 梯度下降单步参数原地(inplace)更新: var = var - alpha * delta **改动原因**:仓库中已有的 optim/apply_gradient_descent 仅支持 Ascend 950 —— 其 kernel / tiling / binary config 均只存在于 arch35 下,AddConfig 也只声明了 ascend950,在 ascend910b 上没有原生实现;当前 CANN 部署包在 ascend910b 上同样没有可直调的同语义内置算子(aic-ascend910b-ops-info-*.json 中无该 OpType,也无对应 aclnn 头文件)。因此该算子在 ascend910b 上存在实现空缺。 本 PR 按仓库既有约定,把 ascend910b 实现放在 experimental/ 下同名目录、复用同一 OpType ApplyGradientDescent (与 experimental/activation/gelu、experimental/activation/mish 完全一致的模式 —— 二者同样是顶层仅支持 Ascend 950、而 ascend910b 实现落在 experimental 同名目录)。--experimental 构建时 CMake 会将整个 category 目录切换到 experimental/,两份实现不会同时参与编译,因此复用 OpType 不产生冲突。 **采取的方法**: - **op_kernel**:经典(classic)AscendC 逐元素 kernel —— 多核按 512B(256 元素)对齐均分数据,单核内 TQue 双缓冲 按 UB tile 搬入 var/delta,读取标量 alpha 后计算并原地写回。中间计算统一在 fp32 完成(fp16/bf16 先 Cast 到 fp32、算完再 Cast 回原类型)。dtype 经 TilingKey 分派(fp16=1 / fp32=2 / bf16=3)。 - **op_host**:算子 def(AddConfig("ascend910b"))、elementwise infershape、tiling(多核切分 + UB tile 切分 + 尾块处理 + TilingKey 下发),以及 config/ascend910b/ binary config。 - **op_api**:手写两段式 aclnn 调用路径 aclnnApplyGradientDescentGetWorkspaceSize + aclnnApplyGradientDescent (含 L0 接口),使算子可经 aclnn 直调。 - **op_graph**:proto + graph_infer,支持 GE 图模式(GEIR)调用。 - **性能**:在精度完全不变的前提下引入 2 项优化 —— 每核 512B 对齐读突发、fp16/bf16 用一次 Axpy 融合 Muls+Sub(数据见「测试」)。 **改动范围**:**纯新增,35 个文件、+5569 行,不修改仓库中任何既有文件** —— 顶层 optim/apply_gradient_descent/ 未做任何改动(逐字节一致),scripts/kernel/binary_config/ascendc_config.json 亦无需改动(该文件对 OpType 的查找 为软匹配,未命中时回落到默认值,与本算子所需配置一致)。 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/3429 ## 测试 以下验证均在 **Ascend 910B3(ascend910b)** 实机环境完成。 ### UT | 套件 | 结果 | |---|---| | tests/ut/op_host(tiling + infershape) | **6/6 PASS** | | tests/ut/op_api(aclnn,含空指针 / dtype / shape / 标量 alpha 等异常分支) | **12/12 PASS** | | tests/ut/op_kernel(CPU 孪生 ICPU_RUN_KF,跑真实 kernel) | **3/3 PASS**,fp16 / fp32 / bf16 均 max_abs_err=0 | ### ST(ATK 上板精度,vs CPU/torch golden) - 判据:single_bm(high_precision,逐 dtype 相对误差阈值 fp16=2^-10 / bf16=2^-7 / fp32=2^-13) - 结果:**30/30 PASS(100%)** - 覆盖:fp16 / fp32 / bf16 × 1D(16 / 17 / 128)、2D(4x8 / 1x1)、3D(2x3x4 / 30x4x2 / 8x8x4)、4D(2x3x4x5)、标量 [1]; alpha ∈ {-1, -0.5, 0, 0.01, 0.1, 0.5, 1, 2}(含 [1] 与 rank-0 两种标量 shape) - 最差相对误差:fp16 4.78e-04(阈值 9.77e-04)、bf16 3.89e-03(阈值 7.81e-03)、fp32 5.95e-08(阈值 1.22e-04) - 用例集随算子一并交付、可复现: tests/st/aclnnApplyGradientDescent/{atk_aclnnApplyGradientDescent.json, executor_aclnnApplyGradientDescent.py} ### 回归 顶层 optim/apply_gradient_descent/(Ascend 950)非 experimental 构建 **仍然通过**,且目录逐字节未改动。 ### 性能(msprof op,warm-up 10 / launch-count 5) 本算子为 MTE2(GM 读)带宽受限型:每元素读 var + delta、写 var,读带宽约为写的 2 倍。上述 2 项优化在 **精度完全不变**(每一步 kernel UT max_abs_err=0,优化后 ATK 上板仍 30/30 PASS)的前提下取得: | dtype | 规模 | 优化前 device(us) | 优化后 device(us) | 加速比 | |---|---|---|---|---| | bf16 | 1M | 7.43 | 6.82 | **1.09×** | | bf16 | 16M | 50.66 | 48.30 | 1.05× | | fp16 | 1M | 7.43 | 7.15 | 1.04× | | fp16 | 16M | 49.06 | 47.80 | 1.03× | | fp32 | 4M | 26.08 | 25.45 | 1.02× | | fp32 | 16M | 92.30 | 92.37 | 1.00× | | fp32 | 4096(极小) | 4.53 | 3.06 | **1.48×** | 大 shape float32 已达 HBM 读带宽上限(MTE2 占比 ≈0.98、聚合读带宽 ~1.4 TB/s),读流量(var+delta)不可 约减,故基本持平;收益集中在 fp16/bf16 与中小 shape。 ## 文档更新 - 新增 experimental/optim/apply_gradient_descent/README.md(支持型号 / 功能描述 / 实现原理 / 性能说明 / 算子接口 / 约束说明 / 调用示例)。 - 新增 experimental/optim/apply_gradient_descent/docs/aclnnApplyGradientDescent.md(aclnn 接口说明)。 - 新增调用示例:examples/test_aclnn_apply_gradient_descent.cpp(aclnn 单算子直调)与 examples/test_geir_apply_gradient_descent.cpp(GE 图模式)。 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 ## 附ApplyGradientDescent实现与测试报告 ## 摘要(当前实现) ApplyGradientDescent 的 **Ascend 910B(Atlas A2,ascend910b)** 实现:经典(classic)AscendC 逐元素 kernel, 对参数做原地(inplace)单步梯度下降更新: var = var - alpha * delta 中间计算统一在 fp32 精度下完成(fp16/bf16 先 Cast 到 fp32 计算、算完再 Cast 回原类型)。对外入口为两段式 aclnn 接口 aclnnApplyGradientDescentGetWorkspaceSize + aclnnApplyGradientDescent,另提供 GE 图模式(GEIR) 调用路径。支持 dtype float16 / float32 / bfloat16,格式 ND,var 维度 1~8;alpha 为 1 元素标量 Tensor, var.shape == delta.shape,三者同 dtype。实现要点:多核按 512B(256 元素)对齐均分数据、单核内 TQue 双缓冲按 UB tile 分批搬运,dtype 经 TilingKey 分派(fp16=1 / fp32=2 / bf16=3);fp16/bf16 计算链用一次 Axpy 融合 var - alpha*delta。本算子为 MTE2(GM 读)带宽受限型 —— 每元素读 var+delta、写 var,读带宽约为写的 2 倍。 ## 1. 精度测试(vs CPU/torch golden) - 判据:single_bm(high_precision,逐 dtype 相对误差阈值 fp16=2^-10 / bf16=2^-7 / fp32=2^-13) - 结果:**30/30 PASS**(100%) | 用例组 | dtype | shape 覆盖 | alpha | 最差相对误差 (阈值) | 结果 | |---|---|---|---|---|---| | aclnnApplyGradientDescent | float16 | 1D(16/17/128)、2D(4x8 / 1x1)、3D(2x3x4 / 30x4x2 / 8x8x4)、4D(2x3x4x5)、标量[1] | {-1, -0.5, 0, 0.01, 0.1, 0.5, 1, 2} | 4.78e-04 (9.77e-04) | 10/10 ✅ | | aclnnApplyGradientDescent | float32 | 同上 | 同上 | 5.95e-08 (1.22e-04) | 10/10 ✅ | | aclnnApplyGradientDescent | bfloat16 | 同上 | 同上 | 3.89e-03 (7.81e-03) | 10/10 ✅ | - 覆盖 1D~4D 与标量 shape、含负 / 零 / 小数 alpha 及两种标量 alpha shape([1] 与 rank-0)。fp32 因 fp32 累加 近乎位精确;fp16/bf16 均在阈值内(bf16 最差约用满 50% 误差预算)。 - 另有 UT:op_host(tiling + infershape)6/6、op_api(aclnn,含异常分支)12/12、op_kernel(CPU 孪生 ICPU_RUN_KF 跑真实 kernel)3/3,fp16/fp32/bf16 均 max_abs_err=0。 ## 2. 对比测试(vs 默认基线) - **基线**:无可运行的默认基线。当前 CANN 部署包在 ascend910b 上没有该算子可直调的同语义内置实现 (aic-ascend910b-ops-info-*.json 中无该 OpType,也无对应 aclnn 头文件),无法构造净测对照。 - **精度等价**:N/A(无基线可对照)。 - **性能**:**N/A** —— 无可运行的默认基线,故不虚构加速比;本算子的绝对性能与优化收益见 §3。 ## 3. 性能优化(加速比 progression) - **状态**:做了 3 轮优化迭代(保留 2 项、回退 1 项)。主导瓶颈始终为 MTE2(GM 读)。数字为 ascend910b (910B3)实测绝对 kernel 时延(msprof op,warm-up 10 / launch-count 5,均值),重复性约 ±3%,sub-3% 视为 噪声。加速比 = 基线时延 / 优化后时延(>1 为更快)。 | 迭代 | 主导 bound | 优化项 | 加速比(代表值) | 精度保持 | |---|---|---|---|---| | 1 | MTE2 | 增大 UB tile(MAX_TILE 8192→16256) | ≈1.00×(净零,证实为带宽受限而非开销受限) | max_abs_err=0,**回退** | | 2 | MTE2 | 每核 512B 对齐读突发(分块粒度 32→256 元素) | 大/中 shape 1.01–1.04×,极小 shape ≈1.48× | max_abs_err=0,**保留** | | 3 | MTE2 / VEC | fp16/bf16 用一次 Axpy 融合 Muls+Sub | bf16 至 ~1.09×、fp16 ~1.03–1.04×,fp32 不变 | max_abs_err=0,**保留** | 累计(iter2 + iter3)代表性加速比与绝对时延: | dtype | 规模 | 基线 device(us) | 优化后 device(us) | 加速比 | |---|---|---|---|---| | bf16 | 1M | 7.43 | 6.82 | **1.09×** | | bf16 | 16M | 50.66 | 48.30 | 1.05× | | fp16 | 1M | 7.43 | 7.15 | 1.04× | | fp16 | 16M | 49.06 | 47.80 | 1.03× | | fp32 | 4M | 26.08 | 25.45 | 1.02× | | fp32 | 16M | 92.30 | 92.37 | 1.00× | | fp32 | 4096(极小) | 4.53 | 3.06 | **1.48×** | > 大 shape float32 已达 HBM 读带宽上限(MTE2 占比 ≈0.98、聚合读带宽 ~1.4 TB/s),读流量(var+delta)不可 > 约减,因此大 shape 热点路径无安全的进一步空间;收益集中在 fp16/bf16(去除计算暴露)与中小 shape(读突发 > 对齐 + 极小 shape 少启核)。精度在每一步均保持不变(kernel UT max_abs_err=0;上板精度 30/30 PASS)。 ## 4. 交付物 - op_host/(def + infershape + tiling + config/ascend910b/ binary config)+ op_kernel/(classic 逐元素 kernel + tiling_data)+ op_api/(aclnnApplyGradientDescent 两段式 L2 接口 + L0)+ op_graph/(proto + graph_infer)+ tests/ut/(op_host / op_api / op_kernel 三类)+ tests/st/aclnnApplyGradientDescent/ (ATK 用例对 json + executor)+ examples/(aclnn 与 GEIR 调用示例)+ README.md + docs/aclnnApplyGradientDescent.md。共 35 个文件,为纯新增,不改动仓库中任何既有文件。 - 已知限制 / 后续项:大 shape float32 已达 HBM 读带宽上限、逐元素读流量不可约减;kernel 结构层面已无安全空间, 进一步提升需从访存 / 硬件带宽层面着手。 See merge request: cann/ops-nn!7422 | 1 个月前 | |
format cpp Co-authored-by: yang-di52<yangdi52@huawei.com> # message auto-generated for no-merge-commit merge: !6784 merge issue_fix into master format cpp Created-by: yang-di52 Commit-by: yang-di52 Merged-by: cann-robot Description: ## 描述 批量刷新cpp代码格式 ## 关联的Issue [#3791](https://gitcode.com/cann/ops-nn/issues/3791) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:代码格式化 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!6784 | 2 个月前 | |
修复 optim 类算子 README 文档格式及内容 Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !7068 merge master into master 修复 optim 类算子 README 文档格式及内容 Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7068 | 2 个月前 | |
修复 optim 类算子 README 文档格式及内容 Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !7068 merge master into master 修复 optim 类算子 README 文档格式及内容 Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7068 | 2 个月前 | |
fix doc tools Co-authored-by: y60124828<yanglou1@h-partners.com> # message auto-generated for no-merge-commit merge: !7147 merge master into master fix doc tools Created-by: yanglu-1 Commit-by: y60124828 Merged-by: cann-robot Description: ## 描述 修改master分支里面doctool扫描的问题 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/3911 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [.] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7147 | 2 个月前 | |
Format update: Adjusted the license description format in all relevant files. Co-authored-by: jiangqi<jiangqi47@h-partners.com> # message auto-generated for no-merge-commit merge: !366 merge license6 into master Format update: Adjusted the license description format in all relevant files. Created-by: jiangqi2025 Commit-by: jiangqi Merged-by: turing_project1 Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #123--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!366 | 9 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 12 天前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 9 个月前 |