| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
C++ Clean Code规范修改 Co-authored-by: baijinxiang<baijinxiang@huawei.com> # message auto-generated for no-merge-commit merge: !3563 merge feature/bjx into master C++ Clean Code规范修改 Created-by: doufloat Commit-by: baijinxiang Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> G.FMT.17-CPP 合理安排空行 G.CNS.02-CPP 不要使用难以理解的字面常量 G.CNS.03-CPP 对于不会修改成员变量的成员函数应使用const修饰 G.EXP.15-CPP 避免使用reinterpret_cast ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> https://gitcode.com/cann/ops-math/issues/2057 <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3563 | 2 个月前 | |
[ascend350] 15个算子新增ascend350平台支持 Co-authored-by: Developer user<zhuzixian1@h-partners.com> # message auto-generated for no-merge-commit merge: !5523 merge ascend350_adapt into master [ascend350] 15个算子新增ascend350平台支持 Created-by: zhuzixian-lr Commit-by: Developer user Merged-by: cann-robot Description: ## 描述 15个算子新增ascend350平台支持:muls、addcdiv、addcmul、bias_add、div_no_nan、floor_div、floor_mod、lerp、less_equal、logical_and、logical_or、not_equal、select_v2、tanh_grad、clip_by_value_v2。 修改模式(350与ascend950完全同配,两者同为 DAV_3510,走同一代码分支): - op_host/<op>_def.cpp:追加 AddConfig("ascend350"),复用 ascend950 同一 config 对象 - CMakeLists:SUPPORT_COMPUTE_UNIT/SUPPORT_TILING_DIR 增加 ascend350/arch35(含 add_kernel_sources 块 COMPUTE_UNITS) - op_host/config/ascend350/:拷贝 ascend950 的 <op>_binary.json(不拷 simplified_key.ini) - scripts/kernel/binary_config/ascendc_config.json:compute_units 加 ascend350,compile_options 与 ascend950 逐项相同(仅对 json 中已有条目的算子修改,原无条目的算子不新增登记,避免影响既有编译选项行为) ## 测试 A5(Ascend950PR)环境实测: - build.sh --pkg --soc=ascend350 --ops=<op> --vendor_name=customize -j4 全部 15 算子编译通过(self config 日志、ascend350 kernel .o 产物、run 包产出、json 选项注入均验证) - 950 硬件伪装 350 路径(ASCEND_OPP_PATH overlay + Short_SoC_version=Ascend350)ttk kernel 精度验证:已验收算子 bin_precision 100%、precision_status 全 PASS(muls 100用例、bias_add 100用例等,详见验收记录) - pre-commit 全部检查通过(按文件运行,含 clang-format/codespell/OAT 合规) ## 关联的Issue https://gitcode.com/cann/ops-math/issues/3114 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 ## SocVersion 判断合规化(2026-09-11 追加) - 规则:不允许 SocVersion 区间判断隐式覆盖芯片,950/350 需显式 IsRegBase() 判断,不再依赖枚举顺序副作用 - 本 MR 清单 18 处复查结果:1 处由本 MR 修改(math/equal/op_api/aclnn_isin.cpp,清单中唯一未被 master 覆盖处);13 处已被 master !5467(823210994)修复,rebase 后去重不再重复修改;4 处跳过(math/not_equal/op_api/aclnn_ne_scalar.cpp×2、aclnn_ne_tensor.cpp×2,区间判断前已有 if (IsRegBase()) 提前返回兜底,追加会造成死条件) - 改法:保留原 [ASCEND910B, ASCEND910E] 区间(覆盖 910B/910C/910E),或逻辑增加 IsRegBase()(显式覆盖 regbase 芯片) - 行为零变化:950 原区间命中(true)→现 IsRegBase()(true);350 原被区间覆盖(true)→现 IsRegBase()(true);910B/C/E 走原区间不变 - 分支已 rebase 至最新 upstream master See merge request: cann/ops-math!5523 | 8 天前 | |
[ascend350] 15个算子新增ascend350平台支持 Co-authored-by: Developer user<zhuzixian1@h-partners.com> # message auto-generated for no-merge-commit merge: !5523 merge ascend350_adapt into master [ascend350] 15个算子新增ascend350平台支持 Created-by: zhuzixian-lr Commit-by: Developer user Merged-by: cann-robot Description: ## 描述 15个算子新增ascend350平台支持:muls、addcdiv、addcmul、bias_add、div_no_nan、floor_div、floor_mod、lerp、less_equal、logical_and、logical_or、not_equal、select_v2、tanh_grad、clip_by_value_v2。 修改模式(350与ascend950完全同配,两者同为 DAV_3510,走同一代码分支): - op_host/<op>_def.cpp:追加 AddConfig("ascend350"),复用 ascend950 同一 config 对象 - CMakeLists:SUPPORT_COMPUTE_UNIT/SUPPORT_TILING_DIR 增加 ascend350/arch35(含 add_kernel_sources 块 COMPUTE_UNITS) - op_host/config/ascend350/:拷贝 ascend950 的 <op>_binary.json(不拷 simplified_key.ini) - scripts/kernel/binary_config/ascendc_config.json:compute_units 加 ascend350,compile_options 与 ascend950 逐项相同(仅对 json 中已有条目的算子修改,原无条目的算子不新增登记,避免影响既有编译选项行为) ## 测试 A5(Ascend950PR)环境实测: - build.sh --pkg --soc=ascend350 --ops=<op> --vendor_name=customize -j4 全部 15 算子编译通过(self config 日志、ascend350 kernel .o 产物、run 包产出、json 选项注入均验证) - 950 硬件伪装 350 路径(ASCEND_OPP_PATH overlay + Short_SoC_version=Ascend350)ttk kernel 精度验证:已验收算子 bin_precision 100%、precision_status 全 PASS(muls 100用例、bias_add 100用例等,详见验收记录) - pre-commit 全部检查通过(按文件运行,含 clang-format/codespell/OAT 合规) ## 关联的Issue https://gitcode.com/cann/ops-math/issues/3114 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 ## SocVersion 判断合规化(2026-09-11 追加) - 规则:不允许 SocVersion 区间判断隐式覆盖芯片,950/350 需显式 IsRegBase() 判断,不再依赖枚举顺序副作用 - 本 MR 清单 18 处复查结果:1 处由本 MR 修改(math/equal/op_api/aclnn_isin.cpp,清单中唯一未被 master 覆盖处);13 处已被 master !5467(823210994)修复,rebase 后去重不再重复修改;4 处跳过(math/not_equal/op_api/aclnn_ne_scalar.cpp×2、aclnn_ne_tensor.cpp×2,区间判断前已有 if (IsRegBase()) 提前返回兜底,追加会造成死条件) - 改法:保留原 [ASCEND910B, ASCEND910E] 区间(覆盖 910B/910C/910E),或逻辑增加 IsRegBase()(显式覆盖 regbase 芯片) - 行为零变化:950 原区间命中(true)→现 IsRegBase()(true);350 原被区间覆盖(true)→现 IsRegBase()(true);910B/C/E 走原区间不变 - 分支已 rebase 至最新 upstream master See merge request: cann/ops-math!5523 | 8 天前 | |
masked_fill等算子下一代实现 Co-authored-by: ly_cann_coder<liyao152@huawei.com> # message auto-generated for no-merge-commit merge: !519 merge local into master masked_fill等算子下一代实现 Created-by: ly_cann_coder Commit-by: ly_cann_coder Merged-by: cann-robot Description: ## 描述 新增以下算子的下一代实现: | 序号 | 名称 | 功能 | |--|--|--| |1| add_n | 将多个输入tensor相加 | |2|axpy_v2|执行标量乘向量加向量的操作| |3|lerp|根据给定的权重,在起始和结束Tensor之间进行线性插值,返回插值后的Tensor| |4|logical_or|完成给定输入张量元素的逻辑或运算| |5|masked_fill|将输入Tensor x中mask位置为True的元素填充指定的值| |6|sub|完成减法计算,被减数按alpha进行缩放| |7|addr|求一维向量vec1和vec2的外积得到一个二维矩阵,并将外积结果矩阵乘一个系数后和自身乘系数相加后输出| |8|square_sum_v1|用于计算输入张量的平方和| |9|is_nan|判断张量中哪些元素是nan| |10|assign_add|完成在原有tensor上的加法操作| |11|assign_sub|完成在原有tensor上的减法操作| |12|invert|按位取反| ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!519 | 8 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 2 个月前 | ||
| 8 天前 | ||
| 8 天前 | ||
| 8 个月前 |