| abs等算子A5实现 Co-authored-by: ly_cann_coder<liyao152@huawei.com> # message auto-generated for no-merge-commit merge: !495 merge develop into master abs等算子A5实现 Created-by: ly_cann_coder Commit-by: ly_cann_coder Merged-by: cann-robot Description: ## 描述 新增以下算子的A5实现 |序号| 算子 | 功能 | |--|--|--| |1| abs | 为输入张量的每一个元素取绝对值 | |2| add | 对输入完成相加操作 | |3| addcdiv | 张量运算函数,用于执行乘除加组合操作,将张量除法(带缩放)+ 张量加法合并为单个操作 | |4| addcmul | 张量运算函数,用于执行乘除加组合操作,将张量乘法(带缩放)+ 张量加法合并为单个操作 | |5| axpy | 源操作数中每个元素与标量求积后和目的操作数中的对应元素相加 | |6| bincount | 计算非负整数数组中每个数的频率 | |7| ceil | 返回输入tensor中每个元素向上取整的结果 | |8| clip_by_value_v2 | 将输入的所有元素限制在一定范围内 | |9| concat | 用于沿指定维度将多个输入 Tensor 进行拼接,输出包含所有输入数据按顺序拼接后的 Tensor | |10| concat_v2 | 用于沿指定维度将多个输入 Tensor 进行拼接,输出包含所有输入数据按顺序拼接后的 Tensor | |11| equal | 计算两个Tensor是否有相同的大小和元素,返回一个Bool类型 | |12|exp|返回一个新的张量,该张量的每个元素都是输入张量对应元素的指数| |13| fill | 对张量进行填充操作,支持非连续的Tensor操作 | |14| floor | 返回输入Tensor中每个元素向下取整,并将结果回填到输入Tensor中 | |15| floor_div | 完成除法计算,对余数向下取整 | |16| floor_mod | 用于计算两个数的模 | |17| is_neg_inf | 判断输入张量的元素是否为负无穷 | |18| is_pos_inf | 判断输入张量的元素是否为正无穷 | |19| less | 判断输入self中的每个元素是否小于输入other的值,返回一个Bool类型的Tensor | |20| less_equal | 判断输入self中的元素值是否小于等于other的值,并将self的每个元素的值与other值的比较结果写入out中 | |21| logical_and | 对两个输入张量的对应元素执行「与逻辑」判断,输出布尔型张量(True/False) | |22| log | 对输入张量x的元素,逐元素进行对数计算,并将结果保存到输出张量y中 | |23| not_equal | 逐元素比较两个输入张量是否不相等 | |24| ones_like | 返回形状和类型相同的张量,所有元素都设置为1 | |25|sign|对输入的tensor逐元素进行Sign符号函数的运算并输出结果tensor| |26| sqrt | 完成非负数平方根计算,负数情况返回nan | |27| sqrt_grad | 完成梯度平方根计算 | |28| square | 为输入张量的每一个元素计算平方值 | |29| squared_difference | 为第一个输入张量减去第二个输入张量,并计算其平方值 | |30| tanh | 激活函数,返回与输入tensor shape相同的tensor,对输入tensor进行elementwise的计算 | |31| tril | 将输入的self张量的最后二维(按shape从左向右数)沿对角线的右上部分置零 | |32| triu | 将输入的self张量的最后二维(按shape从左向右数)沿对角线的左下部分置零 | |33| zeros_like | 将张量填充为全零 | ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!495 | 8 个月前 |
| update operators Co-authored-by: biabu111<hebaojing1@huawei.com> # message auto-generated for no-merge-commit merge: !916 merge master into master update operators Created-by: biabu111 Commit-by: biabu111 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 增强以下算子功能 tensor_equal tensor_move tril triu stalessrandomuniform stalessrandomnormal assign dsarandomuniform dsarandomnormal ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> #530 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!916 | 7 个月前 |
| 新增编译选项module_extension,以便联合modext仓的信息库文件联合编译;删除开源仓中的mc62cm12的信息库 Co-authored-by: lu-yukun<luyukun4@h-partners.com> # message auto-generated for no-merge-commit merge: !2187 merge br_delete_mc62cm12a into master 新增编译选项module_extension,以便联合modext仓的信息库文件联合编译;删除开源仓中的mc62cm12的信息库 Created-by: lu-yukun Commit-by: lu-yukun Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增编译选项module_extension,以便联合modext仓文件,进行联合编译;删除mc62cm12的信息库 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> https://gitcode.com/cann/ops-math/issues/1224 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!2187 | 4 个月前 |
| concat scalar计算优化 Co-authored-by: wuchengming<wuchengming6@huawei.com> # message auto-generated for no-merge-commit merge: !3172 merge master_0608 into master concat scalar计算优化 Created-by: wuchengming123 Commit-by: wuchengming Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 在某些场景下,发现concat算子在scalar计算上耗时较长,通过优化tilingData结构体和kernel全局变量来降低scalar计算耗时 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#1902](https://gitcode.com/cann/ops-math/issues/1902) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 完成冒烟、泛化用例测试 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 无 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3172 | 2 个月前 |
| feat: 支持八个迁移算子的常量折叠(#2551) Co-authored-by: pan-tong<pantong@huawei.com> # message auto-generated for no-merge-commit merge: !4511 merge feat/constant-folding-infershape into master feat: 支持八个迁移算子的常量折叠(#2551) Created-by: pan-tong Commit-by: pan-tong Merged-by: cann-robot Description: ## 描述 为 Ceil、ConcatV2、Expand、GreaterEqual、InvertPermutation、StridedSlice、StridedSliceV2、TransData 接入 HOSTCPU 常量折叠。 - 为尚未接线的 7 个算子在 CMake 中启用 HOSTCPU TRUE,将现有 AICPU kernel 编入 libopconstant_folding_math.so。 - 8 个算子的 AICPU kernel 使用 OPS_MATH_REGISTER_CPU_KERNELV2,兼容 device 注册和 host CPU Kernel V2 注册。 - 为 GreaterEqual 补齐 OPS_FLAG_OPEN;其余算子沿用已有 OPEN 配置。 - TransData 沿用已有 HOSTCPU 配置,并复用已接入 host object 的 format_transfer 辅助源。 - 增强 Ceil AICPU UT 的输出校验,新增 Ceil 全 Const GE 图常量折叠用例。 本 PR 不修改算子的 infershape 实现。 ## 关联的Issue https://gitcode.com/cann/ops-math/issues/2551 ## 测试 - AICPU UT:8 个算子共 156 个用例全部通过。 - HOSTCPU 构建:libopconstant_folding_math.so 构建成功,包含 8 个算子的 host 注册。 - 安装级 GE 常量折叠:8 个算子的全 Const 图输出均校验通过。 - 逐算子日志确认对应 host kernel 执行,ConstantFoldingPass 返回码均为 0。 - pre-commit:clang-format、codespell、OAT 等检查全部通过。 - GitCode 服务端 Hooks:通过。 ## 文档更新 无。该改动不改变算子接口和使用方式。 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4511 | 27 天前 |
| concat scalar计算优化 Co-authored-by: wuchengming<wuchengming6@huawei.com> # message auto-generated for no-merge-commit merge: !3172 merge master_0608 into master concat scalar计算优化 Created-by: wuchengming123 Commit-by: wuchengming Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 在某些场景下,发现concat算子在scalar计算上耗时较长,通过优化tilingData结构体和kernel全局变量来降低scalar计算耗时 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#1902](https://gitcode.com/cann/ops-math/issues/1902) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> 完成冒烟、泛化用例测试 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 无 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3172 | 2 个月前 |
| feat: 支持八个迁移算子的常量折叠(#2551) Co-authored-by: pan-tong<pantong@huawei.com> # message auto-generated for no-merge-commit merge: !4511 merge feat/constant-folding-infershape into master feat: 支持八个迁移算子的常量折叠(#2551) Created-by: pan-tong Commit-by: pan-tong Merged-by: cann-robot Description: ## 描述 为 Ceil、ConcatV2、Expand、GreaterEqual、InvertPermutation、StridedSlice、StridedSliceV2、TransData 接入 HOSTCPU 常量折叠。 - 为尚未接线的 7 个算子在 CMake 中启用 HOSTCPU TRUE,将现有 AICPU kernel 编入 libopconstant_folding_math.so。 - 8 个算子的 AICPU kernel 使用 OPS_MATH_REGISTER_CPU_KERNELV2,兼容 device 注册和 host CPU Kernel V2 注册。 - 为 GreaterEqual 补齐 OPS_FLAG_OPEN;其余算子沿用已有 OPEN 配置。 - TransData 沿用已有 HOSTCPU 配置,并复用已接入 host object 的 format_transfer 辅助源。 - 增强 Ceil AICPU UT 的输出校验,新增 Ceil 全 Const GE 图常量折叠用例。 本 PR 不修改算子的 infershape 实现。 ## 关联的Issue https://gitcode.com/cann/ops-math/issues/2551 ## 测试 - AICPU UT:8 个算子共 156 个用例全部通过。 - HOSTCPU 构建:libopconstant_folding_math.so 构建成功,包含 8 个算子的 host 注册。 - 安装级 GE 常量折叠:8 个算子的全 Const 图输出均校验通过。 - 逐算子日志确认对应 host kernel 执行,ConstantFoldingPass 返回码均为 0。 - pre-commit:clang-format、codespell、OAT 等检查全部通过。 - GitCode 服务端 Hooks:通过。 ## 文档更新 无。该改动不改变算子接口和使用方式。 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!4511 | 27 天前 |
| 冗余空格修复第4批 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !3321 merge master into master 冗余空格修复第4批 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 批量修改md中冗余空格 ## 关联的Issue [DOC_1962#冗余空格](https://gitcode.com/cann/ops-math/issues/1962) ## 测试 自验证 ## 文档更新 all md ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [X ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3321 | 2 个月前 |