| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
支持neg等单目运算算子下一代kernel实现 Co-authored-by: 张磊<zhanglei121@huawei.com> # message auto-generated for no-merge-commit merge: !494 merge master into master 支持neg等单目运算算子下一代kernel实现 Created-by: zl_hw Commit-by: 张磊 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!494 | 7 个月前 | |
支持neg等单目运算算子下一代kernel实现 Co-authored-by: 张磊<zhanglei121@huawei.com> # message auto-generated for no-merge-commit merge: !494 merge master into master 支持neg等单目运算算子下一代kernel实现 Created-by: zl_hw Commit-by: 张磊 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!494 | 7 个月前 | |
新增Mul算子AICPU实现 Co-authored-by: liu-wei<lovline.liuwei@huawei.com> # message auto-generated for no-merge-commit merge: !4111 merge master_mul_aicpu into master 新增Mul算子AICPU实现 Created-by: liu-wei Commit-by: liu-wei Merged-by: cann-robot Description: Closes #2284 ## 描述 为 Mul 算子新增 AICPU 后端实现,支持 AI CPU 上执行逐元素乘法计算。 ### 新增文件 | 文件 | 行数 | 说明 | |------|------|------| | mul_aicpu.h | 46 | CpuKernel 类声明,含模板方法分发与对齐检查 | | mul_aicpu.cpp | 487 | 基于 Eigen 的 Mul 内核实现,支持广播和多数据类型 | | mul_aicpu_def.cpp | 33 | OpDef 注册,支持 13 种数据类型 | | test_geir_mul.cpp | 309 | GE IR 测试示例 | | test_mul_aicpu.cpp | 267 | 单元测试 | ### 修改文件 - docs/zh/op_list.md:Mul 支持后端更新为 AI Core/AI CPU ### 关键特性 - 支持 INT8/UINT8/INT16/UINT16/INT32/UINT64/FLOAT/FLOAT16/BF16/DOUBLE/COMPLEX64/COMPLEX128 共 13 种数据类型 - 支持广播(broadcast)语义 - 使用 Eigen Tensor 库实现高性能计算 - 自动并行处理阈值:同 shape 7K / 中等 33K / 通用 6K ### 测试情况 - [ ] 单元测试通过 - [ ] 算子泛化验证 ### 类型标签 - [x] 新特性 🤖 Generated with [Claude Code](https://claude.com/claude-code) See merge request: cann/ops-math!4111 | 29 天前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 7 个月前 | ||
| 7 个月前 | ||
| 29 天前 |