| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
增补 9D+ rank 拦截(InferShape + TilingFunc 双层) Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !8614 merge master into master 增补 9D+ rank 拦截(InferShape + TilingFunc 双层) Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增ActULQClampMaxGrad 算子 关于 增补 9D+ rank 拦截(InferShape + TilingFunc 双层) ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4717 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> OBP冒烟 二级冒烟均通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8614 | 1 个月前 | |
acts_ulq算子修改proto注释,与算子原型注释对齐 Co-authored-by: h1234515<huangzhiyuan21@huawei.com> # message auto-generated for no-merge-commit merge: !8666 merge acts_readme into master acts_ulq算子修改proto注释,与算子原型注释对齐 Created-by: h1234515 Commit-by: h1234515 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> acts_ulq算子修改proto注释,与算子原型注释对齐 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8666 | 1 个月前 | |
修改ActsULQInputGrad and ActULQClampMaxGrad算子原型宏定义,避免编译冲突 Co-authored-by: Coder_Nerd<shishuai5@huawei.com> # message auto-generated for no-merge-commit merge: !8480 merge master into master 修改ActsULQInputGrad and ActULQClampMaxGrad算子原型宏定义,避免编译冲突 Created-by: Coder_Nerd Commit-by: Coder_Nerd Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 恢复ActsULQInputGrad and ActULQClampMaxGrad算子原型,避免编译冲突 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4674 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> OBP冒烟 耳机冒烟均已通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8480 | 1 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
算子插件迁移 Co-authored-by: welt_lester<songlizhe1@h-partners.com> Co-authored-by: x00842564<xuyanke@huawei.com> # message auto-generated for no-merge-commit merge: !8474 merge master into master 算子插件迁移 Created-by: welt_lester Commit-by: x00842564;welt_lester Merged-by: cann-robot Description: ## 描述 落实issue #4279,将adaptive_avg_pool2d、adaptive_max_pool2d、ascend_anti_quant、ascend_dequant、ascend_quant、batch_mat_mul_v3、batch_norm、celu_v2、instance_norm_v3、ascend_quant、log_softmax_v2、mat_mul_v3、unique_with_counts_and_sorting这13个算子对应的插件从common\src\framework迁出到各自算子目录新建的\framework目录下。 ## 关联的Issue [Bug-Report|缺陷反馈]: 有对应算子的插件不应该放到公共目录 [#4279](https://gitcode.com/cann/ops-nn/issues/4279) ## 测试 compile、本地验证build通过 ## 文档更新 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:代码重构(算子插件归属迁移,落实 #4279 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8474 | 1 个月前 | |
修复算子文档格式与示例代码规范问题 Co-authored-by: yuanbin_22<yuanbin22@huawei.com> # message auto-generated for no-merge-commit merge: !8288 merge fix-doc-format-issues into master 修复算子文档格式与示例代码规范问题 Created-by: yuanbin_22 Commit-by: yuanbin_22 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> fix: 修复算子文档格式与示例代码规范问题 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4603 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8288 | 1 个月前 | |
算子插件迁移 Co-authored-by: welt_lester<songlizhe1@h-partners.com> Co-authored-by: x00842564<xuyanke@huawei.com> # message auto-generated for no-merge-commit merge: !8474 merge master into master 算子插件迁移 Created-by: welt_lester Commit-by: x00842564;welt_lester Merged-by: cann-robot Description: ## 描述 落实issue #4279,将adaptive_avg_pool2d、adaptive_max_pool2d、ascend_anti_quant、ascend_dequant、ascend_quant、batch_mat_mul_v3、batch_norm、celu_v2、instance_norm_v3、ascend_quant、log_softmax_v2、mat_mul_v3、unique_with_counts_and_sorting这13个算子对应的插件从common\src\framework迁出到各自算子目录新建的\framework目录下。 ## 关联的Issue [Bug-Report|缺陷反馈]: 有对应算子的插件不应该放到公共目录 [#4279](https://gitcode.com/cann/ops-nn/issues/4279) ## 测试 compile、本地验证build通过 ## 文档更新 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:代码重构(算子插件归属迁移,落实 #4279 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8474 | 1 个月前 | |
算子插件迁移 Co-authored-by: welt_lester<songlizhe1@h-partners.com> Co-authored-by: x00842564<xuyanke@huawei.com> # message auto-generated for no-merge-commit merge: !8474 merge master into master 算子插件迁移 Created-by: welt_lester Commit-by: x00842564;welt_lester Merged-by: cann-robot Description: ## 描述 落实issue #4279,将adaptive_avg_pool2d、adaptive_max_pool2d、ascend_anti_quant、ascend_dequant、ascend_quant、batch_mat_mul_v3、batch_norm、celu_v2、instance_norm_v3、ascend_quant、log_softmax_v2、mat_mul_v3、unique_with_counts_and_sorting这13个算子对应的插件从common\src\framework迁出到各自算子目录新建的\framework目录下。 ## 关联的Issue [Bug-Report|缺陷反馈]: 有对应算子的插件不应该放到公共目录 [#4279](https://gitcode.com/cann/ops-nn/issues/4279) ## 测试 compile、本地验证build通过 ## 文档更新 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:代码重构(算子插件归属迁移,落实 #4279 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8474 | 1 个月前 | |
修复算子文档格式与示例代码规范问题 Co-authored-by: yuanbin_22<yuanbin22@huawei.com> # message auto-generated for no-merge-commit merge: !8288 merge fix-doc-format-issues into master 修复算子文档格式与示例代码规范问题 Created-by: yuanbin_22 Commit-by: yuanbin_22 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> fix: 修复算子文档格式与示例代码规范问题 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4603 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8288 | 1 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
更新dequant_swiglu_quant文档输入空tensor、±inf和nan支持说明 Co-authored-by: jzj007<jiangzhijie9@huawei.com> # message auto-generated for no-merge-commit merge: !8092 merge dsq into master 更新dequant_swiglu_quant文档输入空tensor、±inf和nan支持说明 Created-by: jzj007 Commit-by: jzj007 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#4451](https://gitcode.com/cann/ops-nn/issues/4451) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 不涉及 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 更新dequant_swiglu_quant文档输入空tensor、±inf和nan支持说明 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8092 | 1 个月前 | |
dequantize算子README.md修改 Co-authored-by: h1234515<huangzhiyuan21@huawei.com> # message auto-generated for no-merge-commit merge: !7985 merge dequantize_change into master dequantize算子README.md修改 Created-by: h1234515 Commit-by: h1234515 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7985 | 2 个月前 | |
fix aclnn自动生成算子输出参数非连续Tensor标记错误及aclnnRReluWithNoise支持A5 Co-authored-by: yuanbin_22<yuanbin22@huawei.com> # message auto-generated for no-merge-commit merge: !8106 merge fix/aclnn-doc-noncontiguous-and-classify-rule into master fix aclnn自动生成算子输出参数非连续Tensor标记错误及aclnnRReluWithNoise支持A5 Created-by: yuanbin_22 Commit-by: yuanbin_22 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ### 1. aclnnInplaceRReluWithNoise支持A5 ### 2. 修复aclnn自动生成算子文档中输出参数非连续Tensor标记错误 自动生成的aclnn算子( ACLNNTYPE aclnn),输出参数不支持非连续Tensor,应标记为 ×。以下5个算子的8个文档文件共19处输出参数从 √ 修正为 ×: | 算子 | 文件 | 修正参数 | |------|------|---------| | dynamic_mx_quant_with_dual_axis | aclnnDynamicMxQuantWithDualAxis.md, aclnnDynamicMxQuantWithDualAxisV2.md | y1Out, mxscale1Out, y2Out, mxscale2Out | | dynamic_block_mx_quant | aclnnDynamicBlockMxQuant.md | yOut, scale1Out, scale2Out | | grouped_dynamic_block_quant | aclnnGroupedDynamicBlockQuant.md, aclnnGroupedDynamicBlockQuantV2.md | yOut, scaleOut | | dynamic_block_quant | aclnnDynamicBlockQuant.md, aclnnDynamicBlockQuantV2.md | yOut, scaleOut | |swi_glu_grad|aclnnSwiGluGrad|x_grad| ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4549 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8106 | 2 个月前 | |
修复算子文档格式与示例代码规范问题 Co-authored-by: yuanbin_22<yuanbin22@huawei.com> # message auto-generated for no-merge-commit merge: !8288 merge fix-doc-format-issues into master 修复算子文档格式与示例代码规范问题 Created-by: yuanbin_22 Commit-by: yuanbin_22 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> fix: 修复算子文档格式与示例代码规范问题 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4603 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8288 | 1 个月前 | |
修改dyanmic_dual_level_mx_quant的demo & 修改grouped_dyanmic_mx_quant的非连续说明 Co-authored-by: ji-jun1<jijun1@huawei.com> # message auto-generated for no-merge-commit merge: !8100 merge dynamic_dual_level_mx_quant into master 修改dyanmic_dual_level_mx_quant的demo & 修改grouped_dyanmic_mx_quant的非连续说明 Created-by: ji-jun1 Commit-by: ji-jun1 Merged-by: cann-robot Description: ## 描述 aclnnDynamicDualLevelMxQuant aclnn接口样例执行失败,可选输入的shape设置问题 aclnnGroupedDynamicMxQuant输出非连续执行报错,资料显示支持非连续 ## 关联的Issue [[Documentation|文档反馈]: aclnnDynamicDualLevelMxQuant 与 aclnnGroupedDynamicMxQuant算子文档出现问题](https://gitcode.com/cann/ops-nn/issues/4416) ## 测试 两个算子的aclnn 接口用例均测试通过 ## 文档更新 https://gitcode.com/cann/ops-nn/blob/master/quant/dynamic_dual_level_mx_quant/docs/aclnnDynamicDualLevelMxQuant.md https://gitcode.com/cann/ops-nn/blob/master/quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuant.md https://gitcode.com/cann/ops-nn/blob/master/quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuantV2.md ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 AI辅助编写 See merge request: cann/ops-nn!8100 | 2 个月前 | |
修改dynamic_mx_quant的输出参数mxscale和y的非连续说明 Co-authored-by: ji-jun1<jijun1@huawei.com> # message auto-generated for no-merge-commit merge: !8069 merge mxquant into master 修改dynamic_mx_quant的输出参数mxscale和y的非连续说明 Created-by: ji-jun1 Commit-by: ji-jun1 Merged-by: cann-robot Description: ## 描述 DynamicMxQuant算子aclnn接口是自动生成的,输出不支持非连续,文档中mxScale和y非连续是选中状态,需要更新 ## 关联的Issue [#4420](https://gitcode.com/cann/ops-nn/issues/4420) ## 测试 不涉及 ## 文档更新 更新了aclnnDynamicMxQuant.md,aclnnDynamicMxQuantV2.md,aclnnDynamicMxQuantV3.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8069 | 2 个月前 | |
fix aclnn自动生成算子输出参数非连续Tensor标记错误及aclnnRReluWithNoise支持A5 Co-authored-by: yuanbin_22<yuanbin22@huawei.com> # message auto-generated for no-merge-commit merge: !8106 merge fix/aclnn-doc-noncontiguous-and-classify-rule into master fix aclnn自动生成算子输出参数非连续Tensor标记错误及aclnnRReluWithNoise支持A5 Created-by: yuanbin_22 Commit-by: yuanbin_22 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ### 1. aclnnInplaceRReluWithNoise支持A5 ### 2. 修复aclnn自动生成算子文档中输出参数非连续Tensor标记错误 自动生成的aclnn算子( ACLNNTYPE aclnn),输出参数不支持非连续Tensor,应标记为 ×。以下5个算子的8个文档文件共19处输出参数从 √ 修正为 ×: | 算子 | 文件 | 修正参数 | |------|------|---------| | dynamic_mx_quant_with_dual_axis | aclnnDynamicMxQuantWithDualAxis.md, aclnnDynamicMxQuantWithDualAxisV2.md | y1Out, mxscale1Out, y2Out, mxscale2Out | | dynamic_block_mx_quant | aclnnDynamicBlockMxQuant.md | yOut, scale1Out, scale2Out | | grouped_dynamic_block_quant | aclnnGroupedDynamicBlockQuant.md, aclnnGroupedDynamicBlockQuantV2.md | yOut, scaleOut | | dynamic_block_quant | aclnnDynamicBlockQuant.md, aclnnDynamicBlockQuantV2.md | yOut, scaleOut | |swi_glu_grad|aclnnSwiGluGrad|x_grad| ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4549 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8106 | 2 个月前 | |
DynamicQuant 字面常量修改 Co-authored-by: ASCEND222<dongfei16@h-partners.com> # message auto-generated for no-merge-commit merge: !8346 merge master into master DynamicQuant 字面常量修改 Created-by: ASCEND222 Commit-by: ASCEND222 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> DynamicQuant 字面常量修改 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4615 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:DynamicQuant 字面常量修改 ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8346 | 1 个月前 | |
test: 更新deep_norm_grad等4个算子golden测试数据 Co-authored-by: tianqiguang<tianqiguang@huawei.com> # message auto-generated for no-merge-commit merge: !8582 merge codex/golden-upstream-rebased into master test: 更新deep_norm_grad等4个算子golden测试数据 Created-by: tianqiguang Commit-by: tianqiguang Merged-by: cann-robot Description: ## 描述 更新 4 个算子的 golden 测试数据。 | 算子 | 变化 | |------|------| | deep_norm_grad | +61 -4 | | apply_adam_w_quant | +113 -28 | | dynamic_quant_update_scatter | +3 -3 | | dynamic_quant_update_scatter_v2 | +6 -2 | ## 类型标签 - [x] 测试 ## 关联的Issue - #4730 See merge request: cann/ops-nn!8582 | 1 个月前 | |
test: 更新deep_norm_grad等4个算子golden测试数据 Co-authored-by: tianqiguang<tianqiguang@huawei.com> # message auto-generated for no-merge-commit merge: !8582 merge codex/golden-upstream-rebased into master test: 更新deep_norm_grad等4个算子golden测试数据 Created-by: tianqiguang Commit-by: tianqiguang Merged-by: cann-robot Description: ## 描述 更新 4 个算子的 golden 测试数据。 | 算子 | 变化 | |------|------| | deep_norm_grad | +61 -4 | | apply_adam_w_quant | +113 -28 | | dynamic_quant_update_scatter | +3 -3 | | dynamic_quant_update_scatter_v2 | +6 -2 | ## 类型标签 - [x] 测试 ## 关联的Issue - #4730 See merge request: cann/ops-nn!8582 | 1 个月前 | |
激活和量化算子的示例中的输出类型不匹配 Co-authored-by: ji-jun1<jijun1@huawei.com> # message auto-generated for no-merge-commit merge: !8372 merge master into master 激活和量化算子的示例中的输出类型不匹配 Created-by: ji-jun1 Commit-by: ji-jun1 Merged-by: cann-robot Description: ## 描述 部分激活算子和量化算子的aclnn demo中,存在变量申请的类型和使用的类型不匹配的问题 ## 关联的Issue [#4608](https://gitcode.com/cann/ops-nn/issues/4608) ## 测试 已跑最新demo ## 文档更新 更新了 activation/ge_glu_grad_v2/docs/aclnnGeGluBackward.md activation/ge_glu_grad_v2/docs/aclnnGeGluV3Backward.md quant/dynamic_quant_v2/docs/aclnnDynamicQuantV2.md ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8372 | 1 个月前 | |
solve the problem of over copy Co-authored-by: wym_666<wangyumei11@huawei.com> # message auto-generated for no-merge-commit merge: !8308 merge fqac into master solve the problem of over copy Created-by: wym_666 Commit-by: wym_666 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 修复了fake_quant_affine_cachemask对齐CopyOut越过calcLength写穿通道边界 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> Issue [#4520](https://gitcode.com/cann/ops-nn/issues/4520) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 400条atk用例测试通过,issue中的脚本符合预期  ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> 不涉及 ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8308 | 1 个月前 | |
TF plugin 算子迁移 Co-authored-by: sunchun<sunchun4@h-partners.com> # message auto-generated for no-merge-commit merge: !7619 merge nn3 into master TF plugin 算子迁移 Created-by: sunchun Commit-by: sunchun Merged-by: cann-robot Description: ## 描述 TF plugin 迁移 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4196 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7619 | 2 个月前 | |
TF plugin 算子迁移 Co-authored-by: sunchun<sunchun4@h-partners.com> # message auto-generated for no-merge-commit merge: !7619 merge nn3 into master TF plugin 算子迁移 Created-by: sunchun Commit-by: sunchun Merged-by: cann-robot Description: ## 描述 TF plugin 迁移 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4196 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7619 | 2 个月前 | |
补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Co-authored-by: zhoulong50_hw<zhoulong50@huawei.com> # message auto-generated for no-merge-commit merge: !8633 merge docs/fake-quant-with-min-max-vars-readme into master 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Created-by: zhoulong50_hw Commit-by: zhoulong50_hw Merged-by: cann-robot Description: 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example See merge request: cann/ops-nn!8633 | 1 个月前 | |
补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Co-authored-by: zhoulong50_hw<zhoulong50@huawei.com> # message auto-generated for no-merge-commit merge: !8633 merge docs/fake-quant-with-min-max-vars-readme into master 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Created-by: zhoulong50_hw Commit-by: zhoulong50_hw Merged-by: cann-robot Description: 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example See merge request: cann/ops-nn!8633 | 1 个月前 | |
补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Co-authored-by: zhoulong50_hw<zhoulong50@huawei.com> # message auto-generated for no-merge-commit merge: !8633 merge docs/fake-quant-with-min-max-vars-readme into master 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Created-by: zhoulong50_hw Commit-by: zhoulong50_hw Merged-by: cann-robot Description: 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example See merge request: cann/ops-nn!8633 | 1 个月前 | |
补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Co-authored-by: zhoulong50_hw<zhoulong50@huawei.com> # message auto-generated for no-merge-commit merge: !8633 merge docs/fake-quant-with-min-max-vars-readme into master 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example Created-by: zhoulong50_hw Commit-by: zhoulong50_hw Merged-by: cann-robot Description: 补齐FakeQuantWithMinMaxVars系列4个算子的geir cpp调用example See merge request: cann/ops-nn!8633 | 1 个月前 | |
fix: torch ops cpp sources Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !8489 merge torch into master fix: torch ops cpp sources Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 本次PR主要修复了 Torch 算子 C++ 源码的路径管理问题,将原本按算子类别(如 activation、matmul、norm、quant)分目录存放的 .cpp 文件统一扁平化到 csrc/ 根目录。同时简化了 OpBuilder 基类,移除 category 参数及相关路径拼接逻辑,并增强了 JIT 编译阶段的错误诊断能力和构建过程中的文件清理机制。 主要改动 OpBuilder 基类重构:移除 __init__ 中的 category 参数,resolve_source 方法简化为直接返回 csrc/{cpp_filename},不再拼接子目录;各子类 sources() 方法统一改用 self.resolve_source("xxx.cpp") 替代原有的硬编码子目录路径。 load 方法增强:新增 ninja 可用性检查,若未安装则抛出明确的 RuntimeError;JIT 编译失败时提供包含常见原因(CANN toolkit 未 source、缺少编译器、缺少 ninja)的诊断信息。 setup.py 打包逻辑适配:_non_python_files 和 _collect_op 中 .cpp 文件的收集路径从 csrc/<category>/ 调整为 csrc/;BuildPyWithOps 新增对 csrc 子目录的处理,构建时清理不属于当前选中算子的残留 .cpp 文件。 install_requires 依赖调整:移除 torch>=2.6.0 和 torch_npu,新增 ninja 作为安装依赖。 ## 关联的Issue [#4690](https://gitcode.com/cann/ops-nn/issues/4690) ## 测试 本地编译构建,查看build目录下的目录层级 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8489 | 1 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
GroupedDynamicBlockQuant 对 rowBlockSize=1 的超宽用例进行性能提升 Co-authored-by: ASCEND222<dongfei16@h-partners.com> # message auto-generated for no-merge-commit merge: !8725 merge master into master GroupedDynamicBlockQuant 对 rowBlockSize=1 的超宽用例进行性能提升 Created-by: ASCEND222 Commit-by: ASCEND222 Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> GroupedDynamicBlockQuant 对 rowBlockSize=1 的超宽用例进行性能提升 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> https://gitcode.com/cann/ops-nn/issues/4834 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [x] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8725 | 1 个月前 | |
修改dyanmic_dual_level_mx_quant的demo & 修改grouped_dyanmic_mx_quant的非连续说明 Co-authored-by: ji-jun1<jijun1@huawei.com> # message auto-generated for no-merge-commit merge: !8100 merge dynamic_dual_level_mx_quant into master 修改dyanmic_dual_level_mx_quant的demo & 修改grouped_dyanmic_mx_quant的非连续说明 Created-by: ji-jun1 Commit-by: ji-jun1 Merged-by: cann-robot Description: ## 描述 aclnnDynamicDualLevelMxQuant aclnn接口样例执行失败,可选输入的shape设置问题 aclnnGroupedDynamicMxQuant输出非连续执行报错,资料显示支持非连续 ## 关联的Issue [[Documentation|文档反馈]: aclnnDynamicDualLevelMxQuant 与 aclnnGroupedDynamicMxQuant算子文档出现问题](https://gitcode.com/cann/ops-nn/issues/4416) ## 测试 两个算子的aclnn 接口用例均测试通过 ## 文档更新 https://gitcode.com/cann/ops-nn/blob/master/quant/dynamic_dual_level_mx_quant/docs/aclnnDynamicDualLevelMxQuant.md https://gitcode.com/cann/ops-nn/blob/master/quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuant.md https://gitcode.com/cann/ops-nn/blob/master/quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuantV2.md ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 AI辅助编写 See merge request: cann/ops-nn!8100 | 2 个月前 | |
fix: torch ops cpp sources Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !8489 merge torch into master fix: torch ops cpp sources Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 本次PR主要修复了 Torch 算子 C++ 源码的路径管理问题,将原本按算子类别(如 activation、matmul、norm、quant)分目录存放的 .cpp 文件统一扁平化到 csrc/ 根目录。同时简化了 OpBuilder 基类,移除 category 参数及相关路径拼接逻辑,并增强了 JIT 编译阶段的错误诊断能力和构建过程中的文件清理机制。 主要改动 OpBuilder 基类重构:移除 __init__ 中的 category 参数,resolve_source 方法简化为直接返回 csrc/{cpp_filename},不再拼接子目录;各子类 sources() 方法统一改用 self.resolve_source("xxx.cpp") 替代原有的硬编码子目录路径。 load 方法增强:新增 ninja 可用性检查,若未安装则抛出明确的 RuntimeError;JIT 编译失败时提供包含常见原因(CANN toolkit 未 source、缺少编译器、缺少 ninja)的诊断信息。 setup.py 打包逻辑适配:_non_python_files 和 _collect_op 中 .cpp 文件的收集路径从 csrc/<category>/ 调整为 csrc/;BuildPyWithOps 新增对 csrc 子目录的处理,构建时清理不属于当前选中算子的残留 .cpp 文件。 install_requires 依赖调整:移除 torch>=2.6.0 和 torch_npu,新增 ninja 作为安装依赖。 ## 关联的Issue [#4690](https://gitcode.com/cann/ops-nn/issues/4690) ## 测试 本地编译构建,查看build目录下的目录层级 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8489 | 1 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
TF plugin 算子迁移 Co-authored-by: sunchun<sunchun4@h-partners.com> # message auto-generated for no-merge-commit merge: !7619 merge nn3 into master TF plugin 算子迁移 Created-by: sunchun Commit-by: sunchun Merged-by: cann-robot Description: ## 描述 TF plugin 迁移 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4196 ## 测试 <!--描述进行了哪些测试来验证你的改动。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7619 | 2 个月前 | |
fix: torch ops cpp sources Co-authored-by: cong-jiyu<congjiyu@h-partners.com> # message auto-generated for no-merge-commit merge: !8489 merge torch into master fix: torch ops cpp sources Created-by: cong-jiyu Commit-by: cong-jiyu Merged-by: cann-robot Description: ## 描述 本次PR主要修复了 Torch 算子 C++ 源码的路径管理问题,将原本按算子类别(如 activation、matmul、norm、quant)分目录存放的 .cpp 文件统一扁平化到 csrc/ 根目录。同时简化了 OpBuilder 基类,移除 category 参数及相关路径拼接逻辑,并增强了 JIT 编译阶段的错误诊断能力和构建过程中的文件清理机制。 主要改动 OpBuilder 基类重构:移除 __init__ 中的 category 参数,resolve_source 方法简化为直接返回 csrc/{cpp_filename},不再拼接子目录;各子类 sources() 方法统一改用 self.resolve_source("xxx.cpp") 替代原有的硬编码子目录路径。 load 方法增强:新增 ninja 可用性检查,若未安装则抛出明确的 RuntimeError;JIT 编译失败时提供包含常见原因(CANN toolkit 未 source、缺少编译器、缺少 ninja)的诊断信息。 setup.py 打包逻辑适配:_non_python_files 和 _collect_op 中 .cpp 文件的收集路径从 csrc/<category>/ 调整为 csrc/;BuildPyWithOps 新增对 csrc 子目录的处理,构建时清理不属于当前选中算子的残留 .cpp 文件。 install_requires 依赖调整:移除 torch>=2.6.0 和 torch_npu,新增 ninja 作为安装依赖。 ## 关联的Issue [#4690](https://gitcode.com/cann/ops-nn/issues/4690) ## 测试 本地编译构建,查看build目录下的目录层级 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8489 | 1 个月前 | |
improve grouped_dynamic_mx_quant performance and add fp4 format Co-authored-by: yeeyanghsia<xiayiyang@huawei.com> # message auto-generated for no-merge-commit merge: !7650 merge GroupedDynamicMxQuant0717 into master improve grouped_dynamic_mx_quant performance and add fp4 format Created-by: yeeyanghsia Commit-by: yeeyanghsia Merged-by: cann-robot Description: ## 描述 GroupedDynamicMxQuant算子新增支持FP4数据类型,新增支持scale_alg=2(Dynamic Dtype Range实现),优化现有切分方案。 ## 关联的Issue 关联Issue [#4181](https://gitcode.com/cann/ops-nn/issues/4181) ## 测试 本地通过1000条泛化用例精度测试,通过算子冒烟测试,和主线性能对比通过。 ## 文档更新 更新了docs/zh/op_api_list.md、docs/zh/op_list.md、quant/grouped_dynamic_mx_quant/README.md、quant/grouped_dynamic_mx_quant/docs/aclnnGroupedDynamicMxQuant.md。 ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [x] 性能优化 - [x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7650 | 2 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
修改README中关联的aclnn Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !8391 merge master into master 修改README中关联的aclnn Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 修改README中关联的aclnn ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4638 ## 测试 NA ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ x] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8391 | 1 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
fix: 放宽 swiglu_group_grad 的 weight 形态校验为 element num Co-authored-by: qq_51545127<24171214023@stu.xidian.edu.cn> # message auto-generated for no-merge-commit merge: !8541 merge fix/swiglu-group-grad-weight-numel-check into master fix: 放宽 swiglu_group_grad 的 weight 形态校验为 element num Created-by: qq_51545127 Commit-by: qq_51545127 Merged-by: cann-robot Description: ## 描述 swiglu_group_backward 原校验要求 weight.dim() == grad_output.dim() 且 weight.shape[-1] == 1,导致 flat 形态的 weight(如 [T] / [B*S])在 autograd 路径被拒绝。 kernel 实际按一维行偏移访问 weight(weightGm_[row]),只依赖元素个数,不感知逻辑 rank。前向 swiglu_group tiling 也只校验 numel == bs。反向校验与前向不一致,autograd 桥透传 flat weight 时反向校验失败。 ## 修改内容 将反向六层 weight 校验从 rank 对齐 + 末维=1 改为 **element num 校验**,跟前向 tiling 对齐: | 层 | 文件 | 改动 | |----|------|------| | Torch Meta | torch_extension/swiglu_group_grad.py | rank/逐维/末维 → element num | | C++ bridge | torch_extension/csrc/swiglu_group_grad.cpp | 同上 | | ACLNN L2 | op_api/aclnn_swiglu_group_grad.cpp | 同上 | | infershape | op_host/swiglu_group_grad_infershape.cpp | 删旧 rank 校验,加 element num 校验(跟 swiglu_group_quant_grad 对齐) | | tiling base | op_host/arch35/swiglu_group_grad_tiling_base.cpp | rank/末维/逐维 → element num | | regbase tiling | op_host/arch35/swiglu_group_grad_regbase_tiling.cpp | 同上 | 命名风格统一跟前向 swiglu_group tiling 对齐:ShapeElementNum / weightElementNum / totalRows。 grad_weight 输出形态保持 weight.new_empty(weight.shape),与输入 weight 形态一致,autograd 形态匹配天然正确。kernel 代码未改动。 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4750 ## 测试 现有正向用例的 weight 形态从 [T,1] / [B,S,1] 改为 flat [T] / [B*S],验证 flat weight 通过各层校验: - test_swiglu_group_backward.py:weight (2,4,1) → (8,) - test_aclnn_swiglu_group_grad.cpp:weight/dWeight {4,1} → {4} - test_swiglu_group_grad_tiling.cpp:加 weightShape = {8} - test_swiglu_group_grad_infershape.cpp:加 weightShape = {4} 950 环境验证 10 个 autograd 用例全部 PASS(含 flat weight + clamp + bf16 组合)。 冒烟测试通过 ## 类型标签 - [x] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!8541 | 1 个月前 | |
refactor: rename AscendC MicroAPIs in 4 arch35 operator kernels (batch5) Co-authored-by: hahaha22<wangrunze20@h-partners.com> # message auto-generated for no-merge-commit merge: !8429 merge rename-api-batch5 into master refactor: rename AscendC MicroAPIs in 4 arch35 operator kernels (batch5) Created-by: hahaha22 Commit-by: hahaha22 Merged-by: cann-robot Description: ## 描述 对 4 个算子的 arch35 kernel 实现进行 AscendC MicroAPI 接口重命名,以同步 AscendC SDK 新版本的 API 命名规范。 ### 改动原因 AscendC SDK 新版本对 MicroAPI 接口命名进行了系统性调整(地址空间限定符统一、加载/存储方向接口拆分、Mask 相关接口去前缀化等),算子代码需同步更新以使用新 API 名称,旧名称将在后续版本废弃。 ### 改动方法 纯机械重命名,不涉及任何逻辑变更。共修改 7 个文件,333 行增 + 333 行删(一一对应替换)。 ### 涉及算子(4 个) | 算子 | 目录 | 修改文件数 | |------|------|-----------| | unique_consecutive | index/unique_consecutive | 1 | | sync_batch_norm_gather_stats | norm/sync_batch_norm_gather_stats | 2 | | swiglu_mx_quant | quant/swiglu_mx_quant | 3 | | swiglu_mx_quant_with_dual_axis | quant/swiglu_mx_quant_with_dual_axis | 1 | ### 变更文件列表(7 个) | 文件 | +行 | -行 | |------|-----|-----| | index/unique_consecutive/op_kernel/arch35/unique_consecutive_helper.h | 83 | 83 | | norm/sync_batch_norm_gather_stats/op_kernel/arch35/sync_batch_norm_gather_stats_n_full_load.h | 22 | 22 | | norm/sync_batch_norm_gather_stats/op_kernel/arch35/sync_batch_norm_gather_stats_n_not_full_load.h | 52 | 52 | | quant/swiglu_mx_quant/op_kernel/arch35/swiglu_mx_quant_axis_last.h | 13 | 13 | | quant/swiglu_mx_quant/op_kernel/arch35/swiglu_mx_quant_axis_not_last.h | 6 | 6 | | quant/swiglu_mx_quant/op_kernel/arch35/swiglu_mx_quant_common.h | 96 | 96 | | quant/swiglu_mx_quant_with_dual_axis/op_kernel/arch35/swiglu_mx_quant_with_dual_axis_regbase.h | 61 | 61 | | **合计** | **333** | **333** | ### API 改名映射 | 旧 API | 新 API | 说明 | |--------|--------|------| | __local_mem__ | __ubuf__ | 地址空间限定符统一(128 处) | | MicroAPI::DataCopy(加载)/ 裸 DataCopy | MicroAPI::LoadAlign / LoadAlign | 对齐加载 | | MicroAPI::DataCopy(存储) | MicroAPI::StoreAlign | 对齐存储 | | MicroAPI::DataCopyUnAlign(加载) | MicroAPI::LoadUnAlign | 非对齐加载 | | MicroAPI::DataCopyUnAlign(存储) | MicroAPI::StoreUnAlign | 非对齐存储 | | MicroAPI::DataCopyUnAlignPre | MicroAPI::LoadUnAlignPre | 非对齐加载预处理 | | MicroAPI::DataCopyUnAlignPost | MicroAPI::StoreUnAlignPost | 非对齐存储后处理(8 处) | | MicroAPI::CompareScalar | MicroAPI::Compares | 标量比较(41 处) | | MicroAPI::MaskAnd | MicroAPI::And | Mask 按位与(11 处) | | MicroAPI::MaskUnPack | MicroAPI::UnPack | Mask 解包(16 处) | | MicroAPI::MaskPack | MicroAPI::Pack | Mask 打包 | | MicroAPI::GatherMask(函数) | MicroAPI::Squeeze | GatherMask 函数更名(GatherMaskMode 枚举不变) | | MicroAPI::UnalignReg | MicroAPI::UnalignRegForLoad / MicroAPI::UnalignRegForStore | 按加载/存储方向拆分 | ## 关联的Issue - #4652 https://gitcode.com/cann/ops-nn/issues/4652 ## 测试 - 二进制一致性验证:对重命名前后的 7 个 kernel 分别编译生成 .o 文件,逐字节对比无差异,确认重命名为纯机械替换、不影响生成代码。 - 无新增/删除逻辑,无需补充功能测试用例。 ## 文档更新 无。本次为纯 API 重命名,不涉及接口语义或使用方式变化。 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:重构(AscendC API 重命名同步) ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!8429 | 1 个月前 | |
refactor: rename AscendC MicroAPIs in 4 arch35 operator kernels (batch5) Co-authored-by: hahaha22<wangrunze20@h-partners.com> # message auto-generated for no-merge-commit merge: !8429 merge rename-api-batch5 into master refactor: rename AscendC MicroAPIs in 4 arch35 operator kernels (batch5) Created-by: hahaha22 Commit-by: hahaha22 Merged-by: cann-robot Description: ## 描述 对 4 个算子的 arch35 kernel 实现进行 AscendC MicroAPI 接口重命名,以同步 AscendC SDK 新版本的 API 命名规范。 ### 改动原因 AscendC SDK 新版本对 MicroAPI 接口命名进行了系统性调整(地址空间限定符统一、加载/存储方向接口拆分、Mask 相关接口去前缀化等),算子代码需同步更新以使用新 API 名称,旧名称将在后续版本废弃。 ### 改动方法 纯机械重命名,不涉及任何逻辑变更。共修改 7 个文件,333 行增 + 333 行删(一一对应替换)。 ### 涉及算子(4 个) | 算子 | 目录 | 修改文件数 | |------|------|-----------| | unique_consecutive | index/unique_consecutive | 1 | | sync_batch_norm_gather_stats | norm/sync_batch_norm_gather_stats | 2 | | swiglu_mx_quant | quant/swiglu_mx_quant | 3 | | swiglu_mx_quant_with_dual_axis | quant/swiglu_mx_quant_with_dual_axis | 1 | ### 变更文件列表(7 个) | 文件 | +行 | -行 | |------|-----|-----| | index/unique_consecutive/op_kernel/arch35/unique_consecutive_helper.h | 83 | 83 | | norm/sync_batch_norm_gather_stats/op_kernel/arch35/sync_batch_norm_gather_stats_n_full_load.h | 22 | 22 | | norm/sync_batch_norm_gather_stats/op_kernel/arch35/sync_batch_norm_gather_stats_n_not_full_load.h | 52 | 52 | | quant/swiglu_mx_quant/op_kernel/arch35/swiglu_mx_quant_axis_last.h | 13 | 13 | | quant/swiglu_mx_quant/op_kernel/arch35/swiglu_mx_quant_axis_not_last.h | 6 | 6 | | quant/swiglu_mx_quant/op_kernel/arch35/swiglu_mx_quant_common.h | 96 | 96 | | quant/swiglu_mx_quant_with_dual_axis/op_kernel/arch35/swiglu_mx_quant_with_dual_axis_regbase.h | 61 | 61 | | **合计** | **333** | **333** | ### API 改名映射 | 旧 API | 新 API | 说明 | |--------|--------|------| | __local_mem__ | __ubuf__ | 地址空间限定符统一(128 处) | | MicroAPI::DataCopy(加载)/ 裸 DataCopy | MicroAPI::LoadAlign / LoadAlign | 对齐加载 | | MicroAPI::DataCopy(存储) | MicroAPI::StoreAlign | 对齐存储 | | MicroAPI::DataCopyUnAlign(加载) | MicroAPI::LoadUnAlign | 非对齐加载 | | MicroAPI::DataCopyUnAlign(存储) | MicroAPI::StoreUnAlign | 非对齐存储 | | MicroAPI::DataCopyUnAlignPre | MicroAPI::LoadUnAlignPre | 非对齐加载预处理 | | MicroAPI::DataCopyUnAlignPost | MicroAPI::StoreUnAlignPost | 非对齐存储后处理(8 处) | | MicroAPI::CompareScalar | MicroAPI::Compares | 标量比较(41 处) | | MicroAPI::MaskAnd | MicroAPI::And | Mask 按位与(11 处) | | MicroAPI::MaskUnPack | MicroAPI::UnPack | Mask 解包(16 处) | | MicroAPI::MaskPack | MicroAPI::Pack | Mask 打包 | | MicroAPI::GatherMask(函数) | MicroAPI::Squeeze | GatherMask 函数更名(GatherMaskMode 枚举不变) | | MicroAPI::UnalignReg | MicroAPI::UnalignRegForLoad / MicroAPI::UnalignRegForStore | 按加载/存储方向拆分 | ## 关联的Issue - #4652 https://gitcode.com/cann/ops-nn/issues/4652 ## 测试 - 二进制一致性验证:对重命名前后的 7 个 kernel 分别编译生成 .o 文件,逐字节对比无差异,确认重命名为纯机械替换、不影响生成代码。 - 无新增/删除逻辑,无需补充功能测试用例。 ## 文档更新 无。本次为纯 API 重命名,不涉及接口语义或使用方式变化。 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:重构(AscendC API 重命名同步) ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!8429 | 1 个月前 | |
aclnn文件加上芯片标签 Co-authored-by: zhouwenfang<zhouwenfang3@h-partners.com> # message auto-generated for no-merge-commit merge: !7981 merge master into master aclnn文件加上芯片标签 Created-by: zhouwenfang Commit-by: zhouwenfang Merged-by: cann-robot Description: ## 描述 aclnn文件加上芯片标签 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4354 ## 测试 NA ## 文档更新 quant目录下的所有aclnn.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!7981 | 2 个月前 | |
refactor: EXEC_OPAPI_CMD 迁移为 CANN_OPS_OPB_SYN_EXEC_ACLNN 并升级 opbase Co-authored-by: yuyuanfeng<yuyuanfeng1@huawei.com> # message auto-generated for no-merge-commit merge: !8648 merge master into master refactor: EXEC_OPAPI_CMD 迁移为 CANN_OPS_OPB_SYN_EXEC_ACLNN 并升级 opbase Created-by: yuyuanfeng Commit-by: yuyuanfeng Merged-by: cann-robot Description: ## 描述 将 6 个 fallback 算子从旧宏 EXEC_OPAPI_CMD 迁移到 opbase 新宏 CANN_OPS_OPB_SYN_EXEC_ACLNN(显式传入 ctx 首参),并升级 opbase 依赖以引入新宏。 改动原因: - opbase 已将 EXEC_OPAPI_CMD 参数化并重命名为 CANN_OPS_OPB_SYN_EXEC_ACLNN(旧宏仅保留一行转发兼容),跟随 opbase 接口演进,显式传入 ctx。 改动方法: - 6 个算子的 op_graph fallback 实现统一改为 CANN_OPS_OPB_SYN_EXEC_ACLNN(ctx, ...):foreach_add_list、scatter_list、group_norm_silu、trans_quant_param_v2、quant_batch_matmul_inplace_add、quant_batch_matmul_v3 - cmake/third_party/opbase.cmake 中 OPBASE_TAG_ID 由 bd20a12e 升级至 40cc7bed ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4782 ## 测试 本地编译 6 个算子验证(ascend910b) ## 文档更新 无 ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [x] 其他,请描述:重构/接口迁移 ## AI/Agent生成声明 - [x] AI辅助编写 See merge request: cann/ops-nn!8648 | 1 个月前 | |
torch_extension API文档新增产品型号标签 Co-authored-by: gitcode-chenjiao<chenjiao31@huawei.com> # message auto-generated for no-merge-commit merge: !8233 merge master into master torch_extension API文档新增产品型号标签 Created-by: gitcode-chenjiao Commit-by: gitcode-chenjiao Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 1. torchapi_*.md增加产品型号标签注释 2. 中文png改为英文文件名 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> [#4551](https://gitcode.com/cann/ops-nn/issues/4551) ## 测试 <!--描述进行了哪些测试来验证你的改动。--> 已自验 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> torchapi_*.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [ ] AI辅助编写 See merge request: cann/ops-nn!8233 | 2 个月前 | |
Format update: Adjusted the license description format in all relevant files. Co-authored-by: jiangqi<jiangqi47@h-partners.com> # message auto-generated for no-merge-commit merge: !366 merge license6 into master Format update: Adjusted the license description format in all relevant files. Created-by: jiangqi2025 Commit-by: jiangqi Merged-by: turing_project1 Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #123--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-nn!366 | 9 个月前 | |
FlatQuant算子补充PTA接口 Co-authored-by: chenhaijie1423<chenhaijie2@h-partners.com> # message auto-generated for no-merge-commit merge: !8144 merge FlatQuant into master FlatQuant算子补充PTA接口 Created-by: chenhaijie1423 Commit-by: chenhaijie1423 Merged-by: cann-robot Description: ## 描述 FlatQuant算子补充PTA接口 ## 关联的Issue https://gitcode.com/cann/ops-nn/issues/4434 ## 测试 验证1400条泛化用例,功能和精度OK 单算子调用、图模式调用在A2、950环境都已经验证过 ## 文档更新 新增了torchapi_flat_quant.md ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: ## AI/Agent生成声明 <!-- [x] 表示选中 --> - [x] AI辅助编写 See merge request: cann/ops-nn!8144 | 2 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 9 个月前 | ||
| 2 个月前 |