| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
[Experimental][310P] 新增FusedGdnGating 自定义算子 Co-authored-by: jy_514wand<1520348265@qq.com> Co-authored-by: hellokitty911<lizhixi2@huawei.com> # message auto-generated for no-merge-commit merge: !12078 merge gdn into master [Experimental][310P] 新增FusedGdnGating 自定义算子 Created-by: hellokitty911 Commit-by: hellokitty911;jy_514wand Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 新增FusedGdnGating 自定义算子 decoder优化空间整图收益:单并发预估8%,多并发预估14% ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] 🐛 Bug修复 - [ ] ✨ 新特性 - [x] ⚡ 性能优化 - [ ] ♻️ 重构 - [ ] 🧪 测试 - [ ] 📦 构建/CI - [ ] 🔧 配置变更 - [ ] 📝 文档更新 - [ ] ⬆️ 依赖升级 - [ ] 🔒 安全修复 - [ ] 🧹 代码清理 - [ ] ❓ 其他,请描述: See merge request: cann/ops-transformer!12078 | 1 天前 | |
swiglu_gated_mlp/cgmct删除MakeLayoutByFormat的constexpr修饰 Co-authored-by: gitcode_lijd<lijiandong20@huawei.com> # message auto-generated for no-merge-commit merge: !11275 merge test into master swiglu_gated_mlp/cgmct删除MakeLayoutByFormat的constexpr修饰 Created-by: gitcode_lijd Commit-by: gitcode_lijd Merged-by: cann-robot Description: 关联Issue https://gitcode.com/cann/ops-transformer/issues/4963 ## 描述 删除 MakeLayoutByFormat 函数签名上的 constexpr 修饰(2 个同名副本文件,各 1 行): - experimental/ffn/swiglu_gated_mlp/op_kernel/common/matmul_act/utils/layout_utils.h - gmm/common/cgmct/utils/cgmct_layout_utils.h 背景:GCC 新版本引入不兼容变更——constexpr 函数体内不允许调用非 constexpr 函数。该函数体内调用了 AscendC::MakeLayout/MakeShape/MakeStride 等非 constexpr 接口,属于调用栈上层的 constexpr,需要删除。在变更前该 constexpr 实际也不生效(无法编译期求值),删除无语义影响。 ## 提交结构(两笔) | 提交 | 内容 | |---|---| | 第1笔 | 纯改动:删除 constexpr 修饰(2 文件各 1 行) | | 第2笔 | pre-commit 格式化修复(clang-format 重排 + 文件末尾换行,均为存量格式问题) | ## 测试 CI 流水线验证(已评论 compile 触发)。 See merge request: cann/ops-transformer!11275 | 14 天前 | |
更新license Co-authored-by: PerrySkywalker<wangmingkang1@huawei.com> # message auto-generated for no-merge-commit merge: !568 merge lic into master 更新license Created-by: PerrySkywalker Commit-by: PerrySkywalker Merged-by: cann-robot Description: ## 描述 更新license <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-transformer!568 | 8 个月前 | |
fix: causal_conv1d perfermance Co-authored-by: wangrui<wangrui124@huawei.com> # message auto-generated for no-merge-commit merge: !9090 merge br_causal_conv1d into master fix: causal_conv1d perfermance Created-by: wangrui_ Commit-by: wangrui Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 1. 修复传入init_state_mode场景的性能问题 2. 增加mamba目录的功能描述 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。例如:关联Issue #000--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> https://gitcode.com/cann/ops-transformer/issues/3849 ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] 🐛 Bug修复 - [ ] ✨ 新特性 - [ ] ⚡ 性能优化 - [ ] ♻️ 重构 - [ ] 🧪 测试 - [ ] 📦 构建/CI - [ ] 🔧 配置变更 - [x] 📝 文档更新 - [ ] ⬆️ 依赖升级 - [ ] 🔒 安全修复 - [ ] 🧹 代码清理 - [ ] ❓ 其他,请描述: See merge request: cann/ops-transformer!9090 | 1 个月前 | |
MC2:公式化档位枚举删除SOC950—A5/310P判定迁移arch值传递(NpuArch直传,三分支) Co-authored-by: gitcode_lijd<lijiandong20@huawei.com> # message auto-generated for no-merge-commit merge: !12072 merge fix_2 into master MC2:公式化档位枚举删除SOC950—A5/310P判定迁移arch值传递(NpuArch直传,三分支) Created-by: gitcode_lijd Commit-by: gitcode_lijd Merged-by: cann-robot Description: 关联Issue https://gitcode.com/cann/ops-transformer/issues/5147 ## 一句话总结 MC2 公式化档位系统的 socVersion 整改:本地枚举 SocVersion 删除 SOC950(SOC310_P 一并迁出),**A5/310P 平台判定从"档位key"迁移为 arch 值传递**——调用点经框架 GetCurNpuArch 取 NpuArch 本尊传入,模型内 3510 / 2002(310P) / 2201 三分支,2201 再按档位细分 A2/A3。**单笔提交(已squash),基线 master 33273bb9d,68 文件 +658/-631,全部位于 mc2/ 与 experimental/mc2/。** ## 动机 旧设计中本地枚举 SocVersion{910B,310P,910_93,910B4,950} 一肩挑两职:既是**平台身份**(950=A5、310P)又是**2201系内细分档位**(910B/93/B4),导致: - A5/310P 的判定语义要靠"档位值"间接表达,且拟合查表键的序列号(4/1)与枚举序值耦合 - A5 专用类仍要接收"档位key"参数(取值空间为1的摆设参数) - 与框架 NpuArch 体系并存,名实不符(SetCommParametersBaseSocType 内部却判 SOC950) ## 改动明细(按层) ### L1 枚举层(formulaic_tiling_datatype.h) - 枚举更名 SocVersion_2201,仅剩 2201 系 {SOC910_B=0, SOC910_93=2, SOC910_B4=3},**序值显式钉住**(2/3 被拟合表键 "2_"/"3_" 依赖,1 留缺给已迁出的 310P) - 新增 NPUARCH_3510_FITTING_CODE=4 / NPUARCH_2002_FITTING_CODE=1(uint64):arch→拟合序列号映射,**表键字面量零改动,系数表无需重标定** - 删除死代码 TilingBestBaseBlock(A5 base block 提升为 A5_BASE_BLOCK_{M,N,K} 具名常量) ### L2 模型层(hccl/matmul_performance.h/.cpp) - 新增成员 NpuArch npuArch_(构造传入);新增 GetFittingSeriesCode():3510→4 / 2002→1 / 2201→档位显式序值,拟合键生成(GetCommMethodString/GetCommInfoString/GetCalcTypeString)全部改走该函数并去参数化 - HCCLPerformanceModel::SetCommParametersBaseArchType:**arch 三分支**(3510→FullMesh;2002→SetCommMethodVersion310P;2201→SetCommParametersBySocType() 无参细分;未识别arch兜底FullMesh同原catch-all) - MatmulPerformanceModel:SetCyclePerMicroSec 改无参成员版;SetCalcType FP8/FP4 规则改 arch 判定,A8W8 规则改 arch 感知 (arch!=2201)||(档位!=910_B)(严格等价旧 socType!=SOC910_B);FindCubeUtilByL2Usage/FindCubeUtil/GetLinearThresholdLen/InverseCommTime 逐一改 arch 判定 ### L3 签名层(9 类统一重排) (args, rankDim, kernelType, NpuArch npuArch = DAV_2201, [bool…], SocVersion_2201 series = SOC910_B) arch 紧随 kernelType 提至第 4 位;档位降尾并默认化。**A5/310P 调用点从此不再出现档位占位值**;2201 系调用点显式写 DAV_2201 再传真实档位,平台身份自解释。涉及:OneCalcOneCommBase、MMPlusAllReduce、MMPlusQuantAllReduce、MMPlusReduceScatter、AllGatherPlusMM(V2)、AlltoAllMM、MatmulPerformanceModel、HCCLPerformanceModel(+ AllGatherPlusMM 档位参数由必填改默认) ### L4 派生层(arch 内蕴体系) | 派生类 | arch | 档位 | 说明 | |---|---|---|---| | MatmulPerformanceArch35/HCCLPerformanceArch35 | 写死3510 | 无参数 | A5 内蕴 | | Mc2FitBasedBalanceTiling+5 fit 派生(agmv2/allreduce/mmaall/rsv2/aam) | 内蕴 | 无参数 | fit 全家族零平台参数 | | AllGatherPlusMMA5 | 写死3510 | 无 | | | AllGatherPlusMMA2A3 | 写死2201 | **开放**(默认910B) | 2201 系内 910B/93/B4 细分运行时定 | | OneCalcTwoCommBase/ShardHBase | 显式传2201 | 开放 | 服务 2 个纯 A2/A3 算子 | ### L5 调用点层(平台分组) - **arch35**:matmul_reduce_scatter(_v2)、all_gather_matmul(_v2)、allto_all_matmul(fp/mx/kc)、matmul_allto_all fit——直传 npuArch_ 成员或 DAV_3510 字面量;GetArch35TilingResult 签名删档位参数(纯死参数) - **arch31**:matmul_all_reduce 4 类 quant/unquant——透传基类 npuArch_(310P=2002) - **arch22**:matmul_all_reduce/matmul_reduce_scatter/allto_all_matmul——显式 DAV_2201+真实档位;默认值兼容故也可省略 - **共用基类**:matmul_all_reduce_tiling_base、all_gather_matmul_v2_tiling_base、allto_all_matmul_tiling_base、matmul_allto_all_tiling_base——npuArch_ 成员经框架 GetCurNpuArch() 赋值(存量机制),公式化构造全量传 npuArch_ - **SetMCutSocVersion(11 调用点)**:签名不变;3510/2002 分支不再改写档位(保持调用方占位值),平台判定完全由构造传入的 arch 承担;910B4 的 L2 容量检测逻辑原样保留 - **字符串降级点**:mc2tiling::GetNpuArch(context_) 取 arch 直传(matmul_allto_all / allto_all_matmul base) - **experimental/mc2**:AllGatherMMFitBalanceTiling 同步删档位第 4 参(共享 mc2/common 正身公共头,CI ENABLE_EXPERIMENTAL=TRUE 编译覆盖) ### L6 测试层 - UT helper 加 NpuArch 参并跟随签名重排;A5 用例传 DAV_3510 - Soc950A5Basic/Soc950QuantDtype → Dav3510A5Basic/Dav3510QuantDtype(仅测试名,语义不变) ## 行为等价性论证 | 平台 | 旧到达条件 | 新到达条件 | 等价性 | |---|---|---|---| | A5 | 档位==SOC950 | arch==DAV_3510 | A5专用类仅A5可达,构造点逐一核验 | | 310P | 档位==SOC310_P | arch==DAV_2002 | 1:1对应(本轮整改一并迁出) | | A3 | 档位==SOC910_93 | arch==2201 && 档位==93 | SetCommParametersBySocType 细分 | | A2/B4 | 档位 else | arch==2201 && 档位 else | 同上 | | 拟合键 | 档位序值 4/1/2/3 | GetFittingSeriesCode 映射 4/1/2/3 | **键字面量零变化** | | 未识别平台 | catch-all→FullMesh | else 兜底→FullMesh | 同语义 | 非 A5 调用点经默认 DAV_2201 零改动;arch22/arch31 存量调用点兼容。 ## 检视闭环记录(4+1 处等价性问题,全部修复并验证) 1. **档位成员未初始化**:HCCLPerformanceModel 构造形参 socVersion_2201 与成员撞名遮蔽,成员恒为默认值,910_93/B4 拟合键错退化为 "0_系"。修复:形参更名 inputSeries、成员初始化列表赋值、细分函数去参读成员 2. **arch 透传遗漏(Quant 路径)**:MMPlusQuantAllReduce 为 6 派生中唯一未透传 NpuArch(默认2201),310P quant 四路径丢失 310P 全部分支行为。修复:8 调用点全量补传 3. **arch 透传遗漏(非低bit路径)**:arch31 4 类非低bit分支 MMPlusAllReduce 漏传(ascendc-code-review skill SEC-7.5 检出,置信度75%)。修复:4 调用点补传 4. **档位占位值误判**:A8W8 分支对 A5/310P 因占位档位不再成立(旧 950/310P 档均触发 QUANT)。修复:arch 感知表达式 5. **experimental 拷贝同步**:Mc2FitBasedBalanceTiling 新签名同步(CI 首轮唯一编译错误) 检视手段:ascendc-code-review skill 全量检视 41 条例(40 PASS / 1 SUSPICIOUS 即第3条,已修复闭环);调用点级复核 11+8+5+5 处公式化构造全量无漏传;设计一致性 S2-S7 对照 23 篇 aclnn 文档全通过;树级残留复扫(旧枚举/旧序调用)零命中。 ## 本地验证 - cust_opmaster 全量链接:**ENABLE_EXPERIMENTAL=ON/OFF 两种配置**均通过(cann-9.2.0) - bash build.sh -u --ophost --ops=all_gather_matmul_v2 --soc=ascend950:**UT 153 例全过** - pre-commit 多轮收敛 + 显式复核无 Failed;OAT 直调脚本 68 文件全合规 ## 测试建议 建议 RDV 编译覆盖 **A2/A3/A5/310P 四平台** + formulaic 相关 UT(尤其 310P quant 路径与 A5 fit balance 路径) --- ## 检视报告(2026-09-17) ### 等价性核对结论:通过 ✅ | 核对项 | 结论 | |---|---| | arch 映射(310P=DAV_2002 / 910B·93=2201 / 950=3510) | 与 SocVersion 清单逐项核实一致 | | 拟合表键兼容(3510→4、2002→1、2201系0/2/3 序值钉住) | 表键字面量零改动,系数表无需重标定 | | SetCalcType A8W8 新条件 (arch!=2201)||(档位!=910_B) | 严格等价旧 socType!=SOC910_B(A5/310P/93/B4 四路逐一验证) | | SetCyclePerMicroSec / FindCubeUtil* / InverseCommTime / EstimateTotal*Time | 判定迁移逐条等价 | | 构造顺序(npuArch_ init list 先于 body 中 SetCalcType 等调用) | 正确 | | A5 专用类(HCCLPerformanceArch35/MatmulPerformanceArch35/Mc2FitBasedBalanceTiling)arch 内蕴 | 三类均正确硬编码 DAV_3510,签名收敛无行为变化 | | AlltoAllMM 默认值语义翻转(旧默认 SOC950→新默认 DAV_2201) | 全部调用点已显式传 arch,无遗漏,无回归风险 | | 旧枚举残留 | 全仓 0(含 experimental/mc2) | | 兜底语义(未识别 arch→FullMesh) | 同原 catch-all | ### 检视发现与处理 | 级别 | 问题 | 处理 | |---|---|---| | 中 | 4 个文件混入 CRLF→LF 行尾转换噪声(reduce_scatter_formulaic_tiling.cpp/.h、matmul_reduce_scatter_tiling_a5.cpp、all_gather_formulaic_tiling.h),+656/-631 中实际语义改动仅 +327/-302,其余为行尾变更 | 属格式规范化,随本笔携带(单笔结构无法剥离);review 时建议用忽略空白方式查看上述 4 文件 | | 低 | UT test_aclnn_all_gather_matmul_v2.cpp SetUpTestCase 注释与代码不符(注释写"直接设 SocVersion_2201",实际是设平台 SocVersion 经框架映射) | **本次更新已订正**(1cc4ea4c5) | | 低 | matmul_reduce_scatter_tiling_a5.cpp / a2a3.cpp 调用点含冗余显式 false(isAicpuComm 默认值) | 不影响语义,保留 | > 注:本次更新仅订正 UT 注释(1cc4ea4c5),无代码行为变化;原 CI 结论对应 d7a87a98e,如需复核请重新触发。 See merge request: cann/ops-transformer!12072 | 16 小时前 | |
update cmake minimum required to 3.18.4 Co-authored-by: poorwill<wangbing110@huawei.com> # message auto-generated for no-merge-commit merge: !9634 merge master into master update cmake minimum required to 3.18.4 Created-by: wangbing110 Commit-by: poorwill Merged-by: cann-robot Description: update cmake minimum required to 3.18.4 See merge request: cann/ops-transformer!9634 | 1 个月前 | |
fix(moe_ffn): 修复自定义包编译失败并改用标准tiling注册 Co-authored-by: weihao18<weihao16@h-partners.com> # message auto-generated for no-merge-commit merge: !11755 merge fix_moe_ffn_build into master fix(moe_ffn): 修复自定义包编译失败并改用标准tiling注册 Created-by: weihao18 Commit-by: weihao18 Merged-by: cann-robot Description: ## 描述 fix(moe_ffn): 修复自定义包编译失败并改用标准tiling注册 ## 关联的Issue https://gitcode.com/cann/ops-transformer/issues/5237 ## 测试 本地验证,编排构建,rdv冒烟通过 ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [x] 🐛 Bug修复 - [ ] ✨ 新特性 - [ ] ⚡ 性能优化 - [ ] ♻️ 重构 - [ ] 🧪 测试 - [ ] 📦 构建/CI - [ ] 🔧 配置变更 - [ ] 📝 文档更新 - [ ] ⬆️ 依赖升级 - [ ] 🔒 安全修复 - [ ] 🧹 代码清理 - [ ] ❓ 其他,请描述: See merge request: cann/ops-transformer!11755 | 7 天前 | |
update cmake minimum required to 3.18.4 Co-authored-by: poorwill<wangbing110@huawei.com> # message auto-generated for no-merge-commit merge: !9634 merge master into master update cmake minimum required to 3.18.4 Created-by: wangbing110 Commit-by: poorwill Merged-by: cann-robot Description: update cmake minimum required to 3.18.4 See merge request: cann/ops-transformer!9634 | 1 个月前 | |
新增RotaryPositionEmbedding3d算子 Co-authored-by: wuxs68<wuxs68@chinaunicom.cn> # message auto-generated for no-merge-commit merge: !9000 merge feat/rope3d-clean into master 新增RotaryPositionEmbedding3d算子 Created-by: wuxs68 Commit-by: wuxs68 Merged-by: cann-robot Description: ## 描述 ### 改动内容 新增 **RotaryPositionEmbedding3D** 算子,实现 Wan2.2 风格的 3D 空间 RoPE。 ### 改动原因 当前 CANN 仅提供标准 1D RoPE 算子,不支持视频场景下按帧/高/宽三轴独立频带编码的 3D RoPE。Wan2.2 等视频生成模型在 Ascend NPU 上只能通过 Host 端 Python 逐样本循环实现位置编码,导致: - 长序列下 Python 循环开销大(随序列长度线性增长) - float64 复数运算带来不必要的精度和带宽 - 多次小 kernel launch 产生大量 host 开销 ### 采取的方法 在 AscendC kernel 内单次完成 **位置解码 → 频带划分 → 三轴独立旋转** 的全流程: 1. **频带划分**:headDim 按 2:1:1 比例分为 T/H/W 三个频带,各频带独立频率衰减率 2. **位置解码**:先读 t_output_dim/h_output_dim/w_output_dim 三个可选 attr,合法时(T*H*W==S)优先用显式网格,否则通过 FactorVideoDims 自动将序列长度 S 分解为视频维度 (T, H, W) 3. **预计算 cos/sin**:调用方按三轴坐标预计算 cos/sin 表,作为第二输入 cos 传入 kernel 4. **单缓冲区**:x 和 cos 数据在 UB 中连续存放,避免双队列 AllocTensor 竞争条件 5. **UB 保护**:自动根据 UB 容量拆分为多 tile,防止大序列 UB 溢出 6. **tmpBuf 保护**:使用临时缓冲区保存旋转公式的中间乘积,避免累加时覆盖未完成的分量 ### 涉及的文件 新增: experimental/posembedding/rotary_position_embedding3d/ ├── CMakeLists.txt ├── op_host/ │ ├── CMakeLists.txt │ ├── rotary_position_embedding3d_def.cpp │ ├── rotary_position_embedding3d_infershape.cpp │ └── rotary_position_embedding3d_tiling.cpp ├── op_kernel/ │ ├── rotary_position_embedding3d.cpp │ ├── rotary_position_embedding3d.h │ ├── rotary_position_embedding3d_tiling_data.h │ └── rotary_position_embedding3d_tiling_key.h ├── examples/ │ └── test_aclnn_rotary_position_embedding3d.cpp ├── tests/ut/ │ ├── CMakeLists.txt │ ├── op_host/ ... │ └── op_kernel/ ... └── README.md ## 关联的 Issue 关联 issue#3869 ## 测试 ### 1. 算子功能测试(9/9 PASS) 在 ascend910b 硬件上通过 9 组 shape 测试,覆盖 D=16~512、S=8~128、B=1~8: [Test 1] PASSED (batch=1 seq=16 D=16) [Test 2] PASSED (batch=2 seq=16 D=32) [Test 3] PASSED (batch=4 seq=8 D=64) [Test 4] PASSED (batch=1 seq=64 D=128) [Test 5] PASSED (batch=4 seq=32 D=128) [Test 6] PASSED (batch=8 seq=16 D=256) [Test 7] PASSED (batch=2 seq=128 D=512) [Test 8] PASSED (batch=4 seq=128 D=256) [Test 9] PASSED (batch=8 seq=128 D=128) === 9/9 tests PASSED, 0 FAILED === ### 2. 3D 轴独立性测试(3/3 PASS) 验证 T/H/W 三轴频带互不影响: [3DTest 1] Axis: (i=0,j=0) fixed, t=1->2: T-band DIFFERS OK, H/W-band SAME OK [3DTest 2] Axis: (i=0,j=0) fixed, t=1->2: T-band DIFFERS OK, H/W-band SAME OK [3DTest 3] Axis: (i=0,j=0) fixed, t=1->2: T-band DIFFERS OK, H/W-band SAME OK --- 3D Tests: 3/3 PASSED, 0 FAILED --- ### 3. 数值正确性验证 - 使用固定种子(seed=42)的随机输入数据 - 对比 CPU 参考实现 RefRoPE3D,逐元素对比 - 精度阈值 eps=1e-4,所有 case 通过 ### 4. 性能测试 使用 msprof op 采集 NPU 纯执行时间(ascend910b, 1650MHz, Block Dim=8): | B | S | D | Task Duration | |---|---|---|--------------| | 1 | 16 | 16 | ~3.7 μs | | 2 | 128 | 512 | ~4.0 μs | | 8 | 128 | 128 | ~4.2 μs | ## 类型标签 <!-- [x] 表示选中 --> - [ ] 🐛 Bug修复 - [√ ] ✨ 新特性 - [ ] ⚡ 性能优化 - [ ] ♻️ 重构 - [ ] 🧪 测试 - [ ] 📦 构建/CI - [ ] 🔧 配置变更 - [ ] 📝 文档更新 - [ ] ⬆️ 依赖升级 - [ ] 🔒 安全修复 - [ ] 🧹 代码清理 - [ ] ❓ 其他,请描述: See merge request: cann/ops-transformer!9000 | 21 天前 | |
修改trans的产品名称和低错 Co-authored-by: zhangfands<18768316492@163.com> # message auto-generated for no-merge-commit merge: !9221 merge test into master 修改trans的产品名称和低错 Created-by: caiwenwen Commit-by: zhangfands Merged-by: cann-robot Description: ## 描述 torch_npu产品和低错 ## 关联的Issue [#3706](https://gitcode.com/cann/ops-transformer/issues/3706) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] 🐛 Bug修复 - [ ] ✨ 新特性 - [ ] ⚡ 性能优化 - [ ] ♻️ 重构 - [ ] 🧪 测试 - [ ] 📦 构建/CI - [ ] 🔧 配置变更 - [x] 📝 文档更新 - [ ] ⬆️ 依赖升级 - [ ] 🔒 安全修复 - [ ] 🧹 代码清理 - [ ] ❓ 其他,请描述: See merge request: cann/ops-transformer!9221 | 1 个月前 | |
Singular Value Decomposition (SVD) Co-authored-by: alexeyvaryzgin<alexey.varyzgin@gmail.com> # message auto-generated for no-merge-commit merge: !2708 merge alexeyvaryzgin/svd into master Singular Value Decomposition (SVD) Created-by: alexeyvaryzgin Commit-by: alexeyvaryzgin Merged-by: cann-robot Description: ## 描述 In SVD there are 3 functions: jacobi, tsqr and svd_lowrank. ## 关联的Issue 关联Issue [#1459](https://gitcode.com/cann/ops-transformer/issues/1459) <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] 🐛 Bug 修复 - [x] ✨ 新特性 - [ ] ⚡ 性能优化 - [ ] ♻️ 重构 - [ ] 🧪 测试 - [ ] 📦 构建/CI - [ ] 🔧 配置变更 - [ ] 📝 文档更新 - [ ] ⬆️ 依赖升级 - [ ] 🔒 安全修复 - [ ] 🧹 代码清理 - [ ] ❓ 其他,请描述: See merge request: cann/ops-transformer!2708 | 4 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 1 天前 | ||
| 14 天前 | ||
| 8 个月前 | ||
| 1 个月前 | ||
| 16 小时前 | ||
| 1 个月前 | ||
| 7 天前 | ||
| 1 个月前 | ||
| 21 天前 | ||
| 1 个月前 | ||
| 4 个月前 |