| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
feat(inductor): add experimental planned fast launch for NPU Python Wrapper Co-authored-by: linjiyuan<1204150587@qq.com> # message auto-generated for no-merge-commit merge: !43981 merge codex/fast-launch-patch-master into master feat(inductor): add experimental planned fast launch for NPU Python Wrapper Created-by: linjiyuan Commit-by: linjiyuan Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [x] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [x] 资料更新 Fixes https://gitcode.com/Ascend/pytorch/issues/3471 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 1. 新增 NPU Inductor Python Wrapper Planned Fast Launch 实验模块,并通过 TORCHINDUCTOR_NPU_FAST_LAUNCH 环境变量控制启用,默认关闭。 2. 在 NPU Triton backend 初始化阶段调用 patch_fast_launch(),运行时 patch NPUPythonWrapperCodeGen 的初始化、Triton header 和 kernel call 生成逻辑,以及 TritonCompileResultNpu.make_launcher();patch 支持重复调用幂等,并在批量属性替换失败时回滚已应用的修改。 3. 对 triton=True、非 C++ Wrapper、非 graph partition 子图且未启用 compile-time autotune 的 callsite 生成 metadata 和单槽调用缓存;首次调用惰性绑定,普通 autotuner 创建 BoundFastLaunch,grouped autotuner 直接缓存原 autotuner.run。C++ Wrapper、graph partition 子图、非 Triton kernel 和 compile-time autotune 继续使用原生成路径。 4. 在保留原 Triton launcher 的基础上附加 kernel name、kernel stub 及 owner、最终 ABI 参数类型、动态 grid resolver、SIMT/shared memory、FFTS 和隐藏资源需求等元数据;元数据提取失败时保留原 launcher 行为。 5. 新增 launcher 稳定性判断和运行时路由:普通 autotuner 必要时先通过原 NPUCachingAutotuner.run 完成 autotune、coordinate descent 和 store cubin 生命周期,再将唯一且稳定的 best launcher 提升为 PlannedFastLaunch;grouped autotuner 继续使用其自身的原 autotuner.run 完整入口;profiler、benchmark_run、runtime kwargs、dump_fx_graph、check_accuracy、triton_interpret、dump_launch_params 等普通 autotuner 完整入口场景继续使用原 NPUCachingAutotuner.run。plan 已建立后如检测到活动 launch hook,仅本次调用已选中的原 launcher,hook 清空后恢复 planned path。 6. 新增 schema/ABI、参数类别、stream、grid、workspace、sync lock、device print、FFTS 和 backend 可用性校验;不支持的稳定 launcher 使用负缓存并复用原 launcher,动态 grid 等单次可恢复错误回退原路径,进入 C++ backend 后的异常不重放 kernel,避免重复提交。 7. 新增 C++ FastLaunchPlan 及 pybind11 内部接口:创建 plan 时保存 kernel name、kernel stub 的 Python 引用和裸指针、归一化 ABI 参数类别、SIMT/shared-memory、force-SIMT 与 FFTS 状态/地址,并预计算隐藏字段、参数字段和 grid 字段的 offset 及 packed buffer 总长度;Python 侧通过 plan._owner 额外持有产生 stub 的 binary owner。每次调用不复用参数缓冲区,而是新建 PackedLaunch:当前 stream 单独保存为 rtStream_t,并依据当前 grid 和 canonical args(Tensor data_ptr、标量及 best_runtime_blocks 补入参数)重新分配和填充 packed args buffer;非 SIMT 分支调用 rtKernelLaunch,SIMT 分支在提交时检查并调用弱符号 rtKernelLaunchWithFlagV2,均经 OpCommand.SetCustomHandler(...).Run() 提交。 8. 通过 torch_npu/csrc/inductor/CMakeLists.txt 将 fast launch C++ 源文件纳入 INDUCTOR_SRCS;该实现仅在非 BUILD_LIBTORCH 的 CPython 扩展构建中编译生效,并在 torch_npu._C 初始化时注册内部类型 _NPUInductorFastLaunchPlan 及 _npu_inductor_make_fast_launch_plan、_npu_inductor_fast_launch_with_plan 两个内部函数。 9. 新增 Python 单元测试、patch/回滚测试和静态结构测试,覆盖默认关闭、代码生成路由、launcher promotion、schema 冲突、负缓存、动态 grid、profiler、FFTS、隐藏资源、backend 异常及 C++ packed layout 等场景。 组件交互链路: torch.compile → NPU Triton backend 初始化 →(环境变量开启时)patch_fast_launch → Python Wrapper codegen/launcher metadata → callsite 首次调用惰性绑定。 - grouped autotuner 继续执行其自身的原 autotuner.run;普通 autotuner 的 full-entry 场景继续执行原 NPUCachingAutotuner.run。 - 普通场景进入 BoundFastLaunch,必要时先执行原 NPUCachingAutotuner.run 完成 autotune/coordinate-descent/store-cubin 生命周期,再由 build_planned_fast_launch 调用 torch_npu._C._npu_inductor_make_fast_launch_plan 创建 C++ plan,并在 Python 侧封装为 PlannedFastLaunch;稳态调用通过 torch_npu._C._npu_inductor_fast_launch_with_plan → OpCommand.SetCustomHandler(...).Run() → rtKernelLaunch/rtKernelLaunchWithFlagV2 提交。不满足 plan 条件的调用继续使用原完整入口或原 launcher。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 涉及。 新增 torch_npu/_inductor/docs/npu_inductor_fast_launch_zh.md,说明 Planned Fast Launch 的功能边界、前置条件、环境变量启用方式、最小示例、launcher 生命周期、ABI 支持范围、plan 创建条件、grid/stream 校验、回退与负缓存行为,以及关闭和故障处理方法。 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 涉及。 1. 新增用户可见环境变量 TORCHINDUCTOR_NPU_FAST_LAUNCH,默认关闭;值经去空白并忽略大小写后为 1、true、yes、on 或 y 时启用。该变量须在首次加载 NPU Triton backend 前设置,推荐在导入 PyTorch/torch_npu 前设置;运行中修改不会补装或撤销 patch,需要重启 Python 进程并重新编译 Wrapper。 2. 在非 BUILD_LIBTORCH 的 torch_npu._C Python 扩展中新增 3 个内部 Python 可见符号(均非用户 API): - _NPUInductorFastLaunchPlan:无公开构造器,作为 plan 的内部持有类型; - _npu_inductor_make_fast_launch_plan; - _npu_inductor_fast_launch_with_plan。 3. FastLaunchPlan 位于 C++ 匿名命名空间,不新增客户可直接调用的 C++ plan API;现有模型代码及 torch.compile(..., backend="inductor") 调用方式不变。 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 已新增以下 UT 看护: 1. test_npu_fast_launch.py:覆盖环境变量关闭、codegen schema 完整/不完整、plan 生命周期与 binary owner、FFTS ABI、隐藏资源拒绝、warmup 后 promotion、负缓存、profiler、launch hook metadata、动态 grid、backend 异常不重放、launcher 变化和 runtime block 参数等场景。 2. test_npu_fast_launch_patch.py:覆盖默认关闭时不解析 patch 目标、patch 只安装一次、代码生成路由、launcher metadata 附加,以及 patch 操作失败后的逆序回滚。 3. test_npu_fast_launch_static.py:覆盖 fast launch 仅通过 runtime patch 接入、package lazy import、C++ backend 保留 OpCommand 和运行时校验、仅暴露 planned launch 接口,以及 packed argument layout 预计算。 本地执行: bash python -m unittest discover -s test/_inductor/experimental/python_wrapper_fast_launch -p "test_*.py" -v 执行结果:共 30 个测试,全部通过。 当前自验证为隔离单元测试和静态结构测试,未执行 NPU/CANN 实机功能及性能测试。 当前 HEAD 已通过文档门禁(markdownlint、链接有效性、资源存在性和标签闭合检查);本次推送后尚未确认完整 PR CI。 【CheckList】 PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常(当前 HEAD 尚未确认完整 PR CI) See merge request: Ascend/pytorch!43981 | 1 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
move_type_checking_import Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !40344 merge master into master move_type_checking_import Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [x] 重构优化 - [ ] 资料更新 # 【修改方案】 > 在import阶段dynamo相关的patch改到compile阶段执行,具体可看关联rfc文档 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > ci验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!40344 | 2 个月前 | |
add_npu_backend_init_log Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !39404 merge master into master add_npu_backend_init_log Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 修复dvm后端stream报错的问题,增加使用后端提示信息 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > UT已通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39404 | 2 个月前 | |
add_triton_warning Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !39040 merge master into master add_triton_warning Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 社区用例https://codehub-y.huawei.com/c00502729/PTA_56_testing/issues/656解决,删除相关patch >torch_npu_inductor处新增警告信息,triton缺失 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 本地验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39040 | 3 个月前 | |
[inductor] Add akg backend ut. Co-authored-by: huawuyi<liuxuehui4@huawei.com> # message auto-generated for no-merge-commit merge: !38584 merge master into master [inductor] Add akg backend ut. Created-by: huawuyi Commit-by: huawuyi Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> https://gitcode.com/Ascend/pytorch/issues/1962 - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [x] 重构优化 - [ ] 资料更新 # 【修改方案】 1、添加了akg后端的ci用例 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!38584 | 3 个月前 | |
refactor(inductor): isolate NPU integrations by device Co-authored-by: Xuan Peng<hin.meego@gmail.com> # message auto-generated for no-merge-commit merge: !42564 merge br/inductor-refactor-part1-0723 into master refactor(inductor): isolate NPU integrations by device Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3329 ## Summary PyTorch Inductor keeps lowerings in a global registry. Previously, importing torch_npu replaced community lowerings globally, so CPU nodes in a mixed CPU/NPU FX graph could enter NPU-specific lowering and autotuning paths. This change installs a device-aware lowering dispatcher: NPU nodes use the NPU lowering, while non-NPU nodes retain the original upstream lowering. ## Changes - Consolidate the NPU autotune runtime and simplify NPU scheduling setup needed by the device-specific lowering path. - Isolate FX patches by device to avoid applying NPU behavior to non-NPU graphs. - Add _make_device_lowering_dispatcher and install it around overridden Inductor lowerings. - Keep the original upstream lowering available for CPU and other non-NPU devices. - Update mm, bmm, flex_attention, and grouped MM call sites for the PyTorch 2.13 (node, choice) algorithm-selector ABI. - Make the NPU algorithm selector delegate non-NPU layouts to the upstream selector with the full PyTorch 2.13 call contract - Add coverage for device dispatch, selector compatibility, CPU GEMM fallback, and mixed-device graph partitioning. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42564 | 2 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[Inductor] master branch support AOTI and cpp_wrapper Co-authored-by: qiaoyaodan888<qiaoyaodan@huawei.com> Co-authored-by: zhuceHW<zhuce@huawei.com> # message auto-generated for no-merge-commit merge: !42521 merge main-0720 into master [Inductor] master branch support AOTI and cpp_wrapper Created-by: zhucehw Commit-by: zhuceHW;qiaoyaodan888;zhucehw Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/2526?ref=&did=4121203#tid-4121203 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1. add cpp_wrapper and AOTI support for master branch 2. sync files from torch2.13 aoti_runtime and aoti_torch 3. format c++ file whitespace num 4. skip lazy compile for cpp_wrapper # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 CI PASS # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42521 | 2 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
lower _assert_scalar op Co-authored-by: lihui<lihui488@huawei.com> # message auto-generated for no-merge-commit merge: !28611 merge asmaster into master lower _assert_scalar op Created-by: lihui488 Commit-by: lihui Merged-by: ascend-robot Description: <!-- Thanks for sending a pull request! --> **What type of PR is this?** > Uncomment only one /kind <> line, hit enter to put that in a new line, and remove leading whitespaces from that line: > > /kind bug **What does this PR do / why do we need it**: 客户现场问题,动态shape的_assert_scalar fallback后会报错;triton里面有三行死代码,特定情况下也会报错 **Which issue(s) this PR fixes**: <!-- *Automatically closes linked issue when PR is merged. Usage: Fixes #<issue number>, or Fixes (paste link of issue). --> Fixes # **Special notes for your reviewers**: See merge request: Ascend/pytorch!28611 | 8 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
refactor(inductor): isolate NPU integrations by device Co-authored-by: Xuan Peng<hin.meego@gmail.com> # message auto-generated for no-merge-commit merge: !42564 merge br/inductor-refactor-part1-0723 into master refactor(inductor): isolate NPU integrations by device Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3329 ## Summary PyTorch Inductor keeps lowerings in a global registry. Previously, importing torch_npu replaced community lowerings globally, so CPU nodes in a mixed CPU/NPU FX graph could enter NPU-specific lowering and autotuning paths. This change installs a device-aware lowering dispatcher: NPU nodes use the NPU lowering, while non-NPU nodes retain the original upstream lowering. ## Changes - Consolidate the NPU autotune runtime and simplify NPU scheduling setup needed by the device-specific lowering path. - Isolate FX patches by device to avoid applying NPU behavior to non-NPU graphs. - Add _make_device_lowering_dispatcher and install it around overridden Inductor lowerings. - Keep the original upstream lowering available for CPU and other non-NPU devices. - Update mm, bmm, flex_attention, and grouped MM call sites for the PyTorch 2.13 (node, choice) algorithm-selector ABI. - Make the NPU algorithm selector delegate non-NPU layouts to the upstream selector with the full PyTorch 2.13 call contract - Add coverage for device dispatch, selector compatibility, CPU GEMM fallback, and mixed-device graph partitioning. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42564 | 2 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
api_trace_rule_changes Co-authored-by: sunhaolun<sunhaolun3@huawei.com> # message auto-generated for no-merge-commit merge: !30549 merge master into master api_trace_rule_changes Created-by: sunhaolun Commit-by: sunhaolun Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > (如有)请关联需求文档/issue链接 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 修改trace_rule.py文件,确保NPU部分API在图模式下,入图行为与标杆一致。修改set-rng_state函数处理多余算子以及torch.npu.current_device白名单处理以确保算子生成fx图与标杆一致。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 新增测试文件test/_inductor/test_npu_current_device.py,参与ut看护 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!30549 | 7 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
fix: pass map_location to _legacy_load in torch_npu.utils.load for torch.compile cache Co-authored-by: LucciC<cuiliangcheng2@hisilicon.com> Co-authored-by: wuyouqi1<wuyouqi1@h-partners.com> # message auto-generated for no-merge-commit merge: !43270 merge master-restore-load into master fix: pass map_location to _legacy_load in torch_npu.utils.load for torch.compile cache Created-by: wuyouqi1 Commit-by: wuyouqi1;LucciC Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 关联 issue: https://gitcode.com/Ascend/pytorch/issues/3005 (Fixes #3005) 恢复 torch_npu.utils.load 在 legacy(非 zip)加载分支对 map_location 的透传,修复 torch.compile 缓存加载在 NPU 上的功能问题。此前该改动被 fix: Revert "modifty torch_npu.utils.load for torch.compile cache use" 回退,本次恢复原始修改。 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1. torch_npu/utils/serialization.py 的 load 函数中,当走 legacy 加载分支且未命中 (torch.device, str) 类型分支时,将 _legacy_load(opened_file, "cpu", ...) 改为 _legacy_load(opened_file, map_location, ...),使加载结果按 map_location 正确映射到目标设备,保证 torch.compile 缓存场景下的加载行为正确。 2. test/npu/test_serialization.py 恢复 test_legacy_load_maplocation 用例,覆盖 legacy load 的 map_location 映射。 本修改等价于恢复 "modifty torch_npu.utils.load for torch.compile cache use" 的原始改动,仅涉及上述两个文件。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 - 场景:torch_npu.utils.load 在 legacy 分支下的 map_location 映射;torch.compile 缓存加载。 - 方法:运行单测 test/npu/test_serialization.py::TestSerialization::test_legacy_load_maplocation。 - 新增/变更内容已通过 test_legacy_load_maplocation UT 用例看护。 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!43270 | 1 个月前 | |
fix_device_dynamo_trace Co-authored-by: sunhaolun<sunhaolun3@huawei.com> # message auto-generated for no-merge-commit merge: !31555 merge master into master fix_device_dynamo_trace Created-by: sunhaolun Commit-by: sunhaolun Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 现场问题 torch.device在原生中为skipVariable 而pta把他归为TorchInGraphFunctionVariable,在dynamo阶段会出现trcae失败的问题。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 社区issue测试,以及现场问题反馈的用例 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!31555 | 6 个月前 | |
move_npu_patch_meta_to_module_level Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !39684 merge master into master move_npu_patch_meta_to_module_level Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > meta_register做lazy_init,将meta注册逻辑修改为公共逻辑 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39684 | 2 个月前 | |
refactor(inductor): isolate NPU integrations by device Co-authored-by: Xuan Peng<hin.meego@gmail.com> # message auto-generated for no-merge-commit merge: !42564 merge br/inductor-refactor-part1-0723 into master refactor(inductor): isolate NPU integrations by device Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3329 ## Summary PyTorch Inductor keeps lowerings in a global registry. Previously, importing torch_npu replaced community lowerings globally, so CPU nodes in a mixed CPU/NPU FX graph could enter NPU-specific lowering and autotuning paths. This change installs a device-aware lowering dispatcher: NPU nodes use the NPU lowering, while non-NPU nodes retain the original upstream lowering. ## Changes - Consolidate the NPU autotune runtime and simplify NPU scheduling setup needed by the device-specific lowering path. - Isolate FX patches by device to avoid applying NPU behavior to non-NPU graphs. - Add _make_device_lowering_dispatcher and install it around overridden Inductor lowerings. - Keep the original upstream lowering available for CPU and other non-NPU devices. - Update mm, bmm, flex_attention, and grouped MM call sites for the PyTorch 2.13 (node, choice) algorithm-selector ABI. - Make the NPU algorithm selector delegate non-NPU layouts to the upstream selector with the full PyTorch 2.13 call contract - Add coverage for device dispatch, selector compatibility, CPU GEMM fallback, and mixed-device graph partitioning. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42564 | 2 个月前 | |
fix: resolve lintrunner failures - bmm.py: add missing inductor_bmm import (F821) - distributed_patches.py: add _apply_fsdp_patches and lazy FSDP trigger functions that were missing (F821), fix unused imports (F401) - dynamo_patches.py: remove trailing newline (W391) - transfer_to_npu.py: revert setattr to direct assignment (B010), add noqa for unused functools and has_triton imports (F401) - _graph_tree.py: remove unused mark_step_begin from import (F401) - test_current_device.py: remove unused import, add trailing newline - .gitignore: add pipeline_logs/ | 1 个月前 | |
[Inductor] master branch support AOTI and cpp_wrapper Co-authored-by: qiaoyaodan888<qiaoyaodan@huawei.com> Co-authored-by: zhuceHW<zhuce@huawei.com> # message auto-generated for no-merge-commit merge: !42521 merge main-0720 into master [Inductor] master branch support AOTI and cpp_wrapper Created-by: zhucehw Commit-by: zhuceHW;qiaoyaodan888;zhucehw Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/2526?ref=&did=4121203#tid-4121203 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1. add cpp_wrapper and AOTI support for master branch 2. sync files from torch2.13 aoti_runtime and aoti_torch 3. format c++ file whitespace num 4. skip lazy compile for cpp_wrapper # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 CI PASS # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42521 | 2 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
rewrite_dropout_meta_and_decompose Co-authored-by: sunhaolun<sunhaolun3@huawei.com> # message auto-generated for no-merge-commit merge: !33673 merge master into master rewrite_dropout_meta_and_decompose Created-by: sunhaolun Commit-by: sunhaolun Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [x] 重构优化 - [ ] 资料更新 # 【修改方案】 把mlir和triton侧对dropout以及dropout_backward的meta和decompose注册整合到了新的文件torch_npu/utils/_npu_meta_registration.py中,避免框架中的多余注册,并添加了UT对dropout进行看护。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 补充UT,并且触发了框架的UT,运行通过。 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!33673 | 5 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
feat(_inductor): Support DVM for the master branch Co-authored-by: huangchengnuo<huangchengnuo1@huawei.com> # message auto-generated for no-merge-commit merge: !39780 merge support-dvm-master-20260701 into master feat(_inductor): Support DVM for the master branch Created-by: SorryNaCN Commit-by: huangchengnuo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [x] 重构优化 - [ ] 资料更新 关联社区 issue:https://gitcode.com/Ascend/pytorch/issues/1962 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 本 PR 将 v2.10.0 分支中已验证的 DVM 相关能力迁移到 master,为 inductor 增加 DVM 后端和融合支持。 1. 引入 DVM 第三方依赖并接入构建,仅在 .gitmodules 中新增 DVM submodule,保留目标分支已有 submodule 配置。 2. 新增/迁移 DVM inductor 代码,包括 mlir_fusion、graph_fusion、DVM op emitter、decomp、codegen、工具函数和相关测试。 3. 新增 DVM C++ pybind 接口,并在 _C 初始化阶段注册 torch_npu._C.dvm 相关绑定。 4. 调整 torch_npu._inductor 后端加载逻辑,支持 npu_backend=dvm;DVM 后端复用 MLIR patch 与 codegen backend 注册流程。 5. 调整 dynamo/inductor wrapper,使 mlir 与 dvm 路径通过 NPU backend scope 生效,覆盖初始化与调用阶段。 6. 补充 DVM 相关 UT 与 public bindings 清单,覆盖后端加载、kernel、graph fusion、mlir fusion 等场景。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及。 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 涉及 torch_npu._inductor 的后端选择能力扩展: 1. 支持通过 torch._inductor.config.npu_backend = "dvm" 选择 DVM 后端。 2. 支持通过 torch.compile(..., options={"npu_backend": "dvm"}) 选择 DVM 后端。 3. 支持通过环境变量 TORCHINDUCTOR_NPU_BACKEND=dvm 选择 DVM 后端。 4. 新增 torch_npu._C.dvm C++ pybind 绑定,供 DVM Python 侧构图与运行调用。 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 已完成本地静态验证: 1. git diff --check origin/master 2. 对相对 origin/master 变更的 Python 文件执行 python -m py_compile 3. 已在 PR 评论中发送 compile 触发编译流水线 新增/迁移测试覆盖: 1. DVM kernel 基础能力测试 2. DVM graph fusion 测试 3. DVM mlir fusion 测试 4. DVM public bindings 清单校验 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39780 | 2 个月前 | |
feat(_inductor): Support DVM for the master branch Co-authored-by: huangchengnuo<huangchengnuo1@huawei.com> # message auto-generated for no-merge-commit merge: !39780 merge support-dvm-master-20260701 into master feat(_inductor): Support DVM for the master branch Created-by: SorryNaCN Commit-by: huangchengnuo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [x] 重构优化 - [ ] 资料更新 关联社区 issue:https://gitcode.com/Ascend/pytorch/issues/1962 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 本 PR 将 v2.10.0 分支中已验证的 DVM 相关能力迁移到 master,为 inductor 增加 DVM 后端和融合支持。 1. 引入 DVM 第三方依赖并接入构建,仅在 .gitmodules 中新增 DVM submodule,保留目标分支已有 submodule 配置。 2. 新增/迁移 DVM inductor 代码,包括 mlir_fusion、graph_fusion、DVM op emitter、decomp、codegen、工具函数和相关测试。 3. 新增 DVM C++ pybind 接口,并在 _C 初始化阶段注册 torch_npu._C.dvm 相关绑定。 4. 调整 torch_npu._inductor 后端加载逻辑,支持 npu_backend=dvm;DVM 后端复用 MLIR patch 与 codegen backend 注册流程。 5. 调整 dynamo/inductor wrapper,使 mlir 与 dvm 路径通过 NPU backend scope 生效,覆盖初始化与调用阶段。 6. 补充 DVM 相关 UT 与 public bindings 清单,覆盖后端加载、kernel、graph fusion、mlir fusion 等场景。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及。 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 涉及 torch_npu._inductor 的后端选择能力扩展: 1. 支持通过 torch._inductor.config.npu_backend = "dvm" 选择 DVM 后端。 2. 支持通过 torch.compile(..., options={"npu_backend": "dvm"}) 选择 DVM 后端。 3. 支持通过环境变量 TORCHINDUCTOR_NPU_BACKEND=dvm 选择 DVM 后端。 4. 新增 torch_npu._C.dvm C++ pybind 绑定,供 DVM Python 侧构图与运行调用。 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 已完成本地静态验证: 1. git diff --check origin/master 2. 对相对 origin/master 变更的 Python 文件执行 python -m py_compile 3. 已在 PR 评论中发送 compile 触发编译流水线 新增/迁移测试覆盖: 1. DVM kernel 基础能力测试 2. DVM graph fusion 测试 3. DVM mlir fusion 测试 4. DVM public bindings 清单校验 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39780 | 2 个月前 | |
feat(_inductor): Support DVM for the master branch Co-authored-by: huangchengnuo<huangchengnuo1@huawei.com> # message auto-generated for no-merge-commit merge: !39780 merge support-dvm-master-20260701 into master feat(_inductor): Support DVM for the master branch Created-by: SorryNaCN Commit-by: huangchengnuo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [x] 重构优化 - [ ] 资料更新 关联社区 issue:https://gitcode.com/Ascend/pytorch/issues/1962 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 本 PR 将 v2.10.0 分支中已验证的 DVM 相关能力迁移到 master,为 inductor 增加 DVM 后端和融合支持。 1. 引入 DVM 第三方依赖并接入构建,仅在 .gitmodules 中新增 DVM submodule,保留目标分支已有 submodule 配置。 2. 新增/迁移 DVM inductor 代码,包括 mlir_fusion、graph_fusion、DVM op emitter、decomp、codegen、工具函数和相关测试。 3. 新增 DVM C++ pybind 接口,并在 _C 初始化阶段注册 torch_npu._C.dvm 相关绑定。 4. 调整 torch_npu._inductor 后端加载逻辑,支持 npu_backend=dvm;DVM 后端复用 MLIR patch 与 codegen backend 注册流程。 5. 调整 dynamo/inductor wrapper,使 mlir 与 dvm 路径通过 NPU backend scope 生效,覆盖初始化与调用阶段。 6. 补充 DVM 相关 UT 与 public bindings 清单,覆盖后端加载、kernel、graph fusion、mlir fusion 等场景。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及。 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 涉及 torch_npu._inductor 的后端选择能力扩展: 1. 支持通过 torch._inductor.config.npu_backend = "dvm" 选择 DVM 后端。 2. 支持通过 torch.compile(..., options={"npu_backend": "dvm"}) 选择 DVM 后端。 3. 支持通过环境变量 TORCHINDUCTOR_NPU_BACKEND=dvm 选择 DVM 后端。 4. 新增 torch_npu._C.dvm C++ pybind 绑定,供 DVM Python 侧构图与运行调用。 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 已完成本地静态验证: 1. git diff --check origin/master 2. 对相对 origin/master 变更的 Python 文件执行 python -m py_compile 3. 已在 PR 评论中发送 compile 触发编译流水线 新增/迁移测试覆盖: 1. DVM kernel 基础能力测试 2. DVM graph fusion 测试 3. DVM mlir fusion 测试 4. DVM public bindings 清单校验 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39780 | 2 个月前 | |
feat: support DVM MM template fusion Co-authored-by: huangchengnuo<huangchengnuo1@huawei.com> # message auto-generated for no-merge-commit merge: !42506 merge dvm-mm-template-fusion-master-20260723 into master feat: support DVM MM template fusion Created-by: SorryNaCN Commit-by: huangchengnuo Merged-by: ascend-robot Description: # 【合入来源】 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [x] 重构优化 - [ ] 资料更新 关联图模式 Issue:https://gitcode.com/Ascend/pytorch/issues/1978 移植来源:https://gitcode.com/Ascend/pytorch/merge_requests/40027 # 【修改方案】 1. 在 torch_npu._inductor.dvm.config 中增加 enable_matmul_fusion。该开关默认关闭,仅在设置 INDUCTOR_DVM_ENABLE_MATMUL_FUSION=1 时注册 DVM matmul template lowering,未启用时保持原有 DVM/Inductor 路径不变。 2. 为 aten.mm、aten.bmm、aten.addmm 与 aten.baddbmm 注册 DVM template lowering,并新增 DvmTemplateBuffer 保存 matmul template FX 图及逻辑 placeholder 到实际 IR 输入的绑定关系。生成 wrapper 调用前恢复真实参数;不满足 DVM shape/type 规则的场景继续走原有 fallback。 3. 保留 addmm 的原始算子形态以进入 template lowering,补齐 baddbmm 的转置标注、图构建参数透传和 DVM codegen;保持 addmm/baddbmm 的 alpha、beta 语义。K=1 的 mm、bmm 下沉为逐元素 mul,K=1 的 addmm 下沉为 mul 与 add 组合。 4. 在 NpuDvmScheduling 的 template codegen 中复用 NpuMetaScheduling 的 traced-graph 构图与回退能力。DVM matmul template 仅支持合法 pointwise epilogue 的纵向融合;prologue、horizontal fusion、reduction、template-to-template、group/numel 不一致及不支持的 broadcast 场景均不融合。 5. 移除 _is_view_only_graph 对纯 view、reshape、_unsafe_view epilogue 的额外拒绝逻辑,统一由既有 pointwise、shape、依赖和广播合法性检查决定是否进入 DVM template 融合路径。 6. 补充 mm、bmm、addmm、baddbmm 的 template fusion 回归覆盖,并覆盖 K=1、multi-user 输出、view/view+pointwise epilogue、view 输入及同一 buffer 多 view 场景。 # 【资料变更】 不涉及。 # 【接口变更】 不涉及客户可见接口变更。 # 【功能验证】 - 对全部变更 Python 文件执行 python3 -m py_compile,通过。 - 执行 git diff --check,通过。 - 完整 NPU 定向用例由 CI 执行。 ## 性能收益 该优化将 matmul 与下游 pointwise/view 融合为单个 DVM mix kernel,减少中间张量读写和 kernel launch。以下为 v2.9.0 同功能实测(端到端统计已排除首次编译与 warm-up): | 网络 / 指标(每 step) | Template OFF | Template ON | 时延收益 | |---|---:|---:|---:| | GLM-4-9B Chat LoRA BF16(batch 1、seq 512,稳态端到端) | 279.752 ms | 255.837 ms | **8.55%** | | Qwen2-VL-2B-Instruct LoRA BF16(batch 1、max length 512,step 11-51) | 773.792 ms | 747.664 ms | **3.38%** | | BERT_pytorch BF16(稳态端到端) | 23.3781 ms | 21.8458 ms | **6.55%** | | GLM-4-9B LoRA BF16(batch 1、seq 128,稳态端到端) | 219.3782 ms | 204.9709 ms | **6.57%** | | Llama3-8B LoRA BF16(batch 1、seq 128,稳态端到端) | 409.4111 ms | 393.3233 ms | **3.93%** | GLM-4-9B Chat 对应吞吐约提升 **9.34%**。GPT-OSS-20B 的 device kernel duration 为 -0.62%,当前不作为性能收益结论。 详细测试配置与完整数据见:https://gitcode.com/Ascend/pytorch/merge_requests/40027 # 【CheckList】 - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42506 | 2 个月前 | |
[sync]Symbolic dynamic-shape grouping for reductions Co-authored-by: zhoujinning<zhoujinning2@huawei.com> # message auto-generated for no-merge-commit merge: !43088 merge master into master [sync]Symbolic dynamic-shape grouping for reductions Created-by: zhoujinning Commit-by: zhoujinning Merged-by: ascend-robot Description: [#3428](https://gitcode.com/Ascend/pytorch/issues/3428) <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!43088 | 1 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
fix: lintrunner --all-files --take NEWLINE -a Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35539 merge code_check_lintrunner into master fix: lintrunner --all-files --take NEWLINE -a Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 文件必须以 LF 换行符结尾,不允许 CRLF(DOS 换行),执行: lintrunner --all-files --take NEWLINE -a # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35539 | 4 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
event_trace Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !30564 merge master into master event_trace Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > (如有)请关联需求文档/issue链接 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 白名单增加torch.npu.Event, 确保torch.npu.Event可以入图 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 测试用例为test/_inductor/test_event.py # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!30564 | 7 个月前 | |
refactor(inductor): isolate NPU integrations by device Co-authored-by: Xuan Peng<hin.meego@gmail.com> # message auto-generated for no-merge-commit merge: !42564 merge br/inductor-refactor-part1-0723 into master refactor(inductor): isolate NPU integrations by device Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3329 ## Summary PyTorch Inductor keeps lowerings in a global registry. Previously, importing torch_npu replaced community lowerings globally, so CPU nodes in a mixed CPU/NPU FX graph could enter NPU-specific lowering and autotuning paths. This change installs a device-aware lowering dispatcher: NPU nodes use the NPU lowering, while non-NPU nodes retain the original upstream lowering. ## Changes - Consolidate the NPU autotune runtime and simplify NPU scheduling setup needed by the device-specific lowering path. - Isolate FX patches by device to avoid applying NPU behavior to non-NPU graphs. - Add _make_device_lowering_dispatcher and install it around overridden Inductor lowerings. - Keep the original upstream lowering available for CPU and other non-NPU devices. - Update mm, bmm, flex_attention, and grouped MM call sites for the PyTorch 2.13 (node, choice) algorithm-selector ABI. - Make the NPU algorithm selector delegate non-NPU layouts to the upstream selector with the full PyTorch 2.13 call contract - Add coverage for device dispatch, selector compatibility, CPU GEMM fallback, and mixed-device graph partitioning. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42564 | 2 个月前 | |
fix: lintrunner --all-files --take NEWLINE -a Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35539 merge code_check_lintrunner into master fix: lintrunner --all-files --take NEWLINE -a Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 文件必须以 LF 换行符结尾,不允许 CRLF(DOS 换行),执行: lintrunner --all-files --take NEWLINE -a # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35539 | 4 个月前 | |
[Inductor] master branch support AOTI and cpp_wrapper Co-authored-by: qiaoyaodan888<qiaoyaodan@huawei.com> Co-authored-by: zhuceHW<zhuce@huawei.com> # message auto-generated for no-merge-commit merge: !42521 merge main-0720 into master [Inductor] master branch support AOTI and cpp_wrapper Created-by: zhucehw Commit-by: zhuceHW;qiaoyaodan888;zhucehw Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/2526?ref=&did=4121203#tid-4121203 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1. add cpp_wrapper and AOTI support for master branch 2. sync files from torch2.13 aoti_runtime and aoti_torch 3. format c++ file whitespace num 4. skip lazy compile for cpp_wrapper # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 CI PASS # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42521 | 2 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[test][master] add test/_inductor/test_graph_deduplication.py Co-authored-by: AACAES<liuyan7892@163.com> # message auto-generated for no-merge-commit merge: !36084 merge master into master [test][master] add test/_inductor/test_graph_deduplication.py Created-by: AACAES Commit-by: AACAES Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> https://gitcode.com/Ascend/pytorch/issues/2017 - [x] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 添加用例 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 A2 A3 A5自验ok  # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!36084 | 4 个月前 | |
fix: lintrunner --all-files --take NEWLINE -a Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35539 merge code_check_lintrunner into master fix: lintrunner --all-files --take NEWLINE -a Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 文件必须以 LF 换行符结尾,不允许 CRLF(DOS 换行),执行: lintrunner --all-files --take NEWLINE -a # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35539 | 4 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
Fix MLIR full lowering fallback mode Co-authored-by: yvjc<yujincheng7@huawei.com> # message auto-generated for no-merge-commit merge: !39326 merge fusionTest-master into master Fix MLIR full lowering fallback mode Created-by: yvjc Commit-by: yvjc Merged-by: ascend-robot Description: https://gitcode.com/Ascend/pytorch/issues/2507 <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) - MLIR 配置增加 allfallback 识别: 在 ascend_npu_ir/ascend_npu_ir/config.py 中新增条件判断,当 enable_full_lowering_fallback 的值为 "allfallback" 时,自动将 fallback_to_aten_mode 设置为 "all",使后续 lowering 逻辑能进入全量回退分支。 - MLIR lowering 注册跳过 allfallback 的算子解析: 在 ascend_npu_ir/ascend_npu_ir/npu/npu_lowering.py 的 _register_npu_inductor_fallbacks() 中,将原先 if env_fallback_list: 的条件增强为 if env_fallback_list and config.fallback_to_aten_mode != 'all':,避免在 all-fallback 模式下将 "allfallback" 当作普通算子名进行无效解析。 - 新增 MLIR 全量回退测试用例: 新增 test/_inductor/test_inductor_all_fallback_mlir.py,包含 test_all_fallback_detection_mlir 测试方法,验证设置 NPU_INDUCTOR_FALLBACK_LIST=allfallback 后 MLIR 后端生成的代码中不包含 mlir_fused 等优化融合标记,确保全量回退模式正确生效。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 测试用例通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39326 | 2 个月前 | |
[inductor]support pointwise group Co-authored-by: rain-666<chenxiaoyu12@huawei.com> # message auto-generated for no-merge-commit merge: !44016 merge master_pointwise into master [inductor]support pointwise group Created-by: rain-666 Commit-by: rain-666 Merged-by: ascend-robot Description: Sync the pointwise symbolic grouping changes from #42716 to master. Closes #3817 Source PR: https://gitcode.com/Ascend/pytorch/pull/42716 See merge request: Ascend/pytorch!44016 | 1 个月前 | |
feat: add the expm1 decomposition to mlir. Co-authored-by: yvjc<yujincheng7@huawei.com> # message auto-generated for no-merge-commit merge: !36482 merge decomp_master into master feat: add the expm1 decomposition to mlir. Created-by: yvjc Commit-by: yvjc Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> https://gitcode.com/Ascend/pytorch/issues/1962 - [ ] 需求 - [x] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) inductor添加mlir后端expm1的decomposition实现,与其他版本对齐. 原本存在的test_inductor_fallback_list.py这个ut存在将triton和mlir后端在同一进程中运行的问题,在inductor初始化的时候首先初始化了triton后端的相关配置,然后在mlir测试例子时又初始化mlir后端的相关配置,导致在triton后端中已经对expm1进行注册,在mlir初始化时会注册失败。该问题属于ut问题,因此将test_inductor_fallback_list.py拆为test_inductor_fallback_list_triton.py和test_inductor_fallback_list_mlir.py两个ut。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 运行torchbench网络tts_angular, aot_eager, mlir, dvm能够成功运行, 不报错 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!36482 | 3 个月前 | |
feat: add the expm1 decomposition to mlir. Co-authored-by: yvjc<yujincheng7@huawei.com> # message auto-generated for no-merge-commit merge: !36482 merge decomp_master into master feat: add the expm1 decomposition to mlir. Created-by: yvjc Commit-by: yvjc Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> https://gitcode.com/Ascend/pytorch/issues/1962 - [ ] 需求 - [x] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) inductor添加mlir后端expm1的decomposition实现,与其他版本对齐. 原本存在的test_inductor_fallback_list.py这个ut存在将triton和mlir后端在同一进程中运行的问题,在inductor初始化的时候首先初始化了triton后端的相关配置,然后在mlir测试例子时又初始化mlir后端的相关配置,导致在triton后端中已经对expm1进行注册,在mlir初始化时会注册失败。该问题属于ut问题,因此将test_inductor_fallback_list.py拆为test_inductor_fallback_list_triton.py和test_inductor_fallback_list_mlir.py两个ut。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 运行torchbench网络tts_angular, aot_eager, mlir, dvm能够成功运行, 不报错 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!36482 | 3 个月前 | |
refactor(inductor): isolate NPU integrations by device Co-authored-by: Xuan Peng<hin.meego@gmail.com> # message auto-generated for no-merge-commit merge: !42564 merge br/inductor-refactor-part1-0723 into master refactor(inductor): isolate NPU integrations by device Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3329 ## Summary PyTorch Inductor keeps lowerings in a global registry. Previously, importing torch_npu replaced community lowerings globally, so CPU nodes in a mixed CPU/NPU FX graph could enter NPU-specific lowering and autotuning paths. This change installs a device-aware lowering dispatcher: NPU nodes use the NPU lowering, while non-NPU nodes retain the original upstream lowering. ## Changes - Consolidate the NPU autotune runtime and simplify NPU scheduling setup needed by the device-specific lowering path. - Isolate FX patches by device to avoid applying NPU behavior to non-NPU graphs. - Add _make_device_lowering_dispatcher and install it around overridden Inductor lowerings. - Keep the original upstream lowering available for CPU and other non-NPU devices. - Update mm, bmm, flex_attention, and grouped MM call sites for the PyTorch 2.13 (node, choice) algorithm-selector ABI. - Make the NPU algorithm selector delegate non-NPU layouts to the upstream selector with the full PyTorch 2.13 call contract - Add coverage for device dispatch, selector compatibility, CPU GEMM fallback, and mixed-device graph partitioning. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42564 | 2 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
support STRONG_CONSISTENCY Co-authored-by: SCh-zx<1325467101@qq.com> # message auto-generated for no-merge-commit merge: !29794 merge master into master support STRONG_CONSISTENCY Created-by: SCh_zx Commit-by: SCh_zx;SCh-zx Merged-by: ascend-robot Description: <!-- Thanks for sending a pull request! --> **What type of PR is this?** > Uncomment only one /kind <> line, hit enter to put that in a new line, and remove leading whitespaces from that line: > > /kind bug > /kind task > /kind feature **What does this PR do / why do we need it**: **Which issue(s) this PR fixes**: <!-- *Automatically closes linked issue when PR is merged. Usage: Fixes #<issue number>, or Fixes (paste link of issue). --> Fixes # **Special notes for your reviewers**: See merge request: Ascend/pytorch!29794 | 7 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
test: add MLIR non-fallback kernel regression test Co-authored-by: yvjc<yujincheng7@huawei.com> # message auto-generated for no-merge-commit merge: !38539 merge fusionTest-master into master test: add MLIR non-fallback kernel regression test Created-by: yvjc Commit-by: yvjc Merged-by: ascend-robot Description: https://gitcode.com/Ascend/pytorch/issues/2392 <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 新增 MLIR 后端 kernel 编译回归 UT: 1. 构造基础 pointwise 融合计算,并通过 torch.compile 使用 MLIR 后端编译执行。 2. Hook NpuMlirCompiler.run,记录实际执行 kernel 的 is_fallback_kernel 状态。 3. 断言执行过程中不存在 fallback kernel,防止 MLIR kernel 编译失败后静默回退。 4. 将编译后的 NPU 结果与 CPU eager 结果进行精度对比。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 ut验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!38539 | 3 个月前 | |
test: add MLIR non-fallback kernel regression test Co-authored-by: yvjc<yujincheng7@huawei.com> # message auto-generated for no-merge-commit merge: !38539 merge fusionTest-master into master test: add MLIR non-fallback kernel regression test Created-by: yvjc Commit-by: yvjc Merged-by: ascend-robot Description: https://gitcode.com/Ascend/pytorch/issues/2392 <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 新增 MLIR 后端 kernel 编译回归 UT: 1. 构造基础 pointwise 融合计算,并通过 torch.compile 使用 MLIR 后端编译执行。 2. Hook NpuMlirCompiler.run,记录实际执行 kernel 的 is_fallback_kernel 状态。 3. 断言执行过程中不存在 fallback kernel,防止 MLIR kernel 编译失败后静默回退。 4. 将编译后的 NPU 结果与 CPU eager 结果进行精度对比。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 ut验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!38539 | 3 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
fix(inductor): add extra device predicates to dispatch convert_element_type Co-authored-by: Xuan Peng<pengxuan9@huawei.com> # message auto-generated for no-merge-commit merge: !43205 merge br/fix-convert-elem-type-cpu into master fix(inductor): add extra device predicates to dispatch convert_element_type Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3442 ## Description Fix an Inductor lowering regression introduced by device-based lowering dispatch. When a CPU 0-D float64 tensor is converted to a non-float64 dtype in a graph that also contains NPU tensors, the conversion could be handled by the community lowering and fused into the NPU Triton kernel. This generated unsupported float64 computation inside the kernel. ## Root Cause After lowering dispatch was separated by device type, prims.convert_element_type selected the community lowering because its input tensor was on CPU. For a 0-D CPU tensor, the generated wrapper passes the value through .item(): python arg2_1 = rand_strided((), (), device="cpu", dtype=torch.float64) triton_poi_fused_0.run(arg1_1, arg2_1.item(), ...) The fused kernel then performs the conversion internally: python tmp1 = in_ptr1 tmp2 = tmp1.to(float32) NPU compilation does not support this float64 input path. ## Changes - Add an op-specific default device predicate for prims.convert_element_type. - Route CPU 0-D float64 to non-float64 conversions to the NPU lowering when the current graph contains NPU devices. - Reuse the existing NPU lowering fallback, so the conversion is materialized outside the NPU kernel. - Keep explicit layout precedence and existing device-based dispatch behavior unchanged. - Merge caller-provided predicates with the default predicates, allowing explicit overrides. - Keep the default behavior inside install_device_lowering_dispatch, so backend initialization does not need op-specific wiring. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!43205 | 1 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
perf: defer dynamo and inductor imports on master Sync import optimization from v2.9.0_import to master. Defers torch._dynamo, torch._inductor and torch_npu._inductor initialization from import time to first torch.compile() / graph capture call. Key adaptations for master (PyTorch 2.13+): - Preserve master's stream/event variable patches (patch_stream_event_variable_python_type, patch_npu_stream_context, register_npu_current_stream_handler) - Keep make_config_entry for _ConfigEntry compatibility (MIN_SUPPORTED >= 2.10) - Preserve master's _patch_flex_attention_device and _dump_snapshot in transfer_to_npu - Merge lazy init infrastructure with master's existing new_init(name=None) signature See master_syn.md for full per-file classification and conflict resolution. | 1 个月前 | |
【rfc】mlir_triton_lowering_file_refactoring Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !37282 merge master into master 【rfc】mlir_triton_lowering_file_refactoring Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 对lowering部分进行重构,torch_npu/_inductor 在 Lowering 层 的多后端(Triton / MLIR / DVM)共享重构方案及转测要求。核心改动是:将 Triton 与 MLIR/DVM 两套 lowering 中重复的逻辑抽取到 lowering_common.py,通过 lowering_patch.py 实现 同进程 backend 切换时的 lowering 快照/恢复,并配合 _load_backend() 按需加载各后端 lowering 实现,消除原先 inductor_patch/__init__.py import 时整表 monkey-patch 的副作用。详见关联文档 # 【资料变更】 > 不涉及 # 【接口变更】 >不涉及 # 【功能验证】 > 已通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!37282 | 3 个月前 | |
support_list_for_register_meta_npu Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !39251 merge master into master support_list_for_register_meta_npu Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [x] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 删除patch,功能已实现 > 为sort函数注册新的meta,解决stride不一致的问题 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 已补充UT # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!39251 | 2 个月前 | |
feat add shim_npu Co-authored-by: zzhongmin<zhongmin23@huawei.com> # message auto-generated for no-merge-commit merge: !35592 merge master_shim into master feat add shim_npu Created-by: zzhongmin Commit-by: zzhongmin Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 将 NPU AOTI Shim 层对齐到上游 CUDA 实现(shim_cuda.cpp),补齐缺失的设备管理、流管理、内存分配等关键 shim 函数。 1. 新增 7 组 NPU Shim 函数(shim_npu.cpp + shim.h) - 设备 Guard 三件套:create_npu_guard / delete_npu_guard / npu_guard_set_index,实现 AOTI 模型执行时的设备自动切换与恢复 - 流 Guard 两件套:create_npu_stream_guard / delete_npu_stream_guard,实现流状态的自动切换与恢复 - 获取当前流:get_current_npu_stream,查询指定设备的当前 NPU 流 - 缓存分配器两件套:npu_caching_allocator_raw_alloc / raw_delete,复用 PyTorch 显存池,替代低效的 aclrtMalloc/aclrtFree 2. 改进已有函数的错误处理(shim_npu.cpp) - 所有输出参数增加空指针检查,预置 nullptr 防止异常时残留野值 - create_tensor_from_blob_npu_v2 修正错误码传播:throw → TORCH_CHECK,检查内部调用返回值 3. 新增流查找底层支撑(NPUStream.cpp) - 新增 getNPUStreamFromManagedAclrtStream,在 torch_npu 管理的流池中查找 aclrtStream 对应的 NPUStream 对象,等价于 CUDA 的 getStreamFromExternal 4. AOTI 运行时改进(model.h + utils_npu.h) - RAII_npuMalloc 新增 AOT_INDUCTOR_USE_CACHING_ALLOCATOR 分支,支持通过 shim 调用缓存分配器 - 新增 normalize_run_stream:当 stream 为 nullptr 时自动获取当前 NPU 流,应用于 run() / run_single_threaded() / run_const_fold() - 新增 utils_npu.h:提供 AOTINpuGuard / AOTINpuStreamGuard RAII 封装类,供 model.so 内部使用 5. 修复流传递 Bug(model_container_runner_npu.cpp) - run_impl:尊重调用者传入的 stream_handle,仅在为 nullptr 时回退到当前流 - run_with_npu_stream:修复忽略传入流参数的 Bug 6. 修正 Python 代码生成(npu_device.py + cpp_wrapper.py) - cpp_aoti_device_guard:raise NotImplementedError → "AOTINpuGuard" - cpp_aoti_stream_guard:"AOTICudaStreamGuard" → "AOTINpuStreamGuard" - aoti_get_stream:"aoti_torch_get_current_cuda_stream" → "aoti_torch_get_current_npu_stream" - cpp_wrapper.py:生成代码中 include utils_npu.h # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35592 | 4 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
adapt pytorch2.13 for_inductor Co-authored-by: TonyYA<pangjiayi@huawei.com> Co-authored-by: zhoupeng<zp2165064878@163.com> # message auto-generated for no-merge-commit merge: !41858 merge pta_master0714 into master adapt pytorch2.13 for_inductor Created-by: TonyYA Commit-by: TonyYA;zhoupeng Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/3056 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1、本次修改将2.10的inductor代码(截至7.11最后一笔)同步到master(2.13)分支 2、针对社区接口变动及参数调整做适配修改 3、整体架构保持与2.10 inductor一致,未做架构级别重构调整 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 端到端模型验证表格 https://onebox.huawei.com/v/6d6647cf5de9b3f8a5118370ddb7a875?type=1&sheet=master%E5%88%86%E6%94%AF%E6%A8%A1%E5%9E%8B%E6%B5%8B%E8%AF%95 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!41858 | 2 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
fix: harden path validation in reselect_static_kernel_with_path Co-authored-by: rich<zhouruiqi5@huawei.com> # message auto-generated for no-merge-commit merge: !40493 merge master into master fix: harden path validation in reselect_static_kernel_with_path Created-by: rich9527 Commit-by: rich Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> https://gitcode.com/Ascend/pytorch/issues/2634 https://gitcode.com/Ascend/pytorch/pull/40386 - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [x] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) 1.路径规范化与解析增强: 在 Module.cpp 中,使用 realpath() 将用户输入的路径解析为绝对路径 abs_path,再基于 abs_path 进行 stat 存在性检查和 S_ISDIR 目录类型判断,并将解析后的路径传入后续的 lambda 和 API 调用,防止原始路径中的符号链接或相对路径绕过校验。 2.新增边界条件单元测试: 在 test_npu_static_kernel.py 中新增 4 个测试用例,分别覆盖路径非字符串、路径含空字节、路径不存在、路径为文件而非目录的场景,验证各类非法输入均抛出 RuntimeError。 3.函数指针判空逻辑调整: 在 OpInterface.cpp 的 ReselectStaticKernelWithPath 中,将 TORCH_CHECK 判空检查移入 if 分支内部,仅在函数指针未初始化时才执行校验,避免重复检查。 4.接口注释修正: 在 OpInterface.h 中移除了 ReselectStaticKernelWithPath 文档注释中“it need to be called once at process”的过时描述。 5.测试文件存量lint检查修正:去除未使用的import,修改一个重复定义bug。 # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” 不涉及 # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 新增UT补充 cmd (zrq_310_29) root@xxx:xxx# python /xxx/torch_npu/test/_inductor/test_npu_static_kernel.py /xxx/lib/python3.10/site-packages/torch_npu/_inductor/__init__.py:97: UserWarning: triton-ascend is not installed, install it first. warnings.warn("triton-ascend is not installed, install it first.") .......... ---------------------------------------------------------------------- Ran 10 tests in 0.593s OK # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!40493 | 2 个月前 | |
skip npu sync func to master Co-authored-by: lihui<lihui488@huawei.com> # message auto-generated for no-merge-commit merge: !27578 merge master into master skip npu sync func to master Created-by: lihui488 Commit-by: lihui Merged-by: ascend-robot Description: <!-- Thanks for sending a pull request! --> **What type of PR is this?** > Uncomment only one /kind <> line, hit enter to put that in a new line, and remove leading whitespaces from that line: > > /kind bug > /kind task > /kind feature **What does this PR do / why do we need it**: **Which issue(s) this PR fixes**: <!-- *Automatically closes linked issue when PR is merged. Usage: Fixes #<issue number>, or Fixes (paste link of issue). --> Fixes # **Special notes for your reviewers**: See merge request: Ascend/pytorch!27578 | 9 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[fix]tiling_key_error Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !32353 merge master into master [fix]tiling_key_error Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 >1. 在codegen的tiling阶段,会调用get_axis_dtype来获取node的type,当axis为sympy.Expr类时会报错 > >File "/home/cuiduo/miniconda3/envs/py311/lib/python3.11/site-packages/torch_npu/_inductor/codegen/triton.py", line 790, in get_axis_dtype >dim = self.range_tree_nodes_removed[key] >torch ._ dynamo. exc. BackendCompilerFailed: backend='inductor' raised: >KeyError: x2 + 512*y1 + 2048*z0 > >因此需要增加校验,提取sympy.Expr中的Symbol以进行dtype的判断 # 【资料变更】 > 不涉及 # 【接口变更】 >不涉及 # 【功能验证】 > 自验完成 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!32353 | 5 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
add_random_op Co-authored-by: sunhaolun<sunhaolun3@huawei.com> # message auto-generated for no-merge-commit merge: !30598 merge master into master add_random_op Created-by: sunhaolun Commit-by: sunhaolun Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > (如有)请关联需求文档/issue链接 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 通过对原生rng实现代码打patch的方法注册npu设备的实现。主要主要针对\torch\_prims\rng_prims.py 中的philox_rand_offset,philox_rand_offset_meta,register_philox_rand,register_run_and_save_rng_state_op,register_run_with_rng_state_op这些代码。其中_philox_rand 此函数原生调用中不传入设备类型,修改为传入设备npu。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 编写UT进行测试,可以保证在固定随机种子的情况下eager,inductor可以得到相同的结果(如有需要可提供截图) # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!30598 | 7 个月前 | |
add_random_op Co-authored-by: sunhaolun<sunhaolun3@huawei.com> # message auto-generated for no-merge-commit merge: !30598 merge master into master add_random_op Created-by: sunhaolun Commit-by: sunhaolun Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > (如有)请关联需求文档/issue链接 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 通过对原生rng实现代码打patch的方法注册npu设备的实现。主要主要针对\torch\_prims\rng_prims.py 中的philox_rand_offset,philox_rand_offset_meta,register_philox_rand,register_run_and_save_rng_state_op,register_run_with_rng_state_op这些代码。其中_philox_rand 此函数原生调用中不传入设备类型,修改为传入设备npu。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 编写UT进行测试,可以保证在固定随机种子的情况下eager,inductor可以得到相同的结果(如有需要可提供截图) # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!30598 | 7 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
fix_config_copy Co-authored-by: sunhaolun<sunhaolun3@huawei.com> # message auto-generated for no-merge-commit merge: !36440 merge master into master fix_config_copy Created-by: sunhaolun Commit-by: sunhaolun Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> https://gitcode.com/Ascend/pytorch/issues/1962 # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 torch_npu/utils/_dynamo.py 的 patch_inductor_wrapper() 将 new_get_config_copy 通过 类级别 (ConfigModule.get_config_copy = ...) patch 到了所有 ConfigModule 实例上。当 torch._functorch.config.get_config_copy() 在第一次编译过程中被调用时(jit_compile_runtime_wrappers.py:194),4 个 NPU 特有的 config key 被永久注入到 functorch config 的 _config 字典中。第二次编译时 save_config() 序列化的内容多了这 4 个 key → 不同的 hash → AOT autograd cache miss。 修复:在 new_get_config_copy 中添加一行检查 if self is not torch._inductor.config: return ori_dict,确保 NPU config key 只注入到 inductor config,不影响 functorch config 等其他 ConfigModule 实例。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 全量UT验证 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!36440 | 3 个月前 | |
【fix】batcnnorm_check_fix Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !36325 merge master into master 【fix】batcnnorm_check_fix Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 为batcnnorm修改校验位置,适配NestedTensor以对其社区 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 本地验证pass # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!36325 | 4 个月前 | |
refactor(inductor): isolate NPU integrations by device Co-authored-by: Xuan Peng<hin.meego@gmail.com> # message auto-generated for no-merge-commit merge: !42564 merge br/inductor-refactor-part1-0723 into master refactor(inductor): isolate NPU integrations by device Created-by: HinPeng Commit-by: Xuan Peng Merged-by: ascend-robot Description: Issue: https://gitcode.com/Ascend/pytorch/issues/3329 ## Summary PyTorch Inductor keeps lowerings in a global registry. Previously, importing torch_npu replaced community lowerings globally, so CPU nodes in a mixed CPU/NPU FX graph could enter NPU-specific lowering and autotuning paths. This change installs a device-aware lowering dispatcher: NPU nodes use the NPU lowering, while non-NPU nodes retain the original upstream lowering. ## Changes - Consolidate the NPU autotune runtime and simplify NPU scheduling setup needed by the device-specific lowering path. - Isolate FX patches by device to avoid applying NPU behavior to non-NPU graphs. - Add _make_device_lowering_dispatcher and install it around overridden Inductor lowerings. - Keep the original upstream lowering available for CPU and other non-NPU devices. - Update mm, bmm, flex_attention, and grouped MM call sites for the PyTorch 2.13 (node, choice) algorithm-selector ABI. - Make the NPU algorithm selector delegate non-NPU layouts to the upstream selector with the full PyTorch 2.13 call contract - Add coverage for device dispatch, selector compatibility, CPU GEMM fallback, and mixed-device graph partitioning. <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42564 | 2 个月前 | |
fix(inductor): complete shape handling migration Co-authored-by: luqichao<luqichao1@huawei.com> # message auto-generated for no-merge-commit merge: !43635 merge bugfix/shape_handle_fix into master fix(inductor): complete shape handling migration Created-by: luqichao Commit-by: luqichao Merged-by: ascend-robot Description: Shape Handle代码同步不完整 同步完整代码 See merge request: Ascend/pytorch!43635 | 1 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
meta_check Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !30141 merge master into master meta_check Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > (如有)请关联需求文档/issue链接 - [x] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 >1. 修复resize_as_和squeeze_算子的unknow format type问题,新增fake tensor校验以绕过过适配流程。 >2.BaseSchedulerNode新增校验,避免非标准节点错误。 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 新增测试文件test/_inductor/test_resize_as和test_squeeze_.py,参与ut看护 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!30141 | 7 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[sync]Symbolic dynamic-shape grouping for reductions Co-authored-by: zhoujinning<zhoujinning2@huawei.com> # message auto-generated for no-merge-commit merge: !43088 merge master into master [sync]Symbolic dynamic-shape grouping for reductions Created-by: zhoujinning Commit-by: zhoujinning Merged-by: ascend-robot Description: [#3428](https://gitcode.com/Ascend/pytorch/issues/3428) <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 > 请确认是否涉及资料变更。如涉及,需要在PR中体现,并简要说明修改内容。如不涉及,需填写“不涉及” # 【接口变更】 > 请确认是否涉及跨代码仓或者客户面可见的接口变更。如涉及,需要详细说明接口以及对应的变更内容,同时需要在资料中体现。如不涉及,需填写“不涉及” # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [ ] 代码注释完备,正确记录错误日志 - [ ] 代码实现进行了返回值、空指针等校验 - [ ] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [ ] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!43088 | 1 个月前 | |
[fix]storge_faketensor Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !33822 merge master into master [fix]storge_faketensor Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 修改storge文件,增加faketensor的处理逻辑,确保其逻辑与GPU一致 # 【资料变更】 >不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 >本地验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!33822 | 5 个月前 | |
[fix] remove to_copy meta_register Co-authored-by: chenshuai<chenshuai81@huawei.com> # message auto-generated for no-merge-commit merge: !35917 merge fix_to_opy into master [fix] remove to_copy meta_register Created-by: culechan Commit-by: chenshuai Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 当前_to_copy已经完全对齐GPU实现,无需另外meta_register来重新推导shape,这样会导致shape不一致。 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】  # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35917 | 3 个月前 | |
register_device_interface_for_triton Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !43625 merge master into master register_device_interface_for_triton Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [x] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 >  修改上述报错,增加npuinterface注册 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 本地验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!43625 | 1 个月前 | |
move_has_triton_to_dynamo Co-authored-by: 1479518308<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !43319 merge master into master move_has_triton_to_dynamo Created-by: cuiduo Commit-by: 1479518308 Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > has_triton在utils阶段的patch挪到init阶段 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 本地验证通过 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 Related: https://gitcode.com/Ascend/pytorch/issues/1978 See merge request: Ascend/pytorch!43319 | 1 个月前 | |
feat(inductor): add physically-isolated triton_experimental backend Co-authored-by: rmch<chenruimin2@huawei.com> # message auto-generated for no-merge-commit merge: !42260 merge 2.13.0 into master feat(inductor): add physically-isolated triton_experimental backend Created-by: rmch Commit-by: rmch Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [x] 需求 https://gitcode.com/Ascend/pytorch/issues/3315 - [ ] 问题单 - [ ] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 请描述修改内容的具体实现,涉及哪些组件之间进行交互,可以用1、2、3、...进行罗列\ > 如果是需求或者重构类的PR,需要补充详细设计文档(说明上下游组件关系、时序图、类图、DFX能力等内容) # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 > 说明测试场景,测试方法。如果本次测试方式与常规单元测试不同,请详细说明您的测试步骤\ > 新增/变更内容是否已新增/适配UT测试用例看护,并补充测试自验证截图 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42260 | 2 个月前 | |
fix: lintrunner --all-files --take NEWLINE -a Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35539 merge code_check_lintrunner into master fix: lintrunner --all-files --take NEWLINE -a Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 文件必须以 LF 换行符结尾,不允许 CRLF(DOS 换行),执行: lintrunner --all-files --take NEWLINE -a # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35539 | 4 个月前 | |
fix: lintrunner --all-files --take NEWLINE -a Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35539 merge code_check_lintrunner into master fix: lintrunner --all-files --take NEWLINE -a Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 文件必须以 LF 换行符结尾,不允许 CRLF(DOS 换行),执行: lintrunner --all-files --take NEWLINE -a # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35539 | 4 个月前 | |
[fix]user_autotune_npu Co-authored-by: cuiduo<cuiduo1@huawei.com> # message auto-generated for no-merge-commit merge: !32039 merge master into master [fix]user_autotune_npu Created-by: cuiduo Commit-by: cuiduo Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 > 为NPU增加自定义算子接口user_autotune_npu,以替代原本的user_autotune包装器,同时增加FixedGridNpu与PrecomputedGridNpu适配,确保自定义算子正常运行 # 【资料变更】 > 不涉及 # 【接口变更】 > 不涉及 # 【功能验证】 > 以增加UT # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!32039 | 6 个月前 | |
[inductor] inductor support master Co-authored-by: duchengkun<duchengkun1@huawei.com> # message auto-generated for no-merge-commit merge: merge inductor_master into master [inductor] inductor support master Created-by: duchengkun Commit-by: duchengkun Merged-by: ascend-robot Description: inductor支持master - 在2.的基础上做的修改 - master的修改可以通过[inductor master](https://gitcode.com/Ascend/pytorch/commit/f99438d3eb6fff832f820bdebf4930fd4aa00512?ref=inductor_master&prId=25033)这个commit查看,为了方便检视,暂时不做commit squash See merge request: Ascend/pytorch!25033 | 11 个月前 | |
[inductor] support and constrain Welford SIMD Co-authored-by: rain-666<chenxiaoyu12@huawei.com> # message auto-generated for no-merge-commit merge: !44018 merge master_layernorm_simd into master [inductor] support and constrain Welford SIMD Created-by: rain-666 Commit-by: rain-666 Merged-by: ascend-robot Description: Sync the Welford SIMD implementation and usage constraints to master. Includes: - Welford SIMD support from #43214. - Welford usage constraints and regression tests from #43722. Depends on #44017. Closes #3819 Source PRs: - https://gitcode.com/Ascend/pytorch/pull/43214 - https://gitcode.com/Ascend/pytorch/pull/43722 See merge request: Ascend/pytorch!44018 | 1 个月前 | |
[Inductor] fix rms norm reduction Co-authored-by: luqichao<luqichao1@huawei.com> # message auto-generated for no-merge-commit merge: !43830 merge bugfix/rms_norm_codegen-master into master [Inductor] fix rms norm reduction Created-by: luqichao Commit-by: luqichao Merged-by: ascend-robot Description: 同步 https://gitcode.com/Ascend/pytorch/pull/42071 See merge request: Ascend/pytorch!43830 | 1 个月前 | |
[Fix] Fix static check errors detected by SPACES Co-authored-by: huangjingwei<huangjingwei4@huawei.com> # message auto-generated for no-merge-commit merge: !35981 merge master_lintrunner into master [Fix] Fix static check errors detected by SPACES Created-by: huangjingwei Commit-by: huangjingwei Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 > <font color="red">**如有社区issue,请关联issue链接**</font>\ > <font color="red">**请勿携带内部流程信息(需求链接、问题单、内部issue等)**</font> - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 检测和删除代码中的行尾空白字符 # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 不涉及 # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!35981 | 4 个月前 | |
[Inductor] master branch support AOTI and cpp_wrapper Co-authored-by: qiaoyaodan888<qiaoyaodan@huawei.com> Co-authored-by: zhuceHW<zhuce@huawei.com> # message auto-generated for no-merge-commit merge: !42521 merge main-0720 into master [Inductor] master branch support AOTI and cpp_wrapper Created-by: zhucehw Commit-by: zhuceHW;qiaoyaodan888;zhucehw Merged-by: ascend-robot Description: <!-- PR描述模板更新日期:20260203 --> # 【合入来源】 https://gitcode.com/Ascend/pytorch/issues/2526?ref=&did=4121203#tid-4121203 - [ ] 需求 - [ ] 问题单 - [x] issue/工单 - [ ] 重构优化 - [ ] 资料更新 # 【修改方案】 1. add cpp_wrapper and AOTI support for master branch 2. sync files from torch2.13 aoti_runtime and aoti_torch 3. format c++ file whitespace num 4. skip lazy compile for cpp_wrapper # 【资料变更】 不涉及 # 【接口变更】 不涉及 # 【功能验证】 CI PASS # 【CheckList】 > PR提交人对以下CheckList自检项进行全量自检,自检通过或不涉及,均修改 [ ] 为 [x] - [x] 代码注释完备,正确记录错误日志 - [x] 代码实现进行了返回值、空指针等校验 - [x] PR标题正确使用类型标签,如:feat、fix、refactor、docs、test等 - [x] PR持续集成流水线(CI)执行通过,代码检查无异常 See merge request: Ascend/pytorch!42521 | 2 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 1 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 3 个月前 | ||
| 3 个月前 | ||
| 2 个月前 | ||
| 11 个月前 | ||
| 2 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 8 个月前 | ||
| 11 个月前 | ||
| 2 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 7 个月前 | ||
| 4 个月前 | ||
| 11 个月前 | ||
| 2 个月前 | ||
| 4 个月前 | ||
| 11 个月前 | ||
| 1 个月前 | ||
| 6 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 5 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 4 个月前 | ||
| 11 个月前 | ||
| 4 个月前 | ||
| 11 个月前 | ||
| 7 个月前 | ||
| 2 个月前 | ||
| 4 个月前 | ||
| 2 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 4 个月前 | ||
| 4 个月前 | ||
| 11 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 3 个月前 | ||
| 3 个月前 | ||
| 2 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 7 个月前 | ||
| 11 个月前 | ||
| 2 个月前 | ||
| 3 个月前 | ||
| 3 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 11 个月前 | ||
| 1 个月前 | ||
| 3 个月前 | ||
| 2 个月前 | ||
| 4 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 4 个月前 | ||
| 2 个月前 | ||
| 9 个月前 | ||
| 4 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 5 个月前 | ||
| 4 个月前 | ||
| 7 个月前 | ||
| 7 个月前 | ||
| 11 个月前 | ||
| 3 个月前 | ||
| 4 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 11 个月前 | ||
| 7 个月前 | ||
| 11 个月前 | ||
| 1 个月前 | ||
| 5 个月前 | ||
| 3 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 4 个月前 | ||
| 4 个月前 | ||
| 6 个月前 | ||
| 11 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 4 个月前 | ||
| 2 个月前 |