| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
修改log_add_exp小值域情况下精度误差 Co-authored-by: zhangqijia<zhangqijia1@h-partners.com> # message auto-generated for no-merge-commit merge: !3611 merge fix_log_add_exp into master 修改log_add_exp小值域情况下精度误差 Created-by: gcw_SUaZx3UQ Commit-by: zhangqijia Merged-by: cann-robot Description: ## 描述 <!--在这里详细描述你的改动,包括改动的原因和所采取的方法。--> 使用数值稳定性公式来解决小值域下精度误差问题,对私有格式进行拦截 ## 关联的Issue <!-- 如果这个PR是为了解决特定的Issue,请在这里提供Issue链接。--> <!-- 如果这个PR是为了解决特定的问题单,请在这里描述问题单单号。--> [#2084](https://gitcode.com/cann/ops-math/issues/2084) ## 测试 <!--描述进行了哪些测试来验证你的改动。包括但不限于二级冒烟、算子泛化等。--> ## 文档更新 <!--如果这个PR包含文档的更新,请在这里指出。例如:更新了README.md文件。--> ## 类型标签 <!-- [x] 表示选中 --> - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3611 | 1 个月前 | |
LogAddExp 新增 Ascend950 AscendC 算子实现 Co-authored-by: zhangqijia<zhangqijia1@h-partners.com> # message auto-generated for no-merge-commit merge: !3150 merge add_log_add_exp into master LogAddExp 新增 Ascend950 AscendC 算子实现 Created-by: gcw_SUaZx3UQ Commit-by: zhangqijia Merged-by: cann-robot Description: ## 描述 为 LogAddExp 算子新增 Ascend950(arch35)的 AscendC 算子实现,复用同一 kernel 通过 base/scale/shift 属性同时支持 aclnnLogAddExp(base=-1,自然对数)与 aclnnLogAddExp2(base=2)。 主要改动: - **op_kernel(device 侧)**:新增 log_add_exp_apt.cpp kernel 入口,按 schMode/formulaType 分发 simplified/full 两套公式 × native/cast 两条数据路径;arch35/log_add_exp_dag.h 实现数值稳定公式 y = max(x1,x2) + ln(1 + exp(-|x1-x2|))(full 路径叠加 base/scale/shift),并通过 InfGuardedSub 处理 x1、x2 同为 +inf/-inf 时 inf-inf=NaN 的污染(与 910B after_v200 分支行为对齐);bf16 走 cast-to-float 路径。 - **op_host(host 侧)**:新增算子定义(base/scale/shift 属性、ascend950 AICore config)、broadcast infershape、arch35 tiling。 支持数据类型:FP16 / FP32 / BF16,支持 broadcast。 ## 关联的Issue #1868 ## 测试 ## 文档更新 无 ## 类型标签 - [x] 新特性 - [ ] Bug修复 - [ ] 性能优化 - [ ] 文档更新 - [ ] 其他,请描述: See merge request: cann/ops-math!3150 | 2 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 1 个月前 | ||
| 2 个月前 |