已关闭
[Bug-Report|缺陷反馈]: aclnnInplaceAddRmsNorm 文档将支持非连续Tensor的入参 x1Ref/x2Ref/gamma 错误标注为不支持 #5965
liangyuhua创建于 14 天前关闭于 14 天前
14 天前 添加了label:bug-report
14 天前 关联了pull request:docs(inplace_add_rms_norm): 修正入参非连续Tensor支持标注
14 天前 将 liangyuhua 设为负责人
14 天前 关闭了 issue
14 天前 添加了label:resolved
Describe the current behavior / 问题描述 (Mandatory / 必填)
aclnnInplaceAddRmsNorm接口文档(norm/inplace_add_rms_norm/docs/aclnnInplaceAddRmsNorm.md)的参数说明表格中,入参x1Ref、x2Ref、gamma的「非连续Tensor」列均标注为 ×(不支持)。但算子定义(
norm/inplace_add_rms_norm/op_host/inplace_add_rms_norm_def.cpp:27-39)在全部支持平台(ascend910b/ascend910_93、ascend310p/kirin9030/kirinx90、ascend950)的配置中,对这三个输入均声明了.AutoContiguous(),框架会对非连续输入自动做连续化处理,实际支持非连续Tensor输入。文档与实现不一致,会误导用户认为该接口不接受非连续Tensor,从而在使用前做不必要的 contiguous 预处理,增加额外开销。
Environment / 环境信息 (Mandatory / 必填)
Steps to reproduce the issue / 重现步骤 (Mandatory / 必填)
norm/inplace_add_rms_norm/docs/aclnnInplaceAddRmsNorm.md,查看aclnnInplaceAddRmsNormGetWorkspaceSize参数说明表格;x1Ref、x2Ref、gamma三行的「非连续Tensor」列均为 ×;norm/inplace_add_rms_norm/op_host/inplace_add_rms_norm_def.cpp第 27~39 行(及 310p/950 平台配置的对应声明),三个输入均有.AutoContiguous()。Describe the expected behavior / 预期结果 (Mandatory / 必填)
x1Ref、x2Ref、gamma三行的「非连续Tensor」列应标注为 √,与算子定义中的.AutoContiguous()行为以及同类算子aclnnAddRmsNorm(norm/add_rms_norm/docs/aclnnAddRmsNorm.md,全列 √)保持一致。Related log / screenshot / 日志 / 截图 (Mandatory / 必填)
算子定义(inplace_add_rms_norm_def.cpp,以 910b/910_93 默认配置为例,310p 与 950 配置同样声明):
this->Input("x1") .ParamType(REQUIRED) .DataType({ge::DT_FLOAT16, ge::DT_FLOAT, ge::DT_BF16}) .Format({ge::FORMAT_ND, ge::FORMAT_ND, ge::FORMAT_ND}) .UnknownShapeFormat({ge::FORMAT_ND, ge::FORMAT_ND, ge::FORMAT_ND}) .AutoContiguous(); // x2、gamma 同样声明 .AutoContiguous()文档现状(aclnnInplaceAddRmsNorm.md 参数表):
Special notes for this issue/备注 (Optional / 选填)
无