文件最后提交记录最后更新时间
1 个月前
1 个月前
1 个月前
1 个月前
1 个月前
1 个月前
1 个月前
README

NPUAllocFloatStatus

产品支持情况

产品 是否支持
Ascend 950PR/Ascend 950DT √
Atlas A3 训练系列产品/Atlas A3 推理系列产品 √
Atlas A2 训练系列产品/Atlas A2 推理系列产品 √
Atlas 200I/500 A2 推理产品 √
Atlas 推理系列产品 √
Atlas 训练系列产品 √

功能说明

  • 算子功能:分配8个float32零值的Tensor,用于NPU溢出状态检测。该算子无输入,输出为固定shape(8,)的全零float32 Tensor,常用于混合精度训练中的loss scaling溢出状态分配场景。
  • 计算公式:

    output=zeros(8,dtype=float32)\text{output} = \text{zeros}(8, \text{dtype}=\text{float32})

  • 示例:

    输出data:
    tensor([0., 0., 0., 0., 0., 0., 0., 0.], dtype=torch.float32)
    

参数说明

参数名 输入/输出/属性 描述 数据类型 数据格式
data 输出 NPU浮点状态Tensor,固定shape为(8,),包含8个float32零值,用于溢出状态检测。 FLOAT ND

约束说明

  • 该算子无输入、无属性,仅有一个输出data。
  • 输出data的shape固定为(8,),不可变更。8个元素对应NPU硬件的溢出状态标志位(共32字节)。
  • 输出data的dtype仅支持float32,不支持其他数据类型。
  • 输出data的format仅支持ND。
  • 输出值始终为全零(8个float32零值),不依赖任何输入。
  • 该算子为确定性算子,输出固定全零,无并行归约,天然确定性。

调用说明

调用方式 调用样例 说明
图模式调用 test_geir_npu_alloc_float_status 参见算子调用完成算子编译和验证。