文件最后提交记录最后更新时间
27 天前
3 个月前
6 个月前
19 天前
25 天前
1 个月前
7 个月前
1 个月前
README

MatMulV3

产品支持情况

产品 是否支持
Ascend 950PR/Ascend 950DT
Atlas A3 训练系列产品/Atlas A3 推理系列产品
Atlas A2 训练系列产品/Atlas A2 推理系列产品
Atlas 200I/500 A2 推理产品 ×
Atlas 推理系列产品
Atlas 训练系列产品 ×
Kirin X90 处理器系列产品
Kirin 9030 处理器系列产品

功能说明

  • 算子功能:完成通用矩阵乘计算。

  • 计算公式:

    C=op(A)@op(B)+biasC=op(A) @ op(B) + bias

    其中,op(A)op(A)op(B)op(B)op(C)op(C) 分别是维度为 (M,K)(M, K), (K,N)(K, N)(M,N)(M, N)的矩阵。biasbias 是维度为(1,N)(1, N)(N)(N)的向量。

参数说明

参数名 输入/输出/属性 描述 数据类型 数据格式
a 输入 矩阵乘运算中的左矩阵。 FLOAT16, BFLOAT16, FLOAT32 ND, FRACTAL_NZ
b 输入 矩阵乘运算中的右矩阵。 FLOAT16, BFLOAT16, FLOAT32 ND, FRACTAL_NZ
bias 输入 矩阵乘运算后累加的偏置,对应公式中的bias。 FLOAT16, BFLOAT16, FLOAT32 ND
c 输出 通用矩阵乘运算的计算结果。 FLOAT16, BFLOAT16, FLOAT32 ND, FRACTAL_NZ
  • Atlas 推理系列产品:只支持FLOAT16数据格式,输入b只支持FRACTAL_NZ格式。

  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:不支持FRACTAL_NZ格式,bias不支持BFLOAT16数据格式。

  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:不支持FRACTAL_NZ格式,bias不支持BFLOAT16数据格式。

  • Ascend 950PR/Ascend 950DT:只有输入b支持FRACTAL_NZ格式。

  • Kirin X90/Kirin 9030 处理器系列产品:不支持BFLOAT16、FLOAT32。

约束说明

  • 支持空tensor,空tensor场景下不支持bias。
  • 支持连续tensor,非连续tensor只支持转置场景。

调用说明

调用方式 样例代码 说明
aclnn接口 test_aclnn_addmm 通过
- aclnnAddmm&aclnnInplaceAddmm
- aclnnMatmul
- aclnnMatmulWeightNz
- aclnnMm
- aclnnAddmmWeightNz
等方式调用MatMulV3算子。