已关闭
[Requirement|需求建议]: 新增MxToBlockMxQuant算子,将FP4低精度数据结合FP8_E8M0缩放系数转换为FP8分块量化格式 #4148
pyongq创建于  7月17日关闭于  7月23日
pyongq
pyongq
7月17日 创建

Thanks for sending an requirement! Please fill in the following template to help quickly solve your problem.

Backgroud(背景信息)

该算子是DynamicMXQuant的下游算子,接收DynamicMxQuant输出的FP4量化数据和对应的FP8_E8M0的mx-scale,进一步转换为FP8分块量化格式,并输出两路FP8_E8M0缩放系数。

Origin(信息来源)

Vector

Benefit / Necessity (价值/作用)

Design(设计方案)

likedislike
pyongq
pyongq
7月17日 评论:

/assign

likedislike
CANN-robotCANN-robot成员
7月17日 将 pyq17870581669 设为负责人
pyongqpyongq
7月20日 关联了pull request:add mx_to_block_mx_quant
CANN-robotCANN-robot成员
7月23日 关闭了 issue
CANN-robotCANN-robot成员
7月23日 添加了label:resolved