已关闭
[Requirement|需求建议]: 新增MxToBlockMxQuant算子,将FP4低精度数据结合FP8_E8M0缩放系数转换为FP8分块量化格式 #4148
pyongq创建于 7月17日关闭于 7月23日
pyongq
7月17日 评论:
7月17日 评论:
/assign


7月17日 将 pyq17870581669 设为负责人
7月20日 关联了pull request:add mx_to_block_mx_quant
7月23日 关闭了 issue
7月23日 添加了label:resolved
Thanks for sending an requirement! Please fill in the following template to help quickly solve your problem.
Backgroud(背景信息)
该算子是DynamicMXQuant的下游算子,接收DynamicMxQuant输出的FP4量化数据和对应的FP8_E8M0的mx-scale,进一步转换为FP8分块量化格式,并输出两路FP8_E8M0缩放系数。
Origin(信息来源)
Vector
Benefit / Necessity (价值/作用)
Design(设计方案)